Tag
#gpu
11 articles sur ce sujet.

La crise des datacenters IA : le nouveau CDO ?
Les datacenters IA se construisent sur la même spéculation qu'avant 2008. Sauf que cette fois, c'est pire.

AMD injecte 5 milliards dans Anthropic pour doper ses GPU
AMD et Anthropic s'allient : 5 milliards d'investissement et 2 gigawatts de puissance GPU d'ici 2027.
Ton infra IA coûte 2x plus cher que tu le crois
Les entreprises achètent de l'infra IA à la pelle mais ignorent ce que ça leur coûte vraiment.

SK Hynix lève 26,5 milliards : la ruée vers les puces mémoire IA
Le géant sud-coréen des puces mémoire lève un record : 26,5 milliards de dollars à Wall Street, mais Washington veut ses usines.
Kernels : la sécurité des custom kernels devient sérieuse
Hugging Face resserre l'étau sur les kernels custom : éditeurs de confiance, signature de code, et un nouveau type de repo.
Lance un serveur LLM privé en une commande sur HF Jobs
Déploie un modèle LLM compatible OpenAI sur GPU en une ligne de commande, sans Kubernetes ni infrastructure à gérer.

SpaceX loue ses GPU 28 milliards par an : bienvenue au néocloud
SpaceX vend sa puissance de calcul plus cher que CoreWeave ne gagne en un an.

Pourquoi les labos IA gaspillent 90% de leurs GPU
xAI tourne à 10% d'efficacité. Le vrai problème : pas les GPU, mais comment on les utilise.

Nvidia RTX Spark : enfin des vrais PC IA sous Windows
Nvidia lance des laptops qui font enfin ce que Microsoft promettait depuis 2 ans : faire tourner de vrais modèles d'IA en local.

Pourquoi Nvidia est devenue une entreprise logicielle
CUDA n'est pas un chip, c'est le fossé infranchissable qui protège Nvidia de tous ses concurrents.
CyberSecQwen-4B : l'IA de sécu qui tient sur ton laptop
Un modèle IA de 4 milliards de paramètres spécialisé en cybersécurité qui rivalise avec des modèles deux fois plus gros, sans passer par le cloud.