Matériel IA
54 articles
Jio de Mukesh Ambani ouvre un service Cloud PC à toute l'Inde, transformant de vieux ordinateurs en machines prêtes pour l'IA
Reliance Jio a étendu JioPC au-delà de sa base haut débit, en diffusant jusqu'à 8 processeurs virtuels et 16 Go de RAM sur des ordinateurs vieillissants à partir d'environ 11 $ pendant deux mois.
OpenAI achète des Mac mini et des Mac Studios par dizaines de milliers pour former des agents IA
The Information rapporte qu'OpenAI a acheté des dizaines de milliers de Mac mini et de Mac Studios pour former des agents à l'utilisation d'ordinateurs, transformant ainsi le silicium Apple en infrastructure d'IA.
Apple pris au dépourvu par la demande d'IA d'entreprise alors que Mac Studio et Mac Mini se vendent
La demande d'IA d'entreprise a pris Apple au dépourvu, rapporte The Information, laissant les versions Mac Studio et Mac mini en rupture de stock pendant des mois au milieu du boom local de l'IA.
Nvidia parie 3,5 milliards de dollars sur MediaTek alors que NVLink Fusion ouvre la porte à des puces IA personnalisées
Nvidia a investi 3,5 milliards de dollars dans les obligations convertibles MediaTek alors que le fabricant de puces adopte NVLink Fusion pour intégrer des XPU personnalisés dans les usines d'IA à l'échelle du rack.
Les barrières américaines contre les robots et les drones ne combleront pas l’écart d’échelle avec la Chine, préviennent les analystes
Les entreprises chinoises ont construit 86 % des nouveaux robots humanoïdes dans le monde début 2026. Les analystes affirment que les droits de douane et les interdictions américaines n’effaceront pas cet avantage d’échelle.
Hugging Face lance MicroDuck, un robot canard open source à 399 $ que vous pouvez entraîner vous-même
MicroDuck de Hugging Face est un canard robot open source à 399 $ qui apprend de nouvelles astuces grâce à l'apprentissage par renforcement – et il sera expédié avant Noël 2026.
La puce MTIA 400 de Meta divise son cerveau entre la formation en IA et la diffusion d'annonces
Meta a détaillé son accélérateur MTIA 400 lors du Hot Chips 2026 : une puce de formation LLM de 3 nm construite sur Broadcom IP qui alimente également les publicités qui paient les factures.
La puce Jalapeño d'OpenAI bat Nvidia Blackwell dans les premiers benchmarks d'inférence
OpenAI affirme que sa puce Jalapeño construite par Broadcom fournit plus de jetons par utilisateur et par kilowatt que Nvidia Blackwell dans les premiers benchmarks InferenceX.
Apple lance les puces M6 et M5 Ultra dans les nouveaux Mac Mini et Mac Studio conçus pour l'IA sur appareil
La première puce M6 2 nm d'Apple et le quad-die M5 Ultra font leurs débuts dans les nouveaux Mac mini et Mac Studio, avec jusqu'à 512 Go de mémoire unifiée pour exécuter localement des modèles d'IA géants.
Intel ouvre Hot Chips 2026 avec Crescent Island : GPU d'inférence AI avec jusqu'à 480 Go de mémoire
Intel a détaillé son GPU de centre de données Crescent Island lors du Hot Chips 2026 : une carte PCIe de 350 W conçue pour l'inférence d'IA agentique avec jusqu'à 480 Go de LPDDR5X.
Xiaomi dévoile les puces Xring O3, O100 et D100 ainsi que AI Cube exécutant des modèles 120B localement
Xiaomi a lancé trois puces Xring auto-développées pour les téléphones, l'IA et les voitures, ainsi qu'un mini PC AI Cube qui exécute localement des modèles à paramètres 120B.
Le Groq 3 LPX de Nvidia entre en pleine production avec 3 400 jetons par seconde pour l'IA agentique
L'accélérateur d'inférence Groq 3 LPX de Nvidia est en pleine production, affichant un record de 3 400 jetons par seconde dans un contexte de 100 000 sur la plateforme Vera Rubin.
Taïwan inculpe neuf personnes, dont le responsable de Nvidia, pour des serveurs d'IA de contrebande à destination de la Chine
Les procureurs taïwanais ont inculpé neuf personnes, dont un responsable de Nvidia et deux anciens employés de Supermicro, pour avoir introduit clandestinement 74 serveurs Blackwell AI en Chine.
L'accord de dette Mega AI de Broadcom pourrait atteindre 100 milliards de dollars pour financer des puces pour Anthropic
Broadcom est en pourparlers pour lever jusqu'à 100 milliards de dollars de dette pour les puces d'IA qu'Anthropic louera, dans le cadre de ce qui serait le plus grand accord de financement d'IA jamais réalisé.
Starcloud lève 250 millions de dollars pour une valorisation de 2,3 milliards de dollars pour construire des centres de données d'IA en orbite
Nvidia rejoint le tour de table de 250 millions de dollars de Starcloud pour une valorisation de 2,3 milliards de dollars alors que la startup fait la course à SpaceX pour mettre en orbite des centres de données d'IA, avec un lancement en janvier.
Nvidia Customers Face Server Price Hikes Above 15% as Memory Costs Soar
Bloomberg reports Nvidia AI server prices will rise over 15% as memory costs climb, hitting Vera Rubin and Grace Blackwell systems due early next year.
Anthropic embauche l'architecte Google TPU, Amir Salek, pour accélérer sa campagne de silicium personnalisé
Anthropic a embauché l'ancien chef des puces de Google, Amir Salek, qui a livré sept générations de TPU, pour développer une initiative interne en matière de semi-conducteurs.
Micron engage 10 milliards de dollars dans les laboratoires de recherche de Boise pour poursuivre la prochaine génération de mémoire IA
Micron Research Labs dépensera 10 milliards de dollars au cours de la prochaine décennie à Boise en mémoire post-DRAM, en emballage avancé et en technologie de fabrication pour l'ère de l'IA.
Google fait appel à Marvell pour des puces d'IA personnalisées dans le cadre d'un accord de garantie de 12,2 milliards de dollars
Google a signé Marvell pour l'aider à construire ses puces TPU AI personnalisées, en accordant un mandat d'une valeur pouvant atteindre 12,2 milliards de dollars. L'action Marvell a bondi tandis que Broadcom a chuté de 5 %.
Cerebras CS-4 est lancé avec WSE-3 Turbo : inférence IA à l'échelle du rack à une vitesse GPU 30x
Cerebras dévoile le CS-4 avec des plaquettes WSE-3 Turbo et une architecture de rack Nexus, revendiquant une inférence 30 fois plus rapide que les GPU tout en remettant en question la domination de Nvidia.
Google aurait fait appel à AMD pour un TPU de nouvelle génération gourmand en CPU, conçu pour l'apprentissage par renforcement
Une note de SemiAnalysis indique que Google pourrait associer la technologie CPU AMD à ses accélérateurs TPU dans une nouvelle conception destinée à l'apprentissage par renforcement et à l'IA agentique.
Nvidia réduit la garantie du centre de données OpenAI de 250 milliards de dollars à moins de 120 milliards de dollars
Nvidia a réduit sa garantie prévue pour le centre de données OpenAI d'Ohio de 250 milliards de dollars à moins de 120 milliards de dollars après les inquiétudes des investisseurs, rapportent le WSJ et Reuters.
Cerebras alimente le nouveau mode ultrarapide d'OpenAI : GPT-5.6 Sol atteint 750 jetons par seconde
Cerebras et OpenAI dévoilent le mode ultrarapide pour GPT-5.6 Sol, fournissant 750 jetons de sortie par seconde sans perte de qualité.
Cerebras et OpenAI dévoilent GPT-5.6 Sol Ultrafast : 750 jetons par seconde sans perte de qualité
Le mode ultrarapide alimenté par Cerebras fournit jusqu'à 750 jetons de sortie par seconde pour le GPT-5.6 Sol d'OpenAI, fonctionnant 11 fois plus vite que Claude Fable 5 avec une précision comparable.
TSMC affiche un chiffre d'affaires record pour juillet, en hausse de 44,7 % alors que la demande de puces IA augmente
Le chiffre d'affaires de Taiwan Semiconductor en juillet a atteint 467,58 milliards de dollars NT en raison d'une forte demande pour les puces de 2 nanomètres, la société prévoyant une croissance de 40 % pour 2026 grâce aux applications d'IA.
Nvidia fait appel aux géants de Wall Street pour un financement de 500 milliards de dollars pour l'infrastructure de l'IA
Apollo, Blackstone, BlackRock, Brookfield, Goldman Sachs et KKR sont en pourparlers avec Nvidia sur un programme de financement d'infrastructures d'IA de 500 milliards de dollars alors que les actions de Nvidia ont chuté à la nouvelle.
Microsoft dévoilera la puce AI Maia 300 de nouvelle génération dès septembre
Microsoft se prépare à dévoiler publiquement sa nouvelle puce Maia 300 AI cet automne, potentiellement en septembre, alors qu'il s'efforce de réduire sa forte dépendance aux GPU coûteux de Nvidia.
Le haut-parleur intelligent d'OpenAI coûtera jusqu'à 400 $ et utilisera des pièces mobiles pour se sentir vivant
Le prochain haut-parleur intelligent ChatGPT d'OpenAI, conçu avec LoveFrom de Jony Ive, pourrait coûter entre 300 et 400 dollars et comporter des pièces mobiles qui s'animent lorsqu'il répond.
La capacité de mémoire de 2027 serait épuisée alors que la demande en IA déclenche un nouveau « RAMageddon »
La capacité de mémoire pour 2027 serait entièrement épuisée alors que la demande d’IA pour HBM et DRAM monte en flèche. SK Hynix prévoit une expansion fabuleuse de 38 milliards de dollars, mais le soulagement ne sera pas possible avant des années.

Lumilens sort de la furtivité avec 900 millions de dollars pour recâbler les centres de données IA avec la lumière
La startup d'interconnexion optique Lumilens a été lancée avec un financement de plus de 900 millions de dollars et une valorisation de 5,5 milliards de dollars, dans le but de remplacer le câblage en cuivre entre les GPU dans les centres de données d'IA.
AMD acquiert Taalas, la startup qui connecte les modèles d'IA directement dans le silicium
AMD a acquis Taalas, une startup torontoise qui grave les poids des modèles d'IA dans le silicium pour accélérer considérablement l'inférence, quelques semaines après son accord avec Cerebras.

Lumilens sort de la furtivité avec 900 millions de dollars pour câbler les centres de données IA avec la lumière
Lumilens a levé plus de 900 millions de dollars pour une valorisation de 5,5 milliards de dollars pour remplacer le cuivre par des interconnexions optiques et résoudre le goulot d'étranglement de la connectivité GPU de l'IA.
SpaceX et Tesla engagent 16,8 milliards de dollars pour construire une usine de puces Terafab au Texas
SpaceX d'Elon Musk et Tesla ont confirmé un investissement initial de 16,8 milliards de dollars pour l'usine de semi-conducteurs Terafab dans le comté de Grimes, au Texas, près de College Station.
Anthropic crée une équipe interne de conception de puces pour alimenter Claude avec du silicium personnalisé
Anthropic a confirmé qu'elle recrute une équipe de silicium personnalisée pour co-concevoir des puces d'IA pour Claude, rejoignant ainsi OpenAI et Google dans la course au contrôle du matériel d'IA.
Musk engage SpaceX sur les GPU Nvidia « exclusivement », envoyant des actions plus élevées et AMD plus faibles
Elon Musk a déclaré que SpaceX utiliserait exclusivement des puces Nvidia à l'avenir, avec un système optimisé Vera Rubin NVL72 qui devrait être lancé dans l'espace l'année prochaine.
Les revenus d'AMD au deuxième trimestre augmentent alors que les ventes des centres de données doublent, mais les actions dérapent par rapport aux attentes élevées
AMD a annoncé une croissance de 50 % de ses revenus au deuxième trimestre 2026, les ventes des centres de données ayant plus que doublé grâce à la demande de GPU Instinct, mais les actions ont chuté par rapport aux attentes exorbitantes de Wall Street.
SK hynix et SanDisk dévoilent la première norme Flash à bande passante élevée ciblant le goulot d'étranglement de la mémoire AI
SK hynix et SanDisk ont publié la première spécification ouverte High Bandwidth Flash (HBF), promettant une bande passante allant jusqu'à 3 To/s pour réduire les coûts de mémoire d'inférence de l'IA.
Jensen Huang de Nvidia prévoit une industrie des semi-conducteurs de 7,9 billions de dollars alimentée par l'IA agentique
Le PDG de Nvidia, Jensen Huang, affirme que l'industrie mondiale des semi-conducteurs pourrait atteindre 7 900 milliards de dollars, car l'IA agentique génère une demande sans précédent de matériel informatique.
DeepSeek V4 Flash fonctionne sur un seul GPU AMD MI300X, aucun Nvidia requis
Un développeur a fait fonctionner le modèle Flash V4 de 304 milliards de paramètres de DeepSeek sur un seul AMD MI300X à 168 jetons par seconde, prouvant qu'AMD peut servir des modèles frontières sans Nvidia.
Lenovo Googlebook Leak révèle des PC Gemini dotés d'une clé AI dédiée et d'un nouveau système d'exploitation
Des images de presse divulguées montrent le premier ordinateur portable Googlebook et tablette 2-en-1 de Lenovo avec une clé Gemini dédiée, des bandes lumineuses et Gemini AI intégrés dans un nouveau système d'exploitation remplaçant ChromeOS.
Les startups de puces IA OLIX et DeepX lèvent des milliards alors que la course mondiale au défi Nvidia s'intensifie
L'OLIX de Londres a levé 312 millions de dollars pour une valorisation de 3,3 milliards de dollars et le coréen DeepX a atteint 2,2 milliards de dollars, alors que les startups du monde entier parient qu'elles peuvent surpasser Nvidia sur le matériel d'inférence d'IA.
AMD lance Instella-MoE : un modèle 16B entièrement ouvert formé à partir de zéro sur ses propres GPU Instinct
L'Instella-MoE-16B-A3B d'AMD est un modèle mixte d'experts entièrement ouvert, entièrement formé sur les GPU Instinct MI300X et MI325X, avec tous les poids d'entraînement, données et configurations publiés.

Kimi de Moonshot fonctionne avec 20 000 puces Nvidia H200 louées à Alibaba
Bloomberg rapporte que Moonshot AI a entraîné ses modèles Kimi sur un cluster Nvidia H200 de 20 000 puces fourni par Alibaba, révélant ainsi la dépendance de la Chine à l'égard du silicium occidental.
Eliyan devient une licorne avec 145 millions de dollars de série C pour résoudre le goulot d'étranglement puce à puce de l'IA
La startup Eliyan de la Silicon Valley a levé 145 millions de dollars pour une valorisation de 1 milliard de dollars pour construire des interconnexions électro-optiques qui débloquent le goulot d'étranglement des données qui ralentit les grappes géantes de puces d'IA.
Brookfield et NextEra dévoilent un centre de données d'IA de 100 milliards de dollars sur un ancien site d'uranium dans le Kentucky
Une coalition dirigée par Brookfield et NextEra Energy prévoit un campus de centres de données d'IA de 100 milliards de dollars, financé par des fonds privés, sur le site de Paducah du département de l'Énergie dans le Kentucky, soutenu par jusqu'à 4,6 gigawatts de production d'électricité dédiée.

Un modèle de langage de 28,9 millions de paramètres fonctionne désormais sur un microcontrôleur à 8 $
Un projet open source exécute un LLM de 28,9 millions de paramètres sur une puce ESP32-S3 bon marché à environ 9 jetons par seconde, en utilisant une astuce de mémoire empruntée à Gemma de Google.

Nvidia investit 1,5 milliard de dollars dans le conditionnement de puces IA aux États-Unis avec l'accord Amkor
Le partenariat Amkor de Nvidia, d'une valeur de 1,5 milliard de dollars, étend le conditionnement et les tests avancés de puces en Arizona, ciblant un goulot d'étranglement croissant dans les chaînes d'approvisionnement de semi-conducteurs d'IA.
Une seule ligne électrique tombée en panne a exposé la menace du centre de données AI pour le réseau américain
Lorsqu'une ligne électrique est tombée près de Washington, D.C., plus de 3 gigawatts de centres de données d'IA ont été déconnectés d'un seul coup, augmentant ainsi la tension sur le réseau PJM. Les experts disent que c’est un avertissement du pire à venir.

NAVER, NVIDIA et Brookfield vont porter l'usine nationale d'IA de Corée à 200 mégawatts
NAVER, NVIDIA et Brookfield étendront l'usine souveraine d'IA de Corée à GAK Sejong à 200 mégawatts d'ici 2028, NVIDIA investissant 1 milliard de dollars et Brookfield finançant jusqu'à 9 milliards de dollars.
Nvidia et SK Group dévoilent une alliance de 500 milliards de dollars alors que Jensen Huang déclare un « âge d'or de l'IA » pour la Corée du Sud
Le PDG de Nvidia, Jensen Huang, a forgé une alliance de 500 milliards de dollars avec le groupe sud-coréen SK lors d'un sommet américain avec le président Lee et Jay Y. Lee de Samsung, déclarant un « âge d'or de l'IA » pour le pays.
Samsung conclut un accord de 200 milliards de dollars avec Broadcom pour fabriquer des puces d'IA, le plus grand gain de fonderie à ce jour
Samsung Electronics a remporté un contrat de 200 milliards de dollars pour fabriquer des puces d'IA pour Broadcom, la plus grande commande de fabrication sous contrat de son histoire et un effort majeur pour réduire l'écart avec TSMC.
Microchip Technology va acquérir Hailo, élargissant ainsi son portefeuille de puces Edge AI alors que le marché de l'inférence se réchauffe
Microchip Technology signe un accord définitif pour acquérir le fabricant de processeurs d'IA de pointe Hailo, élargissant ainsi considérablement son portefeuille de matériel d'IA.
La start-up AI Chip Etched clôture 300 millions de dollars pour une valorisation de 10,3 milliards de dollars, doublant en sept mois
Etched, la startup de puces d'inférence fondée par trois décrocheurs de Harvard, a clôturé une série C de 300 millions de dollars dirigée par Sequoia pour une valorisation de 10,3 milliards de dollars après avoir enregistré 1 milliard de dollars de commandes.
L'humanoïde de Londres devient la première licorne robotique humanoïde d'Europe avec un tour de table de 152 millions de dollars
La startup britannique Humanoid a levé 152 millions de dollars pour une valorisation de 1,35 milliard de dollars, soutenue par Bosch et Schaeffler, pariant que les robots à roues peuvent devancer leurs rivaux bipèdes dans les usines.
