Sujet

Puces et infrastructures IA

L'infrastructure matérielle de l'intelligence artificielle—puces, data centers, réseaux—est devenue un enjeu stratégique majeur. Entre besoins énergétiques croissants, tensions d'approvisionnement et questions de souveraineté technologique, cette fondation est au cœur des débats sur l'avenir de l'IA.

69 articles · Mis à jour il y a 3 mois

À propos de Puces & infrastructures

De quoi il s'agit

Les puces et infrastructures IA regroupent l'ensemble des ressources matérielles nécessaires au déploiement de l'intelligence artificielle : processeurs graphiques (GPU), circuits intégrés spécialisés (ASIC), mémoire haute performance, centres de données et réseaux de transmission. Ces composants forment la base technique sur laquelle fonctionnent les modèles d'IA générative et les systèmes d'apprentissage automatique. La fabrication de ces puces implique des processus de conception et de production hautement complexes, tandis que leur déploiement en data centers impose des infrastructures de refroidissement, d'alimentation énergétique et de connectivité.

Enjeux et débats

Trois enjeux majeurs structurent le débat. Le premier concerne la consommation énergétique : les data centers dédiés à l'IA consomment plusieurs fois plus d'électricité que des centres de données classiques. Cette augmentation soulève des questions environnementales—refroidissement, utilisation d'eau, empreinte carbone—et des tensions sur l'accès aux ressources énergétiques. Le deuxième enjeu est la pénurie structurelle : la demande de puces IA dépasse depuis plusieurs années la capacité de production mondiale, créant des goulets d'étranglement qui affectent l'accès aux technologies d'IA. Le troisième est technologique : le secteur confronte le choix entre les GPU polyvalents, utilisés massivement depuis l'émergence de l'IA générative, et les ASIC spécialisés, plus efficaces énergétiquement mais moins flexibles. Ces tensions alimentent un débat sur l'architecture optimale d'une infrastructure IA à la fois performante et soutenable.

Cadre et acteurs

La Commission européenne a inscrit la maîtrise des puces et infrastructures IA parmi ses priorités stratégiques. Le Chips Act européen, renforcé, vise à augmenter la production européenne de semi-conducteurs, tandis que le paquet de souveraineté technologique s'attaque à la dépendance de l'Europe envers les fournisseurs étrangers pour les puces et data centers. En France, la question de la souveraineté est centrale : les infrastructures déployées doivent servir de levier pour développer des technologies européennes et réduire la dépendance. Le régulateur technique (ARCEP) s'intéresse aux questions d'infrastructure réseau et d'énergie. L'AI Act et le RGPD, tout en ciblant prioritairement les systèmes d'IA, impactent indirectement les choix d'infrastructure (localisation des données, conformité). Les industriels du secteur, ainsi que les laboratoires de recherche publique, sont impliqués dans l'optimisation de ces ressources.

Ce que suit ActuIA

ActuIA suit l'évolution des capacités de calcul disponibles et les arbitrages technologiques entre approches génériques et spécialisées. Nous couvrons les enjeux de souveraineté technologique et les investissements publics destinés à renforcer la chaîne de valeur européenne des semi-conducteurs. Nous examinons aussi l'impact environnemental des infrastructures IA, notamment sous l'angle de la sobriété énergétique et de l'adaptation des ressources en eau. Enfin, nous traitons les questions réglementaires liées à l'implantation des data centers (autorisations, normes énergétiques) et les tensions entre besoin de capacité et durabilité.

Le guide complet

L'infrastructure matérielle de l'intelligence artificielle—puces, data centers, réseaux—est devenue un enjeu stratégique majeur. Entre besoins énergétiques croissants, tensions d'approvisionnement et questions de souveraineté technologique, cette fondation est au cœur des débats sur l'avenir de l'IA.

Concepts clés

Dernières brèves

Conférence / salon

Cinq entreprises japonaises testent jusqu'en février 2027 le déplacement des calculs d'IA entre centres de données selon l'électricité disponible

Le 18 septembre 2026, NTT Docomo Business, Chugoku Electric Power, NTT Anode Energy, Enecom et Hokkaido Telecommunication Network ont annoncé une expérimentation de couplage « watt-bit » engagée en août 2026 et prévue jusqu'en février 2027. Le projet a été retenu par le ministère japonais des Affaires intérieures et des Communications au titre de son programme 2026 d'essais sur le couplage watt-bit. Deux configurations sont éprouvées : les centres de Mitaka, Sapporo et Hiroshima reliés à 10 Gbit/s, puis ceux de Mitaka, Akihabara et Yokohama à 100 Gbit/s, sur le réseau optique docomo business APN Plus. Les cas d'usage retenus sont un grand modèle de langue médical et un modèle vision-langage de surveillance d'installations. Les traitements d'inférence et d'entraînement sont déplacés d'un site à l'autre selon les prévisions de production renouvelable. Les cinq entreprises visent un système de commande watt-bit intégré à l'horizon de l'exercice budgétaire 2028.

Datacenter / supercalculateur

CoreWeave lance une offre privée de 3 milliards de dollars d'obligations convertibles 2033 et ouvre en parallèle un programme de vente d'actions

Le 17 septembre 2026, CoreWeave (Nasdaq : CRWV) a annoncé son intention de placer 3 milliards de dollars d'obligations convertibles senior arrivant à échéance le 1er avril 2033, auprès d'acheteurs institutionnels qualifiés, avec une option de 500 millions supplémentaires ouverte aux acheteurs initiaux pendant treize jours. Le taux d'intérêt et le taux de conversion initial seront fixés au moment de la tarification. Le fournisseur de cloud pour l'IA prévoit d'affecter une partie du produit net à des options d'achat plafonnées destinées à limiter la dilution, le solde allant aux besoins généraux. Le même jour, CoreWeave a déposé un prospectus complémentaire portant sur la vente au fil de l'eau d'un maximum de 35 millions d'actions de classe A, via onze agents dont Goldman Sachs, J.P. Morgan et Morgan Stanley. Les nouvelles obligations seront garanties par les filiales qui garantissent déjà ses souches senior à 8,50 % et 9,75 %.

Conférence / salon

Delta Electronics dévoile depuis Fremont une infrastructure énergie-vers-calcul intégrée pour les usines d'IA NVIDIA DSX

Le 17 septembre 2026, Delta Electronics a annoncé depuis Fremont, en Californie, une infrastructure intégrée qui relie l'énergie sur site au calcul pour accélérer le déploiement des usines d'IA fondées sur la plateforme NVIDIA DSX. L'architecture associe une distribution électrique en 800 volts continu, avec jusqu'à 98 % d'efficacité de conversion, à des unités de refroidissement liquide pouvant atteindre 3 mégawatts et des systèmes en rangée livrant jusqu'à 800 kilowatts par armoire. Au niveau carte, la conversion en 50 ou 12 volts continu atteint un rendement de crête de 98,5 %. Delta mise aussi sur la préfabrication, avec des blocs d'infrastructure assemblés et testés en usine, intégrant alimentation 800 volts et 3 mégawatts de refroidissement liquide, pour réduire la complexité sur site. Austin Tseng, président de Delta Electronics Americas, et Vladimir Troy, vice-président infrastructure IA chez NVIDIA, ont présenté conjointement cette architecture destinée à maximiser le nombre de jetons produits par mégawatt disponible.

Alliance stratégique

NVIDIA fait débuter Vera Rubin NVL72 dans MLPerf Inference v6.1 avec un débit jusqu'à 3,7 fois celui du GB300 NVL72

Le 16 septembre 2026, NVIDIA a détaillé ses résultats MLPerf Inference v6.1, première soumission de sa plateforme Vera Rubin NVL72, en catégorie aperçu, sur deux tests : DeepSeek-R1 et Qwen3-VL. Le débit atteint jusqu'à 3,7 fois celui du GB300 NVL72 sur Qwen3-VL, avec vLLM et le cadriciel ouvert Dynamo, et jusqu'à 2,5 fois sur DeepSeek-R1 avec la bibliothèque TensorRT-LLM. Une soumission GB300 NVL72 de 288 GPU répartis sur quatre baies affiche 99 % d'efficacité de montée en charge dans le scénario hors ligne, par rapport à une baie unique de 72 GPU. Les optimisations logicielles apportent jusqu'à 1,6 fois de gain sur Qwen3-VL par rapport à la v6.0. Nebius a également soumis des résultats Vera Rubin NVL72 en aperçu, et dix-neuf partenaires de NVIDIA ont participé à cette ronde.

Source : NVIDIA
Ranger dans…
Enregistré. Ajouter une note ?
Levée de fonds

Anthropic loue le site de son premier centre de données australien dans l'ouest du Queensland, projet chiffré à 31,9 milliards de dollars australiens

Le 16 septembre 2026, le premier ministre du Queensland David Crisafulli a annoncé au Parlement de l'État qu'Anthropic avait pris à bail le site de son premier centre de données australien. L'installation, le Western Downs digital park, doit être construite par le singapourien Zerra DC près de Dalby, au nord-ouest de Toowoomba, et raccordée à la centrale électrique de Braemar. Le projet est chiffré à 31,9 milliards de dollars australiens selon les documents d'urbanisme, et découpé en quatre tranches d'après le dossier déposé le mois dernier auprès du conseil régional de Western Downs, la première devant ouvrir l'an prochain. La partie louée par Anthropic occupe environ 725,5 hectares, aujourd'hui en partie un parc d'engraissement. Le site servira à l'inférence, pas à l'entraînement de Claude. Le conseil régional n'a pas encore approuvé le projet : son maire, Andrew Smith, annonce une évaluation « approfondie et complète ».

Ranger dans…
Enregistré. Ajouter une note ?

Articles

69 au total
Résultats financiers · STMicroelectronics

STMicroelectronics relève sa guidance data center à 1 Md$ en 2026, sur fond de résultat net en chute de 89 %

02/06
Datacenter / supercalculateur · SoftBank

SoftBank en France : 45 Md€ pour une première phase IA, 75 Md€ sous réserve d’extension

01/06
Levée de fonds · Amazon

Pourquoi Nvidia mise sur Decart, une start-up IA capable d’optimiser aussi les puces concurrentes

29/05
Puce / GPU / matériel · ByteDance

ByteDance prépare ses propres CPU Arm et RISC-V pour reprendre le contrôle du coût par token

28/05
Puce / GPU / matériel · ASML

Huawei annonce LogicFolding : densité 3D sans machines EUV, 1,4 nm visé pour 2031

26/05
Datacenter / supercalculateur · Anthropic

Anthropic loue Colossus 1 à 1,25 Md$/mois sur un parc xAI qui plafonne à 11% de capacité

21/05
Puce / GPU / matériel · Chine

Reprise de l'exportation des puces H20 et MI308 vers la Chine : NVIDIA et AMD s'engagent à reverser 15 % des revenus de la vente de leurs puces au gouvernement Trump

01/09
Faille / vulnérabilité · Nvidia

Sécurité des puces H20 : Pékin convoque NVIDIA après des soupçons de fonctions de traçage à distance

01/08
Puce / GPU / matériel · Sony

Sony Semiconductor Solutions accélère dans le LiDAR automobile avec un capteur SPAD empilé à haute cadence

16/06
Nomination · AMD

AMD dévoile sa stratégie d'écosystème ouvert pour l'IA lors de l'événement Advancing AI 2025

13/06
Capacité de calcul / cloud · IBM

IBM structure son offensive quantique autour de Starling, premier système tolérant aux erreurs à grande échelle

11/06
Conférence / salon · Alice & Bob

France Quantum 2025 : une 4e édition sous le signe de l’internationalisation des technologies quantiques

09/06
Création d'entité / lancement de structure · OpenAI

OpenAI annonce Stargate UAE, le premier déploiement international de Project Stargate

23/05
Datacenter / supercalculateur · Core42

Le consortium OREUS annonce la mise en service d’un des plus puissants centres de calcul d’Europe

20/05
Financement de cluster / infrastructure publique · BpiFrance

La France se prépare à accueillir le plus grand campus d’IA d’Europe

20/05
Alliance stratégique · AMD

AMD et HUMAIN : Une alliance ambitieuse pour développer l’infrastructure IA

15/05
Tribune / opinion · Etats-Unis

Relocaliser par la contrainte : les semi-conducteurs seront-ils finalement soumis à des taxes douanières spécifiques ?

14/04
Création d'entité / lancement de structure · AMD

AMD finalise l’acquisition de ZT Systems, renforçant sa position sur le marché des infrastructures IA et cloud

03/04
Création d'entité / lancement de structure · Institut 3IA Côte d'Azur

Lancement officiel du cluster IA "3IA Côte d’Azur 2030"

27/03
Nouvelle fonctionnalité · Grand Est

Sesterce concrétise son projet de supercalculateur et de campus IA à Valence

20/03
Financement de cluster / infrastructure publique · EuroHPC

EuroHPC sélectionne six nouveaux sites, dont l'un en France, qui viendront étendre le réseau d'AI Factories

17/03
Loi / texte adopté · OpenAI

OpenAI conclut un accord stratégique de 11,9 milliards de dollars avec CoreWeave

12/03
Conférence / salon · Nvidia

La conférence NVIDIA GTC revient du 17 au 21 mars 2025 à San Jose (Californie) et online

03/03
Datacenter / supercalculateur · Meta

Meta annonce le projet Waterworth : un câble sous-marin de 50 000 kms pour booster l’IA

24/02
Alliance stratégique · OpenAI

SoftBank et OpenAI s'associent pour lancer "SB OpenAI Japan" et déployer "Cristal intelligence" au sein des entreprises japonaises

04/02
Datacenter / supercalculateur · InstaDeep

InstaDeep lance Kyber, un supercalculateur proche de l’exascale, en région parisienne

29/01
Capacité de calcul / cloud · AMD

Allemagne : Hunter, le supercalculateur du HLRS de Stuttgart, entre en service

27/01
Subvention / financement public · Oracle

Stargate : l’IA américaine entre dans une nouvelle ère avec un investissement historique

22/01
Tribune / opinion · Corée du Sud

Nouvelles restrictions américaines sur les puces d'IA : la réaction de NVIDIA

14/01
Nouveau produit / service · Nvidia

Avec Project DIGITS, NVIDIA entend démocratiser l'accès à l'IA

09/01
Avancée méthodologique · IBM

Optique co-packagée (CPO) : comment IBM entend booster l'entraînement des LLMs dans les datacenters

17/12
Dataset / ressource ouverte · Google

Willow : une étape majeure pour la feuille de route quantique de Google

11/12
Conférence / salon · Gcore

UltraEdge et Gcore : un partenariat en IA et Edge Computing

04/12
Appel à projets / AMI / AAP · Nvidia

Elon Musk et xAI : une quête insatiable de puissance de calcul met la pression sur NVIDIA

29/11
Pilote / POC / expérimentation · CNES

AIS et IoT : succès du 3ème lancement de nanosatellites de la constellation KINEIS

26/11
Conférence / salon · Nvidia

IA, HPC, quantique, santé, prévisions climatiques : les principales annonces de NVIDIA au Supercomputing 2024

21/11
Subvention / financement public · Amazon

« Build on Trainium » : Amazon annonce un investissement de 110 millions de dollars dans la recherche universitaire en IA générative

19/11
Nouveau modèle · IBM

Quantum Heron 2 : IBM franchit une nouvelle étape vers l'avantage quantique

18/11
Alliance stratégique · Nvidia

Vertiv et NVIDIA collaborent pour développer une architecture complète d’alimentation et de refroidissement pour la plateforme GB200 NVL72

22/10
Conférence / salon · AMD

Advancing AI 2024 : un évènement AMD dédié à l'IA générative et au HPC

14/10
Création d'entité / lancement de structure · IBM

IBM étend son empreinte quantique avec un premier datacenter européen

02/10
Benchmark / évaluation · AMD

AMD dévoile les premiers résultats des GPU Instinct MI300X sur les benchmarks MLPerf Inference v4.1

29/08
Nouveau produit / service · Juniper Networks

"Blueprint for AI-Native Acceleration" : Juniper Networks entend accélérer l'adoption des réseaux AI-native

21/08
Rapport de marché / adoption · Canalys

Les ventes des PC dopés à l'IA décollent avec 14% de parts de marché au second trimestre 2024

20/08
Publication scientifique · Université du Minnesota

La CRAM, une technologie de mémoire innovante pour des applications d'IA moins énergivores

19/08
Acquisition / rachat · Hugging Face

Hugging Face renforce son infrastructure IA avec l'acquisition de XetHub

13/08
Nouveau produit / service · Nvidia

Siggraph : NVIDIA dévoile de nouveaux outils et microservices NIM pour l'OpenUSD

31/07
Appel à projets / AMI / AAP · BpiFrance

PERSEPHONE : Prophesée développe une IA neuromorphique pour les smartphones avec le soutien de Bpifrance

12/07