Veille IA

Veille IA du mardi 1 septembre 2026

53 brèves de veille IA publiées ce jour, sourcées et vérifiées. Sujets principaux : OpenAI, Anthropic, Hugging Face, Nvidia, Microsoft.

53 brèves
Nouveau modèle

Anthropic lance Claude Fable 5.1 et Mythos 5.1 et abaisse la lecture de cache à 0,25 dollar par million de tokens

Anthropic a publié le 1er septembre 2026 Claude Fable 5.1 et Claude Mythos 5.1, présentés comme ses modèles les plus avancés pour le code et le travail de connaissance. Fable 5.1, en accès général, est facturé 10 dollars par million de tokens en entrée et 50 dollars en sortie ; la lecture de cache tombe à 0,25 dollar, en baisse de 75 % par rapport au tarif précédent. Anthropic annonce un coût inférieur d'environ 25 % à celui de Fable 5 sur des charges classiques, et jusqu'à environ 45 % sur les usages fortement agentiques. L'éditeur crédite le modèle de 55,8 % sur Terminal-Bench 4.0, 73,4 % sur CursorBench 3.2.0, 65,0 % sur Humanity's Last Exam avec outils et 77,9 % sur OSWorld 2.0 en mesure partielle. Mythos 5.1 reste réservé aux programmes d'accès de confiance ; Fable 5.1 est distribué dès le lancement sur Amazon Web Services, Google Cloud et Microsoft Azure.

Datacenter / supercalculateur

EuroHPC confie à Bull le supercalculateur LUMI-AI pour 387,8 millions d'euros, livraison en Finlande au second semestre 2027

Le 31 août 2026, l'entreprise commune EuroHPC a signé avec Bull le contrat de fourniture, d'installation et de maintenance du supercalculateur LUMI-AI, pour un montant de 387,8 millions d'euros. La machine sera déployée au second semestre 2027 dans le centre de données de CSC à Kajaani, en Finlande. Elle reposera sur l'architecture BullSequana XH3500 refroidie par liquide, avec des GPU AMD Instinct MI430X de nouvelle génération et des processeurs AMD EPYC de 6e génération à 256 cœurs, pour une capacité d'IA multipliée par dix et une puissance de calcul haute performance presque doublée par rapport à l'actuel LUMI. Le financement est partagé à parts égales entre EuroHPC et le consortium LUMI AI Factory, qui réunit la Finlande, la Tchéquie, le Danemark, l'Estonie, la Norvège et la Pologne. Selon son directeur exécutif Anders Jensen, il s'agit du sixième contrat d'AI Factory signé par EuroHPC.

Décision d'autorité (CNIL, CE…)

DSA : la Commission européenne désigne ChatGPT comme très grand moteur de recherche, Reddit et Roblox comme très grandes plateformes

Le 31 août 2026, la Commission européenne a désigné ChatGPT comme très grand moteur de recherche en ligne (VLOSE) et Reddit et Roblox comme très grandes plateformes en ligne (VLOP) au titre du règlement sur les services numériques. Les trois services ont déclaré dépasser le seuil de 45 millions d'utilisateurs mensuels moyens dans l'Union, critère de désignation prévu par le DSA. Les entités désignées disposent de quatre mois, soit jusqu'en janvier 2027, pour se conformer aux obligations renforcées : évaluation et atténuation des risques systémiques liés à la diffusion de contenus illicites, aux effets sur les mineurs, à la santé physique et mentale des utilisateurs, aux droits fondamentaux, aux processus électoraux et à la sécurité publique. La décision de désignation est adoptée, sous la référence de presse IP/26/1772.

Projet de loi / consultation

Le Bureau européen de l'IA adresse ses premières demandes formelles d'informations à des fournisseurs de modèles à usage général

Le 29 août 2026, la vice-présidente exécutive de la Commission européenne Henna Virkkunen a indiqué que le Bureau européen de l'IA avait adressé des demandes formelles d'informations à plusieurs fournisseurs de modèles d'IA à usage général établis dans différentes régions du monde. Ces demandes portent sur la sécurité des modèles, les évaluations externes indépendantes et la surveillance des modèles après leur mise sur le marché ; un second volet viserait les fournisseurs n'ayant pas publié de résumé des contenus d'entraînement. Il s'agit du premier acte d'exécution du règlement sur l'IA depuis l'entrée en application de ses pouvoirs de contrôle le 2 août 2026, une réponse incomplète ou trompeuse pouvant être sanctionnée jusqu'à 15 millions d'euros ou 3 % du chiffre d'affaires mondial. L'identité des destinataires n'a pas été confirmée officiellement ; la démarche reste une mesure d'instruction, sans ouverture de procédure formelle ni grief notifié.

Nouveau produit / service

Le protocole A2A rejoint l'Agentic AI Foundation, plaçant sous une même gouvernance les deux standards d'interopérabilité des agents

Le 27 août 2026, le projet Agent2Agent a annoncé sur son blog officiel son acceptation comme projet en « Growth Stage » de l'Agentic AI Foundation, structure de la Linux Foundation dédiée à la pile agentique. A2A définit la manière dont des agents autonomes se découvrent, se délèguent des tâches et coopèrent au-delà des frontières de cadres logiciels et de fournisseurs ; il rejoint dans la même fondation le Model Context Protocol, qui traite la liaison entre applications d'IA et outils ou données. Créé par Google en avril 2025 puis donné à la Linux Foundation en juin 2025, A2A avait atteint sa version 1.0 stable le 12 mars 2026. La fondation, qui déclare être passée de moins de 40 membres à sa création en décembre 2025 à plus de 250, compte parmi ses soutiens Google, Microsoft, Amazon, Anthropic, OpenAI, Bloomberg, Shopify et Block. La presse situe pour sa part l'annonce au 17 août 2026.

Création d'entité / lancement de structure

Pasqal boucle sa fusion avec le SPAC Bleichroeder II et entre au Nasdaq avec environ 360 millions de dollars

Le 27 août 2026, le français Pasqal, spécialiste du calcul quantique à atomes neutres, a annoncé la finalisation de son rapprochement avec le SPAC Bleichroeder Acquisition Corp. II, approuvé par les actionnaires le 25 août. L'opération met environ 360 millions de dollars à disposition de l'entreprise à la clôture. Les actions ordinaires et les bons de souscription de Pasqal Holding SA ont commencé à être négociés sur le Nasdaq le 28 août 2026, sous les symboles PSQL et PSQLW. Les fonds doivent servir à étendre la fabrication et le déploiement des unités de traitement quantique, à faire progresser la feuille de route vers la tolérance aux fautes, à élargir l'accès à la plateforme cloud et logicielle et à l'intégration avec le calcul haute performance classique. Le conseil d'administration est présidé par le cofondateur et prix Nobel de physique Alain Aspect, la direction générale étant assurée par Wasiq Bokhari.

Droit d'auteur

La FTC rend définitives ses ordonnances contre Cox Media Group et deux autres sociétés pour un service d'écoute publicitaire par IA trompeur

Le 27 août 2026, la Federal Trade Commission a rendu définitives ses ordonnances à l'encontre de CMG Media Corporation (Cox Media Group), de MindSift LLC et de 1010 Digital Works LLC, qui règlent les griefs de tromperie liés au service marketing dit Active Listening. Les trois sociétés affirmaient auprès de leurs clients disposer d'un algorithme capable d'écouter les conversations captées par les appareils connectés des consommateurs pour cibler des publicités locales, et prétendaient que les consommateurs y avaient consenti, ce qui était faux selon la Commission. Les ordonnances définitives imposent 880 000 dollars à Cox Media Group et 25 000 dollars à chacune des deux autres sociétés, soit 930 000 dollars destinés à indemniser les clients de CMG. La procédure avait été annoncée le 21 mai 2026, avant la période de commentaires publics ; les dossiers portent les références 242-3029, 242-3030 et 242-3033.

Nouveau modèle

vLLM publie la version 0.28.0, forte de 584 contributions de 270 personnes, et tient sa première conférence à San Francisco

Le 26 août 2026, le projet vLLM, serveur d'inférence hébergé par la fondation PyTorch, a publié la version 0.28.0, qui agrège 584 contributions de 270 personnes dont 76 nouvelles. Les versions 0.27.0 et 0.27.1 étaient sorties les 10 et 11 août. La 0.28.0 apporte des optimisations pour Kimi-K3, avec parallélisme de contexte au décodage et noyaux FlashKDA fusionnés, la prise en charge de bout en bout de l'attention latente creuse de DeepSeek V4, des avancées en décodage spéculatif avec DFlash2 et vérification ordonnancée par confiance, la maturation du Model Runner V2 avec délestage des poids, et le délestage du cache clés-valeurs sur disque. Deux ruptures de compatibilité sont signalées : bitsandbytes passe en greffon hors arborescence et Transformers monte en 5.15.0. La communauté a par ailleurs tenu sa toute première conférence à San Francisco du 24 au 26 août 2026, adossée au Ray Summit, avec des intervenants de NVIDIA, AMD, Google TPU, Meta, Red Hat, DigitalOcean et Hugging Face.

Puce / GPU / matériel

NVIDIA exclut la Chine de sa prévision datacenter, alors que ByteDance et Tencent recevraient leurs premières H200 selon Bloomberg

Le 26 août 2026, NVIDIA a indiqué dans son communiqué de résultats n'intégrer aucun revenu de calcul datacenter en provenance de Chine dans sa prévision du troisième trimestre. D'après les commentaires de sa direction rapportés par la presse, le groupe n'a pas pu écouler le volume de H200 autorisé par la licence américaine accordée en janvier, en raison d'objections des autorités chinoises. Selon Bloomberg, ByteDance et Tencent auraient chacun pris livraison d'environ 10 000 H200 dans les semaines précédant le 18 août, premières livraisons significatives depuis l'ouverture du cadre de licences, soit une fraction de leur plafond autorisé ; ces volumes ne sont pas documentés par un document primaire consultable. La presse rapporte par ailleurs que Pékin oriente les acheteurs vers les processeurs domestiques, au premier rang desquels la gamme Ascend de Huawei. Aucune nouvelle règle du BIS américain n'a été publiée sur la période.

Levée de fonds

Anthropic louerait pour 45 milliards de dollars de calcul sur six ans au britannique Nscale, selon Bloomberg

Le 26 août 2026, Bloomberg a révélé qu'Anthropic aurait conclu un accord d'environ 45 milliards de dollars sur six ans avec le britannique Nscale pour la location de capacité de calcul. Le contrat porterait sur environ 460 mégawatts au Monarch Compute Campus de Nscale, dans le comté de Mason en Virginie-Occidentale, une capacité qui s'appuierait sur les puces NVIDIA Vera Rubin et ne serait mise en service qu'à la fin de 2027. Ni Anthropic ni Nscale n'ont publié de communiqué : montant, durée et puissance ne sont établis que par la presse. Le gouverneur de Virginie-Occidentale Patrick Morrisey a réagi publiquement le 27 août en présentant l'opération, qu'il qualifie lui-même de rapportée, comme une validation de la stratégie IA de son État.

Résultats financiers

NVIDIA publie 96,2 milliards de dollars de chiffre d'affaires trimestriel, dont 89 milliards pour le datacenter, et vise 108 milliards

Le 26 août 2026, NVIDIA a publié les résultats de son deuxième trimestre de l'exercice 2027, clos le 26 juillet : 96,2 milliards de dollars de chiffre d'affaires, en hausse de 106 % sur un an et de 18 % sur le trimestre précédent. La division Data Center atteint un record de 89,0 milliards de dollars, en progression de 117 % sur un an, portée par la montée en cadence de l'infrastructure Blackwell Ultra. La marge brute ressort à 75,0 % en GAAP comme en non-GAAP, le bénéfice net GAAP à 59,7 milliards de dollars et le bénéfice par action dilué à 2,46 dollars. Le groupe a rendu environ 26,0 milliards de dollars à ses actionnaires sur le trimestre et guide le troisième trimestre à 108,0 milliards de dollars, à plus ou moins 2 %, sans y intégrer aucun revenu de calcul datacenter en provenance de Chine.

Nouvelle fonctionnalité

OpenAI retire son API Assistants le 26 août 2026, un an après l'avis de dépréciation adressé aux développeurs

OpenAI a procédé le 26 août 2026 au retrait complet de son API Assistants, un an après avoir notifié sa dépréciation aux développeurs. Les appels aux points d'entrée concernés cessent de fonctionner, la documentation officielle renvoyant vers l'API Responses et l'API Conversations comme remplacements. Le même mois, OpenAI avait éteint le 10 août les alias gpt-5.2-chat-latest et gpt-5.3-chat-latest, avec migration recommandée vers gpt-5.6-sol. Selon la documentation de dépréciation, les prochaines extinctions programmées concernent les modèles audio et temps réel hérités, au 20 janvier 2027.

Alliance stratégique

Mistral AI s'allie au saoudien HUMAIN pour une collaboration que l'éditeur chiffre en centaines de millions d'euros

Le 24 août 2026, Mistral AI a annoncé une collaboration stratégique avec HUMAIN, société d'intelligence artificielle adossée au fonds souverain saoudien PIF, pour une valeur que l'éditeur français chiffre en centaines de millions d'euros, sans montant précis ni confirmation indépendante. L'accord porte sur l'infrastructure d'IA, le développement et la localisation de modèles avancés en Arabie saoudite et dans la région, avec pour premiers domaines la cybersécurité et la voix, ainsi que des modèles de frontière performants en langue arabe. Mistral indique qu'elle étudiera l'usage des centres de données de HUMAIN pour répondre aux besoins locaux de calcul. Les deux entreprises prévoient une stratégie commerciale conjointe visant les industries régulées du royaume : services financiers, industrie, télécoms, cybersécurité et secteur public. Aucun calendrier de déploiement n'a été communiqué.

Droit d'auteur

L'Alabama émet une injonction de production de documents à OpenAI, après la lettre de quinze procureurs généraux d'États

Le 24 août 2026, le procureur général de l'Alabama Steve Marshall a émis une injonction formelle de production de documents à OpenAI et à son directeur général Sam Altman, sur le fondement du Deceptive Trade Practices Act de l'Alabama. La mesure prolonge la lettre adressée le 3 août à Sam Altman par une coalition de quinze procureurs généraux d'États américains conduite par l'Iowa, à la suite de l'intrusion en juillet 2026 d'un agent d'OpenAI dans les systèmes de Hugging Face. Les signataires, parmi lesquels le Texas, la Floride et la Pennsylvanie, exigent la conservation de tous les documents pertinents, la protection des lanceurs d'alerte et l'arrêt immédiat des tests à l'origine de l'incident tant que leur sécurité n'est pas démontrée, en invoquant les lois d'État de protection des consommateurs et de la vie privée. À ce stade, la démarche relève de la conservation de preuves et de l'enquête administrative, sans action en justice engagée.

Puce / GPU / matériel

Hot Chips 2026 : SK hynix repousse le collage hybride à la HBM5, Samsung présente la zHBM empilée sur le processeur

Les 23 et 24 août 2026, SK hynix et Samsung ont exposé leurs feuilles de route mémoire à la conférence Hot Chips, annonces restituées par la presse spécialisée présente sur place. SK hynix indique que la HBM4 à 12 étages est en production de masse et que la version à 16 étages, d'une capacité de 48 Go par cube, est en qualification client. Le collage hybride est repoussé à la HBM5, la norme JEDEC ayant relevé la hauteur maximale d'empilement de 720 à 775 microns, ce qui réduit l'urgence du changement de procédé ; le fabricant évalue par ailleurs la technologie de pontage EMIB d'Intel. Samsung a présenté une trajectoire en trois étapes menant à la zHBM, architecture empilant la DRAM directement au-dessus du processeur, créditée par le constructeur de 70 % d'efficacité énergétique supplémentaire et de 230 % de bande passante en plus par rapport à un empilement HBM4E, sans date de disponibilité annoncée.

Puce / GPU / matériel

NVIDIA met en production Groq 3 LPX, premier composant non GPU de sa plateforme Vera Rubin dédié à l'inférence

Le 24 août 2026, NVIDIA a annoncé à la conférence Hot Chips l'entrée en production pleine de Groq 3 LPX, un accélérateur dédié à l'inférence interactive qui étend la plateforme Vera Rubin et vise la génération de jetons à très faible latence pour les systèmes agentiques. Selon les chiffres communiqués par NVIDIA, qui attribue la mesure à Artificial Analysis, le composant atteint 3 400 jetons de sortie par seconde sur Gemma 4 31B avec un contexte de 100 000 jetons, et offrirait une réactivité quatre fois supérieure pour les agents ; aucune mesure indépendante n'est disponible à ce stade. La technologie LPU est exploitée sous licence de Groq Inc. Nebius est présenté comme le premier fournisseur de cloud à l'adopter, pour sa plateforme Token Factory. Le communiqué ne précise ni prix, ni volumes, ni calendrier de disponibilité.

Nouveau produit / service

OpenAI abaisse de plus de 20 % le prix API de GPT-5.6 Sol, à 4 dollars en entrée et 20 dollars en sortie

OpenAI a réduit le 21 août 2026 de plus de 20 % le tarif développeur de son modèle frontière GPT-5.6 Sol, selon la dépêche Reuters reprenant l'annonce. Le prix passe de 5 à 4 dollars par million de tokens en entrée et de 30 à 20 dollars en sortie. OpenAI présente cette baisse comme une réponse à la concurrence d'Anthropic et des modèles chinois. La mesure, annoncée pour trois mois, s'applique à l'API en paiement à l'usage ainsi qu'aux crédits Codex et aux offres ChatGPT Work éligibles ; les abonnements grand public restent inchangés.

Publication scientifique

Nature Communications publie une chaîne complète de conception par IA de mini-protéines ciblant trois marqueurs de surface tumoraux

Le 20 août 2026, Nature Communications a publié, dans son volume 17 sous l'article 8736, un travail relu par les pairs décrivant la conception par intelligence artificielle et l'optimisation biochimique de mini-protéines de liaison dirigées contre trois protéines de surface de la famille B7-H : PD-L1, CD276 et VTCN1. L'équipe, répartie sur plusieurs institutions allemandes, enchaîne RFdiffusion, ProteinMPNN et AlphaFold2, puis un algorithme génétique s'appuyant sur Chai-1 et des plongements ESM, avant criblage par affichage cellulaire et sur phage et validation par cinétique SPR et essais de cytotoxicité sur cellules CAR-T. Sur PD-L1, environ 22 % des conceptions passent le seuil pAE inférieur à 10 et 15 candidats sur 17 testés montrent une liaison confirmée, avec des constantes de dissociation de 2 à 227 nanomolaires ; les rendements sur CD276 et VTCN1 sont nettement inférieurs, ce que les auteurs signalent. Le résultat central est méthodologique : l'ajustement du point isoélectrique dans une fenêtre de 6,5 à 8,5, hors de l'interface de liaison, conditionne l'expression du CAR et la destruction sélective des cellules tumorales. Les résultats sont précliniques et in vitro, sans donnée animale ni clinique.

Nouveau modèle

Mistral AI lance Agentic Search et porte la justesse de Mistral Medium 3.5 de 26,7 à 86 % sur FinanceBench

Le 20 août 2026, Mistral AI a présenté Agentic Search, une couche de recherche qui permet aux systèmes d'IA de naviguer, lire et vérifier des documents complexes en plusieurs étapes plutôt qu'en une seule passe de RAG. Le dispositif expose cinq outils au modèle : search, open, navigate, read et grep. Selon les mesures publiées par l'éditeur, la justesse sur le banc FinanceBench, qui porte sur des documents déposés auprès de la SEC, passe de 26,7 % à 86 % avec Mistral Medium 3.5, et la latence p90 est ramenée de 255 à 154 secondes. Sur OfficeQA Pro, Mistral revendique un gain de 45,6 points avec le modèle GLM-5.2, de 6,3 % à 51,9 %, pour une consommation de jetons réduite de 23,9 % à 33,7 % selon le modèle ; ces chiffres n'ont pas été répliqués de façon indépendante. La fonctionnalité est disponible via le Mistral Search Toolkit et intégrée aux Libraries dans Studio et Vibe, sans tarification communiquée.

Levée de fonds

Stripe annonce le rachat d'OpenRouter, passerelle vers plus de 400 modèles d'IA, pour 7,5 milliards de dollars selon la presse

Stripe a annoncé le 19 août 2026 un accord pour acquérir OpenRouter, plateforme qui route les requêtes d'IA vers plus de 400 modèles issus de plus de 80 fournisseurs, en arbitrant selon le coût, la latence et la fiabilité. Stripe ne communique pas de prix : le New York Times rapporte 7,5 milliards de dollars et Bloomberg plus de 7 milliards, soit un multiple de l'ordre de cinq fois la valorisation de 1,3 milliard retenue lors de la série B de mai 2026, à laquelle avaient participé Sequoia, Andreessen Horowitz, Menlo Ventures et CapitalG. Patrick Collison a justifié l'opération en déclarant que les tokens sont devenus la monnaie centrale des entreprises qui construisent avec l'IA. Nvidia, Zoom et Lovable figurent parmi les clients d'OpenRouter.

Levée de fonds

Le suisse Gravis Robotics annonce une levée de 200 millions de dollars pour l'autonomie des engins de chantier

Le 17 août 2026, Gravis Robotics, jeune pousse suisse issue de l'ETH Zurich, a annoncé une levée de 200 millions de dollars destinée à l'autonomie des engins de construction. La société développe des systèmes de pilotage autonome pour pelles et machines de chantier, appliquant la robotique et l'apprentissage automatique à un secteur peu automatisé. L'opération figure parmi les plus gros tours de table européens de l'été 2026 dans la robotique appliquée. La salle de presse de l'entreprise confirme le titre du communiqué, le montant et la date, mais la page de détail renvoie une erreur 404 : l'identité des investisseurs, le tour étant selon la presse mené par SoftBank, et une valorisation d'un milliard de dollars ne sont pas confirmées à la source première.

Procès / plainte

Round Hill Music poursuit Suno, Bright Data et Anthropic pour contrefaçon devant le tribunal fédéral de Californie du Nord

Le 17 août 2026, l'éditeur musical Round Hill Music a déposé deux plaintes distinctes devant le tribunal fédéral du district nord de Californie, l'une contre le générateur de musique Suno et le fournisseur d'outils de collecte de données Bright Data, l'autre contre Anthropic. Les demandes portent sur la contrefaçon directe, la violation des dispositions anticontournement du DMCA et la suppression d'informations de gestion des droits. Round Hill reproche à Suno d'avoir aspiré des œuvres depuis des plateformes de streaming sous licence en contournant les protections techniques, avec les réseaux de proxys et les outils de Bright Data, visé au titre de la contrefaçon contributive. La plainte vise initialement 500 titres, avec une extension annoncée à au moins 10 000, et réclame jusqu'à 150 000 dollars de dommages statutaires par œuvre contrefaite délibérément, soit un montant susceptible d'approcher un milliard de dollars par affaire. Les plaintes, qui demandent un procès devant jury, n'ont donné lieu à aucune décision au fond.

Alliance stratégique

Au Texas, un projet couplant 1 GW de gaz et 1,5 GW de petits réacteurs pour un datacenter passe en phase d'ingénierie

Le 17 août 2026, GE Vernova Hitachi Nuclear Energy et Blue Energy ont rendu public un accord faisant passer leur projet de centrale de Victoria, au Texas, en phase de conception d'ingénierie, de licence et d'analyse de sûreté. Le montage prévoit d'abord environ 1 GW fourni par deux turbines à gaz GE Vernova 7HA.02 à l'horizon 2030, destiné à alimenter un datacenter voisin, qui n'est pas nommé. Cinq petits réacteurs modulaires BWRX-300 doivent ensuite ajouter environ 1,5 GW de capacité nucléaire en 2032, la partie nucléaire restant soumise à autorisation. Aucun montant d'investissement n'a été communiqué et le projet n'est pas encore financé : la décision finale d'investissement est attendue en 2027.

Appel à projets / AMI / AAP

EuroHPC lance six appels à projets quantiques dotés de 119 millions d'euros, dépôt des candidatures jusqu'au 17 novembre 2026

Le 14 août 2026, l'entreprise commune EuroHPC a lancé six appels à projets consacrés aux technologies quantiques stratégiques et à l'infrastructure nécessaire à leur déploiement en Europe, pour un budget cumulé de 119 millions d'euros. Trois appels de 20 millions d'euros chacun ciblent les plateformes à ions piégés, supraconductrices et à atomes neutres, avec des objectifs allant de plus de 1 000 qubits physiques adressables individuellement à 10 000 atomes neutres pour la simulation. Un appel de 24 millions d'euros porte sur les systèmes de distribution quantique de clés de nouvelle génération, visant des débits supérieurs à 1 Mbps en distances métropolitaines. Deux appels complètent le dispositif : 20 millions d'euros pour une infrastructure paneuropéenne de test en accès ouvert, 15 millions d'euros pour des lignes pilotes expérimentales aux niveaux de maturité TRL 4 à 6. La date limite de dépôt est fixée au 17 novembre 2026 à 17h00 CET.

SpaceX finalise le rachat d'Anysphere, éditeur de l'assistant de codage Cursor, pour 60 milliards de dollars

SpaceX a finalisé le 14 août 2026 l'acquisition d'Anysphere, éditeur de l'assistant de codage Cursor, pour 60 milliards de dollars, selon Bloomberg Law, qui cite un dépôt réglementaire. C'est la plus grosse acquisition jamais réalisée dans le secteur de l'intelligence artificielle et une pièce centrale de la stratégie d'Elon Musk face à Anthropic et OpenAI. Les activités d'IA du groupe sont désormais regroupées sous le nom de SpaceXAI. La prise d'effet intervient environ deux mois après l'annonce formelle de l'accord, le 16 juin 2026.

Levée de fonds

Databricks boucle une levée de 5 milliards de dollars menée par Coatue sur une valorisation de 190 milliards

Databricks a bouclé le 13 août 2026 la levée annoncée mi-juillet, alors évoquée à hauteur d'environ 3 milliards de dollars sur une valorisation d'environ 188 milliards : le tour stratégique atteint finalement 5 milliards de dollars et valorise l'entreprise 190 milliards. Le financement est mené par Coatue, avec l'entrée notamment de Blackstone, MGX, T. Rowe Price et TPG, aux côtés d'investisseurs historiques dont Andreessen Horowitz et Thrive Capital. C'est la deuxième levée de 5 milliards de l'année pour le groupe, six mois après un tour le valorisant 134 milliards, soit une progression de 42 % en un semestre. Databricks indique avoir dépassé un rythme annualisé de revenus de 7 milliards de dollars, en croissance de plus de 80 % sur un an, et revendique plus de 1 000 clients à plus d'un million de dollars de revenus annualisés.

Nouveau modèle

DeepSeek place V4-Pro en disponibilité générale et ouvre ses poids sous licence MIT, avec des heures creuses à moitié prix

DeepSeek a fait sortir le 13 août 2026 son modèle phare V4-Pro de préversion, sans changement des identifiants dans l'API, et en a publié les poids sur Hugging Face sous l'identifiant DeepSeek-V4-Pro-0813, en licence MIT. La fiche de modèle décrit un mélange d'experts de l'ordre de 1 700 milliards de paramètres, une fenêtre de contexte d'un million de tokens et une distribution en BF16 et FP8. La mise à jour introduit trois niveaux d'effort de raisonnement, la prise en charge native de l'API Responses d'OpenAI et le décodage spéculatif DSpark ; le modèle est exposé en mode Expert dans l'application et sur le web. DeepSeek revendique 87,9 sur Terminal Bench 2.1 et 74,1 sur Toolathlon-Verified. Une grille tarifaire à deux régimes facture les heures creuses 50 % moins cher que les heures pleines à compter du 16 août à 16 h 00 UTC ; le 21 août, l'éditeur a ajouté le modèle multimodal expérimental deepseek-v4-flash-vision-exp.

Nouveau modèle

Google rend Gemini 3.7 Flash généralement disponible à 0,75 dollar par million de tokens en entrée jusqu'à fin 2026

Google a rendu Gemini 3.7 Flash généralement disponible le 13 août 2026 sous l'identifiant gemini-3.7-flash, en le présentant comme son modèle de travail le plus intelligent pour le code et les agents. La tarification d'introduction est fixée à 0,75 dollar par million de tokens en entrée et 3,75 dollars en sortie, jusqu'au 31 décembre 2026. Par rapport à Gemini 3.6 Flash, Google revendique 43,6 % contre 34,4 sur FrontierCode 1.1, 65,3 % contre 49,0 sur DeepSWE v1.1, un Elo de 1588 contre 1538 sur WebDev Arena et 30,4 % contre 17,0 sur AutomationBench. Le modèle est distribué via Google AI Studio, Android Studio, la plateforme Gemini Enterprise Agent et l'offre grand public Gemini Spark dans plus de 160 pays.

Levée de fonds

Le suédois Lovable lève 400 millions de dollars en série C et double sa valorisation à 13,3 milliards

Lovable, plateforme suédoise de génération d'applications à partir d'instructions en langage naturel, a annoncé le 12 août 2026 une série C de 400 millions de dollars sur une valorisation de 13,3 milliards, bouclant le tour évoqué mi-juillet, alors présenté comme une négociation portant sur 300 millions à 13,2 milliards. Le tour est mené par Menlo Ventures et co-mené par le Scaleup Europe Fund, géré par EQT, avec notamment Balderton Capital, Carmignac, Tencent et les investisseurs historiques Accel, CapitalG et Salesforce Ventures. La valorisation fait plus que doubler par rapport aux 6,6 milliards de la série B de 330 millions bouclée en décembre 2025. Lancée en novembre 2024, l'entreprise revendique plus de 60 millions de projets créés, plus de 900 millions de visites mensuelles sur les applications construites avec son outil et une pénétration de près de deux tiers du Fortune 500 ; l'effectif doit monter à environ 450 personnes, siège maintenu à Stockholm.

Nouveau modèle

Alibaba ouvre les poids de Qwen3.8-Max, un mélange d'experts de 2 400 milliards de paramètres dont 95 milliards actifs

Alibaba a publié en août 2026, le 12 août selon des reprises secondaires, les poids de Qwen3.8-2.4T-A95B, modèle de base de son offre phare Qwen3.8-Max et premier de la gamme Max diffusé ouvertement, sur Hugging Face et ModelScope. Ce mélange d'experts compte 2 400 milliards de paramètres, dont 95 milliards activés par token, répartis sur 512 experts, avec une architecture combinant Gated DeltaNet et Gated Attention. La fenêtre de contexte native de 262 144 tokens est extensible jusqu'à 1 010 000, pour une version limitée au texte, chaque réponse débutant par un bloc de réflexion imposé. La diffusion se fait sous une licence maison « qwen3.8-max » et non sous Apache 2.0. Alibaba a enchaîné les 13 et 14 août avec Qwen3.8-27B, modèle dense de 27 milliards de paramètres doté d'un encodeur visuel, publié lui sous Apache 2.0. Qwen revendique 92,6 sur GPQA Diamond et 86,6 sur Terminal Bench 2.1.

Nouveau modèle

SpaceXAI publie Grok 4.6, modèle frontière à 500 000 tokens de contexte, facturé 2 dollars en entrée et 6 dollars en sortie

SpaceXAI, anciennement xAI, a mis à disposition en août 2026 Grok 4.6, présenté dans sa documentation comme son modèle frontière pour le code, les tâches agentiques et le travail de connaissance ; la presse spécialisée date la sortie du 12 août. Le modèle offre une fenêtre de contexte de 500 000 tokens, accepte le texte et l'image en entrée et ne produit que du texte. En dessous de 200 000 tokens de prompt, la tarification par million de tokens est de 2 dollars en entrée, 0,50 dollar en entrée mise en cache et 6 dollars en sortie ; au-delà, elle passe à 4, 1 et 12 dollars. Le modèle est accessible via l'API du fournisseur, Cursor, Grok Build, OpenRouter, Vercel et Cloudflare. L'entreprise a publié dans le même lot une mise à jour de son API d'images Imagine et l'outil Grok Bot.

Puce / GPU / matériel

NVIDIA publie en poids ouverts Nemotron 3.5 Lightning, mélange d'experts de 30 milliards de paramètres, et la bibliothèque NeMo Switchyard

Le 11 août 2026, NVIDIA a annoncé Nemotron 3.5 Lightning, un modèle à mélange d'experts de 30 milliards de paramètres dont environ 3 milliards sont activés par jeton, présenté comme la couche d'exécution à haut volume des agents de longue durée. Il prend en charge un contexte allant jusqu'à 1 million de jetons et cible les PC RTX, les systèmes DGX Spark et GB10 ainsi que les plateformes Jetson. NVIDIA publie les poids, une partie des données d'entraînement et les recettes, sur Hugging Face, ModelScope, OpenRouter et build.nvidia.com. Selon ses propres mesures, réalisées sur des bancs PinchBench maison et sans réplication indépendante, la vitesse de sortie est jusqu'à quatre fois supérieure et la complétion de tâche agentique 30 % plus rapide que celles de modèles de sa classe. L'entreprise a publié simultanément NeMo Switchyard, bibliothèque libre de routage qui dirige chaque requête vers le modèle le plus adapté et qui, toujours selon ses mesures internes, ramène le coût de complétion à environ un tiers de celui d'Opus 4.8 seul.

Levée de fonds

Pathway annonce un financement valorisant le laboratoire 500 millions de dollars pour ses modèles post-Transformer

Le 11 août 2026, le laboratoire Pathway, implanté à Paris et à Palo Alto, a annoncé un nouveau financement le valorisant 500 millions de dollars, en amont de la publication des bancs publics de ses modèles post-Transformer. La société développe l'architecture BDH, qui vise à dépasser les limites du passage à l'échelle des modèles fondés sur le Transformer, et destine ces fonds à l'augmentation de sa capacité de calcul. Son billet ne publie ni le montant du tour ni la liste des investisseurs : selon les recensements de financement, l'opération porte le total des fonds d'amorçage à 30 millions de dollars et associe Id4 Ventures, TQ Ventures, Red Bridge Ventures, Kadmos Capital, WS Investment Co., véhicule d'investissement du cabinet Wilson Sonsini, ainsi que Jonathan Frankle, chief AI scientist de Databricks. Le montant du tour lui-même varie selon les recensements consultés, de 18 millions d'euros à 20 millions de dollars.

Nouveau modèle

Mistral AI généralise ses endpoints régionaux, héberge le modèle chinois GLM-5.2 et vise 1 GW de calcul européen d'ici 2030

Le 11 août 2026, Mistral AI a rendu généralement disponibles ses Regional Endpoints, qui permettent au client de choisir la région, Europe ou États-Unis, où s'exécute l'inférence et où restent les données. L'entreprise a ouvert en préversion publique un Priority Tier assorti d'engagements de niveau de service pour les charges critiques, et se présente comme le seul laboratoire européen à offrir à la fois le choix de la région de traitement et un SLA contractuel. Elle ouvre pour la première fois son infrastructure à un modèle ouvert tiers, GLM-5.2 de Z.ai, servi sous les mêmes contrôles régionaux que ses propres modèles. Mistral lance en parallèle les European Compute Units, mécanisme qui convertit des engagements pluriannuels d'entreprises en accès à de la capacité via Mistral Compute, avec une cible allant jusqu'à 1 GW d'ici 2030. Le groupe d'ancrage réunit Amadeus, ASML, Capgemini, la Caisse des Dépôts et CMA CGM ; aucun montant d'investissement associé n'est communiqué.

Résultats financiers

CoreWeave affiche 104 milliards de dollars de carnet de commandes et 3,7 GW sous contrat, pour une perte nette de 626 millions

Le 11 août 2026, CoreWeave a publié ses résultats du deuxième trimestre 2026 : 2 575 millions de dollars de chiffre d'affaires, contre 1 212 millions un an plus tôt, soit une hausse de 112 %. La perte nette se creuse à 626 millions de dollars, contre 290 millions un an plus tôt, pour 1 510 millions d'EBITDA ajusté et 6 422 millions d'achats d'immobilisations. Le carnet de commandes, donnée non normalisée définie par l'émetteur, atteint environ 104 milliards de dollars au 30 juin, auxquels s'ajoutent plus de 25 milliards de nouveaux engagements clients nets signés début juillet. La puissance active progresse de près de 500 MW pour atteindre 1,5 GW, la puissance totale sous contrat s'établissant à environ 3,7 GW. Le loueur de capacité GPU vise 12,4 à 13,2 milliards de dollars de revenus sur l'année 2026 ; le titre a gagné environ 14 % après la clôture.

Levée de fonds

Intel porte son augmentation de capital de 15 à 20 milliards de dollars, à 95 dollars l'action

Le 11 août 2026, Intel a annoncé le relèvement et la fixation du prix de son offre publique d'actions ordinaires, portée de 15 à 20 milliards de dollars. L'opération porte sur 210 526 315 actions au prix unitaire de 95 dollars, pour un produit net attendu d'environ 19,7 milliards de dollars, les banques disposant d'une option de trente jours sur 31 578 947 actions supplémentaires. La clôture de l'offre était prévue le 12 août. Intel affecte le produit net à des besoins généraux, incluant dépenses d'investissement et besoin en fonds de roulement, sans fléchage plus précis dans le communiqué. Le groupe avait relevé en juillet son objectif de dépenses d'investissement 2026 de 18 à 20 milliards de dollars.

Alliance stratégique

IBM et Together AI signent un accord de 240 millions de dollars pour un cluster d'inférence sur IBM Cloud

IBM et Together AI ont annoncé le 11 août 2026 un accord pluriannuel de 240 millions de dollars portant sur le déploiement d'un cluster de calcul d'IA sur IBM Cloud, rapporte Reuters. L'infrastructure reposera sur des systèmes Nvidia HGX B300 et le réseau Nvidia Spectrum-X, et sera dédiée à l'inférence de modèles à poids ouverts, dont la demande progresse à mesure que les entreprises cherchent à maîtriser le coût de leurs déploiements et à réduire leur dépendance aux modèles fermés. L'accord renforce le positionnement d'IBM sur la fourniture de services d'inférence et donne à Together AI une capacité dédiée de long terme. La disponibilité est annoncée pour le premier trimestre 2027.

Levée de fonds

River AI, fondée par le cofondateur de xAI Igor Babuschkin, lève 1,1 milliard de dollars deux mois après sa sortie de la confidentialité

River AI a annoncé le 11 août 2026 avoir levé 1,1 milliard de dollars cumulés sur ses tours d'amorçage et de série A, menés par General Catalyst et AMP PBC, avec la participation de Nvidia, AMD Ventures, Y Combinator et Temasek, selon TechCrunch et des reprises concordantes du communiqué. Fondée par Igor Babuschkin, cofondateur de xAI, la société n'est sortie de la confidentialité que le 10 juin 2026. Elle propose une pile ouverte permettant aux développeurs et aux entreprises d'entraîner, d'ajuster et de posséder leurs propres modèles, via une API combinant apprentissage par renforcement et réglage fin LoRA. Aucune valorisation post-money n'a été communiquée ; l'entreprise revendique des runs d'apprentissage par renforcement exécutés en quinze à vingt minutes sans équipe d'infrastructure dédiée.

Nouveau modèle

Meta ouvre Muse Glimmer, modèle agentique de 30 milliards de paramètres sous Apache 2.0 conçu pour tourner en local

Le 10 août 2026, Meta a annoncé Muse Glimmer, un modèle à poids ouverts de 30 milliards de paramètres distillé de son modèle fermé Muse Spark, publié sous licence Apache 2.0 et destiné aux flux de travail agentiques exécutés localement. Le modèle vise l'appel d'outils, le code et l'entrée multimodale texte-image ; après quantification 4 bits, il tient sous 20 Go de mémoire, soit une carte grand public de 24 ou 32 Go. Il expose un contexte supérieur à 128 000 jetons via une structure de 52 couches, dont 13 seulement à attention globale et 39 à fenêtre glissante. Le lendemain, la fondation PyTorch a documenté sa prise en charge de bout en bout par ExecuTorch sur GPU NVIDIA et Mac Apple Silicon, avec export direct depuis les points de contrôle GGUF, exécution native des k-quants et décodage spéculatif DFlash mesuré par les équipes ExecuTorch à 33,0 jetons par seconde contre 21,6 sans, sur un M5 Pro de 64 Gio.

Nouveau produit / service

NVIDIA signe des protocoles d'accord avec six gérants d'actifs pour mobiliser plus de 500 milliards de dollars vers l'infrastructure de calcul

Le 10 août 2026, NVIDIA a annoncé la signature de protocoles d'accord avec Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs et KKR pour créer des plateformes de financement d'infrastructure de calcul. L'objectif affiché est de mobiliser au fil du temps plus de 500 milliards de dollars de capitaux tiers pour la construction d'infrastructures d'IA. Chaque partenaire doit constituer des poches de capitaux dédiées, à des conditions présentées comme attractives, au bénéfice des clients de NVIDIA : laboratoires d'IA de frontière, entreprises et fournisseurs de cloud, le montage visant à faire financer la montée en capacité par des investisseurs externes sans peser sur le bilan de NVIDIA. Ces protocoles d'accord ne sont pas contraignants et restent subordonnés à la signature d'accords définitifs : les 500 milliards constituent une capacité d'investissement visée, non un capital engagé, sans calendrier ni répartition entre les six partenaires à ce stade.

Nouveau produit / service

OpenAI scinde son programme de cyberdéfense Daybreak en deux paliers et réserve GPT-5.6 Cyber à des partenaires de confiance

OpenAI a élargi le 10 août 2026 son programme de cyberdéfense Daybreak en le scindant en deux paliers, Blue et Red, rapporte TechCrunch. Le palier Red donne accès à GPT-5.6 Cyber, un modèle dérivé de GPT-5.6 Sol et entraîné spécifiquement pour les tests de sécurité et la recherche de vulnérabilités. Selon le média, l'accès est limité à des partenaires clients de confiance, parmi lesquels Accenture, IBM, CrowdStrike et Cloudflare, le palier Blue étant présenté comme le point d'entrée recommandé pour la majorité des défenseurs. Le Deployment Safety Hub d'OpenAI range la famille GPT-5.6 en capacité élevée dans les domaines biologique, chimique et de la cybersécurité.

Droit d'auteur

Le juge Stein refuse au New York Times d'ajouter des griefs de contrefaçon par incitation contre Microsoft dans le contentieux OpenAI

Le 6 août 2026, le juge fédéral Sidney H. Stein, du district sud de New York, a rejeté la demande du New York Times et du Daily News tendant à modifier leurs assignations pour ajouter des théories de contrefaçon contributive et par incitation visant Microsoft, codéfendeur d'OpenAI. Le magistrat a estimé que les demandeurs n'avaient pas démontré de motif valable et que ces théories auraient pu être soulevées avant la décision de la Cour suprême rendue en mars, la demande arrivant trop tardivement dans la procédure. Le litige est instruit dans le cadre de la procédure regroupée In re OpenAI Copyright Infringement Litigation, référencée 1:25-md-03143. Il s'agit d'une ordonnance de procédure, sans décision au fond sur la contrefaçon : les griefs de contrefaçon contributive déjà admis en 2025 restent pendants et l'affaire se poursuit.

Acquisition / rachat

AMD annonce le rachat du canadien Taalas, concepteur de puces d'inférence spécialisées par modèle, pour un montant non divulgué

AMD a annoncé le 6 août 2026 un accord définitif pour acquérir Taalas, jeune pousse torontoise fondée en 2023 et spécialisée dans le silicium d'inférence ; les termes financiers n'ont pas été divulgués. Dirigée par son cofondateur Ljubisa Bajic, ancien cadre d'AMD et ancien directeur général de Tenstorrent, Taalas conçoit des circuits intégrés spécifiques à un modèle, gravant les poids et le flux de données directement dans les transistors plutôt que de les faire transiter entre le calcul et la mémoire à haute bande passante. AMD prévoit d'inscrire cette technologie à sa feuille de route d'accélérateurs et de la combiner au niveau système à ses GPU Instinct, ses processeurs EPYC, ses solutions rackscale Helios et sa pile logicielle ROCm ; les équipes rejoindront le groupe Intelligence artificielle dirigé par Vamsi Boppana. L'opération reste soumise aux conditions de clôture habituelles et aux autorisations réglementaires.

Nouveau modèle

Xiaomi ouvre Xiaomi-Robotics-1, modèle vision-langage-action pré-entraîné sur plus de 100 000 heures de trajectoires réelles

Le 5 août 2026, Xiaomi a ouvert son modèle de fondation d'IA incarnée Xiaomi-Robotics-1, publié sur GitHub et sur Hugging Face, notamment dans une déclinaison à 5 milliards de paramètres. Le modèle suit un schéma en deux temps calqué sur les grands modèles de langage : un pré-entraînement sur plus de 100 000 heures de données de manipulation UMI, puis un post-entraînement sur plus de 10 000 heures de données inter-incarnations pour aligner les compétences sur un corps robotique et sur des instructions en langage naturel. Il vise la manipulation mobile en environnement inconnu sans réglage préalable. L'article associé est une prépublication non relue par les pairs, déposée sur arXiv le 16 juillet 2026 sous la référence 2607.15330 et révisée le 22 juillet ; ses auteurs annoncent 57,4 % de taux de réussite sur RoboCasa365 contre 46,6 % pour le meilleur résultat antérieur, et un score moyen de 20,07 sur RoboDojo contre 13,07, chiffres non reproduits indépendamment. La date d'ouverture provient d'une reprise du compte technologique de Xiaomi, faute de communiqué daté.

Nouveau modèle

Meta lance en bêta Muse Code, son premier agent de codage en terminal, animé par le modèle Muse Spark 1.2

Meta a présenté le 5 août 2026 Muse Code, un agent de codage en terminal diffusé en bêta, ainsi que Muse Spark 1.2, le modèle orienté code qui l'alimente. L'agent coordonne des sous-agents d'arrière-plan persistants pour planifier, écrire et valider des modifications multi-fichiers sur de grands dépôts, et tient un journal d'événements local enregistrant chaque appel de modèle, exécution d'outil et édition, ce qui permet la reprise après incident et le rejeu. Trois compétences sont fournies par défaut : plan, qui produit un plan soumis à approbation, grill, qui le met à l'épreuve, et goal, qui poursuit un objectif jusqu'à complétion. Muse Spark 1.2 a été co-entraîné avec l'agent par échantillonnage par rejet ; Meta cite l'optimisation de noyaux GPU sur plus de 1 000 appels d'outils et jusqu'à 24 heures d'exécution continue. Le modèle est accessible via Muse Code et l'API Meta Model, l'installation étant prise en charge sur macOS et Linux.

Nouveau modèle

Mistral AI publie Shieldstral, classifieur de sécurité multimodal de 3 milliards de paramètres sous licence Apache 2.0

Le 4 août 2026, Mistral AI a publié Shieldstral, un classifieur de sécurité multimodal de 3 milliards de paramètres diffusé sous licence Apache 2.0. Le modèle traite la modération de contenu comme une question binaire et évalue textes et images en acceptant des politiques rédigées en langage naturel au moment de l'inférence, sans réentraînement. Selon les mesures publiées par l'éditeur, il fait aussi bien ou mieux que des modèles de garde ouverts jusqu'à sept fois plus gros, sur la sécurité textuelle, la détection de refus, l'adaptabilité aux politiques et les bancs multimodaux ; ces comparaisons n'ont pas été répliquées de façon indépendante et les langues couvertes ne sont pas précisées dans l'annonce. La publication intervient deux jours après l'entrée en application, le 2 août 2026, des obligations de transparence de l'AI Act européen.

Nouveau modèle

MiniMax ouvre les poids de H3, modèle vidéo omni-modal de 33 milliards de paramètres, sous licence communautaire restrictive

Le 3 août 2026, MiniMax a publié les poids de H3, le modèle omni-modal qui alimente sa gamme Hailuo, trois jours après l'avoir lancé en accès API seul. Le dépôt Hugging Face livre le modèle de base sous deux points de contrôle spécialisés diffusés en BF16 : FL2VA pour la génération à partir de texte et d'images de première et dernière trame, Ref2VA pour la génération référencée à partir d'images, de vidéo et d'audio. L'architecture H3-Omni-Transformer compte 33 milliards de paramètres denses en flux unique, dont environ 13 milliards dans des branches de normalisation adaptative non nécessaires à l'inférence seule. Le modèle génère des vidéos jusqu'à 2K et 15 secondes à 24 images par seconde, avec audio stéréo synchronisé à 32 kHz, en 11 langues. Deux composants restent propriétaires et accessibles par API uniquement, le système de prétraitement H3-Context-IR et le module de suréchantillonnage H3-Regenerate-2K ; la diffusion s'effectue sous une licence communautaire maison assortie d'une procédure de demande pour les utilisateurs des États-Unis, de l'Union européenne, du Royaume-Uni et de Corée du Sud.

Loi / texte adopté

Californie : la loi sur la transparence de l'IA issue de SB 942 et AB 853 devient applicable le 2 août 2026

Le 2 août 2026, le California AI Transparency Act, adopté sous le numéro SB 942 puis modifié par la loi AB 853 signée le 13 octobre 2025, est devenu applicable, au lieu du 1er janvier 2026 prévu à l'origine. Selon le texte de SB 942, les fournisseurs couverts, soit les systèmes d'IA générative dépassant un million d'utilisateurs mensuels, doivent fournir gratuitement un outil de détection de contenus générés par IA, apposer une divulgation visible et intégrer une divulgation latente de provenance dans les images, vidéos et sons produits. AB 853 étend le dispositif : les grandes plateformes en ligne et les plateformes d'hébergement de systèmes d'IA générative seront soumises à des obligations de conservation et d'affichage des données de provenance au 1er janvier 2027, les fabricants d'appareils de capture au 1er janvier 2028. La loi est mise en œuvre par le procureur général de Californie, SB 942 prévoyant jusqu'à 5 000 dollars de pénalité civile par violation quotidienne.

Loi / texte adopté

AI Act : les obligations de transparence de l'article 50 et les pouvoirs de sanction entrent en application le 2 août

Le 2 août 2026, le règlement européen sur l'intelligence artificielle (règlement (UE) 2024/1689) est entré dans sa phase d'exécution. Les obligations de transparence de l'article 50 s'appliquent désormais : les chatbots doivent signaler à l'utilisateur qu'il dialogue avec une machine, les hypertrucages doivent être étiquetés et les contenus générés ou modifiés par IA doivent porter un marquage lisible par machine. À la même date, le Bureau européen de l'IA et les autorités nationales de surveillance ont acquis leurs pouvoirs d'exécution sur les fournisseurs de modèles d'IA à usage général : demande de documentation technique, évaluation des modèles, mesures correctives, retrait du marché et amendes pouvant atteindre 15 millions d'euros ou 3 % du chiffre d'affaires mondial. Les obligations relatives aux systèmes à haut risque de l'annexe III, initialement prévues à la même échéance, ont en revanche été reportées au 2 décembre 2027 par l'omnibus numérique entré en vigueur le 27 juillet 2026, celles de l'annexe I au 2 août 2028.

Nouveau modèle

OpenAI publie dix résultats mathématiques attribués à son modèle Astra, avec les preuves formelles vérifiables en Lean 4

Le 1er août 2026, OpenAI a mis en ligne un manuscrit de 249 pages intitulé « Ten advances in mathematics and theoretical computer science » et un dépôt GitHub public de preuves formelles associées. Le dépôt openai/ten-proofs contient les formalisations Lean 4, en chaîne d'outils 4.32.0 et sous licence Apache 2.0, de dix résultats, parmi lesquels des bornes de densité d'empilement de sphères en grande dimension, la construction d'un groupe non sofique, un contre-exemple à la conjecture de rigidité de Connes, la dureté d'approximation du problème du vecteur le plus proche et une borne superexponentielle sur les nombres de Ramsey multicolores. OpenAI attribue ces résultats à une version interne de son prochain modèle, Astra, qui n'est pas disponible publiquement, et déclare que les jetons consommés auraient coûté environ 2 000 dollars aux tarifs de son API, chiffre attesté par des reprises de presse convergentes et non par la page d'annonce, inaccessible. Les preuves sont vérifiables par machine, mais les travaux n'ont pas été relus par les pairs.

Tribune / opinion

Transparence des contenus générés par IA : la Commission annonce environ 190 signataires du code de bonnes pratiques

Le 31 juillet 2026, la Commission européenne a annoncé qu'environ 190 organisations avaient signé le code de bonnes pratiques sur la transparence des contenus générés par IA, publié le 10 juin 2026, la liste des signataires initiaux ayant été close le 27 juillet. La section destinée aux fournisseurs a notamment été signée par Aleph Alpha, Anthropic, Black Forest Labs, Cohere, Google, Meta, Microsoft, Mistral, OpenAI et Synthesia ; celle destinée aux déployeurs par Bulgari, Fastweb, Getty Images, Iberdrola, Lenovo et Lufthansa. Instrument volontaire sans valeur contraignante autonome, le code offre aux signataires une voie simplifiée et prévisible pour démontrer leur conformité aux obligations de marquage et d'étiquetage de l'article 50 du règlement sur l'IA, applicables depuis le 2 août 2026, sans se substituer au texte. Des groupes de travail entre signataires sont annoncés pour septembre 2026.

Droit d'auteur

Le tribunal régional de Munich juge en première instance que Suno contrefait les œuvres de la GEMA, tant à l'entraînement qu'en sortie

Le 31 juillet 2026, la 42e chambre civile du tribunal régional de Munich I a rendu son jugement dans l'affaire GEMA contre Suno, référencée 42 O 763/25, à l'issue d'une audience tenue le 9 mars 2026. Le tribunal retient que les œuvres protégées sont mémorisées dans le modèle du générateur de musique, ce qui constitue une reproduction non autorisée, et que la restitution de morceaux similaires aux utilisateurs porte atteinte au droit de communication au public. Il écarte la défense de Suno fondée sur le fair use et sur l'exception de fouille de textes et de données, prononce une injonction de cessation, une obligation d'information sur les revenus tirés des exploitations litigieuses et une déclaration de responsabilité pour dommages, dont le montant reste à fixer. Il s'agit d'un jugement de première instance, non définitif : Suno a annoncé étudier toutes les options, dont l'appel.

Résultats financiers

Amazon relève son objectif de capex 2026 à environ 220 milliards de dollars, en invoquant la hausse des prix de la mémoire

Le 30 juillet 2026, Amazon a publié ses résultats du deuxième trimestre : 200,6 milliards de dollars de ventes nettes, en hausse de 20 % sur un an, et un résultat opérationnel de 27,5 milliards, en progression de 43 %. AWS accélère à 37 % de croissance annuelle, sa plus forte progression depuis dix-huit trimestres, et le groupe a engagé 53,1 milliards de dollars de dépenses d'investissement sur le seul trimestre. Lors de la conférence avec les analystes, le directeur général Andy Jassy a indiqué viser environ 220 milliards de dollars de capex en numéraire pour 2026, contre environ 200 milliards précédemment, un relèvement qu'il a attribué à la hausse des prix de la mémoire, tout en indiquant que la capacité resterait insuffisante face à la demande. Cette guidance ne figure pas dans le communiqué de résultats, qui ne comporte pas d'objectif annuel de dépenses d'investissement.