Veille IA

Veille IA du mercredi 23 septembre 2026

61 brèves de veille IA publiées ce jour, sourcées et vérifiées. Sujets principaux : ONU, OpenAI, Google, GPT-5, Amazon.

61 brèves
Nouvelle fonctionnalité

Viettel AI hisse Nemotron 3 Super en tête du banc d'essai vietnamien VMLU et l'affecte à un agent juridique

Le 23 septembre 2026, NVIDIA a détaillé, à l'occasion de son AI Day à Singapour, l'adaptation de ses modèles ouverts Nemotron en Asie du Sud-Est. Au Vietnam, Viettel AI a spécialisé Nemotron 3 Super pour la langue vietnamienne et les usages agentiques : le modèle obtient le meilleur classement sur le banc d'essai VMLU et sur le banc interne de l'opérateur, et doit équiper Legal AI, un agent destiné aux salariés du groupe Viettel comme à ses clients externes. FPT Smart Cloud a codéveloppé Nemotron-Personas-Vietnam, jeu de données ouvert bâti sur des données démographiques et culturelles vietnamiennes. En Thaïlande, iApp Technology adapte Nemotron 3 Nano au droit thaïlandais pour son assistant Thanoy, qui revendique environ 43 000 utilisateurs.

Levée de fonds

Brahma AI lève 150 millions de dollars en actions de préférence, dont 100 millions apportés par le fonds indien Multiples

Le 23 septembre 2026, Brahma AI, éditeur d'un système d'exploitation pour les contenus audiovisuels d'entreprise, a annoncé une levée de 150 millions de dollars par émission d'actions de préférence, dont 100 millions investis par Multiples Alternate Asset Management. La société dit avoir reçu 100 millions de dollars supplémentaires de marques d'intérêt d'investisseurs. Fondée par Prabhu Narasimhan à partir des piles technologiques de DNEG, Metaphysic et Prime Focus Technologies, elle vise quatre secteurs : médias et divertissement, sport, santé et publicité. Ses clients de référence comprennent Warner Bros, la NBA et la Mayo Clinic, ses partenaires de distribution Google, Hakuhodo et DNEG. Les fonds financeront la recherche et développement, le déploiement commercial international et une implantation dans la Silicon Valley. Cantor Fitzgerald a agi comme seul agent placeur.

Nouveau produit / service

Sea Limited devient la première entreprise de l'ASEAN à adopter la plateforme NVIDIA Vera Rubin pour Shopee, Monee et Garena

Le 23 septembre 2026, NVIDIA a annoncé lors de son AI Day Singapore, tenu les 22 et 23 septembre au Raffles City Convention Centre, que le singapourien Sea Limited est la première entreprise de la zone ASEAN à adopter sa plateforme Vera Rubin. Le groupe, qui revendique des centaines de millions d'utilisateurs à travers Shopee, Monee et Garena, doit s'en servir pour développer et déployer à plus grande échelle ses modèles et ses agents. Sea applique déjà l'IA à la rédaction des fiches produits et à la recherche sur Shopee, à la détection de fraude et à l'évaluation du risque de crédit chez Monee, et à ses services de jeu chez Garena. NVIDIA a signalé au même événement les travaux de recherche de l'agence singapourienne HTX sur ses modèles ouverts Nemotron 3 Super et Nemotron 3 Nano Omni pour la sécurité publique, et l'adaptation de Nemotron 3 Super au vietnamien par Viettel AI, classé premier sur le banc VMLU.

Résultats financiers

Corée du Sud : Woori Financial finance le centre de données d'IA de Pohang, 40 mégawatts pour 600 milliards de wons

Le 23 septembre 2026, le groupe bancaire Woori Financial a annoncé la signature de l'accord de financement de projet du « Pohang AI Factory Data Center », implanté dans le parc industriel de Gwangmyeong, à Ocheon-eup, dans l'arrondissement sud de Pohang. Le chantier représente 600 milliards de wons, dont 150 milliards de fonds propres et 450 milliards de prêt de projet, pour une capacité de raccordement électrique de 40 mégawatts et une charge informatique de 32 mégawatts. La livraison est visée pour la fin de 2027. Woori Bank co-arrange le financement avec KB Kookmin Bank et joue le rôle de banque agent, Hyundai E&C construit le site avec un engagement d'achèvement. NHN Cloud a pris un engagement de location anticipée sur 16 mégawatts, soit la moitié de la charge informatique, et exploitera le centre après sa mise en service.

Conférence / salon

Devant l'Assemblée générale de l'ONU, Lee Jae-myung annonce un « hub mondial de l'IA » et une « société mondiale de base fondée sur l'IA »

Le 22 septembre 2026, à la tribune de la 81e Assemblée générale des Nations unies à New York, le président sud-coréen Lee Jae-myung a présenté les trois volets de sa « K-Initiative » : une « société mondiale de base fondée sur l'IA », une grande transition verte baptisée K-GX et une solidarité sur les chaînes d'approvisionnement énergétiques. Il a annoncé la création d'un « hub mondial de l'IA », plateforme destinée à faire coopérer organisations internationales, banques multilatérales de développement, industrie et université. En interne, Séoul commence par une « IA médicale de base » avant d'étendre la démarche à la protection sociale, au travail, au logement et à la culture, en rattachant l'ensemble aux objectifs de développement durable de l'ONU et aux droits économiques, sociaux et culturels. Le comité de pilotage de ce hub avait été installé la veille, pour une ouverture visée en 2027.

Décision d'autorité (CNIL, CE…)

Seattle interdit par sept voix contre deux la tarification alimentaire fondée sur l'analyse automatisée des données personnelles

Le 22 septembre 2026, le conseil municipal de Seattle a adopté par sept voix contre deux le projet CB 121267, qui ajoute au code municipal un chapitre 7.35 intitulé « Fair Pricing and Transparency ». Le texte interdit aux distributeurs alimentaires visés de modifier le prix d'un bien en fonction du suivi, du pistage ou de l'analyse automatisée du comportement, de la localisation, des caractéristiques démographiques, des données biométriques ou d'autres informations personnelles d'un client, et leur interdit d'afficher un tel prix sur une étiquette électronique de rayon. Sont concernées les enseignes d'au moins vingt magasins dans le monde et les plateformes de livraison d’au moins cent salariés. Les sanctions civiles montent à 3 000 dollars par personne lésée et 10 000 dollars par récidive, plafonnées à un million de dollars par action. Le chapitre entre en vigueur le 1er septembre 2027.

Plan / stratégie nationale

La TD investit jusqu'à 25 millions de dollars canadiens dans une collaboration stratégique avec Cohere pour l'adoption de l'IA

Le 22 septembre 2026, le groupe bancaire canadien TD a annoncé un investissement initial pouvant atteindre 25 millions de dollars sur trois ans dans une collaboration stratégique avec Cohere, entreprise d'IA souveraine basée au Canada. L'accord associe Layer 6, le laboratoire de recherche en IA de TD acquis en 2018, et une équipe dédiée de Cohere installée au MaRS Discovery District de Toronto, pour explorer des usages concrets de l'IA au sein de la banque : gestion des connaissances, productivité et expérience client. Rizwan Khalfan, vice-président exécutif de TD, dit vouloir connecter le talent et la recherche canadiens à des applications pratiques. François Chadwick, directeur financier de Cohere, évoque une collaboration pour renforcer productivité et expérience client de manière sécurisée. L'annonce s'inscrit dans l'engagement de 150 milliards de dollars sur cinq ans pris par TD début septembre pour l'investissement au Canada.

Nouveau modèle

OpenAI lance GPT-6 Sol et Luna et divise par deux leurs tarifs API, à 2 et 0,10 dollar le million de jetons d'entrée

Le 22 septembre 2026, OpenAI a mis en ligne GPT-6 Sol et GPT-6 Luna, deux modèles entraînés avec des méthodes voisines de GPT-6 Astra mais orientés vers le coût. Les tarifs API baissent de 50 % par rapport au prix promotionnel de la génération GPT-5.6 : Sol passe de 4 à 2 dollars le million de jetons d'entrée et de 20 à 10 dollars en sortie, Luna de 0,20 à 0,10 dollar en entrée et de 1,20 à 0,50 dollar en sortie. Sur AutomationBench 1.0.6, banc de flux de travail d'entreprise de Zapier, Sol à effort xhigh obtient 33,2 % pour 0,27 dollar par tâche ; sur OSWorld 2.0 hors ligne, il atteint 60,5 % contre 60,3 % à Claude Opus 5 en effort moyen. OpenAI dit aussi avoir relevé par défaut le taux de succès du cache de prompt sur GPT-6, les lectures de jetons d'entrée mis en cache restant facturées 90 % de moins ; GitHub indique avoir réduit de plus de moitié la part de jetons de prompt retraités à neuf. Les deux modèles arrivent dans ChatGPT Work et Codex pour les offres Plus, Pro, Business, Enterprise et Edu, Luna étant ouvert aux comptes Free et Go dans l'application de bureau, et sont exposés dans l'API sous les identifiants gpt-6-sol et gpt-6-luna. Ils ne sont pas encore proposés dans Chat.

Nouveau produit / service

AWS ouvre le jour même Amazon Bedrock à Claude Opus 5.5 et aux GPT-6 Sol et Luna

Le 22 septembre 2026, AWS a publié deux billets qui ouvrent Amazon Bedrock aux trois modèles sortis le jour même par Anthropic et OpenAI. GPT-6 Sol et GPT-6 Luna y passent en disponibilité générale, avec cache de prompt explicite et des tarifs d'API qu'AWS dit nettement inférieurs à ceux des GPT-5.6, sans les chiffrer. Claude Opus 5.5, accessible dès le même jour, est servi par les profils d'inférence États-Unis, Union européenne, Australie, Japon et Global, par les régions us-east-1 et ap-southeast-4 sur bedrock-mantle, et par Claude Platform on AWS en Amérique du Nord. Pour Sol et Luna, AWS précise que l'inférence tourne sur une infrastructure isolée matériellement, sans accès de ses opérateurs aux requêtes des clients, et que le trafic signalé par les classificateurs anti-abus est conservé jusqu'à 30 jours.

Nouveau produit / service

AWS ajoute à Strands Evals et Bedrock AgentCore trois évaluateurs qui notent l'usage des skills par les agents

Le 22 septembre 2026, AWS a décrit trois évaluateurs ajoutés au SDK Strands Evals et à AgentCore Evaluations, une capacité d'Amazon Bedrock AgentCore, pour mesurer la façon dont un agent se sert de ses skills, ces procédures réutilisables rangées dans un fichier SKILL.md. Skill Selection Accuracy rend un résultat binaire par skill invoquée. Skill Instruction Following note à cinq niveaux le respect des étapes prescrites, de Not Followed à Fully Followed, et passe à partir de 0,75. Skill Invoked, déterministe et propre à Strands Evals, vérifie sans appel de modèle qu'une skill nommée a bien été chargée. L'extraction reconnaît les signaux du plugin Strands AgentSkills, de Claude Code, du Claude Agent SDK, de l'OpenAI Agents SDK, de Codex, de Gemini CLI, d'OpenHands et de Google ADK, ainsi que la simple lecture d'un fichier SKILL.md.

Nouveau produit / service

Qualcomm lance deux plates-formes Snapdragon 8 Elite Gen 6 gravées en 2 nanomètres, centrées sur les agents d'IA embarqués

Le 22 septembre 2026, au Snapdragon Summit, Qualcomm Technologies a présenté deux plates-formes mobiles haut de gamme, Snapdragon 8 Elite Extreme Gen 6 et Snapdragon 8 Elite Gen 6, bâties sur le même nœud de gravure 2 nanomètres. Les deux associent un processeur Oryon conçu en interne, un GPU Adreno réarchitecturé et un NPU Hexagon, et visent des agents qui s'exécutent sur l'appareil. Le catalogue introduit Adreno Neural Fusion, qui applique l'IA au rendu graphique des jeux, ainsi que le support Advanced Professional Video et une fonction Intelligent Pixel Control pour la photo et la vidéo. Chris Patrick, vice-président senior chargé des combinés, décrit cette double annonce comme une stratégie de plusieurs vaisseaux amiraux. Les premiers terminaux viendront de HONOR, iQOO, Motorola, OnePlus, OPPO, REDMI, RedMagic, vivo et Xiaomi.

Nouveau modèle

Anthropic sort Claude Opus 5.5, facturé 4 et 20 dollars le million de jetons et présenté comme 40 % moins cher à l'usage qu'Opus 5

Le 22 septembre 2026, Anthropic a publié Claude Opus 5.5, premier modèle de sa famille 5.5, qu'il situe au niveau de Claude Fable 5.1 sur la plupart des tâches. L'entrée et la sortie sont facturées 4 et 20 dollars le million de jetons, soit 20 % de moins qu'Opus 5, les lectures de cache tombent à 0,20 dollar le million, soit 60 % de moins, et la génération est annoncée plus de 30 % plus rapide ; Anthropic chiffre à 40 % la baisse du coût sur des charges typiques. Un mode rapide jusqu'à 2,5 fois plus véloce est proposé à 8 et 40 dollars le million de jetons. Sur FrontierCode v1.1, le modèle marque 54,6 % à effort par défaut contre 53,3 % au meilleur score de GPT-6 Astra ; sur CursorBench, 52,5 % contre 51,8 % à Fable 5.1 et 46,6 % à Opus 5. Anthropic le présente comme sa première sortie depuis son appel à ralentir la course à la frontière, et dit l'avoir fait tester avant publication par des évaluateurs externes dont Frontier Design et METR. Jugé comparable à Claude Mythos 5.1 en biologie et en cybersécurité, il est déployé avec des garde-fous similaires à ceux de Fable 5.1. Claude Sonnet 5.5 et Claude Haiku 5.5 suivront dans les semaines à venir.

Nouvelle fonctionnalité

Meta teste un « concierge humain » qui passe à la place de son agent Muse certains appels téléphoniques

Le 22 septembre 2026, Reuters a révélé, sur la foi de messages internes consultés par l'agence, que Meta teste un « concierge humain » pour son assistant Muse : des sous-traitants formés passent eux-mêmes certains appels téléphoniques demandés à l'agent. La fonction, également désignée comme « appels par agent humain », a été activée la semaine précédente pour la moitié des salariés de Meta, avec un groupe de retrait pour ceux qui n'en voulaient pas. Des employés ont fait part de craintes sur le partage involontaire d'informations sensibles avec des centres d'appels. Le porte-parole Daniel Roberts déclare que le test sert à recueillir des retours avant tout déploiement public et que la fonction ne sortira qu'avec « les mentions d'information appropriées ». Deux semaines après son lancement, Muse revendique plus de 2,5 millions de téléchargements aux États-Unis selon Sensor Tower.

Nouveau produit / service

Colorado Springs fait décrocher ses appels non urgents par S.A.R.A.H., agent d'IA d'Axon, et garde le 911 aux opérateurs humains

Le 22 septembre 2026, la police de Colorado Springs a annoncé que son centre d'appels de sécurité publique fait désormais répondre en premier les appels non urgents par S.A.R.A.H., un agent conversationnel d'intelligence artificielle. La ville indique sur sa page officielle avoir mis en service en juin 2026 le logiciel « Prepared by Axon », qui transcrit les appels, traduit les échanges en temps réel dans plus de 70 langues, produit des résumés actualisés au fil de la conversation et aide à traiter les appels non urgents adressés à la police et aux pompiers. Ces appels représentent près de la moitié du volume reçu par le centre. Les appels au 911 restent décrochés par des opérateurs formés, l'outil ne déterminant pas la réponse à apporter. Selon la station locale KRDO, S.A.R.A.H. a mené seule la moitié des appels non urgents lors d'un test de 54 heures.

Conférence / salon

Vingt-trois États lancent à l'ONU le plan d'action 2026-2027 de la coalition sur l'IA et les droits de l'enfance

Le 22 septembre 2026 à New York, la « Coalition pour les droits et la protection de l'enfance à l'ère de l'IA » a présenté son plan d'action 2026-2027, en marge de la 81e Assemblée générale de l'ONU. Coprésidée par la France, l'Espagne, le Kenya et l'Australie, lancée le 7 juillet 2026 au premier dialogue mondial de l'ONU sur la gouvernance de l'IA, elle réunit 23 États et huit entités onusiennes, dont l'UNESCO et l'UNICEF. La feuille de route pose que les systèmes d'IA censés bénéficier aux enfants devraient à terme être soumis à une autorisation préalable de mise sur le marché. Emmanuel Macron y déclare que l'IA « ne doit pas être mise à la disposition des enfants sans avoir été préalablement testée, évaluée et, par conséquent, autorisée ». Les premiers engagements volontaires seront présentés au Forum de Paris pour la paix, les 10 et 11 novembre 2026.

Levée de fonds

Carvolix dépose auprès de la FDA le dossier 510(k) de son robot TAVIPILOT après 10 procédures réussies sur 10

Le 22 septembre 2026, Carvolix a annoncé le dépôt auprès de la FDA américaine du dossier 510(k) pour son robot TAVIPILOT, dédié au remplacement de valve aortique par cathéter. Ce dépôt s'appuie sur l'étude clinique ROTAO1, désormais achevée, dans laquelle le robot a fonctionné avec succès lors des 10 premières procédures réalisées chez l'homme. L'étude SAIRO, en cours, évalue l'usage combiné du robot et du logiciel TAVIPILOT et a déjà traité 7 patients avec succès. Le logiciel TAVIPILOT, guidage per-procédural en temps réel piloté par intelligence artificielle, avait déjà obtenu l'autorisation 510(k) de la FDA en juillet 2025 et est commercialisé aux Etats-Unis ; l'autorisation du robot doit permettre le lancement commercial de la plateforme complète début 2027, porté par l'évolution des règles de remboursement du Center for Medicare & Medicaid Services.

Nouveau produit / service

Trane ramène de 20 minutes à 20 secondes un diagnostic de bâtiment avec un agent d'IA bâti sur Amazon Bedrock AgentCore

Le 22 septembre 2026, AWS a détaillé sur son blog Machine Learning l'agent conversationnel construit par Trane Technologies sur Amazon Bedrock AgentCore et le cadre Strands. Le fabricant, qui déclare plus de 21 milliards de dollars de chiffre d'affaires annuel et des activités dans plus de 100 pays, pilote des millions d'équipements de chauffage, ventilation et climatisation raccordés à sa plateforme Trane Cloud. L'agent est découpé en cinq assistants spécialisés, chacun gouverné par son propre prompt système et déployé en infrastructure as code avec AWS CDK. Selon les mesures internes conduites avec des techniciens pendant plusieurs semaines, une question opérationnelle qui demandait vingt minutes de navigation entre tableaux de bord se règle en vingt secondes de dialogue en langage naturel, soit un facteur 60. Les équipes de Trane ont monté la solution en trois à quatre semaines.

Levée de fonds

Cognex rachète RealSense pour environ 500 millions de dollars en numéraire et entre dans la perception robotique 3D

Le 22 septembre 2026, Cognex a annoncé un accord définitif pour acquérir RealSense, fabricant de caméras de profondeur pour la robotique, contre environ 500 millions de dollars financés intégralement sur sa trésorerie et ses placements. Fondée par Intel en 2014 et essaimée en 2025, RealSense doit dégager 80 à 90 millions de dollars de chiffre d'affaires en 2026, soit plus de 50 % de croissance sur un an. Cognex y ajoute un programme de rétention en numéraire de 56,5 millions de dollars sur trois ans et des actions gratuites évaluées à environ 50 millions de dollars. Avant la clôture, attendue au quatrième trimestre 2026, RealSense essaimera sa ligne d'authentification faciale dans une société indépendante. Cognex chiffre à 600 millions de dollars le marché actuel de la perception robotique, attendu à environ 1,6 milliard en 2030.

Acquisition / rachat

Microsoft démantèle EvilTokens, service cybercriminel à agent conversationnel lié à 12 000 boîtes de messagerie compromises

Le 22 septembre 2026, Microsoft a annoncé le démantèlement d'EvilTokens, plateforme cybercriminelle vendue sur Telegram 1 500 dollars de droit d'entrée puis 500 dollars d'abonnement récurrent. Lancée en février 2026, elle a été reliée à plus de 12 000 boîtes de messagerie compromises dans plus de 10 000 organisations, les concentrations de victimes les plus fortes se trouvant aux États-Unis, au Canada, au Royaume-Uni, en Australie, en Inde et en France. Son agent conversationnel analysait les messageries piratées pour repérer les circuits de paiement, cartographier les rôles et désigner les personnes à usurper. Microsoft et le coplaignant Health-ISAC ont obtenu du tribunal fédéral du district est de Virginie la saisie de 50 sites et la neutralisation de plus de 150 domaines. La police métropolitaine de Londres a arrêté le 11 septembre deux hommes de 32 et 38 ans. Il s'agit de la 40e action judiciaire de la Digital Crimes Unit de Microsoft.

Projet de loi / consultation

Le Maryland publie un cadre de régulation de l'IA et prépare des règles sur les modèles de frontière, avec déclaration d'incident sous 72 heures

Le 22 septembre 2026, le gouverneur du Maryland Wes Moore a présenté un cadre de principes pour la régulation de l'intelligence artificielle, articulé autour de la protection des habitants, de la place des salariés et de la sécurité des enfants. Le sous-cabinet IA de l'État est chargé de préparer des recommandations législatives visant les entreprises de modèles de frontière : cadres de sûreté et tests, audits et évaluations indépendants par des tiers, protection des lanceurs d'alerte, publication de résultats et déclaration des incidents sous 72 heures. Le texte annonce aussi un droit de la personnalité inscrit dans la loi, l'interdiction des outils algorithmiques discriminatoires de sélection des locataires dans les logements financés par l'État, une interdiction des plateformes de tarification partagée des loyers entre bailleurs et des restrictions sur le ciblage algorithmique des joueurs à risque. Le Maryland avait déjà adopté en 2024 un Artificial Intelligence Governance Act.

Nouveau modèle

Together AI détaille ses déploiements canari sur l'inférence dédiée : une barrière stoppe une régression de 137 %

Le 22 septembre 2026, Together AI a publié le fonctionnement de ses rollouts, qui basculent le trafic de production d'un modèle vers un autre sur un même point d'accès d'inférence dédiée. Trois stratégies coexistent : le canari par paliers de trafic, dont l'échelle par défaut monte à 5, 25, 50 puis 100 %, le bleu-vert en un seul palier, et le remplacement réplique par réplique. Chaque palier enchaîne la montée en charge de la cible, un contrôle de santé avant bascule, puis le drainage de la source. Dans la démonstration publiée, le passage de Qwen2.5-7B à Qwen3.5-9B a été arrêté à 10 % du trafic par une barrière sur la latence au 95e centile, qui a mesuré une dégradation de 137 %, sans aucune requête perdue. L'outil tg est livré dans le paquet Python together depuis la version 2.34.0, mise en ligne le 15 septembre.

Vidéo / podcast / replay

Devant l'Assemblée générale de l'ONU, Donald Trump veut rebaptiser l'IA « superintelligence » et déclare que « celui qui gagne la superintelligence gagne »

Le 22 septembre 2026, au débat général de la 81e session de l'Assemblée générale des Nations unies, Donald Trump a consacré une partie de son discours à l'intelligence artificielle, qu'il a proposé d'appeler « superintelligence ». « L'emploi du mot artificielle rend l'intelligence fausse. Elle n'est pas fausse, elle est formidable », a-t-il dit, avant d'ajouter : « Celui qui gagne la superintelligence gagne. » Le président a indiqué que les États-Unis encourageraient le développement de la technologie tout en surveillant ses risques. Il a par ailleurs attaqué la Cour pénale internationale, le Conseil des droits de l'homme, l'UNESCO et l'Organisation maritime internationale, estimant que les organisations internationales ne doivent pas promouvoir de gouvernance mondiale. Au 23 septembre, aucun décret ni mémorandum présidentiel entérinant ce changement de vocabulaire ne figurait ni au Federal Register ni parmi les actes présidentiels publiés sur whitehouse.gov.

Levée de fonds

Nexstrom lève 12 millions de dollars pour industrialiser des wafers 2D de 12 pouces destinés aux puces d'IA

Le 22 septembre 2026, la société singapourienne Nexstrom a annoncé un tour d'amorçage de 12 millions de dollars mené par Xora Innovation, avec Foothill Ventures et SEEDS. Le financement porte à 15 millions de dollars le capital total réuni depuis la création de l'entreprise en 2024, dont 3 millions de fonds non dilutifs. Nexstrom développe une plateforme destinée à faire croître des matériaux semi-conducteurs bidimensionnels monocristallins sur des plaques de 12 pouces, en s'appuyant sur un dépôt chimique en phase vapeur intégré aux chaînes de fabrication existantes des fondeurs. La société vise les charges d'IA et de calcul haute performance, pour lesquelles la réduction des canaux de silicium se heurte aux fuites d'électrons. Son cofondateur et directeur scientifique Lance Li a dirigé les recherches de TSMC sur l'électronique post-silicium et travaille sur la croissance de disulfure de molybdène monocristallin depuis 2012.

Levée de fonds

Snorkel AI lève 350 millions de dollars en série E et porte sa valorisation à 3,5 milliards

Le 22 septembre 2026, Snorkel AI a annoncé sur son blog un financement de série E de 350 millions de dollars, mené par Insight et S32, qui valorise l'entreprise à 3,5 milliards de dollars. Third Point, March, Blumberg, Allegis, Standard VC et Frontline participent au tour, aux côtés des investisseurs déjà présents Addition, Lightspeed, Greylock, GV, P7, Wells Fargo, Walden Catalyst Ventures et Factory. La société, née voici dix ans d'un projet de recherche à Stanford, dit compter parmi ses clients des laboratoires de frontière, des hyperscalers, des entreprises et des agences du gouvernement américain. Elle indique une croissance de plus de 18 fois depuis le lancement de son offre de données en service il y a près d'un an et avoir franchi cette semaine un revenu annualisé de 375 millions de dollars.

Nouveau produit / service

Palo Alto Networks lance Unit 42 Continuous Frontier AI Defense, sécurité offensive continue avec Claude Mythos et GPT-5.6-Cyber

Le 22 septembre 2026 à Santa Clara, Palo Alto Networks a lancé Unit 42 Continuous Frontier AI Defense, un abonnement qui teste en continu l'exposition des entreprises avec des modèles à capacité restreinte, dont Claude Mythos 5 d'Anthropic et GPT-5.6-Cyber d'OpenAI. L'entreprise affirme que les attaquants compressent désormais les cycles de violation de près de 97 %, de plusieurs semaines à quelques heures. Le service s'appuie sur un harnais multi-modèles qui répartit chaque tâche vers le modèle le plus adapté, et prolonge Frontier AI Defense, lancé en avril. En interne, Palo Alto Networks dit avoir détecté en trois semaines l'équivalent d'un an d'expositions, et son analyse Frontier AI a relevé des failles chez 100 % de ses clients testés, dont 37 % jugées de sévérité haute ou critique. Sam Rubin, vice-président senior d'Unit 42, évoque un avantage asymétrique pour des défenseurs qui opèrent à vitesse humaine.

Tribune / opinion

Guterres ouvre le débat général de l'ONU en réclamant un cadre multilatéral de gestion des risques de l'IA à supervision indépendante

Le 22 septembre 2026, à l'ouverture du débat général de la 81e session et à cent jours environ de la fin de son mandat, le secrétaire général des Nations unies António Guterres a rangé l'intelligence artificielle parmi quatre « épreuves du pouvoir », avec la guerre, les inégalités et le climat. Il a décrit un pouvoir concentré dans les données, le calcul et les algorithmes, qui avance plus vite que la capacité de l'humanité à le gouverner. « Le danger n'est pas la technologie, le danger est la technologie sans responsabilité », a-t-il déclaré, en appelant à un cadre multilatéral de gestion des risques de l'IA doté d'une supervision indépendante. Il a ajouté que les enfants ne doivent pas servir de cobayes à des systèmes non régulés, que « les décisions de vie ou de mort ne doivent jamais être confiées à des machines », les robots tueurs n'ayant « aucune place dans notre avenir ».

Tribune / opinion

Le président de l'Assemblée générale de l'ONU réclame des garde-fous « prudents et fiables » sur l'IA, contre une course aux armements

Le 22 septembre 2026, à l'ouverture du débat général de la 81e session, le président de l'Assemblée générale des Nations unies Khalilur Rahman a placé l'intelligence artificielle parmi les chantiers sur lesquels l'organisation risque de décrocher. Il a relevé que l'IA est déjà intégrée à des systèmes critiques dans le monde entier et a demandé des garde-fous « prudents et fiables », élaborés avec un apport scientifique venu de l'extérieur des gouvernements. « Nous ne pouvons pas laisser une course aux armements pour le contrôle de l'IA nous précipiter dans le vide », a-t-il déclaré. Il a aussi plaidé pour une plus grande participation des entreprises, des scientifiques et de la société civile aux décisions de l'ONU, en particulier sur l'IA. Il a chiffré à environ 175 milliards de dollars l'aide au développement, en recul de 23 % sur un an, face à des dépenses militaires mondiales proches de 3 000 milliards.

Avancée méthodologique

Annals of Family Medicine : une IA de super-résolution fait passer de 87,6 % à 94,8 % la détection des plaques carotidiennes en échographie portable

Annals of Family Medicine a publié le 22 septembre 2026 une étude selon laquelle un modèle d'IA de super-résolution appliqué aux images d'échographes de poche améliore la détection des plaques carotidiennes en dépistage communautaire. Le modèle Hyper-CycleGAN, construit par des chercheurs de l'hôpital central affilié de Changsha, université de Chine du Sud, et de l'Institut polytechnique de Macao, ne pose pas de diagnostic : il affine l'image exportée pour rendre lisible la limite entre la plaque et la lumière artérielle. Testé d'abord sur 127 patients hospitaliers, il a été appliqué au dépistage de 450 adultes de 40 ans et plus dans sept quartiers ; 117 participants porteurs de 153 plaques ont été retenus. Les images traitées montrent 145 des 153 plaques, soit 94,8 %, contre 134 sur 153, soit 87,6 %, sans traitement. Le repérage correct des plaques d'aspect instable passe de 47,4 % à 63,2 %.

Puce / GPU / matériel

NVIDIA publie Isaac ROS 5.0 à la ROSCon de Toronto : support de ROS Lyrical et inférence FoundationPose 5,5 fois plus rapide

Le 22 septembre 2026, NVIDIA a publié Isaac ROS 5.0 à la conférence ROSCon de Toronto, une collection de paquets accélérés par GPU bâtie sur le cadre robotique ouvert ROS, qui compte près de 1,3 million d'utilisateurs. La version ajoute la prise en charge de ROS Lyrical et d'Ubuntu 24.04, ainsi qu'une interface standard de manipulation des données contribuée à ROS Lyrical avec l'Open Source Robotics Alliance, pour faire circuler les données entre matériels de calcul, GPU compris. FoundationPose, le modèle de fondation d'estimation et de suivi de pose d'objets, dispose désormais d'une bibliothèque d'inférence exploitable par un agent, annoncée jusqu'à 5,5 fois plus rapide. NVIDIA ajoute des compétences réutilisables par les agents de développement, dont le réglage fin du modèle stéréo FoundationStereo et le cycle de prise et dépose isolé en compétence autonome. Isaac ROS 5.0 va des cartes Jetson Orin Nano aux Jetson Thor.

Collaboration recherche-industrie

Cisco Talos ouvre CAIRN, boîte à outils pour traquer les logiciels malveillants intégrant l'IA, et documente le premier implant autonome

Le 22 septembre 2026, Cisco Talos a publié sur GitHub CAIRN (Cognitive Artifact Intelligence Research Network), une boîte à outils de recherche open source pour repérer, classer et suivre les logiciels malveillants qui intègrent l'IA. L'outil fonctionne en architecture « metadata-first » : il n'a besoin ni de télécharger ni d'exécuter le binaire, mais extrait jusqu'à 24 filtres d'artefacts (invites intégrées, points de terminaison de fournisseurs, préfixes de clés API, termes de contournement) classés par une ontologie YARA à trois niveaux, du primitif à l'attribution de famille. La publication s'accompagne d'une première découverte, CLOSEDQUORUM, décrit par Talos comme le premier implant Windows documenté publiquement à déléguer ses décisions de commandement et de contrôle à un panel de plusieurs grands modèles de langage commerciaux qui statuent par consensus, sans opérateur humain. Le signalement le plus ancien de logiciel malveillant intégrant l'IA remonte à juillet 2025, avec des échantillons comme LAMEHUG.

Levée de fonds

Go.AI lève 85 millions de dollars en série A pour son infrastructure d'IA sur site destinée aux secteurs régulés

Le 22 septembre 2026, Go.AI a annoncé depuis Chicago une série A de 85 millions de dollars menée par Updata Partners, avec les investisseurs déjà présents GFT Ventures et LAUNCH. Le tour porte à 90 millions de dollars le total levé par cette société qui vend aux banques, aux coopératives de crédit, à la santé, à l'aéronautique de défense et à l'industrie une infrastructure d'IA déployée sur site, dans l'environnement du client et sans transmission de données à un tiers, facturée à prix fixe et non au jeton. Go.AI, rebaptisée ce mois-ci après s'être appelée Go Abacus, revendique plus de 200 clients, un revenu récurrent annuel multiplié par plus de huit en un an, une activité rentable et plus de 12,5 millions de requêtes traitées par jour. Elle compte plus de 50 salariés.

Baromètre / sondage

Sondage Reuters/Ipsos : 73 % des Américains jugent que les entreprises d'IA n'en font pas assez contre les dommages graves

Reuters a publié le 22 septembre 2026 un sondage Reuters/Ipsos selon lequel 73 % des Américains estiment que les entreprises d'intelligence artificielle ne sont pas allées assez loin pour empêcher la technologie de causer des dommages graves à la société. L'enquête a été menée en ligne sur quatre jours, jusqu'au 20 septembre, auprès de 1 277 adultes américains, avec une marge d'erreur de 3 points. Elle mesure à 39 % la part des personnes qui jugent l'effet de l'IA négatif sur la société, contre 36 % en août et le niveau le plus élevé depuis la première mesure en mars ; 11 % la jugent positive. Interrogés sur les priorités, 73 % placent un développement sûr et responsable devant le maintien de l'avance américaine, retenu par 23 %. Enfin, 55 % jugeraient bon de ralentir le développement de l'IA, contre 13 % d'un avis contraire.

Nouveau modèle

inclusionAI publie sous licence MIT Ming-Image-0.1-Design, deux modèles de 6 milliards de paramètres pour le design graphique et les calques

Le 22 septembre 2026, le collectif inclusionAI a mis en ligne sur Hugging Face le paquet de sortie de Ming-Image-0.1-Design, série ouverte sous licence MIT composée de deux modèles de 6 milliards de paramètres. Le premier génère des compositions complètes destinées aux interfaces, aux infographies et aux affiches riches en texte, avec sortie RGBA à fond transparent. Le second, Ming-Image-0.1-Design-Layer, décompose une image de design aplatie en un nombre demandé de calques transparents modifiables. Le dépôt avait été créé le 17 septembre, avec un premier envoi du modèle le même jour, et a reçu son paquet de sortie le 22. La configuration validée par l'éditeur demande un GPU de 80 Go de mémoire en BF16, avec 12 pas d'échantillonnage, une résolution recommandée de 2 048 pixels de côté en génération d'image et de 1 024 pixels en décomposition en calques. Le code d'inférence est distribué dans le dépôt GitHub inclusionAI/Ming-Image.

Tribune / opinion

À Shanghai, Li Qiang demande d'approfondir « l'IA + fabrication » et des plateformes de services pour la modernisation des PME

Le 22 septembre 2026, le premier ministre chinois Li Qiang a visité à Shanghai la base nationale de validation des applications d'intelligence artificielle de Shanghai Electric : robots spécialisés et industriels, atelier pilote d'assemblage et de réglage de robots intelligents, projets d'« usines natives de l'IA » et d'intégrateurs de services « IA+ ». Selon le compte rendu de l'agence Chine nouvelle, il a demandé de « faire avancer en profondeur l'IA + fabrication », de combiner les atouts manufacturiers et numériques du pays, de rendre intelligents les processus de recherche, de production et de gestion, et d'activer le potentiel des données. Il a demandé la création de nouvelles plateformes de services de production centrées sur le design industriel, la validation à l'échelle pilote et la maintenance intelligente, pour que les entreprises, « en particulier les PME », modernisent leurs lignes à plus bas coût.

Conférence / salon

Andy Burnham annonce en marge de l'ONU un partenariat de défense britannique et américain sur l'IA et l'autonomie

Le 22 septembre 2026, Downing Street a annoncé, alors que le premier ministre Andy Burnham partait pour l'Assemblée générale des Nations unies, un partenariat « IA et autonomie » entre la Rapid AI Delivery Taskforce du ministère britannique de la Défense et le Chief Digital and Artificial Intelligence Office du Department of War américain. Le communiqué le présente comme un moyen de protéger les infrastructures critiques et de détecter les menaces par l'IA. Le même texte annonce le premier tir d'une torpille lourde américaine depuis Excalibur, drone sous-marin de douze mètres construit à Plymouth, réalisé la semaine précédente dans les eaux britanniques au titre d'AUKUS. Burnham y confirme que le sommet des dirigeants du G20 présidé par Londres se tiendra à Manchester en novembre 2027, avec l'IA à l'ordre du jour. Le Royaume-Uni prendra la présidence du G20 après le sommet de Miami en décembre.

Avancée méthodologique

Godelblock présente FatigueNet, modèle d'IA qui évalue en 15 secondes la fatigue de 40 géométries d'arbres en acier

Le 22 septembre 2026, l'éditeur japonais Godelblock a détaillé FatigueNet, modèle de substitution par apprentissage profond qui prédit noeud par noeud la durée de vie en fatigue d'arbres en acier tridimensionnels, présenté du 23 au 26 août au congrès IDETC-CIE 2026 de l'American Society of Mechanical Engineers, à Houston. Le réseau travaille sur des maillages non structurés et prend en entrée, par noeud, coordonnées spatiales, normale, courbure locale et distance aux discontinuités de forme. Sur 40 géométries absentes de l'entraînement, la prédiction a demandé environ 15 secondes, contre environ une minute par géométrie en analyse par éléments finis, soit 40 minutes. Au noeud de durée de vie minimale, les valeurs prédites restent dans un facteur deux des valeurs de référence. Le modèle se limite à un acier homogène isotrope. Le jeu de données d'éléments finis et le code sont publics sur Hugging Face et GitHub.

Concours / challenge / hackathon

Dassault Aviation teste en vol sur Rafale deux algorithmes souverains d'IA, dont un développé avec Thales et cortAIx

Le 22 septembre 2026, Dassault Aviation a annoncé depuis Saint-Cloud avoir testé en vol sur Rafale deux nouveaux algorithmes souverains d'intelligence artificielle. Le premier a été développé par les ingénieurs de l'avionneur, le second en collaboration avec Thales et cortAIx. Le groupe décrit ces fonctions comme une IA « maîtrisée et supervisée au service de l'équipage humain » intégrée au cockpit, et les juge assez matures pour être éligibles aux prochaines évolutions du Rafale. Dassault Aviation cite trois contraintes propres à l'aéronautique militaire : la disponibilité et la qualité des données opérationnelles, réelles ou simulées, la capitalisation des expertises métier et la frugalité des ressources sur une plate-forme embarquée. L'avionneur a réalisé 7,4 milliards d'euros de chiffre d'affaires en 2025 avec environ 15 000 salariés.

Plan / stratégie nationale

Impulsion IA 2027 : le ministre du Travail détaille 12 mesures et 80 millions d'euros de financements nouveaux

Le 22 septembre 2026, le ministre du Travail et des Solidarités Jean-Pierre Farandou a présenté les 12 mesures du plan « Impulsion IA 2027 », doté selon l'AFP de 80 millions d'euros de financements nouveaux. Déclinaison pour l'emploi du plan « Osez l'IA » lancé à l'été 2025, il prévoit une plateforme gratuite d'auto-évaluation, Explore IA, et une seconde plateforme dédiée aux apprentis. Les demandeurs d'emploi passeront via France Travail un test de « maturité » en IA débouchant sur un parcours personnalisé, et la réforme du compte personnel de formation érigera l'IA en priorité nationale. Des « task forces entreprises » cibleront les PME, un observatoire de l'impact de l'IA sera créé et de nouvelles méthodes de dialogue social technologique seront expérimentées dans une vingtaine d'entreprises et de branches avec l'appui de l'Anact. Un fonds national pour les centres de formation d'apprentis figurera dans le projet de loi de finances 2027.

Décision d'autorité (CNIL, CE…)

L'AI Security Institute britannique verse ses résultats d'évaluation sur la plateforme ouverte EvalEval, cinq bancs d'essai et six modèles de frontière

Le 22 septembre 2026, la coalition EvalEval a annoncé que l'AI Security Institute (AISI) britannique publie ses résultats d'évaluation sur sa plateforme ouverte Evaluation Cards, au format du schéma Every Eval Ever. La livraison couvre les cinq bancs d'essai de l'expérience principale de l'institut, HealthBench, FrontierMath, Humanity's Last Exam, SWE-Bench Pro et Terminal-Bench 2.0, avec les résultats vérifiés, le contexte et les paramètres de configuration, pour six modèles : Claude Opus 4, 4.5 et 4.6, GPT-5, GPT-5.2 et GPT-5.4. Deux évaluations de cybersécurité, Cyber CTFs et The Last Ones, sont jointes sur un ensemble de modèles partiellement différent. Les données accompagnent le papier de l'AISI intitulé How Inference Compute Shapes Frontier LLM Evaluation, qui mesure la dépendance des scores au calcul consacré à l'inférence et au protocole d'évaluation. Le schéma Every Eval Ever avait été façonné après un atelier commun tenu lors de NeurIPS 2025.

Nouveau produit / service

Alibaba lance Qwen Intelligence pour les smartphones agentiques et signe HONOR comme premier partenaire, à partir du Magic9 le 28 septembre

Le 22 septembre 2026, à la conférence Apsara de Hangzhou, Alibaba a présenté Qwen Intelligence, un ensemble logiciel complet destiné aux fabricants de téléphones qui veulent embarquer des agents d'IA. Le constructeur HONOR est le premier partenaire annoncé et codéveloppe des modèles spécialisés ; sa série Magic9, dont le lancement est fixé au 28 septembre, et son HONOR Robot Phone seront les premiers appareils à l'intégrer. L'offre se compose d'un modèle de fondation Qwen optimisé pour le mobile, d'une couche de plateforme modulaire et de trois agents prêts à l'emploi : Mobile Planner Agent, qui décompose une demande en tâches et réorganise un déplacement quand un vol est annulé, Mobile-Use Agent, qui agit dans les applications via les API avec repli sur l'interface graphique, et Mobile Creative Agent, modèle léger de génération et de retouche d'images. Qwen Intelligence est distribué par son site officiel et par Alibaba Cloud. Le lancement a été porté par Steven Hoi, responsable de Qwen Mobile AI chez Token Foundry et vice-président d'Alibaba Token Hub.

Levée de fonds

Persistent Systems obtient la spécialisation Databricks Brickbuilder pour l'IA gouvernée dans la banque, l'assurance et les services financiers

Le 22 septembre 2026, la société indienne d'ingénierie numérique Persistent Systems a annoncé avoir obtenu la spécialisation Databricks Brickbuilder pour le secteur bancaire, des services financiers et de l'assurance. Cette certification distingue les experts Persistent formés à la plateforme Databricks Data Intelligence et les accélérateurs réutilisables développés pour ce secteur. L'entreprise dit vouloir aider les établissements financiers à transformer des données fragmentées et des pilotes d'intelligence artificielle en solutions évolutives de gestion des risques, de lutte contre la fraude et d'analyse client, alors que les architectures existantes séparent souvent les données transactionnelles, les risques et la conformité. L'annonce a été diffusée depuis San José, en Californie, et Pune, en Inde, les deux sièges du groupe, coté à la Bourse de Bombay et au National Stock Exchange indien.

Avancée méthodologique

Nature Medicine : un modèle d'IA dépiste le cancer de l'oesophage sur scanner sans contraste, validé sur 80 612 patients

Nature Medicine a publié le 22 septembre 2026 la validation d'EAGLE, un modèle qui détecte lésions précancéreuses et cancers de l'oesophage sur des scanners thoraciques sans produit de contraste. Entraîné sur 6 813 patients de deux centres, il a été validé dans douze centres de trois pays auprès de 80 612 patients. Sur les cohortes externes de dépistage opportuniste (huit centres, 11 466 patients), il atteint 98,5 % de spécificité, 90,0 % de sensibilité pour le cancer et 52,5 % pour les lésions précancéreuses. Un recalibrage sur 35 402 patients réduit de 72,7 % les faux positifs sans perte de sensibilité ; la validation hospitalière prospective (17 446 patients) donne une valeur prédictive positive de 42,2 %, et le dépistage à faible dose en conditions réelles (10 959 patients) atteint 99,94 % de spécificité. L'essai est enregistré sous ChiCTR2300074806.

Dataset / ressource ouverte

Hugging Face fait tourner les quantisations GGUF de llama.cpp directement dans transformers, d'abord sur les puces Apple

Le 22 septembre 2026, Hugging Face a annoncé la prise en charge des fichiers GGUF dans transformers : un point de contrôle quantisé publié sur le Hub se charge avec from_pretrained et l'argument gguf_file, puis s'utilise avec l'interface habituelle, y compris via transformers serve et son point d'entrée compatible OpenAI. Pour approcher les performances de llama.cpp, la bibliothèque réutilise les noyaux ggml distribués par la librairie kernels et retire deux points de synchronisation de la boucle de génération, un masque d'attention inutile et le contrôle d'arrêt différé, dans les pull requests 48814 et 47975. Le chemin quantisé est pour l'instant réservé au backend MPS d'Apple et la couverture se limite aux architectures Qwen3.5 dense et à mélange d'experts, ainsi qu'aux points de contrôle Qwen3.8 compatibles. Les mesures ont été faites sur un MacBook Pro M2 Max de 32 Go sous macOS 26.6. L'équipe llama.cpp, à l'origine du format GGUF, a rejoint Hugging Face.

Nouveau produit / service

JetBrains regroupe ses outils agentiques sous JetBrains Air et renomme Central en Air Governance, 26 ans après avoir centré son offre sur l'IDE

Le 22 septembre 2026, JetBrains a regroupé ses produits de développement agentique sous le nom de JetBrains Air, présenté comme un système ouvert et multi-fournisseurs. L'ensemble réunit Air dans les environnements de développement JetBrains, pour diriger et vérifier le travail des agents, Air Teams pour coordonner développeurs et agents autonomes, et Air Governance, ancien JetBrains Central, qui porte la politique d'entreprise, la visibilité, l'audit et le contrôle des coûts d'IA. L'agent de codage maison Junie sera pris en charge sur toutes les surfaces d'Air. L'éditeur s'appuie sur l'Agent Client Protocol, qui normalise la liaison entre un environnement de développement et le harnais complet d'un agent, et sur le registre ACP pour exécuter des agents tiers dans ses outils. JetBrains, dont les 26 ans de produits étaient centrés sur le poste de travail du développeur, annonce des sorties échelonnées et ne communique aucun tarif.

Création d'entité / lancement de structure

Atos installe en France un comité scientifique sur l'IA ouverte et souveraine, avec Jean-Baptiste Kempf (VideoLAN)

Le 22 septembre 2026, Atos a annoncé la création de son comité scientifique en France, instance chargée d'orienter sa stratégie d'intelligence artificielle ouverte et souveraine et les projets de ses Inno'Labs. Le comité accompagnera la constitution d'une base d'IA ouverte regroupant les contributions internes du groupe et le déploiement d'une place de marché d'agents d'IA à l'échelle d'Atos. Quatre personnalités extérieures y siègent : Alexandre Bouard, directeur de programme « véhicule connecté » au sein de la Software République chez Renault Group, Stéphane Canu, professeur à l'INSA Rouen Normandie et chargé de mission IA au ministère de l'Enseignement supérieur, de la Recherche et de l'Espace, Philippe Freyssinet, directeur scientifique du BRGM, et Jean-Baptiste Kempf, fondateur de l'association VideoLAN à l'origine du lecteur VLC. S'y ajoutent des représentants d'Atos France, dont le directeur général Franck Chartier, le directeur de la technologie et des opérations Sylvain Barthélemy et le directeur de l'innovation Laurent Clergue.

Prévisions / projections

Bureau Veritas vise 1 milliard d'euros de chiffre d'affaires lié à l'IA en 2030, contre 370 millions estimés fin 2026

Le 22 septembre 2026 à Courbevoie, Bureau Veritas a fixé lors de sa Journée Investisseurs un objectif de 1 milliard d'euros de chiffre d'affaires sur les marchés et services liés à l'intelligence artificielle d'ici 2030. Le groupe de certification chiffre cette activité à environ 370 millions d'euros à fin 2026 estimé, contribution de l'acquisition de LotusWorks incluse sur une année pleine. Son communiqué annonce le déploiement d'un cadre de gouvernance unique de l'IA à l'échelle du groupe et cite comme relais de croissance l'assurance des systèmes d'intelligence artificielle, la cybersécurité, l'intégrité des données et la surveillance automatisée. Bureau Veritas confirme par ailleurs sa stratégie « LEAP | 28 » et relève à deux chiffres son objectif de croissance totale du chiffre d'affaires pour 2027 et 2028.

Nouveau modèle

vLLM 0.30.0 agrège 762 contributions et ramène de 28,9 à 8,2 secondes l'initialisation d'un moteur sur H200

Le 22 septembre 2026, le projet vLLM a publié la version 0.30.0 de son moteur d'inférence, qui agrège 762 contributions signées par 315 personnes, dont 104 nouvelles. Le gel du ramasse-miettes pendant la capture des graphes CUDA fait passer cette capture de 12 à 2 secondes et l'initialisation du moteur de 28,9 à 8,2 secondes sur un GPU H200. Un démon de cache de poids par GPU conserve en mémoire les poids déjà quantifiés et découpés entre rangs, que les moteurs redémarrés récupèrent par IPC CUDA au lieu de les relire sur disque. La version retire aussi l'ordonnancement des activations GPTQ et rend optionnels les points d'accès de mise à l'échelle. Côté apprentissage par renforcement, le compactage sur GPU du masque d'échantillonnage corrige une régression qui multipliait par environ 2 la durée d'une étape.

Levée de fonds

Mistral AI rachète la start-up publicitaire Pimento pour muscler son assistant Vibe, trois semaines après une levée de 3 milliards d'euros

Le 21 septembre 2026, Mistral AI a confirmé à l'AFP le rachat de Pimento, start-up parisienne fondée en 2022 qui conçoit des campagnes publicitaires assistées par IA pour plus de 180 marques. L'opération, chiffrée à environ 3,8 millions d'euros selon L'Informé, intervient trois semaines après une levée de 3 milliards d'euros menée notamment par le sud-coréen Samsung. Les équipes de Pimento rejoignent Mistral pour renforcer Vibe, l'assistant conversationnel anciennement nommé Le Chat. Il s'agit de la troisième acquisition de l'année pour le groupe français, après le fournisseur d'infrastructure serverless Koyeb en février et la start-up autrichienne de simulation industrielle Emmi AI trois mois plus tard. Mistral compte désormais plus de 1 000 salariés et reste, selon l'AFP, la start-up d'IA la mieux financée et valorisée d'Europe continentale.

Rapport de marché / adoption

Microsoft mesure à 18,8 % la part de la population mondiale en âge de travailler ayant utilisé l'IA générative en juin

Le 21 septembre 2026, Microsoft a publié son Global AI Diffusion Report du deuxième trimestre. En juin, 18,8 % des personnes de 15 à 64 ans dans le monde avaient utilisé un produit d'IA générative, en hausse d'environ 1 % sur le premier trimestre, presque toutes les économies progressant. Les Émirats arabes unis (73,3 %) et Singapour (64,3 %) restent en tête. La Corée du Sud signe la plus forte progression absolue, 3,5 points ; le Japon la plus forte progression relative, 2,2 points au-dessus de ses 22,5 % du premier trimestre ; l'Arabie saoudite gagne cinq rangs, de la 30e à la 25e place. L'écart entre Nord et Sud continue de se creuser, à 28,8 % contre 16,2 %. L'indicateur repose sur la télémétrie Microsoft agrégée et anonymisée, corrigée des parts de systèmes d'exploitation, de la pénétration d'internet et de la population.

Nouveau modèle

Tim Dettmers annonce six sorties open source, dont un cadre qui ferait tourner 125 milliards de paramètres sur un GPU de 24 Go

Le 21 septembre 2026, Tim Dettmers, professeur assistant à Carnegie Mellon, a annoncé sur son blog une semaine open source de son laboratoire : deux projets logiciels et quatre papiers publiés ensemble à partir du 22 septembre. Le cadre d'inférence présenté ferait tourner Qwen 3.8 Flash Next, 125 milliards de paramètres, sur un seul GPU de 24 Go, et DeepSeek V4.1, 550 milliards de paramètres, sur une machine à 128 Go de mémoire unifiée, MacBook, AMD Strix ou NVIDIA DGX Spark. Sur Mac, Dettmers annonce 450 tokens par seconde pour un Qwen 3.6 35B-A3B quantisé à 1,5 bit par poids, après optimisation des noyaux Metal par un agent laissé seul sur le dépôt. Il présente aussi CliffCompaction, une compaction automatique qu'il dit réduire d'environ 50 % le coût des sessions d'agents. Le billet ne lie encore aucun dépôt : Dettmers indique que les projets de ses étudiants étaient terminés depuis plus d'un mois avant ce coup d'envoi du 22 septembre.

Nouveau modèle

Nathan Lambert chiffre à 3,2 milliards les téléchargements des modèles ouverts chinois sur Hugging Face, le double du total américain

Le 21 septembre 2026, le chercheur Nathan Lambert a publié sur Interconnects la version développée des remarques qu'il avait préparées pour un briefing de membres du Congrès américain et de leurs équipes sur les modèles à poids ouverts. Il y chiffre à 3,2 milliards les téléchargements cumulés des modèles chinois sur Hugging Face, soit environ 1,6 milliard de plus que les modèles américains, et situe la bascule en juillet 2025 avec les modèles Qwen d'Alibaba. Sur l'Artificial Analysis Intelligence Index au 14 septembre 2026, il relève GLM-5.3 à 45, Kimi K3 à 44 et GLM-5.3-Flash à 42, devant les meilleurs modèles ouverts américains, Inkling et Inkling Small de Thinking Machines à 26 et Nemotron 3 Ultra de NVIDIA à 23. Sur OpenRouter, le volume hebdomadaire traité par les modèles ouverts passe d'environ 1 000 milliards de tokens en septembre 2025 à 80 000 milliards, dont plus de 80 % pour les modèles chinois.

Tribune / opinion

Le ministère japonais des Affaires intérieures réclame 720 millions de yens au budget 2027 pour généraliser l'IA dans les collectivités

Le 21 septembre 2026, l'agence Kyodo a rapporté que le ministère japonais des Affaires intérieures et des Communications engage un programme baptisé « AX des collectivités » (AI transformation), destiné à étendre l'IA à l'ensemble des tâches des administrations locales alors que la pénurie de main-d'oeuvre s'aggrave. Le ministère juge que les collectivités déjà équipées ne s'en servent que sur une partie de leurs missions. Il a inscrit 720 millions de yens d'études et de recherche à sa demande budgétaire pour l'exercice 2027 et, séparément, 10,2 milliards de yens pour élargir l'aide aux entreprises pivots des territoires, dont la refonte de leurs processus par l'IA. Un groupe d'experts installé en juillet 2026 doit rendre un rapport d'étape d'ici fin mars 2027. À Kawachinagano (Osaka), un avatar génératif oriente les visiteurs vers le bon guichet depuis août 2025.

Création d'entité / lancement de structure

Le Mali inaugure près de Bamako un centre national d'intelligence artificielle et de robotique de 50 hectares, pour 5,7 millions de dollars

Le président malien Assimi Goïta a inauguré lundi 21 septembre 2026 le Centre d'intelligence artificielle et de robotique du Mali (CIAR-Mali), à Kati-Sirakoro Niaré, près de Bamako. Le complexe, construit sur un site de 50 hectares, a mobilisé 3,3 milliards de francs CFA, soit environ 5,7 millions de dollars, sur financement public. Créé par une ordonnance d'août 2023, le CIAR-Mali doit produire des solutions technologiques pour l'agriculture, la santé, l'environnement, l'industrie et la gestion des données. Pour l'année universitaire 2026-2027, le centre ouvre un concours d'entrée pour 40 places en première année d'un cycle préparatoire intégré en mathématiques, physique et sciences de l'ingénieur, destiné à former les compétences locales en IA et en robotique que la Banque mondiale jugeait insuffisantes dans son diagnostic de 2023 sur le pays.

Tribune / opinion

Communications Sustainability : les centres de données d'IA des six grands opérateurs atteindraient 239 à 295 TWh en 2030

Le 21 septembre 2026, la revue Communications Sustainability a publié une étude sur la consommation électrique des centres de données dédiés à l'intelligence artificielle, signée par des chercheurs de l'Ohio State University, de l'université Zhejiang A&F et de Meta Platforms. Les auteurs projettent que la consommation cumulée d'Amazon, Microsoft, Google, Meta, Oracle et Apple passera d'environ 118 térawattheures en 2024 à 239 térawattheures dans le scénario prudent et 295 dans le scénario optimiste en 2030, soit 13 à 17 % de croissance annuelle et environ 1 % de la demande mondiale d'électricité projetée. L'estimation combine une extraction par grand modèle de langage de dépôts boursiers, de rapports d'entreprise et de sources publiques avec des scénarios de croissance. L'Oregon, la Virginie, l'Iowa, l'Ohio et l'Irlande dépassent chacun 15 térawattheures de demande annuelle dans le scénario neutre.

Nouvelle fonctionnalité

Les Philippines lancent eGovAI et son assistant « Kuya A » dans la super-application publique eGovPH, onze services bâtis sur Gemini

Le 21 septembre 2026, le ministère philippin des Technologies de l'information et de la communication (DICT) a lancé eGovAI, couche d'intelligence artificielle de la super-application publique eGovPH. Son assistant conversationnel « Kuya A » propose onze services au lancement : recherche de démarches en langage naturel, cartographie des sites touristiques proches, conseil de culture aux agriculteurs, traduction entre langues philippines, identification d'images, extraction de documents, rédaction de discours, aide au code, assistant santé, assistant textes réglementaires et assistant d'identité. Un message du président Ferdinand Marcos Jr., lu par le secrétaire du cabinet Benhur Abalos, a été lu lors du lancement. Le secrétaire du DICT Henry Aguda indique que les développeurs du ministère ont bâti ces fonctions sur Google Gemini et que l'usage reste gratuit sur eGovPH. Le même ministère avait présenté deux semaines plus tôt un plan d'infrastructures d'IA visant 1,5 gigawatt de centres de données d'ici 2033.

Un message Enigma de juillet 1941 resté indéchiffré depuis 2005 est cassé par GPT-6 Astra, qui a écrit lui-même sa bombe logicielle

Le 15 septembre 2026, Carter Leffer a soumis à Frode Weierud, de Crypto Cellar Research, le déchiffrement du message Enigma MVUEH, transmis le 10 juillet 1941 et reçu à 17h30 par la station radio du quartier-maître de la division SS-Totenkopf. Enregistré sous le numéro 172, ce message de 82 lettres résistait à toutes les tentatives depuis 2005. Weierud, qui a mis sa page à jour le 19 septembre, dit avoir aussitôt reconnu la bonne clé et le bon texte clair. Leffer s'était borné à demander à GPT-6 Astra de tenter les messages non résolus publiés sur le site. Le modèle a choisi lui-même le message 172, supposé un lien avec le message 173 déchiffré en 2017 par Alex Shovkoplyas, retenu comme mot probable le nom de lieu répété ROSENOW, puis développé en Python et en C++ un simulateur d'Enigma et une bombe avant de retrouver la clé et le texte clair. L'ordre des rotors, 253, diffère de celui des autres messages du 10 juillet 1941, fixé à 512. Weierud relève que le rotor gauche opère un report à la 72e lettre, phénomène rare qui complique une attaque, et que les journaux d'exécution du modèle sont encore en cours d'analyse.

Puce / GPU / matériel

Tower Semiconductor et NewPhotonics lancent la production en volume de circuits photoniques à laser intégré pour l'interconnexion IA

Le 17 septembre 2026, Tower Semiconductor et la société israélienne NewPhotonics ont annoncé le début des livraisons en volume de circuits photoniques intégrés (PIC) à laser intégré destinés aux interconnexions optiques des infrastructures d'intelligence artificielle. Les modules NewPhotonics NPG102, fabriqués sur la plateforme silicium photonique PH18DA de Tower, couvrent des débits de 800 gigabits à 1,6 térabit par seconde et intègrent lasers, amplificateurs optiques à semi-conducteurs, modulateurs et photodétecteurs sur une seule puce. Les futurs chipsets NPC505, conformes à la norme CPX-MSA, viseront 6,4 térabits par seconde en production de volume au premier semestre 2027. Doron Tal, vice-président senior et directeur général de NewPhotonics, et Ed Preisler, vice-président de Tower Semiconductor, présentent l'accord comme une réponse à la demande croissante d'interconnexions optiques économes en énergie pour les architectures d'IA à grande échelle.

Avancée méthodologique

L'université de Californie à San Diego publie dans Cell deux modèles d'IA qui simulent les mitochondries pour accélérer la découverte de médicaments

Le 17 septembre 2026, des chercheurs de l'université de Californie à San Diego ont publié dans la revue Cell deux études qui construisent des cellules virtuelles pour prédire la réponse des mitochondries aux traitements. Une équipe a entraîné un modèle d'intelligence artificielle nommé MitoSpace sur 40 000 films 4D de cellules cancéreuses traitées par 25 composés connus pour perturber les mitochondries, afin de prédire la santé cellulaire à partir de la seule forme du réseau mitochondrial. Une autre équipe a construit un jumeau numérique fondé sur la physique à partir de films en microscopie à feuille de lumière en réseau, et a constaté que la réponse des réseaux mitochondriaux virtuels aux médicaments correspondait étroitement à celle des cellules réelles. Selon l'université, ces modèles pourraient réduire la dépendance aux expériences de laboratoire et accélérer la recherche de traitements contre le cancer, le diabète et la maladie d'Alzheimer. Le chercheur Johannes Schöneberg a déposé un brevet sur la technologie et créé une entreprise pour la valoriser.

API / plateforme développeur

Hitachi ouvrira le 1er octobre une place de marché des matériaux recyclés dont l'IA propose des recettes de formulation de plastique

Le 17 septembre 2026, Hitachi et Hitachi High-Tech ont annoncé la mise en service, le 1er octobre, d'une place de marché des matériaux recyclés, centrée d'abord sur les plastiques. La plateforme embarque une IA développée par Hitachi qui exploite la base de données expérimentale du groupe sur les formulations de plastiques recyclés et propose des recettes répondant aux performances visées par l'acheteur, en cherchant la combinaison de matière recyclée, de matière vierge et d'additifs. Hitachi High-Tech y apporte ses moyens de mesure et d'analyse pour l'évaluation de la qualité. Les cas d'usage ont été éprouvés avec Sekisui Chemical ; une démonstration menée avec Toei a abouti au prototypage d'un plastique recyclé conforme aux performances demandées. La banque Mitsubishi UFJ monétisera par anticipation, sans examen de dossier et sans recours, les créances des vendeurs nées des transactions conclues sur la plateforme.

Puce / GPU / matériel

NVIDIA fait traduire en Rust par un agent d'IA les 24 opérateurs de sa bibliothèque de noyaux TileGym, à 99,5 % des performances

Le 16 septembre 2026, NVIDIA a décrit sur son blog développeurs cuTile Rust, une interface d'écriture de noyaux GPU par tuiles en langage Rust, et la chaîne d'agents qui y porte ses noyaux existants. Une compétence d'agent hébergée dans le dépôt TileGym traduit les noyaux écrits en cuTile Python et en Triton-TileIR. Les 24 opérateurs publics de la bibliothèque, soit une quarantaine de noyaux allant des opérations élément par élément au décodage flash-attention, à l'attention latente multi-têtes et aux mélanges d'experts, ont été convertis. Mesurés sur un DGX B200, tous franchissent le seuil de 0,95 en moyenne géométrique face à leur version Python, pour une parité globale de 0,995. Chaque étape de la chaîne se termine par un verdict vérifiable par machine, dont une comparaison des représentations intermédiaires Tile IR avant tout test fonctionnel.

Nous Research fait nettoyer son agent Hermes par 1 393 sous-agents et retire 34,4 % de son code Python hors tests

Le 15 septembre 2026, Nous Research a publié le compte rendu d'un chantier de simplification de Hermes, son agent open source, conduit par l'agent lui-même. Lancée le 2 septembre sur un dépôt de plus d'un million de lignes de Python hors tests, la session principale a duré environ dix-neuf heures actives, réparti le travail en 36 groupes disjoints et lancé 1 393 sous-agents, jusqu'à 218 simultanés. La fusion est intervenue le 4 septembre, après un redémarrage, une session de reprise et deux tours de relecture communautaire qui ont révélé des régressions que les tests existants n'avaient pas vues. Le code Python hors tests recule de 34,4 %. Nous Research chiffre la dépense en jetons à environ 19 300 dollars pour la session principale et 25 000 dollars au total, hors temps de relecture humaine, contre une estimation interne de 150 000 à 1,8 million de dollars pour une petite équipe. Six fichiers dépassent encore 5 000 lignes.