Veille IA

Veille IA du vendredi 3 juillet 2026

29 brèves de veille IA publiées ce jour, sourcées et vérifiées. Sujets principaux : arXiv, Anthropic, Royaume-Uni, Reuters, DeepSeek.

29 brèves
Restructuration / licenciements

Zuckerberg reconnaît en interne que le développement des agents IA n'a pas accéléré comme Meta l'espérait

Lors d'une réunion interne le 2 juillet 2026, dont Reuters a obtenu l'enregistrement, Mark Zuckerberg a déclaré aux salariés de Meta que la trajectoire du développement agentique des quatre derniers mois n'avait pas accéléré comme l'entreprise l'attendait. Le patron de Meta a reconnu que la réorganisation de ses équipes IA n'avait pas été aussi nette qu'elle aurait pu l'être et que certains paris sur la nouvelle structure n'avaient pas encore porté leurs fruits, tout en disant en espérer les bénéfices dans les trois à six mois. Ces propos internes interviennent après une restructuration massive, qui a réaffecté quelque 7 000 personnes à des équipes IA, et un plan d'investissement dans les infrastructures pouvant atteindre 145 milliards de dollars sur l'année.

Nouveau modèle

Z.ai : le modèle open-weight chinois GLM-5.2 talonne les modèles américains de pointe pour une fraction de leur coût, selon Reuters

Dans une analyse publiée le 2 juillet 2026, Reuters rapporte que le laboratoire pékinois Z.ai (Zhipu AI) est présenté par certains experts comme un possible mini-moment DeepSeek pour les développeurs, grâce à son dernier modèle GLM-5.2. Diffusé mi-juin 2026 en open-weight sous licence MIT, avec une fenêtre de contexte d'un million de tokens, GLM-5.2 se situe au coude-à-coude avec les meilleurs modèles occidentaux sur plusieurs benchmarks de codage agentique, selon des scores revendiqués par l'éditeur : il devance GPT-5.5 sur des tâches de développement longues et reste juste derrière Claude Opus 4.8 sur SWE-bench Pro. Facturé 1,40 dollar par million de tokens en entrée et 4,40 dollars en sortie, il coûte, selon Reuters, environ un cinquième à un sixième des modèles fermés américains. David Sacks a salué un modèle open-weight chinois au niveau des meilleurs modèles disponibles d'OpenAI et d'Anthropic. Zhipu, première société de modèles de fondation cotée, avait fait ses débuts à la Bourse de Hong Kong en janvier 2026 sur une valorisation d'environ 7 milliards de dollars.

Tribune / opinion

L'Inde et le Japon adoptent une déclaration conjointe de coopération sur l'IA et visent 500 professionnels indiens formés vers le Japon d'ici 2030

Le 2 juillet 2026, en marge du 16e sommet annuel Inde-Japon à New Delhi, lors de la visite de la Première ministre japonaise Sanae Takaichi, les deux pays ont adopté une déclaration conjointe de coopération dans le domaine de l'intelligence artificielle. Le texte réaffirme l'objectif d'envoyer 500 professionnels indiens hautement qualifiés en IA vers le Japon d'ici 2030 et acte trois protocoles d'entente nommés : entre l'IIT Bombay associé à BharatGen et le National Institute of Informatics japonais, entre Sarvam AI et Preferred Networks, et entre l'IndiaAI Mission et le ministère japonais de l'Économie (METI) pour le soutien aux start-up. Cette déclaration, l'un des trois documents phares du sommet avec la sécurité économique et la résilience énergétique, engage une coopération sur la gouvernance et les infrastructures mais sans chiffrage financier.

Sanction / amende

La Cour de justice de l'UE confirme définitivement l'amende de 4,125 milliards d'euros infligée à Google dans l'affaire Android

Le 2 juillet 2026, la Cour de justice de l'Union européenne a rejeté le pourvoi de Google et d'Alphabet, rendant définitive l'amende de 4,125 milliards d'euros pour abus de position dominante dans l'affaire Android (arrêt C-738/22 P). La Commission européenne avait sanctionné Google en 2018 (4,34 milliards d'euros) pour avoir imposé aux fabricants d'appareils Android la préinstallation de Google Search et de Chrome, ainsi que des accords anti-fragmentation et de partage de revenus. Le Tribunal de l'UE avait confirmé l'essentiel de l'infraction en 2022 tout en ramenant l'amende à 4,125 milliards. Avec ce rejet du pourvoi, la sanction est désormais insusceptible de recours, huit ans après la décision initiale de la Commission.

Alliance stratégique

Cognizant et Domyn nouent un partenariat pour déployer de l'IA souveraine auprès des secteurs régulés en EMEA

Le 2 juillet 2026, Cognizant et Domyn ont annoncé un partenariat stratégique visant les organisations des secteurs régulés dans la région EMEA. Domyn fournit la couche d'infrastructure d'intelligence artificielle souveraine (grands modèles de langage propriétaires, calcul, gouvernance et agents déployables chez le client, sur site ou en cloud privé), tandis que Cognizant apporte la couche applicative et l'intégration métier. Le dispositif commun cible le Royaume-Uni et l'Irlande, la zone DACH, l'Europe du Nord, l'Europe du Sud et le Moyen-Orient. Les deux partenaires citent une prévision de Gartner selon laquelle 50 % des charges d'IA en cloud reposeraient sur des modèles souverains d'ici 2029, contre 5 % en 2025.

Levée de fonds

BidScript lève 701 000 euros en pre-seed pour son IA de réponse aux appels d'offres publics et privés

Le 2 juillet 2026, la startup britannique BidScript, basée à Manchester, a annoncé une levée de fonds pre-seed de 701 000 euros (environ 800 000 dollars), portant le total de ses financements d'amorçage à plus de 876 000 euros (plus d'un million de dollars). Le tour réunit un réinvestissement de NPIF II - PXN Equity Finance, géré par PXN Ventures dans le cadre du Northern Powerhouse Investment Fund II, ainsi qu'un nouvel apport de SFC Capital. Fondée en 2023 par Henry Brogan et Tyler McCarthy, alors étudiants, BidScript édite une plateforme d'intelligence artificielle qui aide les entreprises à identifier, qualifier, rédiger et soumettre leurs offres pour des marchés publics et privés, avec une gestion de la conformité des candidatures. La société, qui cible la construction et l'ingénierie, l'informatique et l'éducation, revendique une amélioration des taux de succès de ses clients allant jusqu'à 50 pour cent. Les fonds serviront à étoffer les équipes et à étendre l'activité au Royaume-Uni, aux États-Unis et au Moyen-Orient.

Levée de fonds

Kling AI, la filiale video de Kuaishou, bouclerait un tour de financement prive de 2 a 3 milliards de dollars avant une IPO a Hong Kong

Debut juillet 2026, Kling AI, l'unite d'IA video generative de la chinoise Kuaishou, serait en passe de finaliser un tour de financement prive de l'ordre de 2 a 3 milliards de dollars, selon le South China Morning Post et Bloomberg citant des sources proches du dossier. L'operation valoriserait la filiale autour de 18 milliards de dollars, en deçà d'une cible initiale de 20 milliards evoquee au printemps. Tencent, Alibaba et Baidu figureraient parmi les investisseurs, la participation de Kuaishou etant ramenee a environ 68 %. Cette levee pre-IPO precederait un projet d'introduction en bourse de Kling AI a Hong Kong, attendu dans les douze mois. Ni le montant definitif ni la valorisation ne sont figes a ce stade, et aucune des parties n'a communique officiellement.

Nouveau produit / service

xAI lance Grok Voice Agent Builder, une plateforme no-code pour créer des agents vocaux téléphoniques

Le 1er juillet 2026, xAI a lancé en bêta le Grok Voice Agent Builder, une plateforme no-code qui transforme une description en langage naturel en agent vocal téléphonique opérationnel en environ deux minutes. L'outil repose sur une architecture speech-to-speech directement couplée au modèle Grok Voice, là où les piles vocales traditionnelles enchaînent trois briques distinctes (reconnaissance vocale, modèle de langage, synthèse vocale) souvent hébergées par des fournisseurs différents. xAI revendique un temps de première réponse audio inférieur à une seconde, qu'elle présente comme près de cinq fois plus rapide que le concurrent le plus proche. La tarification est fixée à 0,05 dollar par minute de conversation, voix comprises et sans frais de plateforme, auxquels s'ajoutent 0,01 dollar par minute pour les numéros de téléphone. La plateforme prend en charge plus de 25 langues avec changement de langue en cours de conversation, plus de 80 voix intégrées et le clonage vocal à partir de deux minutes d'audio. Elle réunit dans une même interface la téléphonie, la recherche documentaire, les outils, les garde-fous, les serveurs MCP et l'observabilité.

Retour d'expérience / bilan

Emissions de CO2 : Google et Amazon publient des bilans en forte hausse, tirés par la construction de data centers pour l'IA

Fin juin et debut juillet 2026, Google et Amazon ont publie leurs bilans environnementaux annuels, faisant etat d'emissions de gaz a effet de serre en nette hausse sous l'effet de l'essor de l'IA. Selon les chiffres relayes par l'AFP, les emissions totales de Google ont augmente de 18 % sur un an et de 82 % depuis 2019 ; le groupe met de son cote en avant une baisse de 2 % de ses emissions operationnelles (Scope 1 et 2) et une hausse de 25 % de son perimetre indirect (Scope 3), qui represente l'essentiel de son empreinte. Amazon declare pour sa part environ 81 millions de tonnes en 2025, en hausse de 16 % sur un an et de 58 % depuis 2019, ses emissions liees a l'electricite achetee bondissant de 34 %. Les deux groupes attribuent cette progression a la fabrication de puces et de serveurs et a la construction de nouveaux centres de donnees, tout en maintenant leurs objectifs de neutralite carbone (2030 pour Google, 2040 pour Amazon).

Levée de fonds

Dawnguard lève 3,3 millions de dollars supplémentaires pour automatiser l'architecture de sécurité par l'IA

Le 1er juillet 2026, la startup néerlandaise Dawnguard, fondée en 2025 à Amsterdam, a annoncé un tour de financement additionnel de 3,3 millions de dollars, portant le total levé à plus de 6,3 millions. L'opération a été menée par BNVT Capital, aux côtés de Curiosity VC et eCAPITAL. La jeune pousse lance publiquement sa plateforme d'automatisation d'architecture de sécurité, articulée autour de workflows de conception, découverte et déploiement, qui vise à déplacer la cybersécurité de la détection des menaces vers leur prise en compte dès la conception. Dawnguard ouvre par ailleurs un bureau à New York.

Cloudflare bloque par défaut les robots d'IA d'entraînement et fait payer les éditeurs à l'usage plutôt qu'au crawl

Le 1er juillet 2026, Cloudflare, qui protège plus de 20 % des domaines du web, a durci sa politique face aux robots d'indexation des sociétés d'IA. L'entreprise classe désormais ces robots en trois usages, recherche, agent et entraînement, et bloquera par défaut, à compter du 15 septembre 2026, les robots d'entraînement et d'agent sur les pages monétisées des nouveaux domaines et des comptes gratuits, seuls les robots de recherche restant autorisés. Cloudflare fait aussi évoluer son péage pay per crawl, lancé un an plus tôt, vers un modèle pay per use : les éditeurs sont rémunérés lorsque leur contenu est effectivement exploité ou cité dans une réponse d'IA, et non plus à chaque requête de collecte, un mécanisme adossé aux réponses HTTP 402 et mis en oeuvre avec les sociétés Ceramic.ai et You.com. La démarche prolonge la coalition d'éditeurs, dont Associated Press, Time, The Atlantic, Condé Nast et Gannett, réunie par Cloudflare dès 2025 pour faire payer l'accès aux contenus.

Retour d'expérience / bilan

Un an après son lancement, l'application GOV.UK dépasse 600 000 téléchargements et étend son assistant conversationnel IA aux usagers britanniques

Le 1er juillet 2026, le Government Digital Service (GDS) britannique a dressé le bilan de la première année de l'application GOV.UK, qui a dépassé 600 000 téléchargements. Plus de la moitié des utilisateurs personnalisent l'application et 20 % y consultent des informations de leur collectivité locale. Son assistant conversationnel GOV.UK Chat, lancé en mai 2026, répond en langage courant aux questions des usagers en s'appuyant exclusivement sur le contenu officiel de GOV.UK ; les sujets les plus demandés sont les impôts, les prestations sociales, la conduite et les transports. Pour sa deuxième année, le GDS annonce l'approfondissement de la personnalisation, l'intégration des données conducteurs et véhicules de l'agence DVLA prévue en juillet, et l'exploration d'une IA agentique capable d'aider les usagers à accomplir leurs démarches. Le ministre Ian Murray a souligné que l'application aide les citoyens à accéder plus facilement aux services, de la demande de permis de conduire à l'aide à la garde d'enfants.

Déploiement en entreprise / organisation

La Californie déploie à l'échelle de l'État Poppy, son assistant IA générative maison pour les agents publics

À compter de juillet 2026, le California Department of Technology (CDT) déploie à l'ensemble de ses employés publics Poppy, l'assistant numérique de l'État de Californie, après un pilote mené depuis septembre 2025 auprès de plus de 2 800 agents dans 67 départements. Poppy est une plateforme d'IA générative sécurisée et indépendante des fournisseurs, qui agrège plusieurs modèles (Claude, Gemini, GPT, Nova) avec comparaison côte à côte, pour la rédaction de documents, l'analyse de données volumineuses et la recherche de politiques à partir de sources californiennes de confiance. Le CDT met en avant plusieurs garde-fous : les données saisies ne servent pas à entraîner les modèles, une détection automatique des informations personnelles est intégrée, et les informations partagées ne quittent pas l'environnement de confiance de l'État. Le déploiement intervient quelques jours après l'annonce, le 29 juin, d'un partenariat de l'État avec Anthropic donnant accès à Claude à moitié prix aux agences, villes et comtés.

Intégration dans une suite existante

Eviden intègre son système de gestion de clés à Hyperforce de Salesforce pour un chiffrement souverain des données

Le 30 juin 2026, Eviden, filiale du groupe Atos, a annoncé l'intégration de son système de gestion de clés (KMS) à Salesforce, sur les environnements Hyperforce et Salesforce Shield. Selon un modèle dit « bring your own sovereign encryption », les organisations conservent le contrôle exclusif de leurs clés de chiffrement, hébergées en Europe, afin de sécuriser leurs données et d'accélérer l'adoption de l'intelligence artificielle sur la plateforme. L'application s'exécute sur des machines virtuelles confidentielles et s'appuie sur le module matériel Proteccio d'Eviden, qualifié par l'ANSSI.

Déploiement en entreprise / organisation

Crédit Agricole CIB et Pasqal visent de premiers cas d'usage quantiques en production dès 2028

Le 30 juin 2026, Crédit Agricole CIB et Pasqal ont annoncé l'approfondissement de leur partenariat, initié en 2019, pour passer de la recherche au déploiement opérationnel du calcul quantique sur les marchés de capitaux. La banque vise de premiers cas d'usage en production dès 2028, à commencer par l'optimisation de portefeuille. La feuille de route se déploie en trois phases : amélioration des traitements classiques par des algorithmes inspirés du quantique, expérimentation sur les ordinateurs à atomes neutres de Pasqal, puis déploiement hybride à grande échelle combinant ressources classiques et quantiques.

Nouveau modèle

Xiaomi décrit GUI-0, un agent multimodal entraîné à piloter des interfaces mobiles sur téléphones réels

Le 30 juin 2026, Xiaomi a mis en ligne sur arXiv un rapport technique présentant Xiaomi-GUI-0, un agent multimodal natif conçu pour piloter des interfaces graphiques dans des environnements mobiles réels, entraîné et évalué en boucle fermée sur des appareils physiques. L'agent revendique un taux de réussite de 72,0 pour cent sur le benchmark interne RealMobile et de 78,9 pour cent sur AndroidWorld, avec un accent mis sur la stabilité d'exécution et la détection d'états anormaux. La taille du modèle n'est pas précisée dans le rapport et la publication des poids n'est pas annoncée à ce stade.

Acquisition / rachat

Nexpublica acquiert l'éditeur lyonnais Wikit pour déployer l'IA agentique dans le secteur public

Le 30 juin 2026, Nexpublica, éditeur de logiciels SaaS pour le secteur public, a annoncé l'acquisition de Wikit, spécialiste français de l'intelligence artificielle agentique pour les collectivités, fondé en 2018 à Lyon. Les agents IA de Wikit sont déjà déployés en production dans plus de 150 collectivités françaises, dont une trentaine de départements et cinq régions. L'opération, deuxième acquisition du groupe en moins d'un an, doit permettre à Nexpublica de proposer l'IA agentique à un marché de 45 000 collectivités, établissements publics et administrations d'État. Le montant de la transaction n'a pas été communiqué.

Levée de fonds

Pie lève 19,5 millions de dollars en série A pour porter la croissance dopée à l'IA aux commerces de proximité

Le 30 juin 2026, la startup américaine Pie a annoncé une levée de 19,5 millions de dollars en série A menée par Lightspeed Venture Partners, portant son financement total à 23,7 millions de dollars. Le tour associe Capital One Ventures, SciFi VC (le fonds de Max Levchin), F-Prime Capital, Commerce Ventures et WEX Venture Capital. Fondée par Syed Ali et Akhil Mantripragada, anciens de Square et Toast, Pie sort de sa phase furtive et se présente comme une couche d'infrastructure de croissance pour les commerces locaux, articulée autour de trois outils : AI Search, Growth et Front Desk, un agent d'IA qui répond aux appels 24h/24, prend les réservations et traite les questions des clients. La société revendique des milliers de clients acquis avant son lancement officiel et plus de 100 000 appels déjà traités.

Nouveau produit / service

CoreWeave lance ARIA, un agent de recherche IA intégré à Weights & Biases, et fait passer W&B Weave en disponibilité générale

Le 29 juin 2026, CoreWeave a annoncé le lancement d'ARIA (AI Research & Iteration Agent), un agent intégré directement dans sa plateforme MLOps Weights & Biases. ARIA lit les données d'expériences des équipes, analyse selon l'éditeur des milliers de runs et des dizaines de milliers de métriques en quelques minutes, construit des visualisations en direct et propose des pistes d'amélioration des modèles et des agents. Il entre en preview publique et s'active depuis l'icône dédiée dans la barre latérale d'un projet Weights & Biases. Le même jour, les capacités de développement d'agents de W&B Weave passent en disponibilité générale. CoreWeave indique s'appuyer sur la visibilité accumulée via près d'un milliard de runs et des milliers de milliards de métriques suivis dans Weights & Biases. Il s'agit du premier lancement produit majeur de CoreWeave depuis le rachat de Weights & Biases.

Partenariat commercial / distribution

Haleon signe un partenariat de cinq ans avec Microsoft pour accélérer sa transformation par l'IA

Le 29 juin 2026, le groupe de santé grand public Haleon a annoncé une collaboration de cinq ans avec Microsoft pour étendre l'usage de l'intelligence artificielle, du cloud et de la donnée dans l'ensemble de ses activités. L'accord s'appuie sur Microsoft Azure comme plateforme cloud centrale et sur Microsoft 365 Copilot, appliqués aux insights consommateurs, à l'innovation, à la recherche et développement, à la chaîne d'approvisionnement et à la personnalisation marketing. Haleon rattache cette initiative à son ambition d'atteindre un milliard de consommateurs supplémentaires d'ici 2030.

Nouveau modèle

BAAI présente Orca, un world foundation model généraliste fondé sur la prédiction du prochain état

Le 29 juin 2026, la Beijing Academy of Artificial Intelligence a mis en ligne sur arXiv un papier présentant Orca, décrit comme une première instanciation d'un world foundation model généraliste. Le système repose sur un paradigme de prédiction du prochain état dans un espace latent unifié du monde, avec un backbone de modèle vision-langage Qwen3.5 (développé par Alibaba) laissé gelé, seuls des décodeurs légers par modalité (texte, image, action) étant entraînés. Le modèle, évalué en versions de 0,8 et 4 milliards de paramètres, a été pré-entraîné sur 125 000 heures de vidéo et 160 millions d'annotations d'événements. À ce stade, seuls le papier et une page projet sont disponibles ; les poids et le code ne sont pas publiés.

Nouveau modèle

Le protocole MCP passe en mode sans état avec les SDK bêta de sa prochaine spécification

Le 29 juin 2026, le projet Model Context Protocol (MCP) a publié des versions bêta de ses SDK Python, TypeScript, Go et C# prenant en charge la version candidate de la spécification datée du 28 juillet 2026. Cette révision fait passer le protocole en mode sans état (stateless) : elle supprime la poignée de main d'initialisation et la session au niveau du protocole, ce qui permet de répartir la charge entre serveurs avec un simple équilibreur en tourniquet, sans sessions persistantes. La bêta introduit aussi les requêtes multi-allers-retours, permettant à un outil de solliciter une saisie de l'utilisateur en cours d'exécution, des en-têtes de transport routables et un durcissement de l'autorisation. Les versions de protocole existantes restent fonctionnelles. Standard de fait pour la connexion entre agents et outils, MCP est gouverné depuis fin 2025 par l'Agentic AI Foundation de la Linux Foundation.

Intégration dans une suite existante

Michelin Connected Fleet intègre un assistant IA conversationnel à sa plateforme MyConnectedFleet

Le 29 juin 2026, Michelin Connected Fleet a annoncé l'intégration d'un assistant d'intelligence artificielle à sa plateforme de gestion de flotte MyConnectedFleet. L'outil permet aux gestionnaires d'interroger leurs données opérationnelles en langage naturel (consommation de carburant, comportement de conduite, entretien pneumatique ou véhicules immobilisés) et d'obtenir des réponses sous forme de texte ou de visuels. Selon l'entreprise, le système fonctionne en environnement fermé et traite les requêtes sans exposer les données des clients à l'extérieur. L'assistant est disponible dans dix pays, dont la France, le Royaume-Uni, les États-Unis, l'Allemagne et l'Italie.

Procès / plainte

Taïwan perquisitionne neuf sites liés à Super Micro dans une enquête sur le détournement de serveurs IA Nvidia vers la Chine

Le 29 juin 2026, le parquet de Keelung (Taïwan) a perquisitionné neuf sites liés au fabricant de serveurs Super Micro et convoqué six personnes, dans une enquête sur le détournement présumé de serveurs d'intelligence artificielle équipés de puces Nvidia vers la Chine, en contournement des contrôles américains à l'exportation. Les opérations ont visé le bureau taïwanais de la société, plusieurs résidences et deux entités affiliées. Super Micro a répondu par une lettre ouverte affirmant ne pas être la cible directe de l'enquête et que ses bureaux n'ont pas été perquisitionnés, indiquant que quatre de ses employés taïwanais avaient été interrogés. L'affaire fait écho à une procédure fédérale américaine descellée plus tôt en 2026, portant sur un schéma allégué de contournement d'environ 2,5 milliards de dollars.

Nouveau modèle

InternScience (Shanghai AI Lab) ouvre Agents-A1, un modèle agentique 35B Mixture-of-Experts sous Apache 2.0

Le 26 juin 2026, InternScience, le hub open source du centre AI for Science du Shanghai AI Laboratory, a publié en open-weight Agents-A1, un modèle agentique Mixture-of-Experts de 35 milliards de paramètres au total dont environ 3 milliards actifs par token (dénomination 35B-A3B), basé sur Qwen3.5 et distribué sous licence Apache 2.0. Le modèle offre une fenêtre de contexte de 262 000 tokens et défend la thèse d'un scaling de l'horizon agentique plutôt que du nombre de paramètres. Selon des résultats revendiqués par l'équipe (self-reported, scores concurrents repris des rapports techniques d'origine), Agents-A1 atteint 56,4 sur Seal-0, 79,0 sur FrontierScience-Olympiad et 94,8 pour cent sur IFEval, se comparant à GPT-5.5, DeepSeek-V4-pro et Kimi-K2.6. Le papier arXiv a été mis en ligne le 29 juin et des variantes quantifiées ont suivi le 2 juillet.

Benchmark / évaluation

Sakana AI publie CoffeeBench, un benchmark d'agents LLM en économie multi-agents simulée

Le 26 juin 2026, Sakana AI a présenté CoffeeBench, un benchmark open source sous licence Apache 2.0 destiné à évaluer des agents LLM sur des tâches à long horizon dans une économie multi-agents hétérogène. Le banc d'essai simule une chaîne d'approvisionnement de café où deux fermiers, deux torréfacteurs et deux détaillants gèrent leurs activités de façon autonome sur 90 jours simulés. Développé avec le cabinet d'audit KPMG AZSA, il met en évidence un écart entre raisonnement et action : certains modèles produisent des analyses cohérentes tout en n'exécutant pas les décisions, un cas documenté étant celui de Claude Haiku 4.5, resté largement inactif. Le framework Python est distribué sur GitHub ; le preprint qui le décrit avait été mis en ligne sur arXiv le 15 juin.

Nouveau modèle

Liquid AI sort LFM2.5-230M, son plus petit modèle open-weight pensé pour l'agentique embarquée

Le 25 juin 2026, Liquid AI, spin-off issu du MIT CSAIL, a publié LFM2.5-230M, le plus petit modèle de sa famille LFM2.5 avec 230 millions de paramètres, en open-weight sur Hugging Face (versions base et instruct) sous LFM Open License v1.0. Fondé sur l'architecture LFM2 (huit blocs convolutifs LIV double-gated et six blocs d'attention GQA), il dispose d'une fenêtre de contexte de 32 000 tokens et a été pré-entraîné sur 19 000 milliards de tokens. Conçu pour l'agentique on-device, il revendique 71,71 sur IFEval et 25,41 sur GPQA Diamond, et affiche 213 tokens par seconde en décodage sur un Galaxy S25 Ultra et 42 tokens par seconde sur un Raspberry Pi 5.

Levée de fonds

Attention lève 30 millions de dollars en série B pour son IA qui pilote les équipes commerciales

Le 24 juin 2026, la startup Attention a annoncé une levée de 30 millions de dollars en série B menée par RTP Global, avec le renfort de ses investisseurs Aglaé Ventures, Eniac et Alven, du nouvel entrant Linea et d'un groupe de business angels issus de sa propre base de clients. Sa plateforme d'IA agentique va au-delà de la simple transcription des appels : elle analyse les conversations commerciales, détecte les risques sur les affaires, recommande les prochaines actions, rédige et envoie les relances et met à jour le CRM. Attention indique exécuter plus de 20 millions d'actions d'agent par mois, un revenu récurrent annuel multiplié par quatre en un an et une valeur moyenne des contrats multipliée par dix en deux ans, pour plus de 500 clients dont Scale, Preply et BambooHR.

Nouveau produit / service

Sakana AI lance Fugu, un orchestrateur qui coordonne plusieurs modèles pour rivaliser avec les meilleurs

Le 22 juin 2026, le japonais Sakana AI a lancé Fugu, un système entraîné à sélectionner et coordonner plusieurs grands modèles de langage plutôt qu'à en bâtir un seul. La société revendique pour sa version Fugu Ultra des performances comparables à celles des meilleurs modèles, dont Fable 5 et Mythos d'Anthropic, sur plusieurs tests, alors même que ces modèles ne figurent pas dans son pool. Les résultats publiés par Sakana sont contrastés selon les benchmarks. Sakana présente cette architecture comme une parade à la dépendance à un fournisseur unique, dans le contexte des récentes restrictions d'exportation.