Individu

Sakana AI

8 actualités

Dernières brèves

Alliance stratégique

Sakana AI intègre les modèles Nemotron de NVIDIA dans son orchestrateur multi-agents Fugu

Le laboratoire japonais Sakana AI a annoncé le 16 juillet 2026 un partenariat avec NVIDIA pour intégrer la famille de modèles ouverts Nemotron comme agents spécialisés au sein de Fugu, son système d'orchestration multi-agents. Fugu est lui-même un modèle de langage capable d'appeler dynamiquement plusieurs LLM, y compris ses propres instances de manière récursive, pour sélectionner et coordonner les agents les plus adaptés à chaque tâche. Les modèles Nemotron apporteront à Fugu des capacités spécialisées en génération de code, en appel d'outils et en suivi d'instructions. Les deux entreprises présentent cette intégration comme une démonstration que les modèles ouverts gagnent en utilité lorsqu'ils sont orchestrés ensemble au sein de systèmes agentiques plutôt qu'utilisés isolément. Aucun montant financier n'est associé à ce partenariat.

Nouveau modèle

Sakana AI lance Sakana Translate, outil de traduction japonais-anglais-chinois fondé sur son moteur Namazu

Le laboratoire japonais Sakana AI a annoncé le 6 juillet 2026 Sakana Translate, un nouvel outil intégré à Sakana Chat proposant trois modes : traduction, relecture et question-réponse, entre le japonais, l'anglais et le chinois. L'outil s'appuie sur Namazu, la technologie de post-entraînement dévoilée par Sakana AI en mars 2026 pour adapter des modèles ouverts existants, dont DeepSeek et Llama, aux spécificités linguistiques et culturelles japonaises. Sakana AI affirme, sur la base d'une évaluation XCOMET-XL utilisant les données de la tâche de traduction générale WMT 2024, se positionner dans la même gamme que des modèles de premier plan comme Gemini 3.1 Pro, sans publier de score chiffré précis sur cette comparaison.

Benchmark / évaluation

Sakana AI publie CoffeeBench, un benchmark d'agents LLM en économie multi-agents simulée

Le 26 juin 2026, Sakana AI a présenté CoffeeBench, un benchmark open source sous licence Apache 2.0 destiné à évaluer des agents LLM sur des tâches à long horizon dans une économie multi-agents hétérogène. Le banc d'essai simule une chaîne d'approvisionnement de café où deux fermiers, deux torréfacteurs et deux détaillants gèrent leurs activités de façon autonome sur 90 jours simulés. Développé avec le cabinet d'audit KPMG AZSA, il met en évidence un écart entre raisonnement et action : certains modèles produisent des analyses cohérentes tout en n'exécutant pas les décisions, un cas documenté étant celui de Claude Haiku 4.5, resté largement inactif. Le framework Python est distribué sur GitHub ; le preprint qui le décrit avait été mis en ligne sur arXiv le 15 juin.

Nouveau produit / service

Sakana AI lance Fugu, un orchestrateur qui coordonne plusieurs modèles pour rivaliser avec les meilleurs

Le 22 juin 2026, le japonais Sakana AI a lancé Fugu, un système entraîné à sélectionner et coordonner plusieurs grands modèles de langage plutôt qu'à en bâtir un seul. La société revendique pour sa version Fugu Ultra des performances comparables à celles des meilleurs modèles, dont Fable 5 et Mythos d'Anthropic, sur plusieurs tests, alors même que ces modèles ne figurent pas dans son pool. Les résultats publiés par Sakana sont contrastés selon les benchmarks. Sakana présente cette architecture comme une parade à la dépendance à un fournisseur unique, dans le contexte des récentes restrictions d'exportation.

Source : Sakana AI
Ranger dans…
Enregistré. Ajouter une note ?

Articles liés

4 au total