Google DeepMind lance Gemini Robotics 2 et ouvre son modèle de raisonnement incarné ER 2 aux développeurs
Le 30 juillet 2026, Google DeepMind a présenté une famille de trois modèles de robotique : Gemini Robotics 2, modèle vision-langage-action de contrôle moteur, Gemini Robotics ER 2, modèle de raisonnement incarné bâti sur une architecture Gemini 3.5 Flash, et une variante embarquée On-Device 2. Sur les tâches de manipulation impliquant tout le corps avec le robot Apollo d'Apptronik, les taux de succès annoncés vont de 45,7 % au sol à 76,3 % sur étagère. Sur les tâches de dextérité, ils s'échelonnent de 32 % pour l'usage d'une pelle et d'une balayette à 92 % pour dévisser une ampoule. ER 2 atteint 91,3 % en localisation de moments dans une vidéo, avec une erreur moyenne de 0,96 seconde. Seul ER 2 est accessible aux développeurs, en préversion via l'API Gemini et Google AI Studio. Les deux autres modèles restent réservés à des partenaires, parmi lesquels Apptronik, Boston Dynamics, Franka Robotics et Agile Robots.




