Physical Intelligence présente π*0.6, un modèle vision-langage-action qui apprend de sa propre expérience par renforcement
Le 17 novembre 2025, la start-up Physical Intelligence a dévoilé π*0.6 (« pi-star-0.6 »), un modèle vision-langage-action (VLA) entraîné avec sa méthode Recap, qui combine démonstrations, corrections d'experts et apprentissage par renforcement à partir de l'expérience autonome du robot. Selon l'entreprise, cette approche permet au modèle d'apprendre de ses succès comme de ses erreurs en conditions réelles et multiplie par deux à trois le débit sur certaines des tâches les plus difficiles, tout en portant le taux de réussite au-delà de 90 %. Parmi les tâches démontrées en continu : préparer des cafés expresso, plier du linge dans une maison inconnue et assembler des boîtes en usine. Les travaux s'accompagnent d'une publication technique.


