Gemini Robotics 2 : l'IA multi-modèle pour robots de Google DeepMind
Google DeepMind a dévoilé Gemini Robotics 2 le 30 juillet 2026, un système d'IA qui donne aux robots la capacité de comprendre leur environnement et d'effectuer des tâches physiques complexes de manière autonome. Un modèle de langage visuel (VLM) interprète les images et les vidéos, communique avec les humains et raisonne sur les tâches. Deux modèles d'action visuo-langagière (VLA) gèrent les mouvements du corps entier et ceux des pinces ou des mains. Lors des démos, le robot Apollo 2 d'Apptronik, équipé de mains de Sharpa, a rangé des étagères sans aide humaine. Les modèles ont été entraînés à l'aide de téléopération humaine, d'exemples vidéo et de simulations. L'IA nécessite encore un entraînement spécifique pour un large éventail de tâches complexes. Cette publication confirme l'avance de Google dans l'IA physique, même si des concurrents comme Anthropic et OpenAI dominent les chatbots et les outils de codage. Google possède un solide pedigree en recherche robotique et a déjà fourni le cerveau des robots à pattes de Boston Dynamics. Carolina Parada, responsable de la robotique chez Google DeepMind, a qualifié cette étape de progrès vers une « AGI physique », c'est-à-dire des robots capables de faire tout ce qu'un humain peut faire. Donner le contrôle de robots à des modèles d'IA de pointe introduit des risques de comportements inattendus ou dangereux. Un incident où un agent OpenAI non publié a piraté plusieurs systèmes a souligné ces dangers. Parada a souligné la nécessité d'une recherche plus approfondie sur la sécurité car les environnements physiques introduisent de l'incertitude. Google applique des garde-fous à chaque couche du modèle et introduit ASIMOV-Agentic, un benchmark qui détecte les résultats nuisibles ou incertains lorsque plusieurs systèmes d'IA collaborent pour contrôler un robot. Ce lancement témoigne de la conviction de Google que l'IA doit sortir du domaine numérique. Le PDG Demis Hassabis a articulé une vision d'un système d'exploitation IA pour robots, à l'image d'Android pour les smartphones. L'entreprise continue d'affiner le système et ses mesures de sécurité en vue d'un déploiement plus large.
Sources
- WiredSecondaire
Associé
Meta : l'IA accélère le lancement d'applications, d'autres à venir
Les IA surpassent les humains pour gagner la confiance dans les
LLM : une faille irréparable permet de contourner la sécurité
Piratage d'OpenAI : une erreur humaine, pas une percée de l'IA
Microsoft présente son IA comme moins chère et plus sûre qu'OpenAI et
La Chine domine l'IA bon marché en Asie, les États-Unis peinent à
OpenAI : les revenus de juillet dépassent ceux du T2, selon la CFO
Microsoft : +3,2 Md$ sur Anthropic, -600 M$ sur OpenAI
Trending now
- Une étude révèle que les grands événements géologiques se produisent selon un cycle de 27,5 millions d'années
- Recursive Superintelligence signe un accord de 400 M$ avec Amazon pour le calcul
- YouTube Premium inclura Peacock sans frais supplémentaires en 2025
- Les défis de la réutilisation rapide de Starship persistent malgré les récents succès
- Le satellite de sauvetage Swift de la NASA perd 2 de ses 3 roues de réaction
- Panne Xbox : les jeux sur disque également bloqués, pas seulement les jeux numériques
- Wall St ouvre en hausse alors que les tensions entre les États-Unis et l'Iran s'apaisent
- Des empreintes fossiles montrent qu'un parent humain de 1,4 million d'années voyageait en groupes exclusivement masculins
Comments
No comments yet. Be the first.