SIMA 2

SIMA 2

Google DeepMind · Image

SIMA 2 est l'agent d'IA de Google DeepMind qui joue, raisonne et apprend à vos côtés dans des mondes virtuels 3D. Ce n'est pas un simple exécutant d'ordres : il tourne sur des modèles Gemini pour comprendre vos objectifs, expliquer ses plans et parler de ce qu'il fait, tout en pilotant un personnage avec le même clavier et la même souris qu'une personne utiliserait. C'est un aperçu de recherche, pas un produit que vous téléchargez aujourd'hui. Voyez-le comme un agent d'IA pour mondes virtuels conçu pour l'étude, et non comme un outil qui attend dans une boutique d'applications.

Aperçu de l'interface de SIMA 2

À propos de SIMA 2

Qu'est-ce que SIMA 2

SIMA 2 signifie Scalable Instructable Multiworld Agent. C'est le successeur du SIMA original de 2024, et il marque un basculement : on passe d'une IA qui ne fait qu'obéir aux ordres à quelque chose de plus proche d'un partenaire de jeu collaboratif. La version précédente gérait des commandes de base dans une poignée de jeux commerciaux. SIMA 2 ajoute le raisonnement, le dialogue et la capacité d'apprendre des ficelles dans des lieux qu'il n'a jamais vus.

Le vrai changement, c'est Gemini. Là où SIMA 1 apprenait un lien direct entre les mots et les pressions de boutons, SIMA 2 intègre un modèle Gemini comme moteur de raisonnement. Cela lui permet de découper un objectif général en étapes, de narrer son intention et de corriger le tir quand quelque chose va de travers. Le langage devient intention. L'intention devient plan. Puis le plan devient action.

Il y a une vraie limite à poser d'emblée. SIMA 2 est un aperçu de recherche de Google DeepMind, pas une application grand public. Pas de téléchargement, pas de page d'inscription, pas d'API publique. Vous ne pouvez pas encore l'essayer sur votre propre machine. L'équipe explique que son but est d'étudier comment les agents transfèrent des compétences des environnements virtuels vers de vrais robots, et il reste volontairement au niveau de la planification, plutôt que de piloter des articulations ou des roues physiques.

Premiers pas

  1. Comprenez qu'il n'existe aucun produit public. Suivez les avancées sur la page de recherche de Google DeepMind et dans les annonces officielles.
  2. Lisez la recherche publiée sur la manière dont l'agent associe un modèle Gemini à un ensemble de compétences incarnées.
  3. Regardez les démonstrations qui montrent la différence entre SIMA 1 et SIMA 2 face à des demandes ouvertes dans des jeux comme No Man's Sky.
  4. Suivez les actualités de l'équipe sur Genie et la robotique si vous voulez voir où mène la recherche.

Informations sur le produit

Aperçu des tarifs, des plateformes compatibles et des performances de SIMA 2.

Offre gratuiteNon
Offres payantesNot available to the public
PlateformeWeb (research preview, no public download)
DéveloppeurGoogle DeepMind
CatégorieImage
Date de lancementNov 2025
Dernière mise à jourNov 2025
Visites du siteN/A
Classement mondial du siteN/A
Disponibilité de l’APINon

Idéal pour

Les utilisateurs, tâches et cas d'usage où cet outil convient le mieux.

Utilisateurs

  • Chercheurs en IA
  • Équipes de robotique
  • Passionnés d'IA dans le jeu vidéo

Tâches

  • Étudier la planification en plusieurs étapes
  • Tester la généralisation
  • Explorer l'auto-amélioration

Cas d'usage

  • Revue de littérature académique
  • Recherche produit
  • Démonstrations et conférences

Fonctionnalités clés

Gemini comme moteur de raisonnement

SIMA 2 place un modèle Gemini au cœur de sa façon de penser. Cet agent d'IA pour mondes 3D s'appuie sur Gemini pour interpréter un objectif, élaborer un plan et expliquer ce qu'il fait. Les travaux publiés désignent la version Gemini 2.5 Flash-Lite comme moteur interne de l'agent.

Dialogue en langage naturel

Vous pouvez parler à SIMA 2 comme vous parleriez à un coéquipier. Il répond en langage simple, décrit son intention et détaille les étapes qu'il compte suivre. Pas d'ordres programmés. Pas de répliques toutes faites. L'intention passe de la distribution d'ordres à la résolution d'un problème ensemble, et c'est la rupture la plus nette avec le SIMA précédent.

Instructions multimodales

L'agent lit plus que des mots tapés. Il réagit à la voix, aux croquis dessinés à la main et même aux emojis, si bien que vous pouvez pointer un endroit sur la carte ou envoyer deux icônes pour signaler une action. Une fois la nouveauté passée, l'entrée par croquis est la plus pratique : c'est un moyen rapide de marquer un lieu ou un chemin sans écrire une phrase.

Transfert de compétences entre jeux

SIMA 2 transporte des concepts d'un monde à l'autre. S'il apprend à miner dans un jeu, il peut appliquer cette idée à la collecte dans un autre. Ce transfert est ce qui rend la recherche sur l'agent utile : les compétences cessent d'être liées à un seul titre.

Boucle d'auto-amélioration

Après les démonstrations humaines initiales, le système génère ses propres tâches et les teste, en s'appuyant sur le retour de Gemini pour affiner son approche. C'est précoce, et les gains se mesurent en milieu de recherche, mais la boucle est ce qui le distingue d'un modèle statique.

Meilleur taux de réussite

Selon Google DeepMind, SIMA 2 a atteint environ 65 % de réussite sur les jeux avec lesquels il a été entraîné, proche d'une base humaine autour de 75 %. Le premier SIMA parvenait à environ 31 % sur les tâches complexes, donc le bond est important. Prenez ces chiffres comme ceux du laboratoire lui-même, non comme un verdict indépendant.

Fonctionne à partir des pixels, pas du code

L'agent ne touche ni au code source d'un jeu ni à une API spéciale. Il observe l'écran et envoie des signaux virtuels de clavier et de souris, exactement comme une personne. Cette contrainte explique pourquoi l'approche pourrait un jour s'étendre au-delà des jeux.

Avantages et inconvénients

Avantages

  • Raisonne sur les objectifs au lieu de seulement suivre des commandes littérales, donc il gère des instructions plus floues.
  • Explique son plan en mots, ce qui rend son comportement plus facile à suivre et à croire.
  • Lit le texte, la voix, les croquis et les emojis, ce qui vous donne plusieurs façons de le guider.
  • Transfère les compétences apprises vers de nouveaux jeux, un vrai pas au-delà des agents dédiés à un seul titre.
  • Fonctionne sans le code du jeu ni d'API personnalisée, donc il peut opérer avec des titres existants.

Inconvénients

  • Ce n'est qu'un aperçu de recherche. Pas de téléchargement, pas d'inscription, pas d'API publique, donc vous ne pouvez pas l'utiliser vous-même.
  • Les taux de réussite viennent de Google DeepMind, et aucun benchmark indépendant ne les étaye encore.
  • Il gère les décisions de haut niveau mais pas le contrôle physique fin, donc il est loin d'un système de robotique abouti.
  • Aucune date de sortie confirmée n'existe, donc tout plan construit autour de lui relève de la conjecture.

Questions fréquentes

Non. C'est un aperçu de recherche de Google DeepMind, sans application grand public, sans lien de téléchargement et sans API publique. La recherche publiée et les démos officielles sont le seul moyen de suivre.

Contenus associés

Découvrez des outils, des compétences et des articles liés à SIMA 2.

Alternatives à SIMA 2

X Ray Interpreter

X Ray Interpreter

X-ray Interpreter · Image

X Ray Interpreter est un outil de radiologie par IA basé sur le web qui transforme les radiographies, les scanners, les IRM, les échographies et les images TEP en comptes rendus en langage clair. Vous téléchargez un examen, obtenez une interprétation préliminaire de la radiographie en quelques instants, puis posez des questions complémentaires si quelque chose mérite une explication. Il sert de second avis et d'aide à l'apprentissage, pas de diagnostic médical.

Gratuit / $9.9 - $99Voir les détails
Aieasypic

Aieasypic

AIEasyPic · Image

AIEasyPic est un générateur d'images par IA qui transforme de simples prompts texte en œuvres finies en quelques secondes. Vous pouvez aussi entraîner des modèles personnalisés sur vos propres photos, échanger des visages dans des images existantes et créer de courts clips vidéo à partir de texte, le tout depuis un navigateur. Il convient aux créateurs occasionnels qui veulent des visuels rapides et aux amateurs qui souhaitent bâtir un modèle personnel sans toucher à la moindre ligne de code.

Gratuit / $6.60 - $29.40/moVoir les détails
Chargen

Chargen

Chargen · Image

Chargen est un générateur de personnages par IA et une boîte à outils de création d'univers conçue pour Donjons & Dragons et les autres jeux de rôle sur table. Il transforme une idée d'une ligne en un portrait de personnage peint, crée des PNJ, des monstres, des cartes et des rencontres dans la même session, et garde les détails de chaque créature à portée de main. Le volet art pour jeu de rôle sur table repose sur un système de crédits appelé Gold, tandis que les générateurs de texte restent gratuits pour tous.

Gratuit / $0 - $30/moVoir les détails