Gestes de base
Sait-il exécuter une consigne simple ?
Attraper, poser, ouvrir, ranger sur demande, dans un environnement connu.
Observatoire de la robotique intelligente
Calculé sur 3 023 résultats publiés par 1 320 modèles. Les pourcentages sont des taux de réussiteTaux de réussiteSur 100 essais, combien de fois le robot a réussi la tâche. sur des examensBenchmarkUn examen standardisé : les mêmes tâches pour tous, afin de comparer les modèles équitablement. en simulationSimulationUn monde virtuel (comme un jeu vidéo réaliste) où l'on teste des milliers de fois sans casser de vrai matériel..
niveau atteint de façon fiable, dans le monde réel
Niveau 2 (suit des consignes) : 85–99 % (sim.) · moyenne 90 % · seuil 99 % et preuve en monde réel.
Du robot d'usine programmé au robot de science-fiction. Pour qu'un niveau soit atteint, il faut deux preuves : une fiabilité de produit (au moins 99 % de réussite, le trait vertical) sur toutes ses capacités, et une démonstration hors simulation, chez de vrais clients.
Répète un mouvement codé à l'avance, sans rien percevoir ni comprendre.
Robot de soudure sur une chaîne automobile.
Reproduit un geste montré par un humain, dans un lieu précis.
Plier une serviette après une centaine de démonstrations.
Comprend une consigne écrite et réalise des tâches variées dans un environnement connu.
« Mets la tasse dans le tiroir du haut. »
Reste efficace quand le décor, les objets ou le robot changent ; utilise ses deux mains ; se débrouille dans une maison inconnue.
Débarrasser la table dans une cuisine jamais vue.
Se souvient, planifie de longues missions et corrige ses erreurs sans aide humaine.
Ranger toute la maison pendant une après-midi, sans surveillance.
Le robot de science-fiction (Terminator, les androïdes d'Asimov) : n'importe quelle tâche, n'importe où, pendant des jours, en improvisant face à l'inconnu.
Aucun benchmark existant ne le mesure.
Grille de lecture embodiedrank, indicative : ce n'est pas un standard officiel. Les records viennent souvent de modèles différents, réentraînésFine-tuning (réentraînement)Réentraîner un modèle sur les données d'un examen précis avant de le passer. pour chaque examen — aucun robot ne cumule encore tous ces records à la fois.
Une mission enchaîne des étapes, et chaque étape peut échouer. Probabilité de la terminer sans aide = (réussite par étape)nombre d'étapes. Entre 90 % et 100 %, chaque point gagné change le résultat d'un ordre de grandeur.
| Réussite par étape | Mission de 10 étapes | Mission de 30 étapes | Mission de 100 étapes |
|---|---|---|---|
| 90 % | 35 % | 4,2 % | < 0,01 % |
| 95 % | 60 % | 21 % | 0,59 % |
| 99 % | 90 % | 74 % | 37 % |
| 99,9 % | 99 % | 97 % | 90 % |
Passer de 90 % à 99 % divise les erreurs par 10 ; de 99 % à 99,9 %, encore par 10. Chaque « 9 » supplémentaire représente le même facteur 10.
Avec 90 % de réussite par étape, sur 30 étapes, le robot termine seul 4 fois sur 100.
Calcul simplifié : étapes indépendantes et aucune correction d'erreur. Un robot capable de se rattraper fait mieux ; un robot qui provoque des dégâts fait pire. Le nombre d'étapes des missions est un ordre de grandeur.
| Nombre d'étapes | Objectif produit (99 %) | Record en simulation (90 %) | Vraie maison inconnue (56 %) |
|---|---|---|---|
| 1 | 99 % | 90 % | 56 % |
| 5 | 95 % | 59 % | 5,5 % |
| 10 | 90 % | 35 % | 0,30 % |
| 15 | 86 % | 21 % | 0,02 % |
| 20 | 82 % | 12 % | < 0,01 % |
| 25 | 78 % | 7,2 % | < 0,01 % |
| 30 | 74 % | 4,2 % | < 0,01 % |
| 35 | 70 % | 2,5 % | < 0,01 % |
| 40 | 67 % | 1,5 % | < 0,01 % |
| 45 | 64 % | 0,87 % | < 0,01 % |
| 50 | 61 % | 0,52 % | < 0,01 % |
| 55 | 58 % | 0,30 % | < 0,01 % |
| 60 | 55 % | 0,18 % | < 0,01 % |
| 65 | 52 % | 0,11 % | < 0,01 % |
| 70 | 49 % | 0,06 % | < 0,01 % |
| 75 | 47 % | 0,04 % | < 0,01 % |
| 80 | 45 % | 0,02 % | < 0,01 % |
| 85 | 43 % | 0,01 % | < 0,01 % |
| 90 | 40 % | < 0,01 % | < 0,01 % |
| 95 | 38 % | < 0,01 % | < 0,01 % |
| 100 | 37 % | < 0,01 % | < 0,01 % |
Valeurs de référence humaines et meilleur résultat robot publié en 2025–2026, avec sources.
100 % sur chaque axe = le robot autonome rêvé. Zone colorée = meilleurs résultats publiés, en simulation seulement.
| Capacité | Robot autonome idéal | Meilleur résultat publié |
|---|---|---|
| Gestes de base | 100 % | 90 % |
| Imprévus | 100 % | 81 % |
| Réalisme | 100 % | 93 % |
| Deux bras | 100 % | 96 % |
| Maison | 100 % | 74 % |
| Mémoire | 100 % | 52 % |
| Missions longues | 100 % | 25 % |
Chaque branche est une capacité ; 100 % = réussite parfaite. La zone colorée = meilleur résultat publié en simulation pour chaque capacité. Les records proviennent de modèles différents, souvent réentraînés pour chaque examen.
| Capacité | Record publié | Écart à 100 % |
|---|---|---|
| Deux bras | 96 % | reste 4 pts |
| Réalisme | 93 % | reste 7 pts |
| Gestes de base | 90 % | reste 10 pts |
| Imprévus | 81 % | reste 19 pts |
| Maison | 74 % | reste 26 pts |
| Mémoire | 52 % | reste 48 pts |
| Missions longues | 25 % | reste 75 pts |
Ce que chaque examen vérifie, le record actuel et sa progression.
Sait-il exécuter une consigne simple ?
Attraper, poser, ouvrir, ranger sur demande, dans un environnement connu.
Résiste-t-il quand les conditions changent ?
Lumière, caméra, décor ou consigne différents : comprend-il vraiment ou répète-t-il par cœur ?
Ses résultats tiendraient-ils sur un vrai robot ?
Simulations calibrées pour prédire les performances sur de vraies machines.
Sait-il coordonner deux mains ?
Tendre, tenir d'une main et agir de l'autre, manipuler à deux bras.
Se débrouille-t-il dans une maison inconnue ?
Cuisines variées, objets du quotidien, bon sens.
Se souvient-il de ce qu'il a vu ou fait ?
Retenir une position, compter, reprendre une tâche là où il l'a laissée.
Peut-il mener une longue mission seul ?
Planifier des dizaines d'étapes, gérer les imprévus, replanifier.
71 robots : marque, pays, prix, usages et preuves réelles.
Qui fabrique, qui installe, qui livre des humanoïdes.
π0.5, OpenVLA, GR00T… capacité par capacité.
RoboArena : des duels à l'aveugle sur de vraies machines.