Réponse rapide
Représenter une démonstration humaine consiste à conserver les observations utiles, les actions, le contexte, les contacts, les objets, le résultat et l’incertitude dans une forme exploitable par le robot. La représentation peut être trajectoire, séquence d’états, relation entre objets ou objectif, selon la généralisation attendue. Les détails personnels ou accidentels sont écartés.
Choisir la bonne abstraction
Position, vitesse, force, événement, outil et repère sont normalisés avec unités et timestamps. Le modèle sépare invariants de tâche et variations de style ou de morphologie. Occlusion, geste incomplet et erreur sont marqués plutôt que lissés sans preuve.
Relier démonstration et réussite
Chaque séquence possède préconditions, étapes, résultat et critères d’arrêt. Le robot peut comparer une nouvelle situation à ces éléments et demander une correction. Les représentations sont rejouées dans des environnements différents avant usage.
Ne pas encoder toute la vidéo comme une instruction
Image, voix et mouvement contiennent du contexte inutile ou sensible. Une représentation trop brute généralise mal et expose des personnes. Les données sont minimisées et leur transformation reste traçable.
Sources et références
- [1] Artificial intelligence and robotics — NIST