Réponse rapide
Avant d’exécuter une politique apprise par démonstration, on vérifie son objectif, ses préconditions, sa couverture, ses limites, ses sorties et son comportement dans des scénarios nominal, perturbé et inconnu. Simulation, banc et essai supervisé comparent actions proposées et contraintes physiques. Une incertitude ou une extrapolation excessive déclenche observation, demande d’aide ou repli.
Valider hors ligne puis sous supervision
Jeu gelé, simulation, robot immobilisé et zone contrôlée mesurent réussite, collision, effort, énergie, latence et stabilité. Les versions de données, modèle et contrôleur sont figées. Les actions risquées exigent confirmation et limite indépendante.
Relier confiance et conséquence
Erreur de prédiction, distance à l’exemple, changement de contexte et résultat sont suivis par étape. Le seuil d’acceptation dépend de la réversibilité et de la présence humaine. Les cas hors distribution restent abstention ou intervention.
Ne pas valider parce que la trajectoire semble fluide
Un mouvement fluide peut franchir une limite d’effort ou échouer sur une charge différente. Les capteurs et contrôleurs mesurent l’effet réel. Toute extrapolation non testée interdit l’exécution autonome.
Sources et références
- [1] Artificial intelligence and robotics — NIST