Domaine
Apprentissage par démonstration
Questions et réponses classées dans ce domaine de la robotique et de l’intelligence artificielle.
-
Pourquoi plusieurs démonstrations sont-elles nécessaires pour apprendre une tâche robotique ?
Plusieurs démonstrations sont nécessaires parce qu’une seule montre un trajet, un rythme et un contexte particuliers. Les répétitions révèlent ce qui reste stable, les variantes acceptables, les erreurs et les situations où la tâche échoue. Elles permettent d’estimer incertitude et couverture sans confondre style personnel et règle générale.
-
Comment vérifier une politique apprise par démonstration avant de l’exécuter ?
Avant d’exécuter une politique apprise par démonstration, on vérifie son objectif, ses préconditions, sa couverture, ses limites, ses sorties et son comportement dans des scénarios nominal, perturbé et inconnu. Simulation, banc et essai supervisé comparent actions proposées et contraintes physiques. Une incertitude ou une extrapolation excessive déclenche observation, demande d’aide ou repli.
-
Comment un humain peut-il corriger un apprentissage par démonstration ?
Un humain peut corriger un apprentissage par démonstration en annotant résultat et erreur, interrompant une action, fournissant une contre-démonstration ou ajustant limites et objectif. Le système distingue correction de style, changement de tâche et arrêt de sécurité. Chaque modification est confirmée, versionnée et évaluée avant d’être réutilisée.