Réponse rapide
Un déséquilibre entre classes peut faire privilégier au modèle la classe fréquente et manquer un événement rare mais critique pour le robot. On examine fréquence réelle, coût d’erreur et collecte, puis on choisit pondération, échantillonnage ou seuils sans fabriquer une distribution trompeuse. La performance est rapportée par classe et par conséquence.
Relier rareté et risque
Fréquence, précision, rappel, matrice de confusion et coût d’un faux négatif sont mesurés. Validation conserve la fréquence d’usage pour estimer le terrain, tandis que l’entraînement peut rééquilibrer avec traçabilité. Les augmentations sont vérifiées visuellement et physiquement.
Tester l’événement rare en contexte
Scénarios simulés, collecte ciblée et revue experte complètent les données sans cacher les limites. Le robot peut abstentionner ou utiliser un capteur complémentaire pour la classe critique. Seuil et politique sont testés après changement de distribution.
Ne pas se satisfaire d’une exactitude globale
Prédire toujours la classe majoritaire peut donner un score élevé et manquer l’obstacle rare. Moyennes et courbes masquent parfois l’effet sur distance ou sécurité. Chaque classe utile possède un critère explicite.
Sources et références
- [1] Model Evaluation — scikit-learn User Guide — scikit-learn