Comment gérer un déséquilibre entre classes dans un apprentissage supervisé robotique ?

Réponse rapide

Un déséquilibre entre classes peut faire privilégier au modèle la classe fréquente et manquer un événement rare mais critique pour le robot. On examine fréquence réelle, coût d’erreur et collecte, puis on choisit pondération, échantillonnage ou seuils sans fabriquer une distribution trompeuse. La performance est rapportée par classe et par conséquence.

Relier rareté et risque

Fréquence, précision, rappel, matrice de confusion et coût d’un faux négatif sont mesurés. Validation conserve la fréquence d’usage pour estimer le terrain, tandis que l’entraînement peut rééquilibrer avec traçabilité. Les augmentations sont vérifiées visuellement et physiquement.

Tester l’événement rare en contexte

Scénarios simulés, collecte ciblée et revue experte complètent les données sans cacher les limites. Le robot peut abstentionner ou utiliser un capteur complémentaire pour la classe critique. Seuil et politique sont testés après changement de distribution.

Ne pas se satisfaire d’une exactitude globale

Prédire toujours la classe majoritaire peut donner un score élevé et manquer l’obstacle rare. Moyennes et courbes masquent parfois l’effet sur distance ou sécurité. Chaque classe utile possède un critère explicite.

Sources et références

  1. [1] Model Evaluation — scikit-learn User Guide — scikit-learn

Cette réponse vous a-t-elle été utile ?