Réponse rapide
Pour les scènes rares, on mesure fréquence réelle et gravité de l’erreur, puis on choisit représentation terrain, évaluation pondérée ou jeu de test dédié. La rareté ne doit pas être masquée.
Quantifier la distribution
Occurrence, exposition, classe, condition et conséquence d’une erreur sont estimés séparément. Une scène peu fréquente peut rester prioritaire si son risque est élevé.
Cibler sans déformer
Exemples supplémentaires, simulation, pondération ou échantillonnage enrichissent l’évaluation. La fréquence réelle reste documentée à côté du jeu équilibré.
Tester le cas rare
Jeu dédié, seuils, abstention et comportement de repli mesurent ce qui se passe dans l’événement. Une moyenne globale ne suffit pas.
Sources et références
- [1] Model Evaluation — scikit-learn User Guide — scikit-learn