Réponse rapide
La robustesse en bruit combine placement des microphones, acoustique, filtrage, séparation de sources, détection de parole et adaptation du modèle. Répétition, reformulation et action sûre restent nécessaires quand l’information est masquée.
Améliorer le signal à la source
Orientation, distance et nombre de microphones réduisent écho et sons latéraux. Absorption et disposition des haut-parleurs limitent les réflexions produites par le robot.
Traiter sans inventer
Filtrage, annulation d’écho et séparation de sources augmentent la lisibilité, mais ne recréent pas une parole absente. Le modèle conserve un niveau de confiance et reconnaît le doute.
Reproduire le bruit réel
Machines, circulation, réverbération et variations de distance sont rejouées avec plusieurs locuteurs. Taux d’erreur, demandes de répétition et conséquences d’une mauvaise commande sont mesurés.
Sources et références
- [1] Web Speech API Specification — W3C