Pour éviter la troncature d’une instruction importante, on la place dans une zone prioritaire, contrôle longueur avant envoi, réserve une marge, vérifie le contexte réellement transmis et refuse une action si elle manque.
Un jeton est une petite unité de texte traitée par un modèle de langage ; le contexte est l’ensemble des informations fournies pour produire la réponse ou la décision courante.
Le nombre de jetons est important pour une interaction robotique car il limite la quantité de consignes, d’historique et d’état que le modèle peut considérer à la fois.
Réduire un contexte trop long pour un robot consiste à résumer ce qui reste utile, supprimer doublons et éléments périmés, puis conserver explicitement contraintes et état courant.
Tester la gestion du contexte d’un modèle de langage embarqué demande de varier longueur, ordre, langue, interruptions et informations contradictoires, puis de vérifier décisions et refus.