Pour qui enseigne les langues
Donner le retour de ce soir sans lire trente fichiers.
Vous n’avez pas besoin de la forme d’onde. Vous avez besoin de trois filtres dans cet ordre : confiance sous 0.5 (réenregistrer, ne pas noter), decodedTranscript contre la phrase demandée (ils ont dit autre chose), puis les mots sous 50 et les phonèmes dedans. Phone PCC 0.682 contre le consensus humain 0.555 est la raison pour laquelle ces phonèmes sont une meilleure remarque que « réécoute ».
Trois filtres, puis la remarque — jamais la deuxième écoute d’abord
Un dossier de devoirs n’est pas une playlist. C’est un tableau. Confiance, decodedTranscript, scores de mots, phonèmes. L’oreille n’entre que sur les lignes qui survivent au tableau — et encore, seulement si vous contestez encore une cellule rouge. La plupart des soirs, l’oreille n’entre pas.
- Confiance sous 0.5 — jeter. Le guide dit que l’audio peut ne pas correspondre à la référence. Noter cela apprend à l’élève à tricher une prise cassée.
- decodedTranscript loin de la phrase — ce n’est pas le devoir. Erreur de consigne, pas de phonème. Redemandez la phrase.
- Mots sous 50 — ouvrir `phonemes[]`. Noter les deux pires phones en IPA. C’est la remarque.
La remarque est un phonème, pas un discours
La procédure interne du moteur est celle-ci : points forts en 80–100, travail sous 60–79, trois sons, paires minimales, IPA. Et : si la confiance est sous 0.5, dire que l’évaluation peut être instable avant toute pédagogie.
Cet ordre est tout le métier. « Pratique davantage » s’écrit quand on a sauté la bande. DH /ð/ dans weather, puis la même phrase, s’écrit quand on l’a lue.
Vingt élèves, une phrase, une passe
Le même texte de référence pour tout le monde, sinon vous ne triez pas. Phone PCC 0.682 est l’accord au phone avec des humains formés à 0.555. Vous ne dites pas que le moteur est une personne. Vous dites qu’il est plus cohérent avec le consensus humain que deux humains entre eux — assez pour décider qui reçoit une remarque ce soir sans écouter trente fichiers.