Fiche technique CALLAII ASR v2
Reconnaissance vocale · Modèle de reconnaissance vocale qui sépare les enregistrements d'appels par canaux de locuteurs et les convertit en texte. L'analyse, le coaching et l'évaluation de la qualité fonctionnent sur la base de cette transcription.
Deuxième version adaptée au turc des centres d'appels. Le taux d'erreur sur les enregistrements réels a été réduit de moitié par rapport à la première version.
Nouveautés de cette version
- Sur 10 enregistrements réels, le taux d'erreur par mot est passé de 14,25 % à 6,51 %
- Le taux d'erreur par caractère est passé de 8,68 % à 4,57 %
- Un prompt de domaine a été ajouté pour les expressions des centres d'appels (annonces et noms d'institutions)
Limites et usage responsable
- Les appels longs pouvaient entrer dans une boucle de répétition en fin d'appel ; corrigé dans la v3
- Lorsqu'un enregistrement arabe recevait un étiquette de langue incorrecte, la sortie était corrompue ; corrigé dans la v3 grâce à la détection automatique de la langue
Entraînement et mesures
| Validation turque | taux d'erreur par mot 7,02 %, taux d'erreur par caractère 2,15 % |
|---|
Plus bas, c'est mieux. Les mêmes 10 enregistrements d'appels réels ont été fournis aux deux versions.
Afficher les valeurs sous forme de tableau
| v1 | v2 | |
|---|---|---|
| Taux d'erreur de mots (WER) | 14,25 | 6,51 |
| Taux d'erreur de caractères (CER) | 8,68 | 4,57 |
Fiche technique
| Version | v2 |
|---|---|
| Publication | juin 2026 |
| Statut | remplacé par la v3 |
Les données clients ne sont pas utilisées pour l'entraînement des modèles. Cette fiche a été créée le 27.09.2026. Consultez callmenta.com pour la version actuelle. Versions et évolutions