Chaque appel est lu, pas un échantillon
CALLAII est le moteur d'analyse des conversations que Callmenta développe en interne. Il transcrit l'appel avec une reconnaissance vocale entraînée pour le turc, lit le parcours émotionnel dans le transcript, produit une note qualité sur 12 dimensions, écrit le coaching du conseiller et remonte les appels à risque aux responsables. Pas d'échantillonnage : tous les appels enregistrés sont traités.
Ce qui sort d'un appel
Tous les champs ci-dessous sont produits en un seul passage d'analyse et figurent sur la fiche de l'appel dans le panneau.
Reconnaissance vocale turque et séparation des locuteurs
L'enregistrement est transcrit et les locuteurs sont séparés en segments horodatés. Le moteur a été entraîné pour le turc, sur de vrais appels avec accents régionaux, débit rapide et bruit de fond.
Le parcours émotionnel, du début à la fin
La façon dont le client est entré dans l'appel et celle dont il l'a quitté sont lues séparément : calme, neutre, inquiet, déçu, en colère, content, satisfait. La direction et l'intensité sont également écrites. Chaque lecture arrive avec une justification courte tirée du transcript ; elle ne dit pas « négatif » puis s'arrête.
Les moments critiques, avec la citation
Jusqu'à cinq moments qui ont fait basculer l'appel, chacun avec la phrase du client, l'émotion à cet instant et le déclencheur. On voit ce qui a cassé sans écouter l'enregistrement.
La désescalade a-t-elle fonctionné
Le fait qu'un appel commencé sous tension se soit réellement apaisé est un champ à part. Savoir si le conseiller a vraiment calmé le client devient mesurable.
Note qualité sur 12 dimensions
Accueil, écoute active, isolement du motif d'appel, compréhension du problème, explication du raisonnement, présentation du résultat, mise en confiance, obtention de l'accord, langage positif, posture calme et professionnelle, dépassement des attentes et expérience globale. Chaque dimension de 0 à 100, avec un total pondéré.
Pourquoi la note est celle-là
Les dimensions les plus fortes, celles qui ont coûté le plus de points et la raison de la perte, appuyée sur le transcript. Ce qu'il aurait fallu dire pour la note maximale est écrit sous forme de phrase exemple, et ce champ n'est jamais laissé vide, même sur un bon appel.
Risque opérationnel
Risque d'attrition, besoin d'escalade, catégorie de risque et priorité. Un appel à risque remonte de lui-même au responsable au lieu d'attendre un rapport.
Note de coaching
Un point fort, un axe de progrès critique et une action. L'axe de progrès vient avec la phrase du conseiller, ce qui n'allait pas dedans et ce qui pouvait être dit à la place.
Mesure du comportement vocal
À côté du texte, un comportement mesurable est extrait de l'audio lui-même. Cette mesure n'est jamais confiée à un modèle de langage ; elle est calculée directement sur l'enregistrement, la marge d'erreur vient donc du signal et non d'une interprétation.
Les seuils ne sont pas inventés ; ils viennent de la distribution d'appels réels et sont remesurés à mesure que les données grandissent. Si une voix ne peut pas être rattachée à une personne avec certitude, la note est écrite sans nommer personne. Dire « vous avez coupé la parole » à la mauvaise personne est pire que de ne rien dire.
- Interruptions : prises de parole qui arrivent sur l'autre partie encore en train de parler
- Équilibre de parole : part du temps de parole de chaque côté
- Silence mort : temps dans l'appel où personne ne parle
- Parole simultanée : temps total où les deux parties parlent en même temps
Nous ne déduisons pas d'émotion de la voix
Ce n'est pas un manque, c'est une décision d'ingénierie et de conformité assumée. Nous en écrivons la raison ouvertement, parce que l'inverse est souvent promis sur ce marché.
La reconnaissance des émotions sur les salariés est interdite
Le règlement européen sur l'IA interdit les systèmes qui déduisent des émotions des données biométriques d'un salarié sur le lieu de travail. Un produit qui sort un score de colère ou de stress depuis le ton de voix d'un conseiller n'est pas vendable en Europe. Nous n'avons jamais ouvert cette porte.
La déduction depuis la voix du client est à haut risque
Déduire l'émotion de la voix du client figure à l'annexe haut risque du même règlement. Entrer dans cette classe implique évaluation de conformité, tenue de registres et obligations d'audit. Nous avons choisi de ne pas y mettre le produit.
Notre lecture du sentiment vient du texte
Le parcours émotionnel est lu dans le transcript. Le texte n'est pas une donnée biométrique, c'est pourquoi cette lecture reste hors de la définition de la reconnaissance des émotions. Derrière chaque étiquette d'émotion visible dans le panneau, il y a une phrase.
La mesure acoustique n'alimente pas le résultat
Interruptions, silence mort et équilibre de parole ne sont pas une entrée de la lecture du sentiment, ne la calibrent pas et ne dirigent pas non plus l'attention vers « regardez cette minute ». Les deux lignes restent volontairement séparées et cette frontière est protégée par un contrôle automatique dans le code. Donner un nom émotionnel au même chiffre ferait basculer le produit en classe haut risque.
Ce que nous y gagnons : la mesure est du comportement brut, elle se discute difficilement et elle se déploie aussi bien en Europe que dans les murs du client. Au lieu de dire à un conseiller « tu avais l'air en colère », nous pouvons dire « sur cet appel tu as coupé la parole sept fois et il y a 42 secondes de silence mort ». Vérifiable, et corrigeable.
Comment la liaison se met en place
- Votre standard actuel se raccorde par un trunk SIP ; vos numéros et votre opérateur ne changent pas.
- Le standard transmet une copie de chaque appel via la norme d'enregistrement SIPREC ; CALLAII ne se place jamais sur le trajet de l'appel.
- L'enregistrement est transcrit, l'analyse est produite et l'appel se pose sur la fiche client.
- Note qualité, coaching et alerte de risque apparaissent dans le panneau sans attendre un rapport.
- Si les données ne doivent pas sortir de votre organisation, CALLAII Edge fait tourner l'analyse sur vos propres serveurs.
La différence avec les API de sentiment généralistes
Les services de sentiment textuel des fournisseurs cloud renvoient une étiquette. Ce qui sert vraiment en centre de contact, c'est une note, une justification, un coaching et une action.
Un bulletin, pas une étiquette
Une étiquette positive ou négative ne fait progresser personne. CALLAII produit ensemble la note sur 12 dimensions, la raison des points perdus et la phrase exemple.
Conçu pour le turc
Le moteur a été entraîné sur des appels en turc. Les services multilingues généralistes perdent le ton, les abréviations et le jargon de terrain des centres de contact turcs.
Le panneau et le flux sont inclus
L'analyse n'est pas une simple réponse d'API ; elle arrive rattachée à la fiche client, au bulletin du conseiller, à l'alerte du responsable et au planning.
Localisation des données explicite
Les données sont conservées dans la région UE et le processus est conforme au RGPD (et au KVKK pour la Turquie). Là où rien ne doit sortir des murs, il y a l'installation Edge.
Questions fréquentes
Faites-vous de l'analyse de sentiment, oui ou non ?
Oui, mais la source compte. La lecture vient du transcript de l'appel : comment le client a commencé, comment il a terminé, la direction, l'intensité et la justification. Nous ne déduisons pas d'émotion du ton, de la hauteur de voix ni d'aucune autre caractéristique biométrique. Cette distinction est juridiquement décisive : le texte n'est pas une donnée biométrique.
Des concurrents disent détecter la colère au ton de voix. Pourquoi pas vous ?
Parce que la reconnaissance des émotions sur les salariés au travail est interdite par le règlement européen sur l'IA, et que la déduction depuis la voix du client relève de la classe haut risque. Un produit bâti sur cette promesse pose problème dès qu'on le vend en Europe ou qu'on l'installe sur site. Nous sommes allés vers le comportement mesurable : interruptions, silence mort, équilibre de parole.
Quel pourcentage des appels est analysé ?
Tous les appels enregistrés. Le contrôle qualité ne passe pas par l'échantillonnage ; au lieu d'écouter quelques appels par mois et de juger l'équipe sur cet échantillon, une note est produite pour chacun.
Devons-nous changer de standard téléphonique ?
Non. CALLAII se connecte à votre système actuel par un trunk SIP et écoute une copie de l'appel via la norme SIPREC. Vos numéros, votre opérateur et votre flux d'appels restent identiques.
Où les enregistrements sont-ils traités ?
En installation cloud, les données restent dans la région UE. Si elles ne doivent pas sortir de votre organisation, CALLAII Edge fait tourner l'analyse sur votre serveur, sans connexion internet si nécessaire.
Que se passe-t-il si une analyse est fausse ?
Les notes sont contestables : le responsable voit l'analyse, lit sa justification et corrige si besoin. En cas de doute sur une erreur de reconnaissance vocale, le transcript se corrige à la main depuis l'écran de correction. La justification derrière un résultat est toujours visible, ce n'est pas une boîte noire.
Testez sur votre propre appel
Pendant la démo, nous faisons tourner ensemble un enregistrement réel de votre secteur. Vous voyez ce que l'analyse produit sur vos données, pas sur un exemple.