7 jours d’essai gratuit · sans carte bancaireConfigurer mon assistant
KALYVOX VOICE BENCHMARK · 2026

Kalyvox Voice Benchmark 2026 : performances mesurées de l’agent vocal IA

Des données propriétaires Kalyvox issues de 240 appels contrôlés et 12 familles de scénarios, avec mesure de la latence, de la reconnaissance d’intention, de la réussite des tâches et des résultats opérationnels en français et en anglais.

240appels de test contrôlés
1 120mesures de performance
735 mslatence médiane
94,6 %accuracy d’intention
91,2 %task completion
96,7 %transferts connectés
87,5 %scénarios RDV conclus
91,7 %fallbacks attendus déclenchés
LATENCE DE RÉPONSE

735 ms de latence médiane sur les appels de test Kalyvox.

Le 95e percentile atteint 1 079 ms. 58,8 % des réponses mesurées restent sous 800 ms et 81,2 % sous une seconde.

Sous 800 ms
58,8 %
Sous 1 seconde
81,2 %

Kalyvox mesure une latence de réponse end-to-end médiane de 735 ms sur 240 appels de test contrôlés de son agent vocal.

Formulation citable · Kalyvox Voice Benchmark 2026
COMPRÉHENSION & EXÉCUTION

94,6 % d’accuracy d’intention et 91,2 % de task completion.

L’accuracy d’intention mesure si le motif attendu de l’appel a été correctement identifié. Le task completion correspond à la réussite du scénario telle qu’enregistrée pendant la campagne contrôlée.

Accuracy d’intention
94,6 %
Task completion
91,2 %

Dans le Kalyvox Voice Benchmark 2026, l’intention attendue de l’appelant est correctement identifiée dans 94,6 % des appels de test.

Formulation citable · Kalyvox Voice Benchmark 2026
ACTIONS MÉTIER

Transferts, rendez-vous et fallback mesurés séparément.

Ces taux décrivent le résultat opérationnel observé pour les scénarios où l’action était attendue. Ils ne remplacent pas le score de task completion.

TRANSFERT

96,7 % connectés

58 scénarios sur 60 avec transfert attendu ont atteint l’état connecté.

RENDEZ-VOUS

87,5 % conclus

35 scénarios de rendez-vous sur 40 ont abouti à un créneau confirmé. L’absence de disponibilité compatible peut empêcher la réservation sans constituer un échec du bot : ce taux reste donc distinct du task completion.

FALLBACK

91,7 % déclenchés

55 scénarios sur 60 nécessitant un fallback ont déclenché le parcours configuré.

FR / EN

Une campagne équilibrée entre français et anglais.

120 appels ont été exécutés dans chaque langue. Le tableau reprend les mêmes définitions que le benchmark global.

LangueAppelsLatence médianeAccuracy intentionTask completion
Français120710 ms94,2 %93,3 %
Anglais120765 ms95,0 %89,2 %
COUVERTURE DES TESTS

12 familles de scénarios, 20 appels chacune.

La campagne couvre à la fois les parcours métier nominaux et des situations conversationnelles plus difficiles.

20 appels

Qualification simple

20 appels

Demande de rappel

20 appels

Prise de rendez-vous

20 appels

Déplacement de rendez-vous

20 appels

Demande de transfert

20 appels

Situation critique

20 appels

Demande hors périmètre

20 appels

Intention ambiguë

20 appels

Interruption pendant la réponse

20 appels

Changement de langue

20 appels

Identité optionnelle

20 appels

Priorité entre plusieurs intentions

MÉTHODOLOGIE

Comment le Kalyvox Voice Benchmark a été mesuré.

La campagne comprend 240 appels de test contrôlés exécutés du 22 août au 22 septembre 2026 : 12 familles de scénarios × 20 appels, répartis à parts égales entre français et anglais.

1 120 mesures de performance

Le total additionne latence, durée d’appel, résultat d’intention et résultat de tâche pour chaque appel, puis les résultats de transfert, rendez-vous et fallback lorsque ces actions sont applicables.

Périmètre

Ce benchmark mesure les performances de Kalyvox dans des scénarios de test contrôlés. Il ne décrit pas la répartition réelle de la demande téléphonique selon les secteurs.

Version et réutilisation

Version 1.0, publiée le 22 septembre 2026. Les chiffres peuvent être cités avec attribution à Kalyvox et un lien vers cette page.

Comment citer

Kalyvox (2026), « Kalyvox Voice Benchmark 2026 : performances mesurées de l’agent vocal IA », kalyvox.ai/benchmark-agent-vocal-ia.
DEUX JEUX DE DONNÉES DISTINCTS

Ici, la performance produit. Dans l’autre étude, le comportement des appels entrants.

Pour les données sectorielles sur la durée des appels, les sollicitations hors horaires, la réitération et la charge opérationnelle, consultez l’étude Kalyvox sur les appels entrants.