Aller au contenu
Décrivez un processus. DRING vous rappelle en deux minutes et qualifie le besoin. Être rappelé en deux minutes
Être rappelé en 2 minutes Voir Agent Factory
Qualité

Testé avant de prendre un appel

Vous n'écrivez jamais de prompt. Nous recueillons la matière, en tirons les tests et ne mettons en service que ce qui les réussit.

Batterie de tests DRING

Des tests tirés de vos propres contenus

Écrire des prompts n'est pas votre métier. Imaginer les appels délicats que recevra votre agent non plus.

Aucun prompt à écrire

Votre équipe explique le travail et relit ce que dit l'agent. Le prompt, nous l'écrivons et le maintenons nous-mêmes.

Des tests issus de la collecte

Documents, enregistrements, règles et commentaires laissés pendant la relecture deviennent la batterie de tests de cet agent.

Validé par DRING, puis lancé

Un agent ne passe en production qu'après avoir franchi cette batterie. D'ici là, il reste sur une ligne privée.

De 1 000 à 10 000 conversations simulées, construites pour votre entreprise, avant le premier appel réel. Le nombre de conversations simulées dépend de l'agent, et chacune est générée à partir de votre parcours, de vos documents et de vos enregistrements d'appels, pas d'un jeu de tests générique.

La même rigueur s'applique à chaque modification. Chaque règle que vous nous donnez rejoint la batterie de tests unique de cet agent, et une nouvelle règle n'est mise en service que si toutes les règles existantes passent encore à ses côtés. Voir comment l'agent est construit

Avant le lancement

Ce qui se passe avant le lancement d'un agent

Le même processus s'applique à chaque agent, aussi simple que paraisse le cas d'usage vu de l'extérieur.

  1. Des personas tirés du réel

    Appelants en colère, commandes erronées, pièges liés aux règles, silences et interruptions, tirés de votre propre parcours.

  2. Conversations simulées

    Chaque persona mène une conversation complète avec l'agent, pas une simple question scriptée.

  3. Évaluation indépendante

    Des évaluateurs automatiques notent chaque conversation. En cas de désaccord, une personne audite l'appel.

  4. Non-régression

    Les résultats sont comparés à la version précédente avant toute mise en service : une correction ne peut pas casser autre chose en silence.

  5. Transferts vérifiés

    Le transfert vers un conseiller est vérifié explicitement, pas supposé fonctionner.

  6. Déploiement progressif

    Le trafic réel augmente par paliers maîtrisés, avec un suivi des scores à chaque étape et la version précédente prête à reprendre la main.

L'évaluation automatique peut dériver ou manquer une nuance. Des contrôles indépendants, complétés par une revue humaine de chaque désaccord, donnent un signal plus utile qu'un score unique.

Après le lancement

Le contrôle qualité continue

Les tests ne s'arrêtent pas au lancement. Les agents en production passent par un contrôle qualité régulier, aussi longtemps qu'ils sont en service.

Chaque appel noté

Dès la fin de l'appel, résolution, respect des règles et temps de réponse sont notés, et le ressenti client est étiqueté.

Contrôles réguliers

Chaque agent en production est rejoué face à la version précédente selon un calendrier défini, pour repérer une régression discrète avant qu'un client ne la remarque.

Alertes de dérive

Un score qui sort de sa plage attendue déclenche une alerte de lui-même, sans attendre le contrôle suivant.

Erreurs de reconnaissance

Les erreurs de reconnaissance vocale sont suivies par nom, lieu et terme produit, puis corrigées dans le dictionnaire de l'agent.

IndicateurDéfinitionEnjeu
RésolutionLe motif d'appel du client a-t-il vraiment été traité ?La mesure clé : l'agent a-t-il fait son travail ?
Ressenti clientL'évolution du ton du client entre le début et la fin de l'appel.Repère les appels résolus sur le papier qui ont pourtant agacé le client.
Respect des règlesLes actions de l'agent sont-elles restées dans les règles configurées pour lui ?Maintient l'agent dans les limites fixées par l'entreprise.
Temps de réponseLe délai entre la fin de la phrase du client et la réponse de l'agent.Une réponse lente donne l'impression d'une mauvaise connexion, même quand elle est juste.
Justesse des transfertsL'agent a-t-il transféré vers un conseiller quand il le fallait ?Un transfert manqué est plus grave qu'un transfert inutile.
Écart de régressionLa variation de score par rapport à la version précédente, sur la même batterie de tests.Repère une version qui dégrade discrètement l'agent.
Tests A/B sortants

La meilleure accroche l'emporte sur les résultats, pas sur les avis

L'accroche, le ton ou la voix qui fonctionnent se décident sur de vrais appels sortants, pas en réunion.

Test illustratif · variantes d'accrochePhase 1 · trafic équilibré
Variante A« Bonjour, je vous appelle de la part de l'équipe logistique au sujet de votre demande d'expédition. »
trafic33 %
résultats positifs0 %
0 appels
Variante B« Bonjour, vous nous avez demandé un devis de fret le mois dernier. Est-ce un bon moment pour deux questions ? »
trafic33 %
résultats positifs0 %
0 appels
Variante C« Bonjour. Il s'agit d'un court appel au sujet des tarifs d'expédition à l'international. »
trafic34 %
résultats positifs0 %
0 appels
Échantillon minimum non atteint. Continuez à répartir le trafic.

Ce qui est testé

L'accroche, le ton, la voix, le rythme, l'ordre des questions, la manière de répondre à une objection. Une seule variable par variante, pour que le résultat soit attribuable.

Choix de la gagnante

Sur le résultat propre à la campagne, avec un échantillon minimal convenu par variante. Le ressenti client et le taux de transfert servent de garde-fous : une variante qui gagne sur les résultats mais perd sur l'accueil n'est pas retenue.

Mise en production

La gagnante est déployée par paliers maîtrisés, les autres variantes sont retirées, et le changement est consigné pour que la comparaison suivante parte d'une référence connue.

Une variante promue passe encore la batterie de non-régression avant d'atteindre toute la campagne.

Garde-fous

Ce qu'un agent ne fera jamais

  • Il refuse ce qui sort de son périmètreUne demande hors du champ pour lequel l'agent a été conçu est déclinée, pas contournée par l'improvisation.
  • Il n'invente jamais de règleSans règle fournie, il n'en devine pas une et ne s'engage pas en votre nom.
  • Il transfère les sujets sensiblesLes demandes sensibles sont confiées à une personne plutôt que traitées selon le seul jugement de l'agent.
  • Il propose toujours un conseillerUne voie vers un interlocuteur humain reste ouverte à l'appelant, quoi que l'agent sache faire lui-même.
FAQ

Questions sur les tests

Devons-nous écrire ou maintenir le prompt ?+

Non. Vous expliquez le travail, partagez les documents et les enregistrements, et relisez ce que dit l'agent. Écrire et maintenir le prompt, c'est notre travail, et les tests sont construits à partir de la matière que vous nous avez confiée, pas d'un modèle générique.

Les tests ont-ils lieu avant chaque version, et pas seulement au lancement ?+

Oui. Des contrôles de non-régression sont menés face à la version précédente selon un calendrier régulier, et chaque modification suit le même déploiement progressif que le lancement initial.

Que se passe-t-il quand deux évaluations divergent ?+

La conversation est confiée à un relecteur humain et auditée avant que le résultat soit arrêté. Des désaccords répétés indiquent qu'il faut affiner le jeu d'évaluation lui-même.

Pouvons-nous voir les scénarios de test de notre agent ?+

Oui. Les personas et les scénarios sont construits autour de vos propres règles et cas limites, et vous y avez accès pendant la mise en place.

Que se passe-t-il quand les scores d'un agent en production dérivent ?+

Une alerte de dérive se déclenche automatiquement, les appels concernés sont examinés, et la correction repasse par la batterie de tests avant que ce type d'appel ne soit de nouveau confié à l'agent.

Voir toute la FAQ

La batterie de tests, sur votre cas d'usage

Parcourez avec nous ce que serait un lancement mesuré, du premier brief de parcours jusqu'à la boucle de revue après la mise en service.