Aller au contenu
Décrivez un processus. DRING vous rappelle en deux minutes et qualifie le besoin. Être rappelé en deux minutes
Être rappelé en 2 minutes Voir Agent Factory
Moteur vocal

Écouter, décider, répondre.

Reconnaissance vocale en flux, cerveau de l'agent, prise de parole et synthèse vocale forment une seule chaîne derrière chaque appel, testée et interchangeable sans ralentir la conversation.

Un tour, de bout en bout

La même chaîne, à chaque appel

Les canaux arrivent à gauche, le moteur vocal répond au centre, avec la mémoire et les outils à ses côtés, et le résultat repart à droite. Tout le parcours est testé et surveillé, version après version.

CANAUX Appels vocauxPSTN · SIP WhatsAppMessagerie pro EmailConfirmations CŒUR SPEECH-TO-SPEECH Mémoire Outils STTVoix entrante LLMCerveau agent TTSVoix sortante Flux audio direct Garde-fousRègles vérifiées en direct Agent Factory S'améliore à chaque version SORTIES Fiche de résultatChaque appel noté ProcessusWebhook · CRM Vos systèmesRapports APPELANT ÉQUIPE IA DRING Tous les canaux Un seul cerveau Chaque appel noté TEST VERSION SUIVI

Voir comment une version est testée avant d'emprunter ce chemin

Au cœur du moteur

Ce que le moteur vocal fait vraiment

Chaque tour de parole de l'appelant passe par cinq étapes, de la ligne à la réponse. Deux garanties valent pour les cinq.

  1. L'appel est connecté

    Le SIP, le PBX virtuel et les routes téléphoniques connectées acheminent l'appel vers le moteur vocal, et les règles d'appels sortants s'appliquent avant la composition du numéro.

    Voir la téléphonie en détail
  2. La voix devient texte

    L'appel est transcrit en temps réel, puis corrigé et normalisé avant que l'agent ne raisonne : un accent, une interruption ou une pause en milieu de phrase ne déforment pas ce qui a été dit.

  3. L'agent raisonne

    Il identifie l'intention en s'appuyant sur la mémoire des tours précédents et des autres canaux, vérifie garde-fous et règles avant de parler ou d'agir, et utilise les outils nécessaires en cours d'appel.

  4. Des tours de parole naturels

    Un modèle dédié gère l'interruption (barge-in), pour que l'appelant puisse couper l'agent en pleine phrase, et la détection de fin de tour, pour que l'agent ne parle pas par-dessus une pause ni ne laisse un blanc après une réponse terminée.

  5. Le texte devient une voix

    Chaque marque choisit une voix dans une bibliothèque sélectionnée, avec un persona pour le rythme, le registre et le ton, une correction d'accent et un dictionnaire de prononciation pour les noms, les lieux et les termes produits.

À chaque tour

Des réponses rapides, sans silence

Quand un outil ou un modèle met plus de temps, une courte formule d'attente naturelle, tirée du répertoire validé par DRING, fait avancer le tour de parole.

  • Les réponses gardent un rythme naturel, quel que soit le fournisseur utilisé
  • Les formules d'attente ne s'insèrent jamais dans une excuse, un chiffre ou la conclusion

Routage et bascule des modèles

Les modèles de reconnaissance, de langage et de voix sont choisis par agent et par langue, et un parcours peut passer à un autre modèle sans changer de plateforme.

  • En cas d'incident chez un fournisseur, l'appel peut basculer vers un fournisseur opérationnel
  • Un service plus performant n'entre en production qu'après avoir passé la batterie de non-régression de toute la pile technique
Voir le benchmark des opérations
Commun avec le chat

Le même cerveau, à l'oral comme à l'écrit

La voix n'est pas un système distinct du chat. La mémoire, les garde-fous et la fiche de résultat sous-jacents sont les mêmes.

Une seule mémoire

Une personne reconnue au téléphone est reconnue dans un message, et une conversation commencée au téléphone peut se poursuivre sur WhatsApp sans que le client ait à se répéter.

Les mêmes garde-fous

La protection contre l'injection de prompt, la vérification des faits et le masquage des données s'appliquent à une réponse orale exactement comme à une réponse écrite, sans version allégée des règles.

La même fiche de résultat

Un appel se clôt sur la même fiche structurée qu'un chat : un résultat, un score et les champs définis par votre équipe, inscrits dans votre CRM.

Voir le moteur de chat qui partage ce cerveau

FAQ

Le moteur vocal en questions.

Le moteur vocal partage-t-il la mémoire et les garde-fous du chat ?+

Oui. Un appel et un message concernant le même client partagent un seul dossier et une seule mémoire, et la protection contre l'injection de prompt, la vérification des faits et le masquage des données s'appliquent de la même façon aux deux.

Que se passe-t-il si une réponse tarde à être générée ?+

Une courte formule d'attente naturelle, tirée du répertoire validé par DRING, fait avancer le tour de parole pendant que la réponse se termine en arrière-plan, sans jamais s'insérer dans une excuse, un chiffre ou la conclusion.

Pouvons-nous changer les modèles de reconnaissance et de synthèse vocales ?+

Oui. Les fournisseurs de reconnaissance vocale, de langage et de synthèse vocale sont interchangeables séparément, par agent et par langue, et un parcours peut passer à un autre modèle sans changer de plateforme.

Comment l'agent sait-il que l'appelant a fini de parler ?+

Un modèle dédié à la prise de parole s'en charge : l'interruption permet à l'appelant de couper l'agent en pleine phrase, et la détection de fin de tour indique à l'agent quand l'appelant a vraiment terminé, pour qu'il ne parle pas par-dessus une pause et ne laisse pas de blanc après une réponse complète.

D'où viennent les voix ?+

D'une bibliothèque sélectionnée, avec un choix par marque et par langue, un persona défini pour le rythme, le registre et le ton, une correction d'accent appliquée à la voix et un dictionnaire de prononciation pour les noms, les lieux et les termes produits.

Voir toute la FAQ

Découvrez le moteur vocal sur votre propre parcours d'appel

Transmettez votre contexte avec votre accord : DRING vous appellera, se présentera et évaluera avec vous comment le moteur vocal traiterait votre ligne la plus chargée.