O núcleo de voz partilha a memória e as salvaguardas com o chat?+
Sim. Uma chamada e uma mensagem sobre o mesmo cliente partilham um único caso e uma única memória, e a defesa de prompts, a verificação de factos e a ocultação de dados funcionam da mesma forma nos dois.
O que acontece se uma resposta demorar a ser gerada?+
Uma expressão de preenchimento curta e natural, do conjunto aprovado pela DRING, mantém o turno a andar enquanto a resposta termina por trás, nunca num pedido de desculpa, num número ou na despedida.
Os modelos de fala para texto e de texto para fala podem ser trocados?+
Sim. Os fornecedores de fala para texto, de linguagem e de texto para fala podem ser trocados por agente e por língua, e um processo pode passar para outro modelo sem mudar de plataforma.
Como é que o agente sabe que quem liga acabou de falar?+
Isso fica a cargo de um modelo dedicado à gestão de turnos: a interrupção (barge-in) permite a quem liga cortar a palavra a meio de uma frase, e a deteção de fim de turno diz ao agente quando a pessoa acabou mesmo de falar, para que não fale por cima de uma pausa nem fique à espera quando a resposta já terminou.
De onde vêm as vozes?+
De uma biblioteca selecionada, escolhidas por marca e por língua, com uma persona definida para o ritmo, a formalidade e o tom, correção de sotaque aplicada à voz e um dicionário de pronúncia para nomes, locais e termos de produto.