Usted nunca escribe un prompt
Su equipo explica el trabajo y revisa lo que dice el agente. Escribir y mantener el prompt sigue siendo cosa nuestra.
Deje un flujo y su número. La IA se identifica, hace preguntas concretas y prepara un brief estructurado.
Usted nunca escribe un prompt. Nosotros reunimos el material, creamos las pruebas a partir de él y solo lanzamos lo que las supera.
Escribir prompts no es su trabajo. Tampoco lo es imaginar las llamadas incómodas que recibirá su agente.
Su equipo explica el trabajo y revisa lo que dice el agente. Escribir y mantener el prompt sigue siendo cosa nuestra.
Documentos, grabaciones, políticas y los comentarios que usted deja durante la revisión se convierten en el conjunto de pruebas de ese agente.
Un agente solo pasa a producción cuando supera ese conjunto. Hasta entonces, se queda en una línea privada.
De 1.000 a 10.000 conversaciones simuladas, creadas para su empresa, antes de la primera llamada real. El número de conversaciones simuladas depende del agente, y cada una se genera a partir de su propio proceso, sus documentos y sus grabaciones de llamadas, no de un conjunto genérico de referencia.
La misma disciplina se aplica a cada cambio. Cada regla que nos da se suma al conjunto único de pruebas de ese agente, y una regla nueva solo llega a producción cuando todas las anteriores siguen superando las pruebas junto a ella. Ver cómo se crea el agente
El mismo proceso se aplica a todos los agentes, por sencillo que parezca el caso de uso visto desde fuera.
Clientes enfadados, pedidos equivocados, trampas de política, silencios e interrupciones, sacados de su propio proceso.
Cada perfil mantiene una conversación completa con el agente, no una única pregunta con guion.
Unos evaluadores automáticos puntúan cada conversación. Cuando no coinciden, una persona audita la llamada.
Antes de publicar nada, los resultados se comparan con la versión anterior, así que un arreglo no puede romper otra cosa sin que se note.
El traspaso a una persona se verifica de forma explícita, en lugar de dar por hecho que funciona.
El tráfico real aumenta por fases controladas, vigilando las puntuaciones en cada paso y con la versión anterior lista.
La evaluación automática puede desviarse o pasar por alto un matiz. Las comprobaciones independientes, junto con la revisión por personas de cada discrepancia, hacen que la señal sea más útil que una única puntuación.
Las pruebas no terminan con el lanzamiento. Los agentes en producción pasan controles de calidad periódicos mientras sigan funcionando.
En cuanto termina la llamada, se puntúan la resolución, el cumplimiento de políticas y el tiempo de respuesta, y el sentimiento se etiqueta.
Cada agente en producción se vuelve a comparar con la versión anterior según un calendario, para detectar una regresión silenciosa antes que un cliente.
Si una puntuación se sale de su rango esperado, salta una alerta por sí sola, sin esperar a la siguiente revisión.
Los errores del reconocimiento de voz se registran por nombre, lugar y término de producto, y se corrigen en el diccionario del agente.
| Métrica | Definición | Por qué importa |
|---|---|---|
| Resolución | Si de verdad se atendió el motivo por el que llamó el cliente. | La medida básica de si el agente hizo su trabajo. |
| Sentimiento | Cómo cambió el tono del cliente del principio al final de la llamada. | Detecta llamadas resueltas sobre el papel que, sin embargo, frustraron al cliente. |
| Cumplimiento de políticas | Si las acciones del agente se mantuvieron dentro de las reglas configuradas. | Mantiene al agente dentro de los límites que fijó la empresa. |
| Tiempo de respuesta | El intervalo entre el momento en que el cliente deja de hablar y la respuesta del agente. | Una respuesta lenta parece una mala conexión, aunque el contenido sea correcto. |
| Precisión del traspaso | Si el agente pasó la llamada a una persona cuando debía. | Un traspaso que falta es peor que uno innecesario. |
| Variación de regresión | El cambio de puntuación frente a la versión anterior con el mismo conjunto de pruebas. | Detecta una versión que empeora el agente sin que se note. |
Qué frase de apertura, qué tono o qué voz funcionan se decide en llamadas salientes reales, no en una reunión.
La frase de apertura, el tono, la voz, el ritmo, el orden de las preguntas y la forma de responder a una objeción. Una sola variable por variante, para poder atribuir el resultado.
Por el propio resultado de la campaña, con una muestra mínima acordada por variante. El sentimiento y la tasa de traspaso actúan como límites de seguridad: una variante que gana en resultados pero pierde en acogida no sale a producción.
La ganadora se extiende por fases controladas, las demás variantes se retiran y el cambio queda registrado para que la siguiente comparación parta de una referencia conocida.
Una variante ganadora sigue pasando la prueba de regresión antes de llegar a toda la campaña.
No. Usted explica el trabajo, comparte los documentos y las grabaciones y revisa lo que dice el agente. Escribir y mantener el prompt es trabajo nuestro, y las pruebas se crean a partir del material que nos ha dado, no de una plantilla genérica.
Sí. Las pruebas de regresión se ejecutan periódicamente frente a la versión anterior, y cada cambio pasa por el mismo despliegue por fases que el primer lanzamiento.
Una persona revisa y audita la conversación antes de dar el resultado por definitivo. Si las discrepancias se repiten, es una señal para afinar el propio conjunto de evaluación.
Sí. Los perfiles y escenarios se construyen en torno a sus propias políticas y casos límite, y puede verlos durante la puesta en marcha.
Salta automáticamente una alerta de desviación, se revisan las llamadas que la originan y el arreglo vuelve a pasar por el conjunto de pruebas antes de que ese tipo de llamada vuelva al agente.
Repase cómo sería un lanzamiento medido, desde el primer resumen del proceso hasta el ciclo de revisión tras la puesta en producción.