Dónde encontrarlas
Abre un asistente, selecciona el botón Test en la cabecera y elige Simulations. El panel se abre junto al editor, para que puedas ajustar el prompt y volver a ejecutar una prueba sin salir de la página.Crear una prueba
Selecciona New test y avanza por los pasos:1
Start
Empieza en blanco, o aplica una persona que haya sugerido Milian; consulta Generate with Milian más abajo.
2
Details
Nombra la prueba y describe en texto simple la persona de quien llama (identidad y personalidad).
3
Goal
Describe qué intenta conseguir quien llama, por ejemplo: “Tu objetivo principal es reservar una consulta para la próxima semana.”
4
Judge
Elige el modo Chat o Voice, añade los criterios de éxito que debe comprobar el juez, opcionalmente enumera las herramientas que se espera que llame el asistente, y define el número máximo de turnos de quien llama (hasta 20, 12 por defecto).
Chat frente a voz
- Chat — una conversación rápida, solo de texto, entre el LLM que hace de quien llama y tu asistente. No se realiza ninguna llamada, y es la forma más económica de iterar sobre un prompt.
- Voice — realiza una llamada real: una persona simulada que llama con una voz sintetizada habla con tu asistente por el mismo camino que sigue una llamada en vivo, de modo que se ejercita todo el pipeline de voz. Tarda más que el chat, cuesta más y aparece en History como cualquier otra llamada; elige la voz de quien llama al cambiar a este modo.
Crear una prueba a partir de una llamada real
Abre una llamada finalizada en History y selecciona Create Simulation Test. Famulor redacta una persona, un objetivo y criterios de éxito por defecto (información precisa, tono profesional, resolución o enrutamiento correctos) a partir de la transcripción y el análisis de esa llamada, los guarda como una prueba nueva y te lleva al panel de Simulations de ese asistente: revísala y edítala allí antes de la primera ejecución. Es la forma más rápida de convertir una conversación real que salió mal en una prueba de regresión. Consulta Análisis posterior a la llamada.Ejecutar pruebas y leer los resultados
Ejecuta una prueba a la vez, o selecciona Run all para recorrer todas las pruebas en orden. Cada ejecución muestra:- un resultado de superado o no superado por cada criterio de éxito, junto con el razonamiento del juez;
- la transcripción completa, etiquetada como Caller / Assistant;
- las llamadas a herramientas realizadas durante la ejecución, comprobadas frente a cualquier cosa que hayas marcado como herramienta esperada;
- para las ejecuciones de voz, un desglose de latencia (de extremo a extremo, tiempo hasta el primer token del LLM, tiempo hasta el primer audio hablado, latencia del reconocimiento de voz y tiempo de respuesta percibido), además de un enlace View call a la llamada resultante en History.
Simulations es una prueba de conversación basada en texto o audio, no un validador únicamente de la redacción de tu prompt: el LLM que hace de quien llama puede improvisar dentro de la persona y el objetivo que definiste, así que un resultado de prueba refleja cómo se desarrolla realmente la conversación.