Las simulaciones te permiten preguntar “¿qué haría este agente si …?” antes envías un cambio rápido. A escenario describe a una persona que llama sintéticamentequiénes son, qué quieren y la afirmaciones Esto debe ser cierto para la llamada resultante. Ejecutar un escenario reproduce un mensaje del sistema contra una persona que llama impulsada por LLM, produce una transcripción sintética y la califica.
Ejecutar los mismos escenarios contra su vivir Y otra vez contra a
Candidato prompt, y la diferencia en la tasa de aprobación le indica si la edición es segura para enviar.
Las simulaciones nunca hacen una llamada real y nunca tocan a su proveedor de voz. Probaron el mensaje, no la implementación, por lo que funcionan para todos los proveedores. Tampoco aparecen en su lista de correo electrónico. conversaciones, análisis o facturación.
Escenarios
Un escenario tiene tres partes:
- Llamada Persona: su papel, su objetivo, rasgos de comportamiento opcionales, hechos que solo revelan cuando se les pregunta, y una línea de apertura opcional.
- Aserciones Cada afirmación es una pregunta que el juez responde sobre la transcripción (sí/no, un número o un texto) más la condición que la hace pasar. Las afirmaciones deciden pasar/no pasar.
- Configuración cuántos turnos puede ejecutar la llamada y qué nivel de modelo la impulsa.
En el editor de escenarios, describa lo que desea probar en una línea (“el agente siempre ofrece una devolución de llamada a las personas que llaman enojadas”) y haga clic en el botón “Agregar”. Borrador con AI genera una llamada y aserciones desde el mensaje en vivo del agente para que lo revises y edites antes de guardarlo.
Tu agente está habilitado monitores También se califican contra la transcripción sintética, pero solo para información: nunca deciden pasar / fallar, porque los monitores están sintonizados con el tráfico real y pueden disparar sorprendentemente en llamadas sintéticas.
Exportar a escenario de LangWatch
Al editar un escenario guardado, expanda Exportar código LangWatch Para copiar un TypeScript Escenario LangWatch test. La exportación asigna la persona que llama, el límite de turnos y las afirmaciones del borrador actual. Incluye un adaptador stub reemplaza ese stub con la integración que invoca a tu agente antes de ejecutar la prueba.
Una carrera o suite puede ser apuntada a cualquiera de las indicaciones de un agente:
- los vivir en el que se encuentra actualmente en el agente, o
- cualquier versión una encarnación desplegada, o una Candidato En el caso de los Pestaña Versiones.
Debido a que un símbolo de solicitud candidato puede ser probado antes de que se implemente, Simulaciones cierra el bucle de “borrar una edición” a “saber que es seguro”.
Suite corre y compara
A suite run reproduce todos los escenarios habilitados para un agente contra un símbolo del sistema. Su tasa de aprobación es el número de titular. Para juzgar un cambio de símbolo del sistema, ejecute la suite contra su símbolo del sistema en vivo, vuelva a ejecutarla contra un candidato y, a continuación, abra Comparar
para ver el delta de paso y un desglose por escenario de lo que se fijo,
retrocedidoo se quedó sin cambios junto a una diferencia de las dos indicaciones.
Habilitar simulaciones
Un administrador de Zelto activa la función desde la pestaña de indicadores de características de la organización; una vez habilitada, los propietarios y administradores ven la función de la cuenta de Zelto.
Simulaciones entrada en la barra lateral y puede crear escenarios y ejecutar.
Relacionado
- Agentes donde viven los avisos en directo y los avisos de los candidatos.
- Monitores los monitores que se puntúen (de forma informativa) en cada llamada simulada.