Experimentos (pruebas A/B)
Ejecuta dos configuraciones de agentes en paralelo en llamadas reales y deja que las tasas de éxito elijan la ganadora.
Las pruebas A/B responden «¿el nuevo prompt realmente es mejor?» con datos en lugar de intuiciones: las llamadas entrantes se dividen entre variantes del agente, cada llamada se califica como de costumbre y comparas las tasas de éxito por variante.
Hay dos superficies:
- Por agente — las pruebas se configuran y ajustan en el
generador de cada agente, en su pestaña A/B (
/dashboard/agents/<id>?tab=variants). Allí se crean las variantes y se activa la prueba. - Vista general entre agentes — la página Experimentos
(
/dashboard/experiments, en Calidad y pruebas) reúne las pruebas de todos los agentes en una sola tabla.
Configura una prueba
En la página Experimentos, haz clic en Configurar una prueba A/B y elige un agente. Llegarás a la pestaña A/B de ese agente, donde crearás las configuraciones de variantes (una se marca como control) y activarás las pruebas divididas. Consulta Crear un agente para conocer el generador.
Lee la vista general
Para cada agente con una prueba, la tabla Experimentos muestra:
- Estado — Activa (pruebas divididas activadas) o Pausada.
- Variantes — cada variante como una etiqueta, con el control identificado.
- Líder — la variante con la mejor tasa de éxito hasta ahora, junto con su porcentaje. Hasta que las variantes tengan llamadas calificadas, aparecerá Aún no hay suficientes datos — no declares un ganador basándote en unas pocas llamadas.
- Llamadas — total de llamadas entre las variantes de la prueba.
Los agentes sin una prueba se muestran debajo como accesos de un clic para iniciar una. Al hacer clic en cualquier fila, irás a la pestaña A/B de ese agente para ajustar o concluir la prueba.