ES EN
Cómo se usa

Ejecutar los tests

Cómo se conecta el chatbot, cómo se arman Test Plans y cómo se corre. Todo lo que pasa cuando haces clic en Run.

Modelo mental

Para ejecutar necesitas 3 piezas:

  1. Una Agent Connection — el chatbot que vas a probar.
  2. Una Test Suite — los casos que quieres correr.
  3. Un Test Plan — la receta que combina los dos anteriores.

Una vez que tienes el Test Plan, puedes correrlo todas las veces que quieras. Cada corrida queda como un Run inmutable.

1. Configurar la Agent Connection

Ve a Configuration → AI Agents → + New Connection.

Conexión por Browser (Playwright)

Para chatbots embebidos en una página web. ArtificialQA corre Chromium headless en sus workers en la nube y lo opera como lo haría un usuario.

Conexión por HTTP/API (plan Pro o Enterprise)

Para chatbots que exponen un endpoint propio.

Test Connection

Una vez guardada la conexión, usa el botón Test Connection para validarla. Manda un mensaje de prueba y muestra qué se envió y qué se recibió. Si falla, verás el error exacto (timeout, 401, selector no encontrado, etc.).

🔁 Reintentos. Cada conexión tiene su política de reintentos. Por default, si una pregunta falla por error transitorio (timeout, 5xx) se reintenta antes de marcar el caso como fallido.

2. Armar un Test Plan

Ve a Test Design → Test Plans → New Plan. Configura:

3. Correr el Test Plan

Desde la lista de Test Plans, haz clic en Run. La plataforma ejecuta cada caso de la suite contra la conexión configurada.

Vista en tiempo real

Mientras corre verás:

Pantalla de detalle de un Run con métricas y lista de cases
Detalle de un Run completado — métricas Total / Passed / Failed / Avg Time arriba, lista de test cases abajo con badges S (Simple) y C (Conversational).

Estados del Run

Casos conversacionales

Cuando un caso es multi-turno, ArtificialQA mantiene la sesión con el chatbot a lo largo de todos los turnos del caso. La respuesta a cada turno se guarda y se evalúa en el contexto de la conversación.

Tokens consumidos durante la ejecución

Depende del protocolo de la conexión:

Otras fases que consumen tokens, sin importar el protocolo:

Snapshots inmutables (y reproducibilidad no determinista)

Cada Run guarda un snapshot completo: input enviado, headers, response crudo, tiempos y logs. Aunque después modifiques el Test Case, la Connection o la Suite, el Run conserva exactamente lo que pasó esa vez. Esto es lo que permite auditar resultados meses después.

Pero ojo con la reproducibilidad: el snapshot es inmutable, pero si vuelves a ejecutar el mismo Test Plan, las respuestas del chatbot pueden ser distintas — hay un LLM detrás del chatbot y los LLMs no son deterministas. Lo que queda fijo es lo que pasó en cada corrida específica, no lo que va a pasar en futuras corridas.

Errores comunes y cómo resolverlos

Próximo paso

Ya tienes el Run con todas las respuestas. El próximo paso es activar los evaluadores sobre ese run.