> ## Documentation Index
> Fetch the complete documentation index at: https://help.ciarem.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# El Centro de evaluación: revisar respuestas reales

> Evalúa las respuestas que tu agente realmente envió, apruébalas o corrígelas por categoría, y convierte tu retroalimentación en comportamiento duradero.

El playground te dice cómo *respondería* tu agente. El **Centro de evaluación** (en **Configuración de IA** en la barra lateral) cubre lo que *realmente* dijo. Recopila las respuestas que tus agentes les enviaron a clientes reales, hace que la IA marque las que merecen una segunda mirada y te guía para revisarlas. Una sesión corta de revisión se convierte en correcciones duraderas.

## Corre una evaluación

Haz clic en **Nueva evaluación**. Ciarem examina cada respuesta que tus agentes han enviado **desde tu última evaluación**, en todos los canales (WhatsApp, Instagram, Messenger y el chat del sitio web), emparejando cada respuesta con el mensaje del cliente al que contestó. Luego conserva solo las respuestas que merecen revisión y las agrupa en **categorías** con nombre, como "Falta respaldo factual" o "Tono demasiado frío", escritas en el idioma principal de tu espacio de trabajo.

Dos desenlaces no te piden ningún trabajo. Si tus agentes no han enviado nada desde la última corrida, ves "No hay respuestas nuevas". Si todo lo examinado se ve bien, la evaluación termina sin nada marcado.

<img src="https://mintcdn.com/ciaremaai/cNtTcjF_a4GWWvTG/images/es/ciarem-help-evaluation.png?fit=max&auto=format&n=cNtTcjF_a4GWWvTG&q=85&s=cf9b819dc8d26682f25ab09a8d4108fa" alt="El Centro de evaluación: historial de evaluaciones con respuestas evaluadas, adecuadas versus corregidas y categorías por corrida" width="1680" height="1114" data-path="images/es/ciarem-help-evaluation.png" />

## Revisa categoría por categoría

Una evaluación preparada te guía por sus categorías paso a paso ("1 de 3"). Cada paso muestra los intercambios reales, con el mensaje del contacto junto a la respuesta que generó tu agente, y te pide un solo veredicto sobre la categoría:

* **Respuestas adecuadas**: estas respuestas son correctas. Pasa a la siguiente categoría.
* **Necesitan corrección**: algo debería cambiar. Entonces dices qué, de una de dos formas:
  * **Mejorar respuesta**: describe en lenguaje simple cómo debió responder el agente ("no confirmes cobertura de cirugías, solo el plan Premium incluye cirugías menores"). Ciarem incorpora esa instrucción al comportamiento aprendido del agente. Si tu descripción contiene un dato del negocio (un precio, una zona de cobertura, una política), Ciarem te lo dice y te lleva a la [base de conocimiento](/es/ai-agent/knowledge-bases). Los datos se responden desde allí, no se aprenden como comportamiento.
  * **Debe transferir**: ese momento le correspondía a una persona. Ciarem crea una [regla de transferencia](/es/ai-agent/human-handoff-and-escalation) real a partir de tu descripción, para que la próxima vez la conversación llegue a una persona.

Cada corrección también deja una prueba automática, para que Ciarem [siga verificando](/es/ai-agent/agent-health) que el arreglo se mantiene a medida que tu configuración evoluciona.

<img src="https://mintcdn.com/ciaremaai/cNtTcjF_a4GWWvTG/images/es/ciarem-help-evaluation-review.png?fit=max&auto=format&n=cNtTcjF_a4GWWvTG&q=85&s=e2a7fd735909d57e24ab5397ef3ac17c" alt="Revisar una categoría: el mensaje del contacto junto a la respuesta generada, con los veredictos Respuestas adecuadas y Necesitan corrección" width="1680" height="1114" data-path="images/es/ciarem-help-evaluation-review.png" />

## El historial de evaluaciones

La página principal del Centro de evaluación es un historial de cada corrida: cuándo corrió, cuántas respuestas se evaluaron, la división entre **Adecuadas** y **Corregidas**, cuántas categorías revisaste y su estado. Abre cualquier corrida con **Ver resultados** para volver a ver qué se marcó y qué decidiste. Con el tiempo, esta tabla es tu tendencia de calidad. Un porcentaje de adecuadas que sube significa que tu agente está mejorando.

## Correcciones también desde el playground

No tienes que esperar a una revisión por lotes. En el playground, cada respuesta analizada trae las acciones **Buena respuesta** / **Necesita corrección**, y una corrección abre el mismo diálogo de dos caminos: mejorar la respuesta o convertir el momento en una regla de transferencia. Consulta [El playground](/es/ai-agent/playground).

## Cuándo correrla

Corre una evaluación después de tus primeros días en vivo, y luego cada vez que algo importante cambie: precios nuevos, un agente nuevo en el equipo, una campaña que trae un tipo nuevo de cliente. Revisar unas cuantas categorías cada semana es más rápido que leer cada conversación.
