En este momento estás viendo 🤖 PharmaWise 6.0! ✨ – Desafio Evaluadores

🤖 PharmaWise 6.0! ✨ – Desafio Evaluadores

🤖 3 Agentes independientes que evalúan cada acción

En la edición anterior mostramos cómo PharmaWise 6.0 responde consultas técnicas con referencias deterministas.

Hoy vamos un paso más allá: ¿cómo sabemos si la respuesta es confiable?

Con un solo clic en «Evaluar», PharmaWise activa 3 agentes evaluadores independientes que analizan la respuesta en tiempo real.

El resultado aparece directamente en pantalla con un sistema semáforo:

🟢 Anclaje al Contexto: 4.5 / 5.0
Evalúa si la respuesta se sustenta exclusivamente en la evidencia documental recuperada. Un score alto garantiza que no hay contenido fabricado ni alucinado — cada afirmación es trazable a su fuente original.

🟢 Relevancia de Respuesta: 5.0 / 5.0
Evalúa si la respuesta aborda de manera directa y completa la consulta del usuario. Verifica que el agente comprendió la intención de la pregunta sin desviarse.

🟢 Relevancia de Contexto: 4.4 / 5.0
Evalúa la calidad de la búsqueda documental: si las fuentes recuperadas eran efectivamente pertinentes para resolver la consulta.

Promedio: 4.6 / 5.0

Pero lo importante no es solo el número.

Cada evaluador justifica su score. En la pantalla de Evaluaciones se puede ver el trabajo individual de cada agente: qué evaluó, por qué asignó ese puntaje y dónde encontró las fortalezas o debilidades de la respuesta.

Los evaluadores son agentes independientes — no tienen relación con el agente que generó la respuesta. Es como tener un equipo de QA automático revisando cada interacción.

Y todo esto queda registrado en el Audit Trail.

En la próxima edición: trazabilidad completa y audit trail para auditorías.

👇 Dejanos tus comentarios y consultas en el chat o envia tu consulta a info@pharma-ia.com.ar 👇

 

👉 Más información descargar pantallas paso a paso:  Evaluadores_PharmaWise