IA · Evidencia contrastada
OpenAI lanza un banco de pruebas para evaluar respuestas de IA en salud mental
OpenAI presentó MentalHealthBench, un conjunto abierto con 1.215 conversaciones sintéticas y criterios de especialistas para medir seguridad, empatía y orientación práctica en respuestas de IA sobre salud mental, desde consultas cotidianas hasta crisis.
Fuente: Diario TI · Ver original ↗
Lo reportado
Qué incluye la evaluación
Según Diario TI, el conjunto abarca 1.215 conversaciones sintéticas que representan patrones generales de uso, perfiles y estilos de escritura, creadas con técnicas orientadas a preservar la privacidad. Incluye situaciones de adultos, adolescentes de 13 a 17 años, cuidadores y profesionales clínicos. El 53,5% corresponde a conversaciones no agudas, el 18,2% a gravedad alta y el 28,3% a emergencias.
Criterios y especialistas
Las respuestas se examinan según búsqueda de contexto, orientación práctica, precisión clínica, empatía, respeto por la autonomía, calibración de urgencia, comprobación de la realidad y prevención de daños. OpenAI afirma que participaron más de 80 psicólogos y psiquiatras con licencia.
Diario TIMentalHealthBench reúne 1.215 conversaciones sintéticas y criterios elaborados por especialistas para evaluar seguridad, empatía y orientación práctica, desde consultas cotidianas hasta situaciones de crisis.
Estado de evidencia: ViaMind comprobó que las afirmaciones materiales publicadas están respaldadas por la evidencia enlazada. Esto no implica confirmación independiente de los hechos.
Qué seguir
Observar si otros laboratorios o reguladores adoptan MentalHealthBench como referencia y si OpenAI publica resultados de sus propios modelos en este conjunto.
Compartir esta historia
RECIBE VIAMIND RADAR
Lo que importa,
directo en tu correo.
Un resumen diario con una historia clave de cada sección.


