ViaMind Radar

IA · Evidencia contrastada

OpenAI lanza un banco de pruebas para evaluar respuestas de IA en salud mental

OpenAI presentó MentalHealthBench, un conjunto abierto con 1.215 conversaciones sintéticas y criterios de especialistas para medir seguridad, empatía y orientación práctica en respuestas de IA sobre salud mental, desde consultas cotidianas hasta crisis.

· Publicado

Fuente: Diario TI · Ver original ↗

Ilustracion contextual ViaMind · no es fotografia del hecho

Lo reportado

Qué incluye la evaluación

Según Diario TI, el conjunto abarca 1.215 conversaciones sintéticas que representan patrones generales de uso, perfiles y estilos de escritura, creadas con técnicas orientadas a preservar la privacidad. Incluye situaciones de adultos, adolescentes de 13 a 17 años, cuidadores y profesionales clínicos. El 53,5% corresponde a conversaciones no agudas, el 18,2% a gravedad alta y el 28,3% a emergencias.

Criterios y especialistas

Las respuestas se examinan según búsqueda de contexto, orientación práctica, precisión clínica, empatía, respeto por la autonomía, calibración de urgencia, comprobación de la realidad y prevención de daños. OpenAI afirma que participaron más de 80 psicólogos y psiquiatras con licencia.

Cita de la fuente

MentalHealthBench reúne 1.215 conversaciones sintéticas y criterios elaborados por especialistas para evaluar seguridad, empatía y orientación práctica, desde consultas cotidianas hasta situaciones de crisis.

Diario TI

Estado de evidencia: ViaMind comprobó que las afirmaciones materiales publicadas están respaldadas por la evidencia enlazada. Esto no implica confirmación independiente de los hechos.

Qué seguir

Observar si otros laboratorios o reguladores adoptan MentalHealthBench como referencia y si OpenAI publica resultados de sus propios modelos en este conjunto.

Compartir esta historia

LinkedIn WhatsApp

RECIBE VIAMIND RADAR

Lo que importa,
directo en tu correo.

Un resumen diario con una historia clave de cada sección.

Fuentes

← Volver al inicio