AI Safety2026-09-24
OpenAI Blog
OpenAI presenta MentalHealthBench
OpenAI presentó MentalHealthBench, un nuevo benchmark diseñado para medir qué tan útiles y seguros son los sistemas de IA durante conversaciones realistas sobre salud mental. La herramienta se desarrolló con aportes de expertos y se centra en escenarios delicados donde una evaluación genérica pasaría por alto matices importantes.
En lugar de probar solo conocimientos factuales o fluidez, MentalHealthBench examina si un modelo responde con el apoyo adecuado, evita consejos dañinos y reconoce cuándo debería alentar al usuario a buscar atención profesional. El benchmark evalúa tanto la capacidad de acompañamiento como el riesgo. Ese doble enfoque importa porque una respuesta puede sonar empática y aun así dar una indicación peligrosa, o puede ser prudente pero no ofrecer ayuda útil.
MentalHealthBench ofrece una manera estructurada de poner a prueba modelos en conversaciones difíciles, incluidos momentos de angustia, confusión o vulnerabilidad. Su propósito es ayudar a los desarrolladores a identificar debilidades antes del despliegue y a seguir el progreso con el tiempo.
El lanzamiento refleja una preocupación creciente por cómo la gente usa la IA como apoyo en salud mental. Los chatbots están disponibles a cualquier hora y pueden sentirse privados, lo que los vuelve atractivos para usuarios que no tienen acceso inmediato a un terapeuta o a un servicio de crisis. Pero no reemplazan a los profesionales capacitados y pueden causar daño si manejan mal situaciones graves. Benchmarks como MentalHealthBench buscan hacer más medibles esas limitaciones.
También abren preguntas más amplias sobre responsabilidad. Si un modelo se despliega en un contexto relacionado con la salud, ¿qué nivel de seguridad debería exigírsele? ¿Cómo deberían las empresas manejar las crisis, la privacidad y la derivación a atención humana? MentalHealthBench no responde todas las preguntas de política, pero les da a investigadores y reguladores un punto de referencia común. A medida que la IA se integra más en la vida cotidiana, las evaluaciones que combinan empatía, precisión y conciencia del riesgo serán clave para construir sistemas que apoyen a las personas sin engañarlas ni ponerlas en peligro.