AI Safety2026-09-24
OpenAI Blog
OpenAI stellt MentalHealthBench vor
OpenAI hat MentalHealthBench vorgestellt – einen neuen Benchmark, der messen soll, wie hilfreich und sicher KI-Systeme in realistischen Gesprächen über psychische Gesundheit reagieren. Das Werkzeug wurde mit Beiträgen externer Fachleute entwickelt und konzentriert sich auf sensible Szenarien, in denen eine generische Bewertung wichtige Nuancen verfehlen würde.
MentalHealthBench prüft nicht nur Faktenwissen oder Sprachgewandtheit. Der Benchmark untersucht, ob ein Modell angemessen unterstützt, schädliche Ratschläge vermeidet und erkennt, wann es einen Nutzer dazu anregen sollte, professionelle Hilfe zu suchen. Bewertet werden Supportivität und Risiko gleichermaßen. Diese Doppelperspektive ist wichtig, weil eine Antwort einfühlsam klingen und trotzdem gefährliche Hinweise geben kann – oder umgekehrt vorsichtig formuliert ist, aber keinen nutzbaren Beitrag leistet. MentalHealthBench bietet eine strukturierte Methode, um Modelle in schwierigen Gesprächen zu testen, etwa in Momenten von Verzweiflung, Verwirrung oder Verletzlichkeit. Entwickler sollen damit Schwächen vor dem Einsatz erkennen und Fortschritte über die Zeit verfolgen können.
Die Veröffentlichung spiegelt die wachsende Sorge darüber, wie Menschen KI für psychische Unterstützung nutzen. Chatbots sind rund um die Uhr erreichbar und wirken privat – attraktiv für Nutzer, die keinen schnellen Zugang zu Therapeuten oder Krisendiensten haben. Sie ersetzen jedoch keine ausgebildeten Fachkräfte und können Schaden anrichten, wenn sie ernste Situationen falsch behandeln. Benchmarks wie MentalHealthBench machen solche Grenzen messbarer.
Sie werfen zugleich größere Fragen nach Verantwortung auf. Welches Sicherheitsniveau sollte verlangt werden, wenn ein Modell in einem gesundheitsnahen Kontext eingesetzt wird? Wie sollen Unternehmen mit Krisensituationen, Datenschutz und der Übergabe an menschliche Hilfe umgehen? MentalHealthBench beantwortet nicht jede politische Frage, gibt Forschern und Regulierern aber einen gemeinsamen Bezugspunkt. Je stärker KI in den Alltag einzieht, desto wichtiger werden Bewertungen, die Empathie, Genauigkeit und Risikobewusstsein verbinden – damit Systeme Menschen unterstützen, ohne sie in die Irre zu führen oder zu gefährden.