OpenAI publică MentalHealthBench, un test pentru răspunsurile AI în conversații despre sănătatea mintală
OpenAI a prezentat pe 23 septembrie 2026 MentalHealthBench, un set deschis de evaluare a răspunsurilor AI în conversații despre sănătatea mintală, realizat cu peste 80 de experți autorizați din 22 de țări.
OpenAI a prezentat pe 23 septembrie 2026 MentalHealthBench, un set deschis de evaluare a răspunsurilor AI în conversații despre sănătatea mintală, realizat cu peste 80 de experți autorizați din 22 de țări.
Pe scurt
- Scenariile acoperă stresul cotidian, situațiile grave și urgențele.
- Conversațiile sunt sintetice, construite pentru evaluare.
- Criteriile urmăresc siguranța, înțelegerea contextului și autonomia utilizatorului.
Evaluare cu criterii scrise de specialiști
Experții au formulat criterii pentru fiecare conversație, iar răspunsurile modelelor sunt evaluate în raport cu acestea. Fiecare conversație a fost verificată de cel puțin trei specialiști. Au fost păstrate criteriile acceptate de cel puțin doi, fără contradicția celui de-al treilea.
OpenAI precizează că proporția scenariilor din test nu reflectă frecvența lor în ChatGPT. Rezultatele unui asemenea test nu demonstrează eficiența unei terapii, iar compania spune explicit că ChatGPT nu înlocuiește îngrijirea profesională.
Surse verificate
OpenAI — Materialul oficial. Data și ora provin din RSS-ul oficial.
