OpenAI представила бенчмарк MentalHealthBench для оцінки безпеки ШІ у темі психічного здоров'я

Introducing MentalHealthBench

OpenAI випустила MentalHealthBench — розроблений за участю експертів бенчмарк для оцінки того, наскільки корисними й безпечними є відповіді ШІ у реалістичних розмовах на теми психічного здоров'я. Інструмент має допомогти розробникам тестувати моделі перед випуском на предмет ризикованих чи шкідливих відповідей.

Мовою оригіналу · EN

OpenAI introduced MentalHealthBench, an expert-informed benchmark for evaluating helpful and safe AI responses across realistic mental health conversations. The tool is designed to help developers…

Читати оригінал на OpenAI →

Чому в стрічці: Новий інструмент безпеки ШІ від OpenAI, релевантний профілю інтересу до AI governance/safety.

← Назад до стрічки