OpenAI представила бенчмарк MentalHealthBench для оцінки безпеки ШІ у темі психічного здоров'я
Introducing MentalHealthBench
OpenAI випустила MentalHealthBench — розроблений за участю експертів бенчмарк для оцінки того, наскільки корисними й безпечними є відповіді ШІ у реалістичних розмовах на теми психічного здоров'я. Інструмент має допомогти розробникам тестувати моделі перед випуском на предмет ризикованих чи шкідливих відповідей.
Мовою оригіналу · EN
OpenAI introduced MentalHealthBench, an expert-informed benchmark for evaluating helpful and safe AI responses across realistic mental health conversations. The tool is designed to help developers…
Чому в стрічці: Новий інструмент безпеки ШІ від OpenAI, релевантний профілю інтересу до AI governance/safety.