OpenAI给AI心理健康划红线,这步棋走早了还是晚了?
原创
当一个AI在用户说"我撑不下去了"时该做什么?是转移话题、给建议,还是直接挂断?OpenAI的MentalHealthBench试图用一套标准化测试回答这个问题。我看了他们的介绍——这个基准的核心假设很激进:把心理危机干预能力变成可量化的分数。争议点显然不在技术指标上,而在于"量化共情"本身是否成立。一个模型能在benchmark上拿高分,不代表它不会在某个深夜给一个绝望的人发一句冰冷的"请寻求专业帮助"。但话说回来,没有这个baseline,行业连讨论"AI能不能做心理陪伴"都没有共同的尺子。我倾向于相信这个基准的价值不在于它的精度,而在于它把"该不该让AI碰心理健康"这个模糊的伦理问题,拽到了一个可以被具体争论的位置上。
原文:MentalHealthBench · 来源:Hacker News
版权声明
所有资源都来源于爬虫采集,如有侵权请联系我们,我们将立即删除
itfan123





