AI给抑郁打分,打出来的到底是谁的病?

原创
alex 2小时前 阅读数 2 #头条
我最近读到一篇论文,结论让我脊背一凉:当语言模型被拿来评估抑郁症患者严重程度时,它打出的分数反映的更多是模型自身的"性格",而非患者真实状态。同一个病人,换模型或换提示方式,评分就能大幅漂移——分数追的是模型的脾气,不是病人的痛苦。这让我很不安。精神健康评估本就是高度主观的领域,医生之间常有分歧,AI插进来后,它的"主观"比人类更不可控、更难校准。如果临床系统已开始依赖这类评分做决策,出错成本谁来承担?这篇论文至少提醒我们:AI在心理健康领域远未到"可信任"阶段,别急着把它当镜子——它照出来的,可能只是它自己。

原文:Language-model ratings of depression reflect the rater more than the patient · 来源:Hacker News

版权声明

所有资源都来源于爬虫采集,如有侵权请联系我们,我们将立即删除