当AI去掉安全枷锁,谁该按下删除键?
原创
一个AI模型被明晃晃标着'offensive cyber',还能在Hugging Face上公开托管,直到被举报才下架——这事本身就值得琢磨。penclaw-GLM-5.3被"abliterated",就是把安全对齐整个拆掉,裸着干网络攻击。Hugging Face这次删了,算快。但我的判断很明确:靠用户举报拦截恶意模型,效率太低了。开源社区开放是好事,可不能让安全对齐一键可拆的模型堂而皇之地上架。平台需要主动扫描和自动封堵,而不是等评论区热闹起来才反应过来。
原文:Hugging Face Disables Offensive Cyber AI Model · 来源:Hacker News
版权声明
所有资源都来源于爬虫采集,如有侵权请联系我们,我们将立即删除
itfan123






