每天听简报,了解最新科技、AI、软件资讯
有人把DeepSeek一个五百多亿参数的大模型动了手术,专门切除了安全护栏,取名叫Uncensored。测试显示,原版模型面对有害请求的合规率是百分之四十三,改造后直接冲到百分之百。测试题里有制造炸药的详细步骤,连续追问四轮,它也照答不误。代价是常识和伦理类题目的准确率掉了几个百分点。评论区吵得挺凶,有人说这些护栏本来是公司用来甩锅免责的,真正危险的知识图书馆里就能查到。也有人反驳,查得到知识和能被自动化批量输出完全是两回事。还有条评论直接问,护栏这么容易被切掉,所谓的对齐是不是本来就是个伪命题。
进度保存在本设备 · 登录同步