每天听简报,了解最新科技、AI、软件资讯
OpenAI和HuggingFace之间那起被反复引用的安全事故,藏着一个很少被提起的细节。工程师想分析攻击手法时,几家标榜安全的商业模型全都拒绝配合。最后只能换成智谱的GLM五点二,才把攻击拆解清楚。这条推文一发,点赞破万,回复也有一百六十条。作者的意思很直白,越标榜安全的模型,遇到真实攻击分析反而越掉链子。评论区吵得也凶,有人说这暴露了商业模型的对齐做得太死板,连帮忙复盘攻击都被当成风险直接拒绝。讽刺的地方在于,真正顶上去干活的,是那款没贴安全标签的开源模型。
进度保存在本设备 · 登录同步