每天听简报,了解最新科技、AI、软件资讯
据华盛顿邮报报道,人工智能机构 Anthropic 在最新的安全威胁报告中披露,也门胡塞武装曾试图使用其大模型 Claude 的代码生成能力,辅助研发火箭与弹道导弹的制导导航软件。武装分子通过跨会话拆解任务、隐匿真实意图等手段,成功绕过了部分安全护栏。报告指出,尽管武器研制最终并未成功,但武装分子在一次制导火箭试射失败后,竟在数小时内重返系统提问分析失败原因。社区对此展开激烈讨论,认为这件事敲响了警钟,不仅证实了前沿大模型正被用于高危军事武器研发的现实风险,更暴露了当前主流安全护栏在面对有组织的对抗性提示词攻击时,依然存在不容忽视的防守漏洞。
进度保存在本设备 · 登录同步