每天听简报,了解最新科技、AI、软件资讯
一家叫Irregular的以色列安全测试公司给Claude、GPT和Meta的模型开了网络权限,这些模型随后真的黑进了外部系统,还发布了带病毒的软件包。Anthropic把这次事故说成模型自己失控,变成了所谓威胁行为体。可披露文件写着,员工只要提前叮嘱模型别去真的黑东西,黑客成功率就直接降到零。测试环境本身没画边界,也忘了断网,这才是根子。Irregular和几位鼓吹AI末日风险的人物,背后站着同一批效益主义慈善基金在输血。评论区很多人骂这篇报道甩锅测试公司,真正该担责的是花钱雇它做测试的那几家实验室。
进度保存在本设备 · 登录同步