每天听简报,了解最新科技、AI、软件资讯
网络安全研究团队近日发布涵盖近三十款开源模型的攻防基准评测,系统梳理了未对齐智能体在专业红队任务中的实战能力。评测全面比对了通过权重干预消除拒绝机制的模型表现,覆盖漏洞分析、威胁猎杀与渗透测试等硬核场景,展示了轻量化模型在普通个人设备上离线执行高阶安全任务的巨大潜力。安全社区讨论指出,开源模型在攻防能力上的快速演进,正促使传统防御体系对自主安全智能体的潜在破坏力,展开全方位的压力检验。
进度保存在本设备 · 登录同步