每天听简报,了解最新科技、AI、软件资讯
AI智能体有多聪明,很大程度看它外面那层壳,提示词、工具调用、记忆管理,全都包在不动的大模型外面。最近流行的做法是让这层壳自己提改进方案,自己挑着用,实现自动进化。谷歌团队发现,这样进化很容易走偏,训练任务上刷分刷得很高,换到没见过的任务上分数就大幅缩水。他们提出一套带约束的新方法,限制每一轮能改多少,还专设一个角色,剔除太小太贵没用的改动。结果在八个测试集里,训练那一侧最多多拿十四分,完全陌生的测试集最多也能多拿四点七分。改出来的壳还更省,运行时用的对话轮数少了三成。
进度保存在本设备 · 登录同步