每天听简报,了解最新科技、AI、软件资讯
英伟达团队做出一套编程智能体执行框架,叫SoL-Pi。它能把智能体干活时的token消耗砍掉四成五到五成,API开销省下大约三分之一,性能不打折扣。做法是把自动研究循环拿到大量不同环境里反复跑,专挑真正管用的改动留下来。最后筛出四个机制,包括动作执行、上下文压缩、观察结果处理和委托阅读。在一个叫EdgeBench的五十一项任务测试集上,配上两款新模型。跟一个叫Pi的现有框架打成平手,token流量却明显更省。论文估算,按小时算能省下几美元到十几美元的调用费用。代码已经挂在NVIDIA自己的NVlabs账号下,想验证随时能跑。
进度保存在本设备 · 登录同步