每天听简报,了解最新科技、AI、软件资讯
换一套执行框架,同一个大模型能解出的题几乎不变,花费却能差出五倍,这是加州大学伯克利分校团队实测出来的结果。执行框架行话叫哈尼斯,是包在模型外面管工具调用的软件,Claude Code、Codex CLI都算。团队让七个模型分别套上Claude Code、Codex CLI和开源的Pi,跑同一批测试题。同一个模型换框架解题数几乎一样,用Claude Code却比用Pi多花接近一倍的钱。更扎心的是,四分之三的跨厂商对比里,模型换到别家框架反而解题更多。评论区有人反驳,贵框架多花的钱买的是安全防护,不能算浪费。也有人说单框架比较,本身就漏掉了并行执行这类关键设计。
进度保存在本设备 · 登录同步