每天听简报,了解最新科技、AI、软件资讯
Cognition今天发布了新一代编程模型SWE-2,在自家编码基准上拿到百分之五十的分数,只比Fable五点一低一个百分点,价格却便宜六成四。这个模型不是从零训练,而是在月之暗面的Kimi K3基础上做强化学习后训练而成。Cognition说,他们这次让每一档算力强度都按真实使用成本打分,一次训练同时优化全部档位,不用分开训练再拼接。评论区反应却两极。有人翻出一个细节,SWE-2在旧的终端基准上拿了九成三,换到刚发布的新基准立刻掉到两成七,质疑这是冲着旧题库调出来的分数。也有人反驳,新旧基准难度本来就不一样,不能直接类比着说谁在刷分。还有人提醒,提交这篇文章的账号注册时间很新,怀疑是自我推广。
进度保存在本设备 · 登录同步