每天听简报,了解最新科技、AI、软件资讯
Grok四点七换上更大的基础模型,用更长强化学习训练,把CursorBench四点零的成绩从四十点四分拉到四十六点三分。价格却和上一代四点六完全一样,输入每百万代币两美元,输出六美元。xAI说它还更耐心核查自己的工作,能处理的上下文也更长。不过这个成绩仍不及Fable五点一拿到的百分之五十一点八。评论区有人发现官方对比图里没放GPT六Astra。随后有人解释,这是因为该基准专门用Cursor做测试环境,Cursor不允许里面调用Astra,并非xAI故意藏成绩。有人还算了一笔账,这一代权重多了四成,定价却没涨,发布还推迟了将近两周,正好卡在传闻中Opus五点五发布的前一天。
进度保存在本设备 · 登录同步