每天听简报,了解最新科技、AI、软件资讯
把三个GPT-6版本的模型放进毁灭战士里对打六十场,胜率最高的赢了八成二,性价比最高的模型却输了七成五的仗。这是Rootly AI Labs做的一个基准测试,让不同大模型互相对战判定强弱。Astra胜率八成二点五,命中率八成三,伤害差领先对手八十六点二五点,三项都是第一。Sol决策最快,平均五点三四秒出一步棋。Luna胜率只有两成五,但每花一美元赢下的场次是十二点八次,是Sol的五点六倍,是Astra的九点八倍。三个模型都不直接操控射击和移动,只提交高层路线规划,系统负责瞄准和开火,比的是战术判断,不是手速。
进度保存在本设备 · 登录同步