每天听简报,了解最新科技、AI、软件资讯
普林斯顿大学团队让Anthropic的Claude Opus 4.8写两篇顶会论文,结果原作者直接把两篇全部退稿。团队给了模型六天时间、三千美元调用额度,还配了独立虚拟电脑和上网权限。模型的工程能力没问题,跑了几百个实验,写作也没有造假。问题出在判断力上,它太快放弃有潜力的方向,也没法推倒重来换个思路。子模型给出不同意见时,它选择缩小结论范围,而不是重新设计实验。Anthropic联合创始人杰克·克拉克说,AI系统缺一种直觉式的创造力,管这叫看空短期自我改进的信号。
进度保存在本设备 · 登录同步