每天听简报,了解最新科技、AI、软件资讯
同一对研究想法,只改提示语,人工智能对新颖性的判断就可能大幅变化。十月一日的一项研究测试了六种评审器。研究者从 OpenReview 筛出人类评审意见一致的论文,再与模型生成的想法配对。提示里只要加入评审者认为哪个想法更新颖,有的设置下,超过一半想法对就会被改判。同样的提示改动,还可能帮到一个评审器,却让另一个变差。论文也发现,增加检索和推理预算帮助有限。结论限于这套测试,但它提醒研究者,报告创意提升时也要检查评审器是否稳定。
进度保存在本设备 · 登录同步