每天听简报,了解最新科技、AI、软件资讯
一家做材料科学实验室的公司,给自己训出的模型取名Neon,宣称在自定的分析基准上,把一款通用大模型甩开二十倍。这是发推的研发负责人自己说的,还没见第三方复现。所谓超越,比的是一项很窄的任务:看X光衍射图判断材料晶体结构。用真实实验室的新数据,给一个开源模型做二次训练和强化学习,准确率从百分之二点七冲到百分之五十五点三。打分的是几个模型裁判,用人类专家校准过,不是人工评审。训练只用了一千三百块H200,比顶尖大模型的训练规模小得多。窄任务模型赢一个通用大模型的专项考试,本不算意外。它盯的是超导体、磁体和半导体材料这些老大难问题。
进度保存在本设备 · 登录同步