每天听简报,了解最新科技、AI、软件资讯
从一堆文本选项里一次运算打出概率,不用像别的模型那样一个词一个词地写答案,这是TypeSafe卖的商用模型Jev在做的事,但没公开过内部怎么做。有人只凭那篇公开博客,自己设计了一套结构类似、输入输出对得上的模型,开源出来,取名jevlike。作者说得很清楚,没打算证明自己和Jev一样聪明,也没还原TypeSafe的私有训练方法,只是个独立起步的研究项目。核心结构是给每个选项算一个查询向量,对上下文做注意力,再用共享点积打分,softmax转成概率。换成维基百科点击预测这种真实数据,准确率只有百分之二十六到二十九,比瞎猜的百分之八高不了多少。评论区有人质疑演示视频是讽刺,认为十亿参数的模型撑不起真正的智能。
进度保存在本设备 · 登录同步