每天听简报,了解最新科技、AI、软件资讯
Benchmark Heaven做了一套叫JevBench的评测,测的是能读场景规则、给出结构化决定的模型。这次测了五十二个系统,按智能、校准、速度、成本四项各占四分之一算总分。第一是创业公司TypeSafe的闭源模型Jev,七十四点四分;第二叫SemIf,只差一点三分,成本却低了近一半。评论区有条评论说,SemIf用的是没微调过的开源Qwen模型,几天就搭出来,还能在浏览器里直接跑,而Jev融了四千万美元、藏了两年才做出来,价格却更贵,直言这像是拿开源模型套壳忽悠投资人。也有人提到,Jev的服务条款本来禁止外部跑分,那是给内测用户定的,正式上线时忘了拿掉。
进度保存在本设备 · 登录同步