每天听简报,了解最新科技、AI、软件资讯
一份关于开源大模型的阅读书单里,藏着一条挺劲爆的技术细节。有论文发现,闭源模型的接口存在巧妙手法,能被用来系统性窃取模型的推理过程。这段推理过程正是现代模型训练里最核心的部分。Anthropic,就是做Claude那家公司,证实中国实验室确实用这种手法窃取推理轨迹,去训练自家模型。清单整理者认为,这不代表中国模型没有创新,却是他们追赶美国的一条捷径。目前开源和闭源模型的差距已缩小到四到六个月,最强开源模型近年多来自中国实验室。评论区吵得更凶,有人直接否认存在真正的开源AI模型。说开放权重顶多是一份能下载运行的二进制文件,训练数据用了什么,实验室从不公开。
进度保存在本设备 · 登录同步