每天听简报,了解最新科技、AI、软件资讯
Google 的 EmbeddingGemma 2 把文字、图像、视频和音频放进同一个向量空间,让搜索能跨越文件类型。十月六日的官方介绍举例,用语音备忘录找视频片段,或用文字检索录音。它把内容转换成可比较的向量,供检索系统寻找语义相近的结果。完整模型有七点四亿参数,但纯文字任务只需要两点七亿参数,其余是可选的视觉和音频编码器。输出向量也能从七百六十八维缩到一百二十八维,减少索引占用。模型采用 Apache 2.0 许可。开发者可以按自己的资料类型选择模块,搭建离线检索流程。
进度保存在本设备 · 登录同步