每天听简报,了解最新科技、AI、软件资讯
Perplexity 的多向量检索模型,可以直接给文档页面图像建立索引,减少先做文字识别的依赖。它为每个词元保留一个一百二十八维向量,再将问题里的词元与文档中最接近的部分匹配。这样,检索比较能保留更细的局部信息。官方提供大小两个版本,而且共享同一个向量空间,小模型也能查询大模型建立的索引。代价是每个词元都要存向量,索引可能变大。模型卡还有一个具体限制:纯文字和纯图像需要分批编码,同一输入里混合图文尚不支持。接入时需要把页面处理方式和索引空间一起纳入测试。
进度保存在本设备 · 登录同步