每天听简报,了解最新科技、AI、软件资讯
领英的一名工程师下个月要在PyTorch大会上,展示一套几乎全用PyTorch跑的检索引擎。检索、过滤、排序三步全靠张量计算完成,平时用来撑住领英信息流和搜索这类高流量场景。索引常驻在GPU显存里,检索运算走张量操作。团队还专门写了CUDA内核来做属性过滤,模型推理交给TorchScript执行。整套服务架构由Rust和一个叫tch-rs的绑定库编排调度。这条预告来自PyTorch官方账号,大会十月二十号到二十一号在圣何塞举行,具体效果得等他现场讲完才知道。
进度保存在本设备 · 登录同步