每天听简报,了解最新科技、AI、软件资讯
英伟达让GPU内核本身也能直接用Rust写了。以前用Rust只能写调用代码,内核这层还得靠C加加或Python,这次编译器直接把Rust代码翻成PTX,补上了这层缺口。官方放了两条路线。一条叫cuda oxide,走单线程处理单元素的老模型,要求固定版本的每日构建Rust再加自带LLVM,官方自己说这还是早期实验,离生产还早。另一条叫cutile,一段代码只写一次,映射到多少线程交给编译器决定,跑在稳定版Rust上,已经被HuggingFace的推理引擎实际用上,走得更靠前。两条路线都在编译阶段就拦住并发读写同一块内存的错误,这类错误平时极难复现。评论区有人不买账,说出问题以后得先分清楚锅在Rust工具链还是闭源的CUDA本身,后者修不修都得等英伟达点头。
进度保存在本设备 · 登录同步