每天听简报,了解最新科技、AI、软件资讯
强化学习后训练现在已经是训练大语言模型必不可少的一步,但真正部署起来,远不止把几个计算核心跑快这么简单。系统得同时协调分布式训练、生成推理内容,还有模型权重的持续同步,这些环节横跨好几套软件栈,还得保证结果正确、性能不掉。PyTorch官方账号发消息说,一位研究者将联合芯片厂商AMD,在北美的PyTorch开发者大会上展示一张海报。海报讲的是怎么把一个叫vime的开源强化学习后训练框架,跑在AMD的Instinct系列GPU上。用的软件栈是ROCm,也就是AMD自己针对GPU计算做的那套软件平台。海报还没正式展出,具体能跑出什么样的性能数据,要等大会现场才会揭晓。
进度保存在本设备 · 登录同步