字节跳动与清华AIR发布CUDA Agent,提升大模型GPU内核生成性能

字节跳动Seed团队与清华大学智能产业研究院(AIR)发布CUDA Agent,用于训练大型语言模型编写高性能GPU内核。该系统将模型置于真实CUDA开发环境,结合性能分析、正确性校验和安全沙盒,并采用PPO算法进行训练。在KernelBench相关测试中,基础模型Seed1.6任务通过率为74.0%,生成内核速度超越torch.compile的比例为27.2%;经CUDA Agent训练后,模型在250个任务中的通过率提升至98.8%,96.8%的生成内核运行速度超过torch.compile。目前完整模型权重未公开,团队已开放CUDA-Agent-Ops-6K数据集、SKILL.md规范及训练配方。

上一篇:

下一篇:

发表回复

登录后才能评论