直接跳两个大版本!AMD ROCm 10正式发布:推理性能暴涨3.3倍

(由多段落组成):

AMD于2024年8月29日正式发布全新一代开源AI与异构计算软件平台——ROCm 10,标志着其在GPU加速计算与大模型开发生态建设上迈出关键一步。值得注意的是,此次版本升级采取“跨越式迭代”策略:官方跳过ROCm 8与ROCm 9两个中间版本,直接从7月发布的ROCm 7.14跃升至第十代主版本,释放出加速AI开发生态整合与技术收敛的强烈信号。

对广大开发者而言,ROCm 10最值得关注的实用改进在于开发环境的统一化重构。Windows平台正式告别原有独立维护的HIP SDK,全面转向与Linux一致的ROCm Core SDK架构。这一调整不仅大幅降低跨平台代码迁移与调试成本,更让“一次编写、双端部署”真正成为可能,显著提升AI模型训练与推理应用的工程落地效率。

本次更新的核心亮点是全新推出的ROCm.AI智能开发平台。该平台深度融合三大关键技术组件:面向开发者能力成长的AMD Skills知识库、命令行驱动的ROCm CLI工具链,以及支持动态工作流编排的ROCm Hyperloom框架。尤为关键的是,ROCm.AI已原生集成Claude Code、Cursor等新一代AI编程助手,可实时提供针对AMD Instinct GPU及锐龙AI PC硬件深度优化的代码建议、内核调优提示与性能瓶颈分析,让开发者从“写得对”迈向“跑得快”。

性能实测数据同样令人振奋。据AMD官方实验室披露,在配备8张AMD Instinct MI355X加速卡的服务器集群中,启用ROCm.AI的ROCm 10系统相较ROCm 7.0版本实现质的飞跃:大语言模型推理吞吐量平均提升达3.3倍,分布式训练速度亦提升2.4倍。需特别说明的是,该数据基于启用预览版优化内核的测试配置,实际部署中建议结合ROCm Tuner工具与AMD GPU Profiler进行针对性调优,以充分释放硬件潜力。

在硬件兼容性方面,ROCm 10展现出更强的平台延展性:不仅完整支持MI300系列(含MI355X)、MI250X等全系Instinct数据中心加速卡,更首次实现对全新Strix Halo架构高性能移动APU的原生支持——这意味着未来搭载锐龙AI 300系列处理器的轻薄创作本与AI工作站,也将具备本地运行Llama 3、Phi-3等主流开源模型的能力,真正打通“云-边-端”AI算力闭环。

ROCm 10, AMD AI开发平台, ROCm.AI, Instinct MI355X, Strix Halo

本文来源: 快科技【阅读原文】
© 版权声明

相关文章

暂无评论

您必须登录才能参与评论!
立即登录
暂无评论...