AI 推理 MLPerf 6.1 发布:AMD 以 512 个 MI355X 刷新纪录、英伟达 Vera Rubin 首次现身
MLPerf Inference v6.1 结果公布,AMD 与英伟达同步提交测试数据。AMD 使用 512 个 Instinct MI355X GPU,在 DeepSeek R1 测试中离线吞吐达 2901950 tokens/s,服务器场景为 2405310 tokens/s,并称以 575 万 tokens/s 创下新纪录。英伟达在同一项目提交 288 GPU 配置的 GB300 与 GB200,GB300 离线为 2705130 tokens/s,服务器为 2028030 tokens/s。此外,英伟达 Vera Rubin VR200 首次现身 MLPerf,提供 36 GPU 和 72 GPU 两种配置;在 72 GPU 配置下,VR200 比 GB300 快 95%,36 GPU 版本也快于 72 GPU 的 GB200。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(IT之家)→
