快讯 23:54PS2初代安全芯片MechaCon被破解,爱好者耗时四年攻克26年谜题23:47古特雷斯呼吁全球协作管控AI风险,联大高级别周将成关键节点23:07华邦电子11.2亿美元接手英飞凌NOR与F-RAM业务,飞索半导体品牌将重启 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期四 · 09-17 14:31

AI 推理 MLPerf 6.1 发布:AMD 以 512 个 MI355X 刷新纪录、英伟达 Vera Rubin 首次现身

摘要

IT之家 9 月 17 日消息,科技媒体 Wccftech 昨日(9 月 16 日)发布博文,报道称在 MLPerf Inference v6.1 发布后,AMD、NVIDIA 等厂商同步提交结果。IT之家注:MLPerf Inference 是由 MLCommons 维护的推理基准测试套件,用于衡量不同硬件在 AI 推理任务中的吞吐和延迟表现。最新 6.1 版重点集中在 AI 推理吞吐、扩展效率和不同 GPU 配置下的表现。AMD 称以 575 万个 token / 秒的速度在 512 个 GPU 规模下创造了新的 MLPerf 记录,这是 AMD 迄今为止规模最大的提交,再次证明了 AMD 的性能、规模、软件成熟度和可复现性。DeepSeek R1 测试中,AMD 以 512 个 Instinct MI355X GPU 参赛,离线(强调批量处理能力,通常用于衡量系统在非实时场景下的最大吞吐)成绩 2,901,950 tokens/s,服务器(强调在线服务场景中的吞吐与响应能力,更接近实际部署中的请求处理环境)成绩 2,405,310 tokens/s。英伟达在同一项目中提交 GB300 和 GB200 的 288 GPU 配置,GB300 离线 2,705,130 tokens/s,服务器 2,028,030 tokens/s。由于配置存在差异,以上数据仅供参考。此外英伟达的

正文整理中

本条快讯正在等待内容整理,稍后将在此展示完整报道。
你可以先查看下方原文出处获取信息,或浏览其他已完成的快讯。

213
收录 AI 工具
23
模型产品档案
41
企业落地案例
5
完整版提示词