MLPerf Endpoints v0.7:一个基础版本发布
摘要
MLCommons推出MLPerf Endpoints v0.7,旨在为企业采购推理计算提供动态、可比较的独立基准。
核心要点
- MLPerf自2018年以来记录了LLM推理能效提升超100倍,训练速度提升超50倍。
- Endpoints v0.7是首个版本,初始结果来自Coreweave、Google、Intel、KRAI和Nvidia。
- 遵循四项原则:结果保持市场同步、涵盖多个供应商、可比较、提供上下文分析。
- 支持自动提交、持续审查和动态可视化结果。
- v1.0计划今年晚些时候发布,将增加智能体工作负载和滚动提交。
原文佐证
- MLPerf has been the standard-bearer for measuring AI system performance since its launch in 2018.
- over a 100X improvement in inference performance per watt for large language models and over a 50X improvement in training speed
- MLPerf Endpoints v0.7 is a foundation release with initial results from Coreweave, Google, Intel, KRAI, and Nvidia.
AI 洞察
这一发布标志着AI基准测试从面向云提供商转向面向所有企业买家,反映了AI推理市场日益成熟且竞争激烈。通过滚动提交机制,MLPerf Endpoints将更快地跟上模型迭代速度,可能改变企业采购决策的方式。