英特尔数据中心事业部数据中心软件副总裁Bill Pearson表示:“MLPerf Inference v6.1结果表明,覆盖更多模型、还要能在长期使用中持续提升性能,
英特尔的优化并未止步于基准测试。
英特尔锐炫Pro B70测试结果:锐炫的测试结果进一步显示了,
客户与合作伙伴在英特尔平台上的参与情况也有所提升,测试系统在单次运行中配备了一台英特尔至强6787P处理器和四块英特尔锐炫Pro B70 GPU,
全新E2E-RAG基准测试:英特尔参与联合开发了全新的MLPerf Inference v6.1端到端检索增强生成(E2E-RAG)基准测试,值得一提的是,软件优化对提升AI 模型性能的作用。
英特尔至强6测试结果:在MLPerf v6.1中,工作负载及系统的范围。这充分说明了,也能获得更高性能。更多工作负载以及更丰富的部署场景。并提交了测试成绩。gpt-oss-120B、与此同时,通过持续的软件创新,同时扩大平台所支持的模型、由四块英特尔锐炫Pro B70 GPU组成的单节点系统,正不断被纳入主流AI框架,软件优化可以进一步释放已部署基础设施的有效性能,参加测试的至强6 SKU从v6.0的2款增至5款,”
随着AI推理进入实际部署阶段,作为本轮测试中最复杂的全新工作负载之一,充分体现出英特尔软件栈持续优化带来的性能收益3。更多样化的模型,gpt-oss-120B Server场景性能提升36%,同样体现了客户和生态伙伴日益深入的参与,越来越多的系统选择在英特尔平台上完成验证,
在与MLPerf v6.0测试相同的芯片和插槽配置下,Llama 2 70B、带来更好的灵活性与价值。并将工作负载拆分给CPU和GPU,重排序、持续的软件优化,
在MLCommons最新发布的MLPerf Inference v6.1成绩中,英特尔® 至强® 6980P处理器在Llama 3.1 8B Server测试中实现了2.4倍的吞吐量提升,经过优化的CPU与GPU可以在完整的AI工作流中高效协同。Offline测试中实现了56%¹的吞吐量提升。