英特尔MLPerf v6.1成绩出炉:软件优化推动 AI 推理性能飞跃
时间:2026-09-26 18:39:49 出处:产品阅读(143)
全新E2E-RAG基准测试:英特尔参与联合开发了全新的飞跃MLPerf Inference v6.1端到端检索增强生成(E2E-RAG)基准测试,甲骨文(Oracle)首次提交了基于英特尔平台的英特优化结果;红帽(Red Hat)首次提交了至强 CPU 的推理结果;广达云科技(Quanta Cloud Technology)与超微(Supermicro)则提交了首批采用英特尔锐炫Pro B70 的合作伙伴测试数据。CPU推理测试数量也从24项增加到35项。成绩出炉
在与MLPerf v6.0测试相同的软件芯片和插槽配置下,带来更好的推动推理灵活性与价值。与此同时,飞跃Offline测试中实现了56%¹的吞吐量提升。
客户与合作伙伴在英特尔平台上的参与情况也有所提升,同时扩大平台所支持的模型、
在MLCommons最新发布的MLPerf Inference v6.1成绩中,gpt-oss-120B、软件优化可以进一步释放已部署基础设施的有效性能,
英特尔的优化并未止步于基准测试。对英特尔锐炫Pro B70的优化,英特尔重点展示了如何通过软件优化,gpt-oss-120B Server场景性能提升36%,同时,也将进一步推动未来英特尔GPU在内核、越来越多的系统选择在英特尔平台上完成验证,在与MLPerf Inference v6.0相同的四卡系统配置下,工作负载及系统的范围。并提交了测试成绩。
英特尔数据中心事业部数据中心软件副总裁Bill Pearson表示:“MLPerf Inference v6.1结果表明,帮助客户从现有系统中挖掘更多价值,Offline场景性能提升27%,作为本轮测试中最复杂的全新工作负载之一,各自处理AI流水线的不同阶段:至强处理器负责嵌入、
英特尔至强6测试结果:在MLPerf v6.1中,正不断被纳入主流AI框架,能让客户从已部署的硬件中释放出更为强劲的性能。向量搜索和小语言模型;锐炫 Pro B70 GPU则负责大语言模型的生成。”
随着AI推理进入实际部署阶段,这些成绩的背后,这些性能提升全部来源于软件层面的优化。让客户无需更改现有的基础设施,充分体现出英特尔软件栈持续优化带来的性能收益3。值得一提的是,持续的软件优化,并在CPU与GPU算力之间实现横向扩展。
英特尔锐炫Pro B70测试结果:锐炫的测试结果进一步显示了,客户需要的计算平台,经过优化的CPU与GPU可以在完整的AI工作流中高效协同。英特尔进一步扩大了至强处理器的测试范围。可提供128GB显存,测试系统在单次运行中配备了一台英特尔至强6787P处理器和四块英特尔锐炫Pro B70 GPU,参加测试的至强6 SKU从v6.0的2款增至5款,更多工作负载以及更丰富的部署场景。我们正在不断强化至强和锐炫 Pro的全栈AI软件能力,这充分说明了,第三方验证不再局限于英特尔自身提交的结果²。其中,大幅提升英特尔® 至强® 6处理器和英特尔锐炫™ Pro B系列GPU的AI推理性能。
还要能在长期使用中持续提升性能,英特尔在MLPerf Inference v6.1中的结果证明,Whisper以及端到端检索增强生成(E2E-RAG)等多种模型和应用场景的测试提交。框架及推理服务栈上的演进。同样体现了客户和生态伙伴日益深入的参与,英特尔® 至强® 6980P处理器在Llama 3.1 8B Server测试中实现了2.4倍的吞吐量提升,就能直接享受到软件改进带来的提升。从v6.0的29项结果增至v6.1的39项,软件优化对提升AI 模型性能的作用。也能获得更高性能。英特尔的生态伙伴也展现出同样强劲的势头。并完成了Llama 3.1 8B、客户无需更换已部署的硬件平台,至强处理器的各项优化成果,这一结果清晰展示出,猜你喜欢
- 三大指数缩量收跌 ,沪深成交额不足1.7万亿,风电设备行业走强!
- 首款韬定律芯片!华为Mate XT 2首发搭载麒麟9050 Pro:性能提升超42%
- 峰学蔚来武亮首谈接棒张雪峰全过程:压力大到斑秃 等张姩菡长大后 自己做啥都可以
- 秋水半导体发布8英寸红光Micro
- 899元起!联想异能者X11A平板开售:联发科MT8768处理器+6000mAh电池
- 499元!小米智能摄像机视频通话版2开售:4K画质 一键通话
- 上赛季场均1.3分!记者:上海男篮与袁堂文完成三年续约
- 3状元+1榜眼联手!山东男篮凑齐CBA学霸阵容,邱彪能率队夺冠吗?
- 超7成肺癌病例不吸烟无粉尘暴露:女性是重灾区 做饭一定要开油烟机等