1.发生了什么:AMD MI355X在运行vLLM推理框架的Kimi K2.5模型时,性能击败NVIDIA B200,源于GPU MODE社区的黑客马拉松中,Readonflow团队开发的内核将MI355X端到端性能提升超4倍。

2.属于产业链哪个环节:属于芯片设计验证后的【AI推理性能测试】,直接影响数据中心AI加速器的选型与部署,不直接对应制造流程,但反映芯片架构与软件生态的协同优化。

3.可能影响的公司或赛道:直接利好AMD的Instinct产品线,对NVIDIA的Blackwell系列构成竞争压力,同时影响【云服务商】和大模型推理赛道。

4.为什么值得关注:AMD此前受困于软件生态,本次优化已上游化至AMD的AITER库及vLLM主分支,表明其社区协作模式初见成效,有望逐步缩小与NVIDIA在AI训练/推理领域的差距。链接

[1] [2] [3] [4] [5]