Copied


AMD GPU获得对阿里巴巴Qwen 3.8 AI模型的Day-0支持

realtime news   Aug 12, 2026 15:59 1 Min Read


AMD宣布其Instinct MI300X、MI325X和MI355X GPU对阿里巴巴最新的Qwen 3.8模型系列提供Day-0支持。此集成使开发者能够立即利用AMD的ROCm软件栈部署和评估Qwen 3.8,同时借助SGLang和vLLM等工具,为大规模AI和高性能计算(HPC)应用创建了新机会。

Qwen 3.8在其前身Qwen 3.6的基础上进行了显著的架构升级。该模型现在采用稀疏专家混合(MoE)设置,拥有512个专家、92层深度网络,以及针对长上下文任务优化的混合注意力机制。这些进步使其特别适合于编码、复杂推理和需要可靠逐步处理的长时间任务。

为什么这很重要

Qwen 3.8与AMD Instinct GPU的结合凸显了高容量加速器在生成式AI和HPC工作负载中的日益重要趋势。AMD的Instinct MI300X于2023年底推出,配备192GB的HBM3内存和5.3TB/s的带宽,使其成为大规模AI推理和训练任务的有力竞争者。MI325X和MI355X进一步扩展了这些能力,提供更高的HBM3E内存容量和多节点扩展的增强效率。

对于阿里巴巴来说,这一合作加速了Qwen 3.8的可用性,这是其迄今为止最先进的开放权重AI模型之一。开发者可以利用该模型改进的推理、代理执行以及与流行AI工具的兼容性,从而更顺畅地集成到现有工作流程中。

性能提升与部署

AMD的ROCm软件栈已针对Qwen 3.8的高需求工作负载进行了优化。该模型的基准测试显示出卓越的准确性,对于像GSM8K这样的数据集,其严格匹配指标超过95%。开发者可以根据性能需求,将Qwen 3.8部署在从单节点MI355X设置到多节点MI300X集群的配置中。

例如,使用FP8精度在双节点MI300X设置下,模型实现了每秒112个token的吞吐量,准确率超过97%。这使AMD的硬件成为需要高速、大规模AI处理的企业的首选。

市场影响

此公告发布之际,AI硬件领域的竞争日益激烈。尽管NVIDIA仍主导GPU市场,但AMD的Instinct系列正稳步获得关注,特别是在数据中心的AI训练和推理领域。今年早些时候,AMD在MLPerf训练和推理基准测试中展示了破纪录的成绩,进一步验证了其硬件的能力。

对于投资者而言,AMD向下一代AI工作负载的转型是一个关键的增长驱动因素。截至8月12日,AMD的股票交易价格为489美元,日增幅为3.09%,市值为8107.5亿美元。与阿里巴巴的战略合作以及ROCm与Qwen 3.8等尖端模型的无缝集成,突显了AMD在AI生态系统中的日益影响力。

展望未来

Qwen 3.8在AMD Instinct GPU上的Day-0支持确保开发者能够立即利用该模型的增强功能。随着AI工作负载的复杂性不断增加,此合作为性能和可扩展性设定了高标准。对于开发者和企业而言,Qwen 3.8与AMD Instinct GPU的结合提供了一个强大的平台,可应对一些最具挑战性的生成式AI和HPC任务。

有关部署Qwen 3.8的更多资源可通过AMD的开发者中心和ROCm文档获取,确保用户顺利上手。


Read More