AI资讯

阿里发布Qwen3.8大模型,总参数量达2.4万亿

阿里巴巴正式发布新一代基座大模型Qwen3.8,总参数量2.4万亿,在编程和专业办公方面能力大幅提升。Qwen3.8-Max支持视觉理解,上下文长度达1M Tokens。

AI云图智寻编辑部2026-08-03 13:26
阅读时间:约 3 分钟
阿里发布Qwen3.8大模型,总参数量达2.4万亿
8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8,总参数量达到2.4万亿,显著提升了在编程和专业办公方面的能力。Qwen3.8的API已上线千问AI平台,并接入了新推出的Agent产品“千问办公”。

性能提升与全球排名

Qwen3.8在权威三方榜单Arena中仅次于Anthropic的Claude系列,整体性能处于全球大模型第一梯队。Qwen3.8通过稀疏MoE架构与混合注意力机制的联合优化,首次将总参数量拓展至2.4T,激活95B。这使得Qwen3.8在科研复现评测PaperBench等编程智能体评测中,较上代模型大幅提升28.2分,以93.0分录得评测新高。此外,Qwen3.8在WideSearch、Agent's Last Exam等通用智能体评测中也取得了优异成绩,分别取得81.9分和52.4分,位居前沿。

编程与办公能力的突破

Qwen3.8在编程能力方面实现了自主编程的新突破。它可以从一个空文件夹出发,自主完成一个十数天的真实项目交付,全程无需人干预。例如,只需一句“创建一个自进化的智能体Harness”,Qwen3.8就能从零开始,自主搭建循环工程框架,编排智能体自动领取和执行任务。此外,Qwen3.8还能胜任广泛的专业工作任务。一支法务助理团队需要一周时间标注数百份法律文档中的相关条款,而Qwen3.8一小时内就能完成。一个篮球数据分析团队逐帧标注160个小时的比赛录像,Qwen3.8数十分钟就能精准拆解8400多个攻防回合,并输出球员战术画像和教练报告。

视觉理解和多模态能力

Qwen3.8不仅在文本和推理能力上有所提升,还在视觉理解方面表现出色。在权威Vision Arena榜单中,Qwen3.8-Max排名全球第二。Qwen3.8不仅能读懂200页的财报PDF,看懂超100小时的长视频,还能将这些信息反馈到工作全流程中。在千问团队构建的“应用复刻”基准RecreationBench长程任务中,Qwen3.8没有源代码,也无法联网,仅通过交互与反馈去理解应用,却能从零复刻出整个应用。这表明Qwen3.8已经展现出前沿水准的混合多模态智能体能力。此外,阿里真武M890超节点已成功适配Qwen3.8,通过芯片、云平台与千问大模型的全链路优化,显著提升推理效率,降低推理成本,在Agentic推理场景中最多可实现1.5倍性能提升。