阿里巴巴发布2.4万亿参数旗舰大模型Qwen3.8-Max并宣布开源
本文是 24TopNews 对公开财经信息完成重复合并后的事件分析,不是原始采访或证券推荐。
8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8-Max,总参数量达2.4万亿,采用稀疏混合专家(MoE)架构,单次推理仅激活约950亿参数,支持最长100万Token上下文窗口,并原生具备多模态视觉能力。该模型基于Qwen 3.5架构,通过稀疏MoE与混合注意力机制联合优化,成为千问系列中尺寸最大、性能最强的旗舰模型。官方宣布,Qwen3.8-Max的模型权重将于下周在Hugging Face和ModelScope平台开源,同时将开源Qwen3.8-27B小尺寸模型。这是千问Max级别模型首次对外开源权重。
Qwen3.8-Max的API服务已上线千问AI平台,国内每百万Token输入价格为12元、输出价格为36元,隐式缓存命中价格为1.5元;海外每百万Token输入价格为2美元、输出价格为6美元,隐式缓存命中价格为0.25美元。模型还接入阿里巴巴同日推出的企业级Agent产品“千问办公”(QwenWork),该产品由QoderWork、MuleRun、悟空三款产品整合而成,开启公测,已初步打通钉钉,未来将连接企业真实数据流和工作流,并计划推出独立App端和国际版。
在第三方评测中,Qwen3.8在Arena榜单中仅次于Anthropic的Claude系列,整体性能处于全球大模型第一梯队。在CodeArena编程榜单中位居全球第四,在Vision Arena视觉榜单中排名全球第二。基准测试方面,PaperBench得分93.0,高于Anthropic Fable 5的88.8;CoWorkBench得分74.8,接近Fable 5的75.9;WideSearch得分81.9,与Fable 5持平。此外,模型在指令遵循IFBench评测中得分82.8,科学推理GPQA Diamond得分92.6,在OSWorld-Verified评测中以86.1分位居主流模型首位。
在长周期任务中,Qwen3.8-Max展示了自主执行能力。在自动化编程测试中,模型在无人工干预的情况下独立运行16天,完成了oh-my-cli项目的自动建构与自进化harness搭建,在GitHub上产生265次代码提交。在科研场景中,模型连续自主工作约125小时,成功复现AI Reasoning相关论文并进行了四轮自我进化探索,使AIME24基准测试得分额外提升2.7分。在电商经营模拟基准E-Commerce Bench中,模型以416,252元总资金成绩排名第一。在芯片设计沙箱内,模型历经约500轮交互将硬件门数从8,298门精简至678门。
8月3日,阿里巴巴港股股价上涨7.01%,报收125.2港元/股,成交额达239亿港元,总市值回升至2.4万亿港元;美股盘中上涨超5%,收涨4.13%。