阿里巴巴发布2.4万亿参数旗舰大模型Qwen3.8-Max,港股单日涨超7%
本文是 24TopNews 对公开财经信息完成重复合并后的事件分析,不是原始采访或证券推荐。
8月3日,阿里巴巴集团正式发布新一代基座大模型Qwen3.8-Max。该模型总参数量达2.4万亿,激活参数为95B,是千问系列中尺寸最大、性能最强的旗舰模型。Qwen3.8-Max基于Qwen3.5架构,通过稀疏MoE架构与混合注意力机制的联合优化,支持最长100万tokens的上下文窗口,并原生支持视觉理解。模型在编程、专业办公、科研以及长周期任务等场景中实现了能力提升,能够以较少的人工介入完成复杂任务的端到端交付。
受模型发布消息提振,阿里巴巴港股当日收报125.2港元,全天上涨7.01%,成交额达239亿港元,总市值回升至2.4万亿港元。阿里巴巴美股股价上涨超过5%,报127.36美元。从6月下旬创下的88.65港元阶段低点计算,阿里巴巴港股本轮反弹幅度已超过41%。
在权威第三方榜单Arena中,Qwen3.8-Max在Text Arena排名第五、Vision Arena排名第二,整体性能处于全球大模型第一梯队。在编程智能体评测CodeArena中排名全球第四。在PaperBench论文能力评测中以93.0分超越Anthropic Fable 5的88.8分;在指令遵循IFBench中以82.8分领先Fable 5的63.5分。在视觉推理BabyVision评测中,Qwen3.8-Max在无工具条件下取得82.0分;在评估智能体电脑操作能力的OSWorld-Verified评测中以86.1分位居主流模型首位。
Qwen3.8-Max在自动化编程测试中,无人工干预独立运行16天,完成了oh-my-cli项目的自动建构与自进化框架搭建,在GitHub上产出265次代码提交。在科研场景中,模型连续自主工作约125小时,成功复现AI Reasoning相关论文并进行四轮自我进化探索,使AIME24基准测试得分提升2.7分。在阿里云天池平台举办的WWW2025多模态对话意图识别挑战赛中,模型于24小时内击败458支人类参赛队伍。在芯片设计沙箱内,模型历经约500轮交互将硬件门数由8298门精简至678门。在365天长周期电商经营模拟基准E-Commerce Bench中,模型以416,252元的总资金成绩取得第一。
Qwen3.8-Max的API已上线千问AI平台,面向全球开发者开放调用。国内定价为每百万tokens输入12元、输出36元,隐式缓存命中1.5元。海外定价为每百万tokens输入2美元、输出6美元,隐式缓存命中0.25美元。
同日,阿里巴巴推出企业级Agent产品“千问办公”,该产品由QoderWork、MuleRun、悟空三款产品整合而来,已接入Qwen3.8并开启公测。该产品已初步打通钉钉IM,未来将连接企业数据库和工作流,并计划上线独立App端及推出国际版。