跳至正文
-
Subscribe to our newsletter & never miss our best posts. Subscribe Now!
78227科技派

AI工具测评 | 科技资讯 | 软件推荐 - 客观真实的科技自媒体

78227科技派

AI工具测评 | 科技资讯 | 软件推荐 - 客观真实的科技自媒体

  • 首页
  • 关于我们
  • 广告合作
  • 联系我们
  • 首页
  • 关于我们
  • 广告合作
  • 联系我们
关

搜索

  • https://www.facebook.com/
  • https://twitter.com/
  • https://t.me/
  • https://www.instagram.com/
  • https://youtube.com/
Subscribe
AI工具测评

阿里Qwen3.8-Max正式发布:2.4万亿参数+千问办公公测,国产大模型进入”交付级”时代

作者 admin
2026-08-03 1 分钟阅读
0

8月3日,阿里巴巴正式发布Qwen家族迄今最强大的模型Qwen3.8-Max。2.4万亿参数、950亿激活、100万token上下文,这是阿里首次将Max级别的模型权重开放给全球开发者。同一天,企业级Agent产品”千问办公”开启公测。阿里港股盘中一度涨超7%。

信息来源:Alibaba Cloud官方新闻稿(2026年8月3日)、developersdigest.tech技术博客。

Table of Contents

Toggle
  • 2.4万亿参数+950亿激活:MoE架构的效率革命
  • 自主编程16天:从”写函数”到”交付项目”的质变
  • 千问办公公测:企业级AI入口争夺进入系统级下半场
  • 开源Max级权重:”前沿模型”的获取门槛被重新定义

2.4万亿参数+950亿激活:MoE架构的效率革命

Qwen3.8-Max基于Qwen3.5架构扩展,采用稀疏MoE(Mixture-of-Experts)架构。总参数2.4万亿,但每次推理仅激活950亿参数。这种设计让模型在保持接近100B稠密模型推理效率的同时,拥有更大参数量带来的知识容量和泛化能力。

上下文窗口达到100万token,并引入混合注意力机制。标准Multi-Head Attention与线性注意力结合,让模型在处理超长文档时不会因为上下文过长而显著降速。国内API定价为每百万token输入12元、输出36元,海外输入2美元、输出6美元。与国际前沿模型相比,输入价格仅为Opus 5的40%,输出为24%。

为什么重要:MoE架构正在重新定义大模型的”性价比公式”。阿里用2.4T总参数换95B激活效率,本质上是在算力成本和模型能力之间寻找新平衡点。对企业用户而言,这意味着可以用接近入门级模型的调用成本,获得顶级模型的知识深度。

自主编程16天:从”写函数”到”交付项目”的质变

阿里在发布中展示了两项长程自主任务测试。第一项是自动编程:Qwen3.8-Max从零创建项目,在完全自主运行约16天后,留下265次commit与127个PR,最终交付一个自进化的CLI工具框架”oh-my-cli”。

第二项是科研复现:模型连续工作约125小时,编写约7600行代码,完成33轮GPU训练,先复现目标论文结论,再经四轮探索取得高于原方法2.71分的结果。

在三方评测榜单Arena中,Qwen3.8-Max位列Text Arena第5、Vision Arena第2、Code Arena第4,综合能力仅次于Claude系列。在PaperBench、IFBench、OSWorld-Verified等项目上取得对比集最高分。

为什么重要:编程评测的度量衡正在从”能不能写出正确代码”转向”能不能独立交付完整项目”。16天自主运行、265次commit意味着模型具备了持续迭代和自我纠错的能力。这不是编程助手,而是初级软件工程师的完整工作流。

千问办公公测:企业级AI入口争夺进入系统级下半场

与Qwen3.8-Max同步发布的是”千问办公”(QwenWork)。该产品由QoderWork、MuleRun、悟空三款产品整合而成,是业内首款同时支持桌面端、云端与企业协同的Agent平台。

目前已初步打通钉钉IM,未来将连接企业真实数据库和工作流。核心功能包括:将资深员工的工作流程一键存为”团队技能”供新人调用;创建7×24小时在线的Agent进行跨国协同。公测用户注册即得2000积分。

据第一财经报道,千问办公未来还将上线独立App端并推出国际版。这意味着阿里的AI战略正从”提供模型API”向”提供完整工作流解决方案”跃迁。

为什么重要:企业级AI的竞争已经从”模型能力”转向”入口控制”。微软有Copilot+Office,谷歌有Gemini+Workspace,阿里现在有千问办公+钉钉。谁能把AI Agent嵌入企业日常协作流,谁就能锁定B端客户的长期价值。阿里同日还发布了Kimi K3权重开源的相关竞品动态,国产大模型在企业级赛道的竞争正在加速。

开源Max级权重:”前沿模型”的获取门槛被重新定义

Qwen3.8-Max最引人注目的承诺是:下周开源模型权重。这是Qwen历史上首次开源Max级别的模型,也是全球开源模型中第二个参数规模突破2T的版本。

同步开源的还有Qwen3.8-27B稠密模型。接口层面同时兼容OpenAI的chat completions与responses协议以及Anthropic协议,输入模态支持文本与图像。

阿里官方也坦诚了模型的局限:Terminal Bench 2.1得分86.6,低于GPT-5.6 Sol的88.8;SWE-bench Pro得分67.7,低于Claude Fable 5的80.0。这种自我审视的透明度在厂商发布中并不常见。

为什么重要:开源正在改写AI行业的权力结构。当Kimi K3、智谱GLM-5.2、阿里Qwen3.8-Max等国产模型纷纷以开源方式释放前沿能力,”闭源=领先”的旧叙事正在被瓦解。对企业而言,自托管前沿模型的门槛从”不可能”变成了”需要足够的GPU集群”。

阿里在同一天甩出模型+Agent两张牌,叠加股价盘中涨近7%的市场反应,说明资本市场对”AI落地”叙事的认可正在升温。当行业风向从”拼参数、拼榜单”转向”拼落地、拼解决实际问题”,Qwen3.8-Max和千问办公的组合,正是这一转向的标志性产物。

作者

admin

关注我
其他文章
上一个

OpenAI Astra连破10道悬置十年数学难题:2000美元成本震动数学界

下一个

白宫敲定AI安全测试框架:智能体越界入侵倒逼监管提速

近期文章

  • 英伟达35亿美元入股联发科:定制AI芯片战正式打响
  • 前英伟达VP带9000万美元出逃:Veeda押注”世界模型”成具身智能新基建
  • OpenAI自研芯片Jalapeno实测跑赢英伟达:AI推理成本战正式打响
  • AI吞噬现金流:中美巨头单季烧掉1318亿,自由现金流集体转负
  • Anthropic发布MHS标准:AI智能体首次跨入物理世界操控机械臂

归档

  • 2026 年 9 月
  • 2026 年 8 月
  • 2026 年 7 月
  • 2026 年 6 月
  • 2026 年 5 月
  • 2020 年 1 月

分类

  • AI大模型
  • AI工具测评
  • AI教育
  • AI硬件/芯片
  • AI编程工具
  • AI行业动态
  • AI设计/创作
  • SEO/搜索优化
  • 科技教育
  • 科技资讯
  • 赚钱攻略
  • 软件推荐
Copyright 2026 — 78227科技派. All rights reserved. Blogsy WordPress Theme