云栖大会首日:Qwen4 开训,千问把训练成本压下去近九成

9 月 22 日,2026 云栖大会在杭州开幕。三星手机、消费级笔记本这些热闹的东西当然有,但首日真正占版面的是大模型:阿里巴巴把千问这一整年的进展攒在一起,做了一次集中发布。

先把最硬的一条说了:Qwen4 已经在训练

云栖大会首日:Qwen4 开训,千问把训练成本压下去近九成

千问大语言模型的迭代路线图是本届大会最受关注的部分。按现场披露的信息,基于下一代架构的 Qwen4 已经进入训练阶段,Qwen4.5、Qwen5 的参数规模计划扩展到 5 万亿到 10 万亿量级。

千问 LLM 项目负责人刘大一恒在会上给出的判断是:Scaling 仍然是走向更强通用能力的核心路径,更大的参数规模依然带来更强的性能。这个说法放在当下并不算主流——过去一年行业里讲得更多的是”效率”和”单位算力产出”——但阿里的意思很明确:性价比要做,规模也要继续往上顶。

Qwen3.8-Max:两个榜单第一,得分从 40 抬到 45

云栖大会首日:Qwen4 开训,千问把训练成本压下去近九成

已经放出来的这一代旗舰 Qwen3.8-Max,主攻方向是编程与办公。发布后它拿下了 Artificial Analysis 的智能体(Agentic)评测第一,以及 CodeArena 前端编程第一。

在 Artificial Analysis 的全球大模型排行榜上,Qwen3.8-Max 的分数从 40 分提升到 45 分,进入 Claude、GPT 所在的第一梯队,排在 GLM5.3、Kimi-K3 等国产模型之前。分数变化看起来只有 5 分,但在榜单这个位置,向上的每一分都不便宜。

RSI:让它自己迭代一个月,跑了 33 轮

云栖大会首日:Qwen4 开训,千问把训练成本压下去近九成

如果只挑一个技术点讲,这次大会给出的答案是 RSI——递归自我改进。

传统的大模型迭代流程里,人是绕不开的一环:分析评测结果、准备训练数据、设计下一轮实验、定位缺陷,然后重复。按阿里的说法,Qwen3.8-Max 已经能自己把这一整圈跑下来——自主搭建训练流程、构造训练数据、自主设计实验并定位缺陷。在人类完全”零参与”的情况下,它持续迭代超过一个月,完成了 33 轮有效迭代。

结果体现在榜单上:结合 RSI 与后训练等系列优化,新版本在 Artificial Analysis 上的得分提升了 12.5%。

RSI 并没有只停留在训练环节,而是往上下游都伸出去了:

  • 推理侧:Qwen3.8 在一块从未见过的平头哥新款 GPU 上,自主完成了下一代架构 Qwen3.8-Flash 的 SGLang 推理框架适配优化,单实例推理吞吐量提升 96%。
  • 芯片侧:Qwen3.8 仅凭一份真实的总线模块规范,自主展开前端、验证、后端的全链路自迭代,在自主运行超过 60 小时、调用 EDA 工具上万次之后,完成了一版面积减少 42% 的物理实现优化。

后一项的意义比数字更大。芯片设计一向被认为是”AI 最不容易插手”的领域之一,因为流程长、依赖大量工具链和人工经验判断。如果只给一份规范就能把前端到后端跑通,那说明模型在长周期、多工具的任务上已经具备了一定的自主规划能力。

架构与多模态:训练成本掉了近 90%

云栖大会首日:Qwen4 开训,千问把训练成本压下去近九成

架构层面,最值得记的是 Qwen3.8-Flash——它提前开源了下一代千问大模型的架构。通过注意力机制和模型内信息传递机制等核心改动,它在保持前沿性能的同时把训练成本压下去接近 90%,同时依靠极少的参数激活,把推理计算效率推到了新的帕累托前沿。用发布方的说法,这是一款行业性价比”斩杀线”级别的模型。

多模态这边则是整套升级:

  • 全模态模型 Qwen3.8-Omni 亮相,把视频、音频、图像、文字纳入统一理解框架。
  • 视频生成模型 Wan3.0 支持单次生成 30 秒视频,可接受文档、表格、网页等结构化输入,并做到原生音画同步;在 Artificial Analysis 的文生视频与视频编辑两个榜单位列全球第一。全新的下一代视频生成模型计划在 11 月发布。
  • 语音家族 Qwen-Audio-3.1 覆盖语音转写(ASR)、语音合成(TTS)和实时交互(Realtime)三条线,同步推出 Qwen-Audio-3.1-ASR-Next 与 Qwen-Audio-3.1-TTS-Next。
  • 同声传译模型 Qwen3.8-LiveTranslate 首次登场,把字均延迟压到 2.3 秒左右;作为对照,人类同传的平均时延通常超过 4 秒。
  • 图像侧放出 Qwen-Image-3.1,面向电商、创意、设计等商用场景优化,把原本数小时的视觉设计压缩到秒级;7B 参数量的 Qwen-Image-2.1 全面开源。
  • 音乐生成模型 HappyShrimp 1.1、世界模型 HappyOyster 2.0-Preview 也一并更新。

开源这件事,阿里把数字摆了出来

开源是这次大会的另一条主线。官方给出的数据是:Qwen3.8 系列发布一个月内下载量突破 5600 万次,衍生模型超过 1900 个;累计已开源 460 多个千问模型,总下载量超过 30 亿次,衍生模型数量突破 30 万个。Hugging Face 上,Qwen3.8-27B 超越 DeepSeek-R1、Meta-Llama3.1 等热门模型,成为该平台历史上点赞数最高的开源大模型。

落地侧,Perplexity、Airbnb、Pinterest 以及路透社等企业已经在用 Qwen 做智能体、AI 助手或自研模型,覆盖搜索优化、内容生成、客户服务等场景。硬件侧则发布了面向手机的 Qwen Intelligence 全栈方案,为合作方提供基于千问的智能体技术平台。

时间、地点和可以去看什么

2026 云栖大会 9 月 22 日到 24 日在杭州国际博览中心举行。现场设置 3 场主论坛、120 多场分论坛和 5 万平方米展区,展区分智能、算力、创造、产业四个主题馆。分论坛话题集中在模型前沿、Agentic 应用、芯片算力与产业落地。

如果只看一个趋势,那就是这次发布把重心从”模型能考多少分”挪到了”模型能不能自己往前走”。RSI 讲的是迭代速度,芯片协同讲的是把 AI 塞进硬件研发流程,性价比讲的是把成本打到别人不敢跟的位置——三条线指向的是同一件事。