2026云栖大会呈现递归自我改进进入训练、推理和硬件协同,多模态产品同步刷新,下一代视频模型确定11月推出,生态下载累计已超过30亿次,千问后续版本容量路线清晰。
2026年9月22日,阿里在云栖大会给出千问系列的下一段路线图。下一代架构版Qwen4已经进入训练阶段,规划中的Qwen4.5、Qwen5目标把参数规模推向5到10万亿。这次发布不只围绕容量扩张,递归自我改进RSI被安排在模型训练、推理系统与芯片模型协同设计三类环节中,多模态模型也进入集中更新周期。
在训练侧,Qwen3.8-Max可生成自身所需的训练流程、构造数据、安排实验并寻找缺陷,全程无需人类介入即可连续运转超过一个月,留下33轮有效迭代。对应Artificial Analysis指标由40增至45,发布后又在Agentic智能体与CodeArena前端编程评测中位于榜首。推理侧,在平头哥新款GPU环境完成Qwen3.8-Flash推理框架适配后,每个推理实例的吞吐提高96%。硬件协同侧,它以一份真实总线模块规范作为起点,串联前端、验证和后端,自动运行超过60小时、调用EDA工具逾万次,得到比原方案少42%面积的物理实现结果。
多模态产品线同步扩充。视频、语音、图像、音乐和世界模型在当天或近期集中推出新版本。新一代视频生成模型定于11月对外发布,主要目标是拉长可用时长并保持人物、场景、镜头的一致,同时从单个画面走向对故事结构的理解。Wan3.0单次生成时长可达30秒,并提供结构化输入方式。Qwen3.8-Omni-Flash可同时处理视频、音频、图片和文本,Qwen-Audio-3.1覆盖语音识别、语音合成和实时交互,Qwen3.8-LiveTranslate的每字延迟降到2.3秒。架构层面,Qwen3.8-Flash借助注意力机制等改动使训练成本降幅接近90%,并以更少激活参数改善推理效率。
开发生态方面,Qwen3.8相关模型在一个多月内的下载量已超过5600万次,基于其衍生的模型数量超过1900个;阿里累计开源的千问模型已超过460个,总体下载量超过30亿次。围绕这套体系,本次云栖大会把讨论扩展到自动研发链条:模型参与自身权重更新,也进入推理加速与芯片设计流程,算法、系统工具与硬件设计被放到同一反馈回路中。