9月22日,2026云栖大会开幕,阿里巴巴交出大模型全家桶进展:Qwen3.8-Max发布即斩获Artificial Analysis Agentic智能体第一、CodeArena前端编程第一,AA全球榜从40分提升到45分;基于下一代架构的Qwen4已投入训练,Qwen4.5、Qwen5稳步推进,未来总参数将扩展至5万亿甚至10万亿规模。
RSI:模型开始自己迭代自己
本次大会最具想象力的公布是自我进化(RSI)已进入训练、推理与芯模协同环节:Qwen3.8-Max能在人类"零参与"下自主搭建训练流程、构造数据、设计实验并定位缺陷,持续迭代超1个月、完成33轮有效迭代。推理侧,Qwen3.8在从未见过的平头哥新款GPU上自主适配SGlang推理框架,将下代Qwen3.8-Flash的单实例吞吐提升96%;芯片协同侧,仅凭一份总线模块规范,自主运行超60小时、调用EDA工具上万次,完成面积减少42%、功耗降低59.5%的物理实现优化。
生态数据:全球第一的开源家族
Qwen3.8系列开源一个月下载超5600万次、衍生模型超1900个;Qwen3.8-27B超越DeepSeek-R1与Llama 3.1,成为Hugging Face史上最受欢迎大模型全球第一。阿里累计开源460多个千问模型,总下载超30亿次。海外采用同样凶猛:Airbnb CEO称"大量依赖千问,比OpenAI更好更便宜";Pinterest用Qwen搭建AI购物助手,成本不到同类闭源模型的8%;路透社为降低对闭源模型的依赖基于Qwen开发自有模型。
多模态矩阵齐刷刷升级
- 视频:Wan3.0支持单次30秒生成、结构化输入与原生音画同步,AA文生视频与视频编辑双榜第一,下代视频模型训练中;
- 语音:Qwen-Audio-3.1在ASR/TTS/Realtime三线均居国际第一梯队,实时交互可"边听边想边说";同传模型LiveTranslate字均延迟降至2.3秒(人类同传约4秒);
- 图像:Qwen-Image-3.1面向电商设计秒级交付;7B的Qwen-Image-2.1全面开源,原生支持透明图生成与多图编辑,开源榜第一;
- 世界模型:HappyOyster 2.0 Preview亮相,实时交互、记忆与物理规律遵循能力全面升级。
Qwen3.8-Flash提前开源了下代架构:训练成本骤降近90%,缓存命中输入低至每百万Token 0.1元——性价比再次成为"斩杀线"。
当训练成本被架构创新持续压低、模型开始参与自身迭代,大模型竞争正从"拼参数"转向"拼进化速度与生态纵深"。这与九天技术在天行大模型上坚持的行业知识注入+持续增量训练路线不谋而合。
(事件信息综合自公开报道)