9月22日,2026云栖大会在杭州开幕,阿里巴巴公布大模型体系最新进展。Qwen LLM项目负责人刘大一恒披露,基于下一代架构的Qwen4已经投入训练,后续Qwen4.5、Qwen5等版本的参数规模计划扩展至5万亿到10万亿。大模型递归自我改进(RSI)已初步进入模型训练、推理及芯片模型协同等环节。
具体进展上,Qwen3.8-Max发布后拿下Artificial Analysis Agentic智能体评测第一和CodeArena前端编程第一。更受关注的是自我迭代能力:该模型在人类完全零参与的情况下自主搭建训练流程、构造数据、设计实验并定位缺陷,持续迭代超过1个月,完成33轮有效迭代,Artificial Analysis得分从40分升至45分,与Claude、GPT最强模型同处第一阵营。在推理侧,它在未接触过的平头哥新款GPU上自主完成推理框架适配,单实例吞吐量提升96%;在芯片协同设计中,自主运行超60小时、调用EDA工具超万次,完成减少42%面积的物理实现优化。
多模态方面,下一代视频生成模型将于11月发布,支持更长时长、更可控的叙事级创作。开源生态数据显示,阿里已开源460多个千问模型,整体下载量超30亿次,衍生模型超30万个。
【AICOR点评】这条新闻真正的看点不是参数规模,而是RSI从论文概念走进生产管线:模型自己搭训练流程、自己找缺陷,等于把“算法工程师的部分工作”交给硅基劳动力。对企业而言,模型能力竞赛由大厂代劳即可,真正要补的课是让自有业务数据、流程知识成为模型进化的养料——组织侧的上下文工程,比追任何一个新版本都更值得投入。
Copyright Notice This article is AI-assisted, rewritten from public reports. Copyright of the information belongs to the original authors and media; content is for industry sharing only and does not constitute investment or business advice.
For copyright concerns, contact AICOR (400-601-8080 / WeChat: aicor-ai); we will handle it promptly upon notification.