行业观察

Qwen4已投入训练,阿里公布5万亿至10万亿参数演进路线

Publicado 2026-09-22 Autor Fuente 新华财经 · https://www.cnfin.com/gs-lb/detail/20260922/4473395_1.html · 2026-09-22 Etiquetas Organización Nativa IA / Auto-Caso / Lanzamiento
2026云栖大会上,阿里披露下一代架构Qwen4已投入训练,Qwen4.5、Qwen5参数规模将扩展至5万亿至10万亿,递归自我改进RSI已进入训练、推理与芯模协同环节。

9月22日,2026云栖大会在杭州开幕,阿里巴巴公布大模型体系最新进展。Qwen LLM项目负责人刘大一恒披露,基于下一代架构的Qwen4已经投入训练,后续Qwen4.5、Qwen5等版本的参数规模计划扩展至5万亿到10万亿。大模型递归自我改进(RSI)已初步进入模型训练、推理及芯片模型协同等环节。

具体进展上,Qwen3.8-Max发布后拿下Artificial Analysis Agentic智能体评测第一和CodeArena前端编程第一。更受关注的是自我迭代能力:该模型在人类完全零参与的情况下自主搭建训练流程、构造数据、设计实验并定位缺陷,持续迭代超过1个月,完成33轮有效迭代,Artificial Analysis得分从40分升至45分,与Claude、GPT最强模型同处第一阵营。在推理侧,它在未接触过的平头哥新款GPU上自主完成推理框架适配,单实例吞吐量提升96%;在芯片协同设计中,自主运行超60小时、调用EDA工具超万次,完成减少42%面积的物理实现优化。

多模态方面,下一代视频生成模型将于11月发布,支持更长时长、更可控的叙事级创作。开源生态数据显示,阿里已开源460多个千问模型,整体下载量超30亿次,衍生模型超30万个。

【AICOR点评】这条新闻真正的看点不是参数规模,而是RSI从论文概念走进生产管线:模型自己搭训练流程、自己找缺陷,等于把“算法工程师的部分工作”交给硅基劳动力。对企业而言,模型能力竞赛由大厂代劳即可,真正要补的课是让自有业务数据、流程知识成为模型进化的养料——组织侧的上下文工程,比追任何一个新版本都更值得投入。

Aviso de Copyright Este artículo está asistido por IA, reescrito a partir de reportajes públicos. El copyright de la información pertenece a los autores y medios originales; el contenido es solo para compartir información del sector y no constituye asesoramiento de inversión ni comercial.

Por cuestiones de copyright, contacte a AICOR (400-601-8080 / WeChat: aicor-ai); lo gestionaremos con prontitud al recibir la notificación.

← Volver a Noticias