2026年8月26日晚,阿里正式对外发布并同步开源旗下通义千问最新一代模型 Qwen3.8-Flash。该模型采用全新的下一代(Next)架构,首次让千亿级别的总参数量通过混合专家机制把单次激活量压到 60 亿——这意味着模型在绝大部分推理任务中只需调用 60 亿参数即达到或超越体量远超自身的闭源旗舰。
据官方说明,这一架构得益于阿里自研的 QSA(稀疏注意力)与 GDN 混合注意力机制、自研的 Gated Residual 信息通道、51B 的 N-gram Embedding 参数外挂能力以及配套的训练优化。在多个长上下文与智能体评测上,Qwen3.8-Flash 明显领先 Opus 4.6,其中长程办公任务超 19 分、多模态数学视觉任务超 25 分、具身智能任务超 31 分。
更具冲击的是价格:每百万 Token 输入定价 1 元、输出 3 元,仅为 DeepSeek-V4-Flash 闲时价格的三分之二、忙时价格的三分之一,约为 Claude Opus 4.6 价格的 3%。模型权重同步开源至 Hugging Face 与魔搭社区。下一代架构被官方明确定义为 Qwen4 的雏形。
AICOR 点评:开源闭源之间原本泾渭分明的「能力-价格」护城河正在快速坍塌。Qwen3.8-Flash 的意义不只是发布了一款模型,而是把「千亿模型按 60 亿使用」的工程路径公之于众——这会迫使所有以 Token 计价的玩家重新定价。更深的影响是:当一张 API 价格表被压缩到接近边际成本的水平时,企业 AI 的成本结构也会被迫从「卡 Token」转向「卡场景」,谁能在场景里消化掉更多 Token,谁就拥有了下一个十年的位置。
Aviso de Copyright Este artículo está asistido por IA, reescrito a partir de reportajes públicos. El copyright de la información pertenece a los autores y medios originales; el contenido es solo para compartir información del sector y no constituye asesoramiento de inversión ni comercial.
Por cuestiones de copyright, contacte a AICOR (400-601-8080 / WeChat: aicor-ai); lo gestionaremos con prontitud al recibir la notificación.