行业观察

小红书开源dots3-note多模态模型,280B参数仅激活16B,华为昇腾当日完成适配

Published 2026-08-24 Author Source AI Base/网易 · https://www.163.com/dy/article/L516AC190511D3QS.html · 2026-08-23 Tags AI-Native Organization / Self as Product / Launch
小红书dots实验室开源280B参数MoE模型dots3-note preview,支持512K上下文与多模态理解,发布当天华为昇腾完成部署适配。

8月23日,小红书dots模型实验室开源发布dots3-note preview预览版大模型。该模型采用Mixture-of-Experts架构,总参数280B,每次推理仅激活16B参数,支持512K超长上下文窗口,具备文本、视觉与语音多模态理解能力。模型以Apache 2.0协议开源,权重已在Hugging Face和ModelScope上线。

架构方面,模型包含1层dense层和45层MoE层,配备256个路由专家和1个共享专家,每个token仅激活top-8专家。视觉编码器参数量70亿,音频编码器参数量8亿,可在单一上下文窗口内同时处理视频画面与原生音频轨道,无需额外转录步骤。

训练方面引入了名为TEMPO的强化学习方法,允许模型在长程任务中持续自评进度并更新记忆,针对数十小时跨度的Agent工作流进行优化。小红书自测数据显示该模型在SWE-bench Verified得分78.4%,MMMU Pro得分79.1%。同系列另一检查点在IMO 2026取得42/42满分认证。

发布当天,华为昇腾Atlas 800A3与900A3 SuperPoD即通过vLLM Ascend完成0 Day适配部署。dots3系列后续还将推出jazz和aria两个更高级别版本,分别面向不同任务复杂度和计算成本需求。

【AICOR 点评】 内容平台自研并开源前沿大模型,标志着AI能力建设正从专业实验室专利下沉为平台基础设施刚需。小红书以内容社区起家却投入重金造模型,说明AI能力已成为数字平台的底层竞争力。对企业而言,开源MoE模型的涌现意味着私有化部署前沿AI能力的门槛持续降低——280B参数仅激活16B的稀疏设计,让中等规模企业也有可能以可接受的成本自主运行多模态AI。

Copyright Notice This article is AI-assisted, rewritten from public reports. Copyright of the information belongs to the original authors and media; content is for industry sharing only and does not constitute investment or business advice.

For copyright concerns, contact AICOR (400-601-8080 / WeChat: aicor-ai); we will handle it promptly upon notification.

← Back to News