行业观察

小红书开源dots3-note多模态模型,280B参数仅激活16B,华为昇腾当日完成适配

发布日期 2026-08-24 作者 信息来源 AI Base/网易 · https://www.163.com/dy/article/L516AC190511D3QS.html · 2026-08-23 标签 AI原生组织 / 自身即产品 / 上线
小红书dots实验室开源280B参数MoE模型dots3-note preview,支持512K上下文与多模态理解,发布当天华为昇腾完成部署适配。

8月23日,小红书dots模型实验室开源发布dots3-note preview预览版大模型。该模型采用Mixture-of-Experts架构,总参数280B,每次推理仅激活16B参数,支持512K超长上下文窗口,具备文本、视觉与语音多模态理解能力。模型以Apache 2.0协议开源,权重已在Hugging Face和ModelScope上线。

架构方面,模型包含1层dense层和45层MoE层,配备256个路由专家和1个共享专家,每个token仅激活top-8专家。视觉编码器参数量70亿,音频编码器参数量8亿,可在单一上下文窗口内同时处理视频画面与原生音频轨道,无需额外转录步骤。

训练方面引入了名为TEMPO的强化学习方法,允许模型在长程任务中持续自评进度并更新记忆,针对数十小时跨度的Agent工作流进行优化。小红书自测数据显示该模型在SWE-bench Verified得分78.4%,MMMU Pro得分79.1%。同系列另一检查点在IMO 2026取得42/42满分认证。

发布当天,华为昇腾Atlas 800A3与900A3 SuperPoD即通过vLLM Ascend完成0 Day适配部署。dots3系列后续还将推出jazz和aria两个更高级别版本,分别面向不同任务复杂度和计算成本需求。

【AICOR 点评】 内容平台自研并开源前沿大模型,标志着AI能力建设正从专业实验室专利下沉为平台基础设施刚需。小红书以内容社区起家却投入重金造模型,说明AI能力已成为数字平台的底层竞争力。对企业而言,开源MoE模型的涌现意味着私有化部署前沿AI能力的门槛持续降低——280B参数仅激活16B的稀疏设计,让中等规模企业也有可能以可接受的成本自主运行多模态AI。

版权声明 本文由 AI 辅助整理,基于公开报道转写,信息版权归原作者及原媒体所有;内容仅作行业信息分享,不构成任何投资或商业建议。

如涉版权问题,请联系 AICOR(400-601-8080 / 微信 aicor-ai),我们将在收到通知后及时处理。

← 返回新闻列表