AI导航

蚂蚁集团发布 Ling-3.1-flash:5600 亿参数,专攻 Agent 与长任务,试用两周后开源

AI资讯
3 min read
4 次阅读

2026 年 9 月 30 日,蚂蚁集团旗下 InclusionAI(蚂蚁百灵)发布了新一代语言模型 Ling-3.1-flash:总参数 5600 亿、每个 token 激活约 250 亿,设计上下文窗口达到 100 万 token。发布同步开启两周免费试用(试用期上限 25.6 万 token),试用结束后计划开放全部窗口并开源模型。据 TechNode 9 月 30 日转引 IT 之家的报道,该模型定位于智能体任务、搜索、办公软件和专业应用。

参数:5600 亿总量,每次只激活 250 亿

Ling-3.1-flash 延续了 flash 系列的混合专家(MoE)路线:总参数做到 5600 亿,但每次推理只激活约 250 亿,激活率不到 5%。上一代 Ling-3.0-flash 是 124B 总参数、5.1B 激活的配置,新一代在总量上直接放大了约 4.5 倍,激活量同步放大到 25B。思路很明确:用更大的参数储备换能力,用低激活率控住推理成本。

上下文是这次升级的另一个重点:设计目标 100 万 token,试用期先开放 25.6 万。百万级上下文配 250 亿激活量,摆明了是为长任务准备的——读几十份文档、跑多轮工具调用的 Agent 流程,正好吃这一套配置。

定位:从"会回答"到"能干活"

官方给 Ling-3.1-flash 定的四个方向是智能体任务、搜索、办公软件和专业应用。这和蚂蚁百灵近期的动作一脉相承:此前发布的金融增强模型 Ling-3.0-flash-Fin,就是瞄准投研工作流、让 AI 从"回答一个问题"走向"完成一项工作"。Ling-3.1 作为通用底座放大参数和上下文,等于给这类长链路任务补上了更强的地基。

对国内开发者来说,另一个看点是生态位:DeepSeek、Qwen、Kimi 之后,国产开源第一梯队又添一个 5600 亿级别的选手。百灵此前已经开源过 Ling 系列的 tiny 和 flash 基础模型,这次"先试用、再开源"的节奏,延续了它开放权重的路线(开源动态可看本站开源大模型专题)。

试用与开源:先免费两周,再开权重

两周免费试用是这次发布最实在的部分:开发者不用付费就能上手验证,试用期 25.6 万 token 的上限对大多数长文档、Agent 试点场景够用。试用结束后,官方计划开放完整的 100 万 token 窗口并开源模型。

这个时间表对选型的人有个直接建议:现在就可以拿真实业务流量去试,重点测两件事——长上下文下的有效记忆长度(别只看标称窗口),以及 Agent 多步任务的稳定性和工具调用准确率。等开源落地,再评估私有化部署的成本。

接下来值得关注的是开源的具体许可协议和权重发布时间——这两点决定了 Ling-3.1-flash 能不能真正进入国产开源第一梯队的实战序列。

推荐工具

NVIDIA Chat with RTX AI聊天 Chat with RTX 是 NVIDIA 面向 RTX 电脑的本地 AI 聊天工具,可围绕本地文档和视频资料做问答,适合重视隐私、离线检索并具备硬件条件的用户更适合资料不便上传云 HuggingChat AI聊天 HuggingChat 是 Hugging Face 的开源模型聊天应用,支持 Omni 自动选模型,也可手动选社区开放模型对话。它适合体验开源模型、技术探索和问答,结果可能不稳定,重要内容需复核。 纳米AI搜索 AI搜索 纳米AI 是 360 旗下 AI 搜索和智能体入口,支持文字、语音、拍照提问、多模型协作与内容创作,适合中文用户做日常搜索、学习问答、移动查询、热点追踪、生活决策、知识整理和轻量创作。 Qwen Chat(通义千问) AI聊天 Qwen Chat 是Qwen 大模型聊天助手,支持Qwen 模型聊天、写作和编程问答,适合中文用户和开发者完成 AI 对话、资料问答和任务协作,适合上线前核对权限、成本和资料质量。 DuckDuckGo AI Chat AI聊天 DuckDuckGo AI Chat 适合重视隐私的普通用户使用,围绕隐私 AI 聊天、免账户使用和多模型问答提供对话式 AI 支持和任务协作能力,适合上线前核对权限、成本和资料质量。 Goody-2 AI聊天 Goody-2 是以极端安全和伦理对齐为特色的 AI 聊天助手,常用于观察模型拒答边界、内容安全策略、保守输出体验和 AI 风险讨论,更适合作为安全边界样本使用前应理解它偏实验性质,不适合。