人工智能

蚂蚁百灵发布 Ling-3.1-flash:约 560B 总参数,计划开放 1M 上下文

2026年10月1日 · admin
OpenMagic API

据 IT之家 9 月 30 日消息,蚂蚁百灵今日发布新模型 Ling-3.1-flash。来源显示,该模型拥有约 560B 总参数,每个 Token 激活约 25B 参数,主打长上下文与多任务能力。其上下文窗口上限为 1M,可用于容纳更长的文档、代码和任务历史。不过在开放初期,Ling-3.1-flash 将提供为期两周的免费体验,免费期间模型服务长度为 256K;待免费体验结束并转为付费服务后,官方计划开放 1M 上下文,并同步推进开源与后续性能更新。

大参数与长上下文:面向智能体和复杂任务

从公开信息看,Ling-3.1-flash 的核心标签包括“大规模参数”“稀疏激活”和“长上下文”。约 560B 总参数意味着模型整体规模较大,而每个 Token 激活约 25B 参数,则表明其在推理时并非调用全部参数,而是采用更偏向效率的激活方式。这类设计通常有助于在模型能力和服务成本之间取得平衡。

更值得关注的是 1M 上下文窗口。对于 AI 工具用户而言,长上下文并不只是“能输入更多字”,而是直接关系到模型能否连续处理大段文档、复杂代码仓库、跨轮任务记录以及多步骤工作流。蚂蚁百灵官方表示,模型研发过程中围绕通用智能体、搜索、日常办公和软件研发等任务持续优化,这与长上下文能力的应用方向高度相关。

  • 文档处理:更适合分析长报告、合同、资料集和多文件材料。
  • 代码任务:可容纳更长的代码片段、项目上下文和历史修改记录。
  • 智能体场景:有助于保留任务规划、工具调用结果和多轮执行轨迹。
  • 办公流程:面向搜索、总结、撰写和跨资料整合等高频需求。

免费体验先限 256K,1M 上下文将在付费阶段开放

此次发布中,一个关键细节是免费体验与正式服务能力之间的差异。Ling-3.1-flash 将开放两周免费体验,但由于综合服务成本因素,免费体验期间模型服务长度为 256K。官方计划在免费体验期结束并转为付费服务后,开放 1M 上下文能力。

这说明超长上下文虽然是模型的重要卖点,但在实际在线服务中仍涉及推理资源、响应延迟和成本控制等问题。对企业和开发者来说,256K 已经可以覆盖不少长文档与复杂对话场景;而 1M 上下文更适合需要持续读取大型资料、长代码库或完整任务历史的高阶应用。

影响与解读:国产大模型竞争转向“可用场景”

近一段时间,大模型发布不再只强调通用问答能力,更多开始围绕智能体、办公、研发和行业场景展开。Ling-3.1-flash 官方提到,在医疗、金融和材料科学研究等场景持续提升模型能力,这表明模型厂商正在把技术指标与垂直应用结合起来,试图进入更高价值的工作流。

对中文 AI 生态而言,Ling-3.1-flash 的意义在于:一方面,它把长上下文作为关键能力推向应用层;另一方面,后续计划开源也可能为开发者、研究者和企业用户提供更多评测与二次开发空间。来源还提到,IT之家附有该模型在多个任务评测中的得分,但摘要未披露具体分数,因此目前仍需等待更多公开信息来判断其在实际任务中的表现。

总体来看,Ling-3.1-flash 的发布反映出国产模型正在从“参数规模竞赛”走向“场景效率竞赛”。如果后续 1M 上下文、付费服务和开源计划能够按计划推进,它将为长文档理解、软件研发辅助和智能体应用带来新的选择。对于开发者和企业用户,接下来更值得观察的是其稳定性、成本、工具调用能力以及在真实业务流程中的表现。