2026 年 10 月 3 日——OpenCode 于 10 月 2 日宣布,蚂蚁集团百灵团队(inclusionAI)9 月 30 日发布的新一代稀疏 MoE 大模型 Ling-3.1-flash 已登陆其 Zen 模型网关,以 ling-3.1-flash-free 模型 ID 限时免费开放调用,输入、输出与缓存读取价格均为零,免费期可用上下文 262K。模型总参数约 560B,每个 token 仅激活约 25B。
模型于 9 月 30 日发布,官方先开两周免费体验
Ling-3.1-flash 由蚂蚁百灵于 9 月 30 日正式发布,采用混合专家(MoE)架构,总参数约 560B,每个 token 激活约 25B,稀疏比约 1/22。据官方公告,研发围绕通用智能体、搜索、日常办公与软件研发四类任务持续优化,并在医疗、金融与材料科学研究场景增强能力。
模型上下文窗口上限为 1M token。官方表示,考虑到综合服务成本,自 9 月 30 日起为期两周的免费体验期内服务长度为 256K;转为付费服务后计划开放完整 1M 上下文,届时团队也计划同步开源,并继续更新模型性能。官方体验入口为 ling.tbox.cn 网页端与 ling.tbox.cn/open 开发者平台。截至发稿,官方付费定价与文字版评测数据均未公布,发布时公布的评测得分仅以图片形式提供。
OpenCode Zen 接入信息
OpenCode Zen 是开源编码代理 OpenCode 官方运营的模型网关,此前美团 LongCat-2.5-Preview 等模型也以限时免费模式在该网关上架。据 OpenCode Zen 官方文档,Ling 3.1 Flash Free 已进入免费模型列表,官方说明为「目前在 OpenCode 上限时免费提供,团队正在利用这段时间收集反馈并改进模型」。
接入信息(数据来源:OpenCode Zen 官方文档):
| 项目 | 数据 |
|---|---|
| 模型名称 | Ling 3.1 Flash Free |
| 模型 ID | ling-3.1-flash-free |
| OpenCode 配置格式 | opencode/ling-3.1-flash-free |
| API 端点 | https://opencode.ai/zen/v1/chat/completions |
| 协议兼容 | OpenAI 兼容(@ai-sdk/openai-compatible) |
| 输入 / 输出 / 缓存读取价格 | 免费(限时) |
| 思考模式 | 可开关(reasoning toggle) |
| 免费期可用上下文 | 262K(262,144 token) |
在 OpenCode 中使用需先登录 OpenCode Zen 获取 API 密钥,在 TUI 中执行 /connect 选择 OpenCode Zen 并粘贴密钥,再通过 /models 选择该模型;Zen 网关同时可脱离 OpenCode 供其他编码代理调用。262K 的上下文口径与官方免费体验期 256K 服务长度一致,262,144 token 即 256×1024。
OpenCode Zen 官方文档同时注明,Ling 3.1 Flash Free 在免费期间收集的数据可能会被用于改进模型,同类免费模型均适用该条款。涉及敏感或机密内容的场景建议暂缓使用免费通道。
除 Zen 外,Vercel AI Gateway 已免费收录 inclusionai/ling-3.1-flash;NanoGPT 提供付费通道,定价约 0.075 美元输入、0.22 美元输出每百万 tokens(数据来自 models.dev 收录的 provider 配置)。
开源计划与后续关注点
与前代 Ling-3.0-flash(124B 总参数、5.1B 激活,发布即以 MIT 协议开源)不同,Ling-3.1-flash 采用了「闭源托管先行、转付费时开源」的节奏。官方承诺转为付费服务时同步开源;前代全系 MIT 协议的开源先例与 inclusionAI 组织在 Hugging Face 主页「所有模型基于 MIT 或 Apache 协议」的自述,为该承诺提供了参照。
截至 10 月 3 日,Hugging Face 的 inclusionAI 组织下尚未出现 Ling-3.1-flash 权重仓库,蚂蚁百灵官网模型家族页也未上线该模型。按两周免费体验期自 9 月 30 日起算,免费期约在 10 月 14 日前后到期,开源权重与 1M 上下文的开放节奏值得在此窗口前后关注。此为按免费期推算,官方未给出具体日期。
举手提问