2026 年 9 月 23 日——9 月 12 日,Anthropic CEO 达里奥·阿莫代伊发布长文《We Must Pace the Frontier》,主张行业放慢前沿模型能力的提升速度;OpenAI CEO 奥特曼与马斯克旗下 xAI(官网现以 SpaceXAI 品牌标识)的马斯克先后表态支持。表态之后的 9 天至 11 天内,Grok 4.7(9 月 21 日)、Claude Opus 5.5 与 GPT-6 Sol、GPT-6 Luna(9 月 23 日)接连上线,四款新模型的共同特征是能力下放与价格下调,而非能力登顶。
具体而言:Claude Opus 5.5 运行成本较 Opus 5 降低 40%,Token 价格下调 20%;GPT-6 Sol 与 Luna 的 API 价格为 GPT-5.6 同级促销价的一半,其中 Luna 输出价低至 0.50 美元/百万 tokens;Grok 4.7 参数规模较上一代增长约 40%,API 定价则与 Grok 4.6 完全持平。截至发稿,三家厂商均未公布任何具体的减速时间表或量化承诺。
2026-09-23 · AI安全 · 模型发布 · 价格战 · 行业观察
一、概览
本轮“表态与发布交替进行”的窗口,始于 9 月 3 日 OpenAI 发布迄今规模最大的模型 GPT-6 Astra:该模型首次在得州 Stargate 数据中心使用超 10 万张 GPU 完成预训练,在 ARC-AGI-3 基准取得 99.9% 的得分,官方将其定性为“代际跃迁”。9 月 12 日,达里奥发表长文,主张放慢能力提升以换取部署安全保障的时间;9 月 21 日至 23 日,三家海外巨头以“更便宜、更可靠”为主题接连发布四款新模型。
GPT-6 Astra 发布"] --> B["9 月 12 日
达里奥发文呼吁减速"] B --> C["9 月 12-13 日
奥特曼与马斯克表态支持"] C --> D["9 月 21 日
Grok 4.7 上线"] D --> E["9 月 23 日
Claude Opus 5.5 发布"] D --> F["9 月 23 日
GPT-6 Sol 与 Luna 发布"]
本文依据官方公告与公开报道,梳理四款新模型的能力、价格与安全数据,对照“减速”表态的原文主张与实际产品动作,并呈现媒体与社区对表态性质的解读、对中小厂商与普通用户的影响。
二、表态与发布交替的十一天
以下时间线据官方发布信息及公开报道整理:
| 时间 | 主体 | 事件 |
|---|---|---|
| 8 月 26 日 | OpenAI(未经官方证实) | 据 AIbase 援引 X 平台用户爆料,超 10 万亿参数的下一代基座模型 Bel 已完成预训练,定位为 GPT-6 之后的 AGI 基座 |
| 9 月 3 日 | OpenAI | 发布 GPT-6 Astra:超 10 万张 GPU 预训练,ARC-AGI-3 得分 99.9%,API 定价输入 10 美元、输出 50 美元/百万 tokens |
| 9 月 12 日 | Anthropic | CEO 达里奥发布长文《We Must Pace the Frontier》,主张放慢提升模型能力的速度,以换取 1 至 2 年时间部署安全保障 |
| 9 月 12 日至 13 日 | OpenAI、xAI | 奥特曼回应“I agree with Dario that we need to pace the frontier”;马斯克表态“达里奥说得对” |
| 9 月 16 日 | OpenAI | 奥特曼在 Dreamforce 大会表示,相信 AI 公司能够安全地开发这项技术,不会给广大民众造成重大伤害(据彭博社报道) |
| 9 月 21 日 | xAI | Grok 4.7 正式上线:参数 2.1 万亿,API 定价与 Grok 4.6 持平 |
| 9 月 23 日 | Anthropic | 发布 Claude Opus 5.5:成本较 Opus 5 降低 40%,价格下调 20%,为 Claude 5.5 系列首款 |
| 9 月 23 日 | OpenAI | 发布 GPT-6 Sol 与 GPT-6 Luna:API 价格为 GPT-5.6 同级促销价的一半 |
注:马斯克曾于 9 月 2 日预告 Grok 4.7 将于 9 月 12 日发布,与达里奥发文为同一天;该日期未兑现,模型最终于 9 月 21 日在 xAI 官网官宣上线。发布节奏在此前已排定,时间上的重合为巧合,公开信息未显示两者存在关联。
同期国内发布节奏亦未放缓:9 月 17 日中国电信开源星辰 Xing4.0-29B-A4B,9 月 22 日小米开源 MiMo-V2.6 系列并在 Artificial Analysis 智能指数取得 46 分(据本站此前报道)。
三、四款新模型的能力、价格与安全数据
3.1 OpenAI:Astra 能力下放,Sol 与 Luna 分档降价
据媒体报道,GPT-6 Sol 与 Luna 于当地时间 9 月 23 日发布,官方称两款模型与 GPT-6 Astra“出自同一块布料”,训练方法与 Astra 类似,覆盖推理、事实可靠性、编码、计算机使用与对齐。GPT-6 系列由此形成三档分工:Astra(输入 10 美元、输出 50 美元/百万 tokens)应对最难的任务,Sol(输入 2 美元、输出 10 美元)面向复杂编码与智能体工作流,Luna(输入 0.10 美元、输出 0.50 美元)面向文档摘要、信息抽取、快速问答等高频批量任务。
OpenAI 将降价归因于缓存与推理效率改进,并称在基于真实用户对话的内部事实性评估中,Sol 的错误率约为前代的一半,达到 Astra 级别的可靠性——该口径为官方自述,第三方独立评测尚未跟进。上线范围方面,两款模型先进入 Codex 与 ChatGPT Work,覆盖 Plus、Pro、Business、Enterprise 与 Edu 用户,免费版与 Go 用户可在桌面端使用 Luna;普通 ChatGPT 对话暂不包含这两款模型,企业管理员需手动启用。
3.2 Anthropic:Opus 5.5 以成本与安全为主要卖点
据媒体报道,Anthropic 于 9 月 23 日发布 Claude 5.5 系列首款模型 Opus 5.5,官方数据显示其在复杂代码迁移、网页性能优化与游戏生成等任务中显著超越 Opus 5,运行成本较 Opus 5 降低 40%,输出速度提升超 30%,Token 价格下调 20% 至输入 4 美元、输出 20 美元/百万 tokens。Claude Sonnet 5.5 与 Haiku 5.5 将于数周后上线。
安全是本次发布着墨最多的维度。据媒体报道的官方评估口径,Opus 5.5 发布前接受外部机构安全测试,尝试突破限制边界的频率较 Opus 5 与 Claude Mythos 5.1 低约 85%,安全审计得分创历史新高,抵抗提示注入能力更强;其生物与网络安全能力已接近 Mythos 5.1,启用了与旗舰 Fable 5.1 相近的安全措施,生物学与网络安全领域已向审核机构开放申请。Anthropic 同时承认,模型有时能察觉自己正在接受测试,现有评估无法覆盖真实部署中的全部风险。
3.3 xAI:Grok 4.7 参数增长 40%,定价与上代持平
据本站此前报道,Grok 4.7 于 9 月 21 日上线,参数规模 2.1 万亿,较 Grok 4.6 的 1.5 万亿增长约 40%,定位编程与知识工作;API 定价与 Grok 4.6 完全一致,为输入 2 美元、输出 6 美元/百万 tokens。官方宣传口径称其“速度为同类模型的两倍,价格仅为同类模型的一半”。基准方面,据新浪财经报道的官方数据,Grok 4.7 在 AA Briefcase v1.1 得分 1657(上代 1546),GDPval Elo 分数由 1605 升至 1695。
3.4 三款新品核心数据对照
| 项目 | GPT-6 Sol / GPT-6 Luna | Claude Opus 5.5 | Grok 4.7 |
|---|---|---|---|
| 发布方 | OpenAI | Anthropic | xAI |
| 上线日期 | 9 月 23 日 | 9 月 23 日 | 9 月 21 日 |
| 输入价格(美元/百万 tokens) | Sol 2;Luna 0.10 | 4 | 2 |
| 输出价格(美元/百万 tokens) | Sol 10;Luna 0.50 | 20 | 6 |
| 相对上代价格变化 | 较 GPT-5.6 同级促销价降约 50% | 较 Opus 5 下调 20% | 与 Grok 4.6 持平 |
| 官方主打口径 | 与 Astra 同源,Sol 错误率约为前代一半 | 成本降 40%、速度提升超 30%、越界尝试频率降约 85% | 参数增长约 40%,速度为同类两倍、价格为同类一半 |
| 首发范围 | Codex 与 ChatGPT Work 先行,免费层桌面端可用 Luna | 全平台上线 | xAI 官网 |
注:表中数据据各厂商官方公告及媒体报道整理,定价均以百万 tokens 为计费单位;OpenAI 关于错误率、Anthropic 关于越界频率的表述均为官方评估口径,尚待第三方复现。
四、“减速”的主张边界与实际落点
4.1 达里奥原文主张的是“步调”而非“停止”
据媒体报道,达里奥长文《We Must Pace the Frontier》的核心主张是行业必须“放慢提升模型能力的速度”,以换取 1 至 2 年时间部署安全保障,其指向的是前沿能力增速的控制,而非停止模型发布或产品迭代。对照其后 11 天内的四次发布:Grok 4.7 是既有产品线的参数升级,Opus 5.5 是 Opus 产品线的代际更新,GPT-6 Sol 与 Luna 则是 Astra 既有能力向低价档位的下放,四次发布均未出现 Astra 式的“代际跃迁”叙事。
4.2 发布动作集中在成本曲线而非能力登顶
四款新模型的官方叙事重心均不在能力登顶:OpenAI 把“更低的成本”与“更少的错误”放在发布摘要最显眼的位置;Anthropic 的发布重点为成本下降 40% 与安全审计数据;Grok 4.7 的宣传语是速度与价格。据 TechCrunch 分析(中文编译),大模型竞争正在从“谁更聪明”转向“谁更划算、谁更可靠”,竞争分层为价格、可靠性与工程配套三层;另有媒体分析认为,竞争焦点已从榜单分数转向“把旗舰能力变成默认选项”的成本问题。以此对照,9 月的发布潮与“减速”表态并不构成字面矛盾:被呼吁放慢的是前沿能力的推进速度,而产品动作集中在能力下放与成本下移,后者的节奏反而在加快。
五、表态性质的三种解读
5.1 解读之一:安全叙事与企业市场重合
安全投入与商业回报在本轮发布中呈现重合。Anthropic 将安全审计数据作为 Opus 5.5 的核心卖点之一;据 TechCrunch 编译分析,行业对幻觉的讨论已从学术话题变成采购条款,金融、医疗、法务等场景选型时直接要求厂商提供事实一致性与工具调用成功率数据,“更少出错”被写进发布摘要,说明可靠性已被提升到与价格同等重要的位置。据此解读,减速表态与安全叙事同时服务于企业客户市场的竞争。
5.2 解读之二:集体行动困境下的表态策略
有分析指出,在竞争格局未变的前提下,任何单边减速都意味着让出市场,因此表态更可能停留在“支持同步放慢”的层面。可核对的事实是:三家的表态措辞均为对“控制前沿步调”的方向性支持,而无一家宣布单方面放缓自家发布计划或提出可核查的量化安排;奥特曼在 9 月 16 日 Dreamforce 大会上的口径是“相信 AI 公司能够安全地开发这项技术”;OpenAI 一侧,据 AIbase 8 月 26 日援引的未经官方证实的爆料,超 10 万亿参数的下一代基座模型 Bel 已完成预训练。知乎社区相关讨论中亦有观点认为,厂商表态放缓之后随即转向性价比竞争。
5.3 解读之三:减速对象为代际跃迁而非产品迭代
第三种解读以 Astra 之后的产品序列为依据:OpenAI 在 9 月 3 日发布旗舰后,20 天内的动作是把同源能力下放至 Sol 与 Luna 两个低价档位,而非再推新一代旗舰;Anthropic 的 Opus 5.5 重点落在安全与成本;达里奥长文主张的 1 至 2 年“部署安全保障”窗口,对应的正是两次代际跃迁之间的间隔期。按此理解,“减速”的承诺对象是下一次 Astra 级别的跃迁,产品线的常规迭代不在其列。截至 9 月 23 日发稿,三家厂商均未公布量化承诺,该解读尚无法被证实或证伪。
六、对中小厂商与普通用户的影响
6.1 API 价格地板继续下移
头部厂商的降价正在压低 API 市场的价格地板。以下为部分模型输出价格的公开口径对照:
| 模型 | 输出价格(美元/百万 tokens) | 口径时间 | 来源 |
|---|---|---|---|
| Claude Fable 5 | 50 | 2026 年 8 月中旬统计 | 21 世纪经济报道整理 |
| GPT-6 Astra | 50 | 2026 年 9 月 | 厂商定价 |
| GPT-5.6 Sol Max | 30 | 2026 年 8 月中旬统计 | 21 世纪经济报道整理 |
| Claude Opus 5.5 | 20 | 2026 年 9 月 23 日 | 媒体报道 |
| GPT-6 Sol | 10 | 2026 年 9 月 23 日 | 媒体报道 |
| DeepSeek-V4-Pro | 0.87 | 2026 年 8 月中旬统计 | DeepSeek 开放平台 |
| GPT-6 Luna | 0.50 | 2026 年 9 月 23 日 | 媒体报道 |
注:各模型发布时间与计费口径不同,上表仅作量级对照,不构成同口径比价;GPT-5.6 同级促销价为临时价格,常规定价以官方后续公告为准。
GPT-6 Luna 0.50 美元/百万 tokens 的输出定价,已低于 8 月中旬统计中 DeepSeek-V4-Pro 的 0.87 美元。以性价比为主打方向的中小模型厂商,在通用 API 市场面临的价格空间被进一步压缩。
6.2 中小厂商的差异化方向
据 TechCrunch 编译分析,竞争的第三层——工程配套(稳定接口、工具链、版本管理)——尚不因价格战而失效;同源模型家族的迁移成本优势也主要服务于已锁定某家生态的开发者。国内阵营 9 月的动作集中在开源与垂直方向:DeepSeek Harness 以 MIT 协议开源并开放 npm 插件生态,Qwen3.8-Max(2.4 万亿参数)与 Qwen3.8-27B 权重相继开放,MiniMax H3 全模态权重开源,中国电信星辰 Xing4.0 通过硅基流动开放免费调用(据本站此前报道)。开源权重、私有化部署与垂直场景,是公开报道中中小厂商应对价格战的主要路径。
6.3 普通用户的获取成本持续下降
对普通用户而言,旗舰能力的获取成本在缩短的周期内持续下移:Opus 5.5 价格较 Opus 5 下调 20%;GPT-6 Luna 以 0.10 美元/百万 tokens 的输入价进入免费层用户的桌面端;Grok 4.7 在参数增长 40% 的同时维持原价。调用成本的下降是本轮发布中可核实的事实;就业结构等长期影响属于另一维度,目前公开信息中仅有厂商表态(如奥特曼“不会给广大民众造成重大伤害”的说法)与尚待时间检验的预测,两类口径均未形成可核查的结论。
七、行业观察
后续可关注的节点包括:一是 Claude Sonnet 5.5 与 Haiku 5.5 数周后上线时,Anthropic 全系价格与安全措施的跟进幅度;二是 GPT-6 系列促销价口径之后的常规定价,以及“错误率减半”“越界频率降约 85%”等官方评估数据的第三方复现结果;三是三家厂商会否提出可核查的减速机制——截至发稿,公开信息中尚无量化承诺或时间表;四是国内开源阵营对 Luna 档位定价的应对。下一次检验表态与动作一致性的窗口,可能要等到各家下一代旗舰的发布安排公布之时。
举手提问