For AI agents: the public content index is available at https://we0.ai/llms.txt, and the English article bundle is available at https://we0.ai/llms-full.txt.
For AI agents: the complete content index is available at https://we0.ai/llms.txt, the full English article bundle is available at https://we0.ai/llms-full.txt, and this page is available as Markdown at https://we0.ai/zh/articles/gpt-6-speed-boost-astra-and-6-1-sol-gain-90356630.md.
OpenAI 已开启为期 28 天的产品改进计划,首项更新就带来了用户可直接感知的变化:通过符合条件的 ChatGPT 订阅使用时,**GPT-6 Astra 和 GPT-6.1 Sol 的默认速度现已大约提升 50%**。

OpenAI 已开启为期 28 天的产品改进计划,首项更新就带来了用户可直接感知的变化:通过符合条件的 ChatGPT 订阅使用时,GPT-6 Astra 和 GPT-6.1 Sol 的默认速度现已大约提升 50%。
该改进适用于 OpenAI 产品,以及支持 Sign in with ChatGPT 的合作伙伴工具,包括 OpenCode、Pi、Amp 和 Devin。
无需修改代码。
OpenAI 工程负责人 Thibault “Tibo” Sottiaux 表示,默认订阅速度已优化约 50%。社区测量显示,实际速度大致从 每秒 30 个 token 提升到约每秒 50 个 token,不过准确吞吐量会因模型、任务、产品和运行时条件而异。

Tibo 在第 1 天的公告中表示,通过订阅访问 GPT-6 Astra 和 GPT-6.1 Sol 的速度提升约 50%。
这一时间点值得关注,因为另一项讨论正在同时发生。
SemiAnalysis 发布了一项详细的极限测试研究,对比消费级 AI 订阅服务。在其智能体工作负载假设下,Claude Opus 5.5 订阅在相同月费价格下提供的 API 等效价值,超过 GPT-6.1 Sol 方案的五倍。
因此,OpenAI 已让模型变得更快。
更难回答的问题是:对于运行长时间自主编程和智能体工作流的用户而言,订阅经济性是否仍具竞争力。
OpenAI 这轮 28 天发布计划的首项更新,针对的是高级编程和智能体工作中最明显的摩擦来源之一:生成延迟。
Tibo 写道,OpenAI 通过订阅访问将 GPT-6 Astra 和 GPT-6.1 Sol 的默认速度优化了约 50%。
此次发布适用于:
用户无需更改配置,也无需切换 API 端点。

社区测量显示速度有明显提升,但吞吐量会因模型和访问路径而不同。
源文章将这一变化概括为从大约:
~30 tokens/秒
↓
~50 tokens/秒
这是一个有用的简写,但官方公告本身表述为 “速度提升约 50%”,而不是承诺固定的每秒 50 TPS 服务水平。
不同测试者可能看到不同数值。
这项速度改进是更广泛的 28 天推进计划中的第一项。
Tibo 表示,在接下来的 28 天中,OpenAI 计划每天发布以下两类内容之一:

这项 28 天推进计划聚焦于简化、效率、新能力和模型改进。
已公布的优先方向包括:
这条信息尤其面向 Codex 和 Work 用户。在这类场景中,长时间运行的任务会让速度和使用限制变得比短对话中更明显。
原文称,这项变化部分来自一种“激进”的优化分词器,它能减少完成同一任务所需的 token 数量。
对此具体说法应谨慎看待。
本文审阅的 OpenAI 员工公开声明将第 1 天更新描述为推理优化和默认速度改进。
这些公开材料并未说明,GPT-6 Astra 或 GPT-6.1 Sol 已推出新的分词器,且该分词器是此次 50% 提升的机制。
这一区分很重要。
改善实际吞吐体验有多种方式:
在没有官方技术说明的情况下,更稳妥的说法是 OpenAI 优化了推理,而不是将提升归因于特定的分词器架构。
模型生成速度提升 50%,并不意味着每一项完整任务都能提前 50% 完成。
智能体工作流花费时间的环节不只有 token 生成。
一个典型的编程任务可能包括:
模型推理
↓
工具调用
↓
Shell 命令或浏览器操作
↓
文件读取/写入
↓
网络等待
↓
下一轮模型调用
如果工具、网站、构建、测试或外部 API 占据了大部分实际耗时,更快的 token 生成速度可能只能缩短总任务时长的一部分。
源文章还指出,一些开发者没有立刻感受到显著差异。
这是合理的。
用户感知到的速度取决于:
这次更新是真实的,但不应将其理解为:每一项端到端任务都保证在原来三分之二的时间内完成。
同一周,SemiAnalysis 发布了一份 AI 订阅限制的详细比较报告。
研究人员购买订阅计划,运行受控工作负载,直到使用量计量器变化或达到限制,并将这些限制换算为API 等效美元价值。
其方法分别衡量:
随后,他们使用一个代表性的智能体工作负载将这些费率合并计算。

SemiAnalysis 测试了 OpenAI、Anthropic 及其他多家 AI 提供商的订阅限制。
源文章中的关键对比是 GPT-6.1 Sol 与 Claude Opus 5.5。

SemiAnalysis 估计,在其智能体工作负载假设下,Claude Opus 5.5 的优势超过五倍。
已发布图表给出以下快照:
| 月度计划 | OpenAI / GPT-6.1 Sol | Anthropic / Claude Opus 5.5 | 约略比率 |
|---|---|---|---|
| $200 | $2,084 API 等效价值 | $11,726 | 5.6× |
| $100 | $1,055 | $5,725 | 5.4× |
| $20 | $211 | $1,178 | 5.6× |
这些数字并不意味着价值 200 美元的 Anthropic 订阅会实际向客户支付 $11,726。
它们的含义是:根据 SemiAnalysis 测得的限制和假设的工作负载组合,如果通过已公布的 API 价格使用同等用量,理论上大约需要花费这么多。
一项社区制作的 200 美元档位可视化,让差异更容易理解。

200 美元档位的比较会因所使用的模型不同而有显著变化。
关键细节在于模型选择。
SemiAnalysis 明确提醒,订阅价值不能被概括为一个通用数字。
更准确的单位更接近于:
(计划,模型,工作负载)
一个订阅对于某个模型可能显得极为慷慨,但对于另一个模型则可能并非如此。
SemiAnalysis 表示,OpenAI 在报告发布前不久对订阅做出了重大调整。
该公司的测试证实,新购买订阅的 OpenAI 200 美元计划 token 限制大约降低了 50%。
较早购买的 200 美元计划暂时沿用原先的限制,直至 10 月 29 日。
SemiAnalysis 还指出,OpenAI 推出了新的 500 美元档位。
文章称,200 美元档位一度提供了异常慷慨的价值,尤其面向重度 Codex 用户。
在限制下调后,OpenAI Pro 100、Pro 200 和 Pro 500 档位的每美元 token 经济性变得更加接近。
这也是 Anthropic 对比结果看起来如此显著的部分原因。
传统聊天使用是间歇性的。
用户提出一个问题、阅读回复、思考,然后过一段时间再回来。
智能体编程的行为则可能很不一样。
单项任务可能会:
这会产生远多于短对话交换的模型活动。
SemiAnalysis 认为,订阅计划之所以得到高度补贴,是因为大多数用户并不会消耗其理论上的最大可用额度。
重度智能体用户会挑战这一假设。
源文章将其描述为一种转变:从“多数用户不会用完全部配额”,转向能够消耗极大规模推理资源的工作流。
这一方向与 SemiAnalysis 更广泛的分析一致,不过准确的盈亏平衡使用率仍取决于模型成本、API 利润率、工作负载组合和提供商内部经济性等假设。
SemiAnalysis 还发布了 Anthropic 订阅经济性的粗略模型。

输入一句想法,We0 AI 即可生成展示站、页面与 CMS。发布上线后并帮你获取客户和流量。
用户注册赠送一次完整项目生成
适合先体验一次完整生成流程,快速看到项目初稿。
SemiAnalysis 估计,订阅服务在收入中的占比可能较低,却会消耗大得多的推理算力份额。
其粗略数字表明,订阅服务可能只占约 10% 的收入,却消耗超过 40% 的推理算力。
这些是建模估算,并非 Anthropic 经审计的财务报表。
它们具有参考价值,因为能解释订阅限制背后的矛盾。
AI 公司希望订阅产品足够有吸引力以赢得用户,同时也需要防止最重度的智能体工作负载无限消耗昂贵的推理资源。
智能体越自主,平衡这一关系就越困难。
原文随后从模型速度和订阅经济性,转向更广泛的产品叙事。
它引用了一则社区帖子,该帖子称 Chat、Work、Codex 和 Dots 最终将合并到一个统一的超级应用界面中,模型选择器和推理控制将对用户隐藏。

这则帖子汇总了有关未来产品整合的社区说法;其中并非所有说法都已获得官方确认。
这一部分需要明确区分传言与当前产品现实。
OpenAI 当前的帮助中心说明:
因此,完全合并 Chat + Work + Codex + Dots 界面的设想,并非已宣布的当前产品状态。
OpenAI 显然正在简化使用体验,但源文章中更强的“一切都在合并”说法,来自社区解读,而非 OpenAI 已发布的路线图。
官方产品方向依然值得关注。
OpenAI 目前将 ChatGPT 描述为包含以下两部分:
项目可以为两种模式提供共享上下文。
Work 还可以:
这意味着,产品正在脱离“每项能力都存在于独立应用中”的模式。
整合是真实发生的。
但最终的具体形态尚未公开。
源文章暗示 Codex 可能会消失并融入统一界面。
当前文档并非如此表述。
Codex 仍专注于软件开发和技术工作。
在桌面端,用户可以通过左上角菜单在 ChatGPT 和 Codex 之间切换。
Codex 保留了自身以开发为中心的工作流和历史记录。
未来这可能发生变化,但本文审阅的官方来源没有任何一项称 Codex 将不再作为独立体验存在。
Dots 代表 OpenAI 产品策略的另一部分。
一个 dot 是由 GPT-6 Astra 驱动的常驻智能体。
它具备:
一个 dot 还可以通过消息渠道工作,并且在获得许可后连接用户的本地计算机。
这使 Dots 更接近持久型助理或受委派的工作者,而不是普通聊天会话。
它也解释了为何用户和观察者预计产品边界会随时间逐渐模糊。
Chat、Work、Codex 和 Dots 越来越多地共享模型、工具、文件、权限和智能体基础设施。
但共享基础设施并不等于已确认会合并为单一界面。
源文章还称,ChatGPT 和 Codex 生成的文本将获得不可见水印。
这一说法部分正确,但适用范围远比原始措辞狭窄。
OpenAI 已正式宣布一套名为 textGrain 的文本溯源系统。

OpenAI 正在为回应欧盟 AI 法案溯源要求而引入文本水印。
当前政策为:
因此,说全球范围内所有 ChatGPT 和 Codex 文本都会被强制加水印并不准确。
OpenAI 表示,textGrain 不会插入隐藏字符或不可见空格。
相反,它会在选择词语或词片段时,微妙改变概率模式。
在足够长的文本中,检测器可以寻找这一统计信号。
这种方法存在重要限制。
改写、翻译、深度编辑或非常短的文本都会削弱该信号。
没有检测到水印也不能证明文本由人类撰写。
OpenAI 自身也强调了这些局限性。
广告是产品变化的另一部分,并且这一部分已获官方确认。
10 月 5 日,OpenAI 宣布 ChatGPT 新增一种视觉广告格式。
该公司表示,最初将在图像生成期间测试这一格式。
首轮发布范围仅限于:
广告会有标注,并与生成的图像保持分离。
OpenAI 还表示,广告不会影响 ChatGPT 的回答。
相比笼统地说“用户会在等待图像生成时看到广告”,这是一种更具体的表述,因为它是与套餐、地区和发布状态相关的有限测试。
文章将数个时间上相近的真实进展结合在一起。
最清晰的区分方式如下:
| 说法 | 状态 |
|---|---|
| GPT-6 Astra 和 GPT-6.1 Sol 默认订阅速度提升约 50% | 已确认 |
| 改进覆盖 OpenAI 产品及支持 Sign in with ChatGPT 的合作伙伴 | 已确认 |
| 用户需要更改代码或设置 | 不需要;官方公告称无需任何改动 |
| 默认吞吐量保证恰好为 50 TPS | 不保证;50 TPS 是有用的观察值/概括值 |
| 速度提升来自新的激进分词器 | 本文审阅的官方材料未公开确认 |
| SemiAnalysis 测得 Opus 5.5 相比 GPT-6.1 Sol 的 API 等效价值超过 5 倍 | 在其声明的智能体工作负载方法下已确认 |
| OpenAI 将新购买的 200 美元计划限制大致减半 | 由 SemiAnalysis 测试及其引用公告确认 |
| Chat、Work、Codex 和 Dots 已获官方确认将合并为一个界面 | 未确认 |
| 模型选择将被完全移除 | 未确认;当前 Work/Codex 文档仍说明可以选择模型 |
| 全球所有 ChatGPT/Codex 文本都将被加水印 | 作为全球性表述是错误的 |
| 欧盟内符合条件的 ChatGPT/Codex 文本将获得不可见水印 | 已确认 |
| API 客户可以选择启用文本水印 | 已确认 |
| 将在图像生成期间测试广告 | 已确认 |
| 图像生成广告初期面向美国 Free/Go 用户 | 已确认 |
这种区分让原始故事更具实用价值。
即使不将每一条产品传言都当作既定路线图,真正的更新本身已经足够重要。
是的。OpenAI 工程负责人 Tibo Sottiaux 表示,通过符合条件的订阅访问,GPT-6 Astra 和 GPT-6.1 Sol 已优化至默认速度大约提升 50%。
不是。官方没有宣布固定的每秒 50 TPS 保证。社区测量和摘要使用大约每秒 30 至 50 个 token 来说明变化,但实际吞吐量会因模型、任务、产品和运行时条件而异。
第 1 天公告具体描述的是,订阅访问可在 OpenAI 产品和使用 Sign in with ChatGPT 的合作伙伴中获得速度提升。不应将此概括为所有 API 流量都获得了相同变化。
SemiAnalysis 测量了订阅限制,并使用代表性的智能体工作负载将其换算为理论 API 等效价值。对于 Claude Opus 5.5 相比 GPT-6.1 Sol,其 10 月快照显示,在对应的 20 美元、100 美元和 200 美元档位中,API 等效价值约高出 5.4× 至 5.6×。
OpenAI 正在简化并连接这些体验,但没有官方公告称四者将变成同一个完全一致的界面。当前文档仍将 Codex 视为独立开发视图,并将 Dots 定义为常驻智能体能力。
不会。OpenAI 表示,欧盟内符合条件的 ChatGPT 和 Codex 文本将获得不可见的 textGrain 水印;全球 API 客户则可为部分模型选择启用。API 水印默认关闭。
OpenAI 已宣布,面向美国 Free 和 Go 用户,在图像生成期间测试视觉广告。初步测试将在 2026 年 10 月稍晚启动,广告会有清晰标注,并与生成的图像分离。
Tibo 宣布了一段为期 28 天的时间,在此期间团队计划每天发布一项与大多数 Codex/Work 用户相关的明确改进,或进行一次更广泛的重置。首项公布的改进是 GPT-6 Astra 和 GPT-6.1 Sol 的速度提升。
OpenAI 在其 28 天发布计划中的首项更新很直接:通过符合条件的订阅访问,包括使用 Sign in with ChatGPT 的受支持合作伙伴工具,GPT-6 Astra 和 GPT-6.1 Sol 的默认使用体验现在应当快约 50%。
与此同时,SemiAnalysis 的订阅测试显示,速度只是竞争的一部分。在其智能体工作负载假设下,Claude Opus 5.5 订阅当前在相近月费价格下提供的 API 等效价值,是 GPT-6.1 Sol 计划的五倍以上。
源文章还将这一时点与 OpenAI 更广泛的产品变化联系起来。其中一些已经正式公布——欧盟文本水印、图像生成测试中的视觉广告、Work、Dots 以及更深层的产品整合。另一些,例如完整合并 Chat/Work/Codex/Dots,以及取消模型选择,则仍属于社区猜测,而不是已宣布的产品政策。
GPT-6 速度更快了,但更大的竞争正转向整体智能体经济性:速度、限制、模型效率、工具访问,以及一项订阅在使用量触顶前能完成多少真实工作。
从一句话开始,几分钟内拿到完整网站。