Agent.Space 博客

OpenAI 用户正在流向 Claude 吗?流量、Codex 用量与营收分别看

Claude 网站份额增长有数据支持,但不能直接推导 Codex 用量或 OpenAI 营收下滑。核对近期热点中的证据,再决定自己的 AI 编程工具。

Claude 正在获得更多关注,有数据支持。更强的说法——OpenAI 最近半个月整体用量和营收因为模型变差而大幅下滑——目前公开证据不足。

截至 2026 年 10 月 8 日,需要分清四件事:网站流量、编程 Agent 活跃使用、付费收入,以及一次任务的完成质量。它们可能朝不同方向变化。下面逐项看已知事实,以及这些信息应该怎样影响工具选择。

Claude 的网站增长可以观察到

Similarweb 在 9 月 24 日的分析中报告:截至 2026 年 8 月的十二个月内,Claude 在所统计主要 AI 聊天网站中的访问份额从 2% 升至 9.6%,ChatGPT 从 78% 降至 57%。

这说明该时间段内消费者网站注意力发生了变化。它没有测量 Codex CLI 会话、API token,也不是最近两周的数据。Similarweb 明确说明,这类数据不能直接反映 API 消耗或公司财务表现。

份额下降还需要看分母:它衡量的是某产品在被统计群体中的相对位置。仅凭份额,无法判断多少付费客户离开,更无法确定某个用户换工具的原因。

OpenAI 营收有没有下降?

Axios 9 月 29 日报道的 OpenAI 年化营收方向是增长。

媒体报道不等于经审计财报,也不能直接回答是否达到某个内部预期。“不及预期”需要明确目标、实际结果、相同期间与可比口径。年化运行收入、季度确认收入和利润,也不能互相替代。

本文核查到的来源没有确立近期 OpenAI 营收崩跌,因此不能把这个说法当成购买其他编程工具的依据。

用户抱怨能证明 Codex 整体变差吗?

一次失败可以真实存在,但未必代表整个服务的失败率提高。报告如果包含起始文件、模型、设置、失败产物和验收条件,就能说明那次运行的问题。没有总任务数作分母的一批抱怨,则无法告诉我们成功和失败各占多少。

输出变差本身也不能确定原因。指令变化、上下文处理、工具失败、模型配置、服务故障和路由变化,可能需要不同处理。要证明服务故意返回较弱模型,需要请求级证据;询问助手“你是什么模型”,不能代替服务端记录。

此前的 GPT-6 Astra 质量问题梳理区分了已承认的问题与尚未证实的解释。它保留原来的 9 月报道截止日,不能当成对每一次 10 月故障的新调查。如果现在最重要的是把手上的活做完,可以看 Codex 变慢后的排查与切换指南。

服务调整与股市叙事,也要单独核对

AP 在 3 月报道了 Sora 应用关停。这是有明确对象与日期的产品变化。它不能证明 Codex 关停,也不能证明 OpenAI 所有服务最近都出现需求下降。

看市场影响同样如此。私营公司的估值、交易价格和上市科技公司的股价,是不同概念。新模型发布后出现股价波动,也不能单独确定因果;财报、利率、交易仓位和其他消息可能同时发生。

本文不从编程 Agent 的舆论推导交易预测。对明天要完成项目的开发者,更直接的问题是:当前可用的哪套配置,能可靠地交出结果?

试用 Claude Code,可以有更直接的理由

因为它可能解决一件正在耗费你时间的事,所以值得试。Claude Code 编码能力的证据可以帮助挑选方向,真正的验证由自己的仓库提供。

找一件最近反复纠正的任务,准备其初始状态的独立副本,给新 Agent 相同需求,用相同验收条件检查结果。把自己的审查时间和实际账单一起算进去。辨认更好的结果,不需要先解释服务商的营收。

如果希望项目里同时使用两种工具,Agent.Space可以通过持久 Workspace 文件,以及分别使用受支持 Agent 和兼容模型的 Session 来组织工作。公平比较需要独立副本;接着完成已有工作,则需要明确的顺序交接。新 Session 不会自动继承旧聊天,独立产品也不会转移你的官方订阅额度。

真正实用的目标,是让项目在工具变化时仍能往前走。依据已验证的任务结果和当前可用配置作选择,再随着证据更新而调整。

报道截止日:2026 年 10 月 8 日。流量为注明期间和来源的估计数据。Agent.Space 未测量 Codex 整体活跃使用、服务商营收或股价变化的因果关系。