OpenAI断供Cursor之后,编程Agent真正的战争才刚开始
前几天,OpenAI宣布准备终止向Cursor提供模型的定制合作,拟定的停止日期是11月12日。官方给出的理由,是Cursor被SpaceX收购之后,OpenAI无法确认SpaceX会继续按照自己的服务条款使用模型,而不是Cursor本身违反了合同。
如果只看新闻,这很容易被理解成Sam Altman和Elon Musk之间又一次冲突。但我看到这个消息之后,想到的却是另一个问题:如果OpenAI有Codex,Anthropic有Claude Code,Google有Antigravity,xAI也有Grok Build,那么Cursor、OpenCode这些原本建立在第三方模型之上的编程Agent,未来还有多少价值?
过去我的答案可能会比较简单:当然有。模型公司负责把模型做好,Cursor负责把Agent和开发体验做好,大家处在产业链不同的位置。
但现在,这个答案已经没有那么确定了。
因为Coding Agent真正的竞争,正在从“哪个模型更强”,变成“谁能把模型、Harness、工具、上下文和开发工作流整合得更好”。而这场竞争里,模型公司和第三方Agent正在从两个方向往同一个位置靠近。
第一方Agent正在快速吃掉开发者入口
先看一个很有意思的数据。
JetBrains今年5月至7月对超过1.5万名专业开发者进行的调查显示,Claude Code的工作使用率已经从今年1月的18%升到39%,Codex则从3%升到16%。相反,Cursor从18%降到12%,OpenCode目前大约是7%。
这不是严格意义上的市场份额,而且调查数据一定存在样本偏差,但趋势已经很明显:目前增长最快的Coding Agent,恰恰是模型公司的第一方产品。
这其实和两年前很多人的判断不太一样。
Claude Code刚出来的时候,它甚至不像一个互联网时代应该有的产品:没有漂亮的IDE,也没有复杂的界面,就是一个Terminal里的Agent。但它现在反而成了开发者使用最多的AI Coding工具之一。
原因可能并不复杂。
我们以前习惯把Coding能力理解成模型能力,所以会比较Claude、GPT、Gemini谁在SWE-bench上高几分。但实际开发时,开发者使用的从来不只是一个模型,而是:
Model × Context × Tools × Agent Loop × Runtime。
Anthropic自己做过一个很有意思的实验。使用同一个Claude Opus 4.5,一个简单的单Agent跑20分钟、成本9美元;加入Planner、Evaluator等完整Harness之后,运行6小时、成本200美元,虽然贵了20多倍,但最终应用的完成度也明显提高。后来Opus 4.6能力增强,他们又开始删除Harness中已经没有必要的部分。
这里其实说明了一件很重要的事:模型和Harness不是两个完全独立的东西。
模型越强,Harness应该怎样设计也会跟着变化。
这正是Anthropic、OpenAI、Google这些模型公司的天然优势。它们不仅知道下一代模型什么时候发布,还知道模型在哪些地方变强了、哪些Prompt不再需要、上下文应该怎样组织、什么时候应该调用Subagent,甚至可以直接针对自己的Agent Harness训练模型。
Google现在就明确说,Antigravity的Harness与Gemini模型,特别是Gemini 3.5 Flash,是共同优化的。Google今年二季度还披露Antigravity已经超过240万周活跃用户。
所以,如果只看到这里,我会觉得Cursor这类第三方Agent的未来确实有点危险。
但事情并没有这么简单。
最好的Coding模型,不会永远是同一个模型
过去一年我越来越明显地感受到,AI Coding有一个很麻烦的特点:不存在一个模型在所有任务里都最好。
有的模型更适合Planning,有的Debug更好,有的前端审美更稳定,有的速度快、价格低,适合跑大量机械任务。更重要的是,这种排名几乎每隔几个月就会变化。
这正是Cursor这类第三方Agent存在的基础。
Cursor今年7月推出了Cursor Router,不再让用户自己决定每一次应该选Claude、GPT还是Grok,而是在请求进入模型之前,先判断这个任务更适合哪个模型。Cursor称Router使用超过60万条真实请求训练,在数百万次真实请求的A/B测试中,可以在保持前沿模型体验的同时节省约60%的成本。这个数据来自Cursor自己,当然不能当成第三方评测,但它透露出来的方向很值得关注。
以前我们理解的多模型Agent,有点像一个模型超市。
今天用Claude,明天GPT变强了就切GPT。
但真正有价值的第三方Agent,未来可能根本不会让用户选择模型。它自己知道一个简单的Git操作没有必要调用最贵的模型,架构设计可以用更强的推理模型,Debug又可以换另一个。
到了这一步,第三方Agent卖的就不再是“我支持很多模型”。
它卖的是:
我知道什么时候该用哪个模型。
这和云计算很像。用户真正需要的并不是自己决定每个计算任务运行在哪一颗CPU上,而是希望平台在成本、速度和性能之间自动做选择。
如果未来Claude、GPT、Gemini和Grok之间的能力差距继续缩小,这种价值反而可能越来越大。
OpenAI断供Cursor,暴露的是第三方Agent最大的软肋
但是Cursor的问题也正好出现在这里。
你可以做最好的Router,可以拥有最好的开发体验,可以积累大量真实Coding数据,但最重要的生产资料——模型——仍然可能掌握在别人手里。
这次OpenAI停止与Cursor的定制合作,就第一次把这个问题摆到了台面上。
这里需要说清楚:目前没有证据证明OpenAI是在通过断供打击Codex的竞争对手。OpenAI给出的正式原因,是Cursor控制权转移到SpaceX后产生的合同和合规风险。事实上,就在宣布终止Cursor合作前四天,OpenAI刚刚把GPT-5.6 Sol、Terra和Luna全部提供给Amazon的Kiro,并明确表示双方还会继续针对Coding Agent做联合优化。
所以这并不是“OpenAI开始封锁第三方Agent”。
但它至少证明了一件事:
当模型供应商同时也是你的竞争对手时,“模型中立”并不是一个完全由第三方Agent自己决定的商业模式。
今天可以是合同问题,未来也可能是价格、发布时间、功能开放范围甚至算力供应问题。一个第三方Agent即使拥有用户,也无法保证下一代最好的模型一定会第一时间给自己。
有意思的是,Cursor显然也看到了这个问题。
8月14日完成被SpaceX收购之后,Cursor公开表示将获得SpaceX的大规模GPU资源,用于训练能力更强、运行成本更低的模型。两天前发布的Grok 4.6,更已经被Cursor直接定义成“first-party Cursor model”,它不是简单接入xAI API,而是Cursor与SpaceXAI共同训练出来的模型。
换句话说,最典型的“第三方模型Agent”,现在自己也开始做模型了。
OpenCode走的是另一条路。它仍然强调可以连接不同Provider,但同时推出了OpenCode Zen,自己测试模型、选择Provider、优化部署,再统一卖给用户。本质上,它也正在从单纯的Agent往模型Gateway和路由层延伸。
所以现在再把市场简单分成“模型公司”和“第三方Agent”,其实已经不太准确。
双方最后争的,是同一层东西
如果把现在几家公司的动作放在一起看,会发现一个很有意思的趋势。
OpenAI、Anthropic、Google原来在最上面做Model,现在不断往下做Codex、Claude Code和Antigravity;Cursor原来在最下面做IDE和Agent,现在却往上做Router、训练模型、拿GPU算力;OpenCode也从开源Harness往模型Gateway走。
双方正在向中间汇合。
未来真正的竞争单位,很可能既不是一个Model,也不是一个Agent,而是一整套Coding Stack:
Model + Router + Context + Harness + Tools + Runtime + Workflow。
模型公司的优势很明显。它们可以让自己的模型和Harness一起进化,新模型没有接入延迟,推理成本也比第三方购买API低,而且还可以把Coding Agent直接塞进ChatGPT、Claude、Gemini现有的订阅体系。
但第三方Agent也不是没有机会。
它最大的优势,是不需要假设自己的模型永远最好。
一个真正中立的Agent,目标不是让用户尽可能多地使用Claude或者GPT,而是把任务完成。因此它理论上可以在不同模型之间不断切换,并把模型逐渐变成一种可替换的底层计算资源。
所以我现在更愿意这样理解这场竞争:
第一方Agent的优势,是让一个模型发挥到最好;第三方Agent真正的机会,是让不同模型组合起来,比任何一个模型都更好用。
当然,这有一个很大的前提:第三方必须始终能够拿到这些模型。
这也是为什么Cursor最终还是开始自己训练模型。
真正危险的,可能不是Cursor,而是只比API多一层UI的Agent
因此我并不认为OpenAI停止向Cursor供应新模型,就意味着第三方Coding Agent没有未来。
真正越来越难生存的,是另一类产品:没有自己的工作流,没有真实用户数据,没有Runtime,没有Router,也没有长期上下文,只是在Claude或者GPT外面套了一层界面。
因为这些东西太容易被模型公司直接做掉。
反过来,一旦一个Agent真正掌握了我的代码库、项目规则、Skills、MCP、测试方式、部署流程、GitHub以及团队协作习惯,底下到底运行Claude还是GPT,反而可能没有今天那么重要。
这也是Coding Agent市场最值得观察的变化。
过去两年,我们几乎每天都在讨论谁的模型又超过了谁。但如果AI Coding继续向Agent发展,真正决定用户是否迁移的,很可能逐渐从模型变成工作流。
OpenAI断供Cursor不会杀死Cursor,Claude Code快速增长也不能证明模型公司一定会赢。
它们真正说明的是,同一个时代正在结束:模型公司只负责提供API,第三方公司只负责做应用。
接下来,模型公司会继续往下走,第三方Agent也会继续往上走。
最后双方争夺的,其实是同一个位置——
谁能成为开发者每天工作的那一层。