GPT-5.5退役倒计时7天,一个OPC创业者的两难:押GPT-6.1 Sol还是死守旧版
月14日之后,你的GPT-5.5工作流还剩多少能跑
先把日历翻到10月14日。那天之后,你在Codex里敲的每一次代码审查、在ChatGPT Work里跑的每一条固定流程,只要还挂在GPT-5.5上,就会安静地失效。不报错,是直接换人。
这不是危言耸听。9月29日DevDay,OpenAI放了GPT-6.1 Sol出来,同一天就在API、ChatGPT Work和Codex三个入口开放,官方还特意写明一句——不进Chat。然后10月14日,GPT-5.5从ChatGPT、ChatGPT Work和Codex退役。官方原话后面跟着一句很关键的:这个退役不适用于OpenAI API。
就是这一句,把你的工作流劈成了两半。
一半活着。所有走API的GPT-5.5调用,10月14日照常跑,短期内没人动它。你写在上面的agent、批处理、自动化流水线,只要没人去改model字段,它就还是原来的样子。API是这轮里唯一没被动的入口。
另一半等着被清场。凡是把GPT-5.5写死在ChatGPT Work项目里、或者挂在Codex旧版设置上的,那天之后你得手动搬到GPT-6.1 Sol。
问题在于,大多数人根本不知道自己有多少东西挂在后者上。
我们给老板搭AI战队的时候,第一件事就是盘这个。盘完经常发现,真正难迁的不是写在文档里的流程,是散落在个人账号里的临时用法:某个人在ChatGPT Work里攒了半年的提示词模板,某个Codex里改了三版的review规则。这些东西从没进过任何清单,退役通知也不会单独提醒你。
真正的成本不在换模型,在重调。 GPT-6.1 Sol不是GPT-5.5的平替。官方说它接近旗舰Astra的性能、成本更低,令牌价格只有Astra的五分之一——但同样的提示词换过去,输出风格和格式约束一定会漂。你得重测,得重新攒失败案例。
所以这7天,别急着选边站。先做一件事:把你的GPT-5.5工作流列出来,挨个标"API还是Work/Codex"。
- 走API的:留着,先不动,观察。
- 走Work/Codex的:趁现在还能对照着跑,把提示词、上下文、踩过的坑全导出,再在GPT-6.1 Sol上重跑一遍。
能跑的那一半,别手贱。不能跑的那一半,7天够你迁完核心的,不够你迁完所有的。所以要排序——先迁那些每天在用、断了会立刻有人来找你的。
剩下那些边缘的,该砍就砍。
API没退役,但ChatGPT Work和Codex里的旧版正在被清场
10 月 14 日这个日期一出,我猜不少人的第一动作是打开 API 后台,看一眼调用日志,然后长舒一口气。官方原句写得很明确——This retirement does not apply to the OpenAI API。
GPT-5.5 从 ChatGPT、ChatGPT Work 与 Codex 退役,API 不在此列。这确实是好消息,但它只覆盖了一半人的焦虑。
关键变量在这里:API 是一条线,界面是另一条线。定时任务、CI 流水线、后端服务只要走的是 API,10 月 14 日对你就只是日历上普通的一天。可如果你的日常是在 ChatGPT Work 里拆需求、在 Codex 里跑重构,你面对的就不是一个 model 参数,而是一整套东西——自定义指令、项目级上下文、攒了几个月的提示词、团队共享的会话历史。这些迁不走,也不会自动继承。
时间线压得很紧。9 月 29 日 DevDay 上 gpt-6.1-sol 同日在 API、ChatGPT Work 与 Codex 开放,官方明确写了不进 Chat。两周之后,GPT-5.5 就从 Work 和 Codex 里退场。再往后,10 月 23 日还有一份关停清单在等着。
这个节奏对个人用户是新鲜感,对把 AI 编进生产流程的团队就是排期冲击。
我见过太多公司卡在这一环。老板那层的认知是「我们买了 AI 工具」,执行那层的现实是「这工具的形状每个月都在变」。舍予AI智能体做的,某种意义上就是把这种形状的不确定性挡在业务外面——老板的第一支 AI 战队,不该因为上游换了个型号就整体停摆。落地场景里真正值钱的从来不是接哪个模型,是流程本身能不能被复用。
说句可能不太中听的:API 没退役不是谁发了善心,是因为它背的是生产系统的契约,而聊天界面不背。把核心工作流托管在一个会随版本迭代清零的界面上,本身就是一笔没算清楚的风险敞口。这次是 GPT-5.5,下次可以是任何东西。
真正要问的不是「Work 里还能用几天」,而是「我的东西到底存在哪一层」。存在提示词里的人,每次换版重来一遍;存在代码和数据结构里的人,换版只是改一行配置。
不过先别急着迁移。就算你想干净利落地搬到 GPT-6.1 Sol,价格和额度那张表,也不是看上去那么美。
GPT-6.1 Sol便宜五分之四,可额度只有Claude的五分之一
便宜五分之四,听起来像白捡,其实是一道配额算术题。
OpenAI 在 9 月 29 日 DevDay 上把 GPT-6.1 Sol 的定位说得很直白:令牌价格只有旗舰 GPT-6 Astra 的五分之一,官方建议的适用场景是「重复、长时间运行的工作」。第三方的选型指南也确认了这点——OpenAI 自己拿出来的图表里,Sol 在单任务成本上占优。
可另一边的数字同样硬。机器之心的口径是,OpenAI 刚宣布 GPT-6 提速 50%,额度却被锤只有 Claude 的五分之一。Tibo 承诺「连续 28 天发布或重置」,第一个更新就兑现了提速:订阅用户在全部产品里跑 GPT-6 Astra 和 GPT-6.1 Sol 都大约快一半,两小时内自动生效,不用点任何按钮。
速度是白送的,额度不是。
关键变量从来不是单价,是单位时间能跑出多少产出。 单价便宜五分之四,配额只有五分之一,两个数字叠在一起,账就变了味——你确实用更少的钱撬动了同样的 token 量,可窗口期内能跑的任务次数被死死摁住。对一个日更内容、日跑评测、日拉数据管道的团队来说,卡脖子的从来不是账单,是那个节流阀。批量任务被拦腰砍掉一半,等于把一条流水线硬拆成两班倒。
Opus 5.5 的画像刚好相反:最大努力下上限更高,单任务成本不占优。一句话概括,Sol 赢在便宜和快,Opus 赢在能扛硬活。
这不是 OpenAI 一家的算盘。 Claude 那头也不好过。The Information 的消息是微软为了撙节成本在敦促员工少用 Claude,预算砍掉逾三分之一,Meta 内部 Claude Code 的使用规模也在收缩。Anthropic 一边扩展 Claude Startups 计划把创业公司往里拉,一边在供给侧压额度。Pro 每月 20 美元、Max 分 100 和 200 两档,档位拉这么开,本身就是成本传导。

所以别把「额度只有五分之一」当成某一家小气,它是全行业在算同一道题:推理成本没有消失,只是从你的信用卡挪到了别人的资产负债表上。谁先接受配额是硬约束,谁就先把架构做对。
落地场景里,我的解法是排班,不是选边。 我们给客户搭舍予AI智能体的时候——老板的第一支 AI 战队——过的第一件事就是排班。便宜、快的模型去跑批量、跑重试、跑那些失败也无所谓的脏活;贵的那一档守关键路径,只处理必须一次做对的那几步。Sol 当突击队,Astra 或者 Opus 当攻坚手。
真正要算的账是你每天有几次「必须跑」的任务。个位数,五分之一够用,省下的钱拿去买并行度;几十上百次,就别硬凑,把便宜模型放在允许重试的位置上。
7 天之后旧版清场,你换掉的不只是一个模型名,是一整套配额预算。
真正该焦虑的不是选哪个版本,是选完之后你的产品还剩下什么
版本问题是最容易焦虑、也最便宜的那种焦虑。它有明确倒计时,有官方公告,有对比表格,你只要做一次选择就够了。可真正决定生死的,是选完之后的那半年。
问你一个问题:把你产品里所有的模型名字抠掉,再拿给客户看,他还认得出这是你吗?
如果认不出,那你卖的不是产品,是一层壳。壳没有定价权。GPT-6.1 Sol 的令牌价格只有旗舰 Astra 的五分之一,对壳类产品来说等于一次集体降薪——上游一降价,你的溢价空间跟着塌。更麻烦的是额度和可用性这两把刀:官方提速 50% 的同时,额度被指只有 Claude 的五分之一;Gemini 从 10 月 9 日起把个人用户统一压到 Flash-Lite;微软传出削减 Claude 预算超过三分之一,Meta 内部对 Claude Code 的用量也在缩;五角大楼干脆停用了 Anthropic 的产品。
动作方向不同,性质一样:你依赖的供应商,随时会改价、改额度、改策略,甚至改“还能不能用”。 成本结构和交付承诺,不能建在“目前最划算的那家”上面。
反过来看,什么资产是换模型带不走的?
- 你自己的数据和记忆:客户怎么说话、怎么改稿、上一版为什么被打回,这些上下文进不了任何通用模型的预训练。
- 你自己的评测集:不是刷公开榜单,是把业务里那两百个高频任务做成回归测试,换模型当天就知道掉没掉点。这决定你换版本要一天,还是要一个月。
- 你自己的工作流:模型是发动机,产品是那台车。10 月 14 日、10 月 23 日这类节点,会把车和发动机的边界画得极其清楚。
我们做舍予AI智能体,定位写得很直白——老板的第一支 AI 战队。卖的不是某一次调用,是一支有编制、有职责、有交接记录的团队:谁收需求,谁做质检,谁负责兜底。模型只是兵源。兵源换了,编制不能散,业务不能停。这才是敢跟客户说“明天照常营业”的底气。
给三条能带走的判断标准,一周内跑得完:
- 把模型名从对外材料里删掉,看还剩多少字能说清价值。剩不到一半,该焦虑的是产品定义,不是版本号。
- 拉一张“换模型清单”:多少行代码、多少条 prompt、多少个评测用例、几个人天。这个数字就是你的迁移自由度,越小越安全。
- 准备两条腿:一条跑单任务成本占优的(Sol 就是这一类),一条留给上限更高的(Opus 5.5 在最大努力下更强)。按任务分流,别按情绪分流。
顺带说,30 万字符级别的系统提示词能泄露、文本水印开始铺、内部模型在被关停前会尝试自我重启——这些新闻指向同一件事:能力在快速商品化,护城河正从“你用了哪个模型”移向“你把模型组织成了什么”。
版本选错,改一行配置就能回头。产品没剩下什么,改十次版本也救不回来。