Opus 5.5 不比最强比最省,DeepSeek 便宜到涨219%——一人公司的护城河该往哪挪

2026-09-23舍予基业来源:公众号「舍予AI智能体」
Opus 5.5 不比最强比最省,DeepSeek 便宜到涨219%——一人公司的护城河该往哪挪
从 Opus 5.5 主打低成本、DeepSeek 调用量暴涨 219% 等动态切入,说明模型能力与采购已脱钩,一人公司应把贵模型留给低频高风险任务,并用可插拔记忆模块沉淀自己的行业知识。

今天早上七点四十,我在厨房烧水,手机屏幕亮了。

Anthropic 发了新模型。

我把火关了,站着看了十几秒。不是因为这东西有多强——恰恰相反,官方通稿第一句就承认它不如自家另一个更强的模型。但整个上午把各路消息翻完,我发现今天几乎所有的新闻,讲的其实是同一件事:

模型开始比谁便宜了。

最贵的那家,先讲便宜

Claude Opus 5.5|9月22日。 Anthropic 发布 Claude Opus 5.5,称其在大多数工作型任务上的表现接近能力更强的 Fable 5.1,但成本显著低于上一代 Opus 5,出结果更快,文字表达也更清晰。官方表示,未来几周会继续扩充 5.5 系列,推出新版 Sonnet 和 Haiku。

把这段话的语序再读一遍:先说"接近",再说"成本显著降低",最后才轮到"表达更清晰"。

两年前不是这个写法。以前新模型的通稿,第一句刷榜成绩,第二句参数规模,"成本"两个字通常藏在最后一页的定价表里。

今天它被提到了前排。这个变化对一人公司来说,比任何一个基准分数都重要。

它意味着:能力排名和采购排名,正式脱钩了。

如果你的业务里有一个环节每天要跑几百次——回客户消息、写商品描述、审一份标准合同——你根本不该用最贵的那档。

最贵的那档,留给一年只跑几十次、但错一次就赔钱的任务。这个分配动作,今天开始有了明确的产品依据,不再只是抠门。

DeepSeek V4.1-Flash|9月21日。 《每日经济新闻》根据 OpenRouter 数据测算,上周(9月14日至20日)全球大模型总调用量129万亿 Token,环比增长1.57%。DeepSeek V4.1-Flash 登顶榜单,环比增长219%。中国大模型的周调用量为美国的4.7倍,已连续二十一周领跑。

219% 这个数字,比"第一"更值得琢磨。

榜单第一名每周都在换,但一个降价后的版本能让调用量翻两倍多,说明真金白银正在往"够用且便宜"的方向走。调用量是最诚实的投票——没人会拿生产环境的账单,去给排行榜投票。

这是好消息。你不需要用最好的模型做所有事,你需要的是把每个环节的成本,压到能长期跑下去的水位。

基座会下线,记忆不会

如果基座都在降价,那降价之后,你身上还剩什么?

这是今天下午我一直在想的问题。然后翻到了 9 月 21 日上海人工智能实验室公开的一条技术细节。

书生-S2|9月13日发布,9月21日公开细节。 上海人工智能实验室发布书生-S2 多模态大模型,核心创新是 Memory Decoder:以可插拔的专业记忆模块扩展领域能力,不修改主模型参数即可接入新知识。在生物领域,接入一个 4B 的记忆模块后,Biology-Instructions 评测平均分从 56.92 提升到 60.32,提升幅度接近从上一代到这一代的跨代提升。

这条,我觉得是今天所有新闻里最该被老板读三遍的。

配图

它干的事,本质是把"知识"从模型里拆了出来。以前想让模型懂你的行业,只有两条路:写长长的提示词,或者花钱微调。前者容易越写越乱,后者基座一换代基本作废。

现在有了第三条:知识做成独立模块,插上去。基座换,记忆留着。

注意官方那句看起来很技术的提醒——书生-S2-Preview-397B 将于 2026 年 10 月 31 日下线,请调用方及时切换。这句话在说一件很朴素的事:

基座是会下线的,你攒下的东西不该跟着一起下线。

Kimi K3 上 Amazon Bedrock|9月21日。 月之暗面确认,亚马逊云科技旗下模型服务平台 Amazon Bedrock 已接入开源大模型 Kimi K3,全球企业开发者可直接调用,此前传言的与海外云厂商收入分成合作落地。

这条的启发不在技术,在渠道。你的能力如果能出现在客户已经在用的地方,获客成本会掉一个数量级。自己搭一个入口,远不如把东西摆上别人的货架。

钱还在往这条赛道里砸。 9 月 8 日,Mistral AI 完成 30 亿欧元融资,估值从 120 亿欧元升至 213 亿欧元,三星电子首次入股并贡献最大一笔投资。同一周,AI 编程公司 Cognition AI 完成 20 亿美元 E 轮,估值 480 亿美元,年化收入从 4.92 亿美元增至近 9 亿美元。

半年收入翻倍——资本买的不是模型,是这条收入曲线的斜率。跟你没有直接关系,但有一句可以借:投资人问你的第一个问题,会慢慢从"你用了什么模型"变成"你的钱是怎么收上来的"。

没人再为"全能"买单

小米 MiMo-V2.6|近日。 小米发布新一代 MiMo 大模型,含全模态旗舰 MiMo-V2.6-Pro 与高效推理版 MiMo-V2.6-Flash,Pro 首次支持文本、图片、视频、音频。同场,平头哥发布新一代 AI 芯片真武 V900,算力约为上一代 M890 的三

AI 应用一人公司大模型成本门店经营

想知道这套东西装到你的生意里是什么样?

留个联系方式,顾问按你的行业给一版可落地的方案。