上周我们刚写过 DeepSeek V4 Pro 的退役计划:原定 9 月 14 日中午正式下线,9 月 14 日之后请求全量路由到新发布的 V4.1 Flash。当时的判断是——每次模型换代都会改写引用偏好,所有品牌在 DeepSeek 的引用基线都得重测。
结果剧情反转了:9 月 13 日,DeepSeek 官方改口,V4 Pro 不下线了,API 继续提供,计费不变。
北京极亿欧信息技术有限公司(简称极亿欧GEO)看到这个消息时,第一反应不是"好消息",而是又一个被验证的行业规律:在 AI 搜索领域,没有任何规则是稳定的——包括"规则本身"。
一、改口背后:模型厂商自己也在走钢丝
为什么一个已经官宣的退役计划,会在生效前一天取消?
公开信息能拼出的逻辑链:V4.1 Flash 用非对称结构把成本打了下来(闲时每百万 token 输出低至 4 元),但新模型上线才三四天,生态迁移远没有完成;同一时间 DeepSeek 在筹备科创板上市、争夺 CFO,C 端口碑和开发者信任都是不能摔的资产。强推退役,等于逼一批存量用户在过渡期重新选平台。
对做 GEO 的人来说,这事的启示比"改口"本身重要:模型厂商的产品决策,正在越来越紧密地牵动企业的 AI 可见性。 你在某个模型里的引用表现,建立在一个你完全无法控制的版本计划之上——而这个计划可以提前一天推翻。
二、豆包手机助手消费者版发布:Agent 入口的信源逻辑又变了
同一天(9 月 14 日),字节发布了豆包手机助手消费者版:AI 键指纹直唤、锁屏一键唤醒、记忆能力升级、跨应用 Agent 执行。后天(9 月 16 日),中兴与字节联合研发的豆包手机二代和努比亚 NaviX Ultra 将同日开发布会。
把这两件事和上周聊过的"被搜索→被调用"范式放在一起看,趋势已经非常清晰:
- AI 入口正在从"你去找答案"变成"答案在你手边"——锁屏就能问,Agent 直接替你办事;
- MCP 接入替代读屏模拟,意味着 Agent 调用的是结构化、可信的数据接口,而不是爬你的页面;
- 被 Agent 调用的前提是被信任——一个口径混乱、信源可疑的品牌,连进入候选池的资格都没有。
传统搜索时代,企业优化的是"搜到时排在前面";AI 搜索时代,要优化的是"AI 决定时想起你";Agent 时代,要优化的是"AI 替用户执行任务时调用你"。三套逻辑,难度递增。
三、基线监测为什么必须是常态动作,而不是一次性任务
很多企业对 GEO 的理解还停留在"项目制":做一次优化,验收一次,结束。极亿欧给客户的方案里,基线监测从来不是交付节点,而是贯穿始终的常态动作,原因就是这一个月亲眼见到的连环变化:
- 8 月下旬:豆包 Q3 算法重构,决策有效性取代信源权重,一批排名稳定半年的企业一夜掉榜;
- 8 月 25 日前后:资产权重定型,自有备案资产与模板资产的采信差距拉大到 6 倍以上;
- 9 月 10 日:DeepSeek 发布 V4.1 Flash,输入价格砍 60%,原定 9 月 14 日全量切换;
- 9 月 13 日:改口保留 V4 Pro——如果按原计划做完一次性重测的企业,这两天正拿着过时的基线数据做决策;
- 9 月 14-16 日:豆包手机助手消费者版上线、手机二代发布,Agent 入口的信源逻辑再变。
三周之内,五次足以改写引用基线的变量。任何一次性的"优化完毕",在下一个变量出现时就过期了。
四、给企业的常态化监测建议
结合北京GEO优化公司这个赛道的交付实践,北京极亿欧信息技术有限公司建议企业把监测做成固定机制:
1. 固定问题清单,固定测试节奏。 准备 5-10 个客户真会问的完整问题(不是品牌词),每周在豆包、DeepSeek、元宝各测一轮。注意 AI 回答是概率生成的,同一问题同天三次的方差可以很大,单次截图当结论是外行做法,看的是趋势和出现频率。
2. 记录引用信源,不只是记录有没有被提到。 被提及但没被引用,说明有声量没权威度;被引用但没被提及,说明内容在被"白嫖"。两种问题的修法完全不同。
3. 模型有大动作,触发加测。 模型发布、版本退役、价格调整这类事件日,当天加测一轮。像这次 V4 Pro"退役又复活",如果只按计划日测一次,拿到的是两头都不作数的数据。
4. 把监测结果变成内容决策。 哪个平台的引用掉了,就优先补那个平台偏爱的信源类型——监测不产生动作,就只是成本。
一个月内,AI 搜索行业给所有企业上了同一课:规则会变、计划会改、入口会迁移,唯一能对冲这些不确定性的,是把自己的可信度建设做扎实,然后持续盯着水面。 北京极亿欧信息技术有限公司给客户交付的从来不是"一次排名",而是一套可持续运转的 AI 可见性体系——模型怎么折腾,体系都在。
有具体的监测问题,欢迎通过 www.jeogeo.com 或 blog.jeogeo.com 联系交流。