ChatGPT把搜索工具整个重写了!我读懂了它的新"语言",独立站卖家赶紧看


大家好,我是Neo。

先问一个问题:你知道 ChatGPT 在回答你的问题之前,内部是怎么“搜”的吗?

上周六(8月16日)之前,ChatGPT 的搜索工具调用长这样——一串 JSON:

{"system1_search_query":[{"q":"site:intercom.com Fin AI Agent pricing 2026"}]}

四天之后,8月20日,我再用同一个账号问同样的问题,它变成了这样:

fast|Intercom Fin AI agent pricing 2026 live chat support|30|intercom.com
fast|Gorgias AI Agent pricing 2026 customer support|30|gorgias.com
fast|Zendesk AI agents pricing 2026|30|zendesk.com
fast|best AI live chat support Intercom Gorgias Zendesk Ada Tidio Crisp reddit|365|reddit.com
length|long

注意,这不是我手动格式化的,这是 ChatGPT 自己生成的新调用格式。OpenAI 在四天之内,把 ChatGPT 搜索底层的“扇形展开查询”(fan-out queries)从 JSON 整体换成了一个用竖线分隔的紧凑查询语言。

这事对做独立站的意味着什么?意味着 ChatGPT 选源、抓取、引用的整个逻辑都在变化。今天这篇文章,我把国外技术博主 Suganthan Mohanadasan 的最新拆解(他为此专门写了四篇系列文章,这是第四篇)和 Search Engine Land 的逆向工程研究揉在一起,给你讲清楚这个新格式的五大发现,以及每一条背后,独立站卖家该做什么。

一、先搞清楚背景:ChatGPT 搜索是怎么“扇出”的

在讲新格式之前,得先回顾一下 ChatGPT 搜索的工作原理。

当你问 ChatGPT 一个问题,它不是搜一次就完事,而是会把你的问题拆成多个子查询(可能2到10个以上),分别去不同的来源找答案——这个机制业内叫 fan-out(扇形展开)。

Search Engine Land 在5月的一篇深度研究里,把这个机制拆得很透:

  • 3月4日,OpenAI 把默认模型切到 GPT-5.3 Instant 之后,每个回答平均引用的独立域名从19个降到了15个,独URL数从24个降到19个——跌了20%以上,之后再没恢复过。他们把这叫做“大脚怪效应“(Bigfoot Effect):像2012年Google那次一样,少数几个域名霸占了几乎整个结果页。
  • ChatGPT 的周活用户已经达到 9亿。引用“饼”没变大,分饼的人却少了——没挤进去的网站,正在失去以前够得着的可见性。
  • 底层搜索工具叫 web.run,现在支持 12种操作(原来只有4种),包括 search_query、open、find、click、screenshot、product_query,外加独立的 widget 系统(体育、金融、天气等)。
  • GPT-5.4 可以在一次回答里串联 5到10多轮搜索,边搜边修正;5.3 Instant 通常只有2-3轮。
  • 真正去抓取你页面内容的是 ChatGPT-User 爬虫,不是 OAI-SearchBot——后者主要用来建索引。

这个背景很重要:ChatGPT 的搜索机制一直在快速进化,而8月下旬的这次格式重写,是它选源逻辑的一次大改版。

二、新格式长什么样?——每个字段都是戏

新版查询语言的通用结构是:

调用类型|查询词|数字|域名

例如:

fast|Zendesk AI agents pricing 2026|30|zendesk.com
  • fast:调用类型,对应网络搜索
  • Zendesk AI agents pricing 2026:查询词本身
  • 30:新鲜度窗口(天数)
  • zendesk.com:目标域名槽位

每个搜索块还会以一行指令收尾,比如 length|long / length|medium / length|short——这是控制每个结果要返回多少文本的。作者发现:深度产品对比时会触发 long,大多数查询是 medium,最后验证两个店名时是 short。

这里有一个非常重要的推论:大多数搜索抓取的是你页面的“摘录片段”,而不是整页内容。 也就是说,那个能回答问题的句子,必须出现在摘录开始的位置——藏在页面深处、要靠读者往下翻才能看到的关键答案,AI 可能根本读不到。

三、五大发现,条条都关系到你的流量

发现一:每一行都是一次搜索,字段都可读

新格式最大的变化是:一次工具调用现在是一块多行的文本块,每行一次搜索,字段用竖线分隔。查询词里依然会出现品牌名(模型自己写进去的)、年份、意图词(如 pricing)。

怎么做?去问那些你客户会问的问题,然后看 ChatGPT 写出来的品牌名。 这些品牌名就是 ChatGPT 当前认知里你品类的“竞争对手集合”;域名槽位里的网站,就是它打算去访问的站点。如果你不在这个集合里,第一步就输了。

发现二:第三个字段是“新鲜度窗口”,不同类型问题窗口不同

作者对比了同一字段在五类问题里的取值:

问题类型 新鲜度窗口(天)
股票价格 2
足球比赛结果 7
商业产品研究(如AI客服软件价格) 30
盈利指引 90

他判断这个数字是新鲜度窗口(recency window,以天为单位)——跟答案“过期”的速度挂钩。虽然还没看到官方文档,但作者在跑的所有商业问题里,每个品牌探测都是30天窗口。

这对独立站卖家意味着什么?如果这个判断成立,那么一个超过30天没更新的定价页或对比页,在“品牌被比较”的查询上,等于是在默认窗口之外参赛。 如果你的产品页、价格页、对比页半年没动过,ChatGPT 可能根本不在考虑范围里。

应对:把回答购买类问题的页面,放在30天的更新周期里滚动更新——不是改个日期糊弄,而是真实的内容变化加上可见的更新日期。

发现三:搜索变成了一套“垂直系统”——你卖实物产品吗?注意了

作者抓到的调用类型已经有五种:

  • fast:网络搜索,是整个旧 fan-out 的继任者
  • product:商品目录查询。只在扫机器人和床垫这类实物商品时出现,软件类问题从不触发。一行里是分号分隔的产品名:product|Roborock Saros 10R robot vacuum;Dreame X50 Ultra robot vacuum;Eufy E28 robot vacuum
  • business:商家查询,带地点参数。比如 business|Dubai, UAE|specialty coffee Dubai Marina;best coffee Dubai Marina——第一调用发搜索词,第二调用发真实店名逐一验证
  • image:图片搜索,比如 image|Dubai Marina specialty coffee shop|30
  • genui_run:widget 调用,带 JSON 参数,比如股票图表、英超赛程

这对做实物产品的卖家太关键了:ChatGPT 查实物商品,走的是一条独立的“商品目录”通道——它先查目录(有没有你的产品卡片、报价、商家信息),再搜网页。目录里有没有你,跟你博客写得再好是两套游戏。

自查方法:问 ChatGPT 你的品类,看它推荐时有没有出现产品卡片(含价格、评分、商家)。有卡片 = 目录认识你;只有文字提及没有卡片 = 你只存在于“内容游戏”里——这种情况下,你改再多页面,也改变不了 product 调用的返回结果。

发现四:域名槽位 = ChatGPT 会直接访问它“已经知道”的网站

旧时代,ChatGPT 想搜某个特定网站,会写 site:intercom.com 这样的操作符。新格式里,“网站”成了一个专门的槽位,就放在每行查询旁边——模型自己从记忆里填这个槽。

这带来一个新风险:如果模型记忆里的域名是错的或过期的,它就会去错的地方找。

作者亲眼看到一个真实案例:有人问“最好的LLM可见性工具及价格”,模型写出的探测是 site:profound.ai pricing AI visibility platform——但 Profound 公司根本不在 profound.ai,人家在 tryprofound.com。结果这次探测零结果,浪费了四次搜索中的一次。品牌最后靠通用搜索里的正确域名被救回来了,被引用了6次——但作者明确说:我不会把希望寄托在“救援”会重复发生上。

应对:自己抓一次 ChatGPT 的调用日志,检查域名槽位里的域名是不是你真正在运营的。 最容易出错的就是:品牌改名、网站迁移、换了国家域名(比如从 .com 换成 .de / .co.uk)。模型从记忆填槽,记忆是滞后的。

发现五:有些答案变成了 Widget——没有引用可赢了

genui_run 调用意味着什么?意味着对某些问题,ChatGPT 的答案是直接调用一个功能组件:英超赛程表、NVDA 股票走势图——都是带类型参数的函数调用,根本不是“搜索”。

这对所有做内容的人来说是个残酷的信号:凡是能被做成 widget 的答案类型(比分、股价、汇率、天气、航班时刻),以后可能就没有“引用”可赢了。 你写的“英超本周末赛程”文章,无论多好,都竞争不过一个实时组件。

这不是危言耸听。Search Engine Land 的研究同样确认:独立的 widget 系统(genui)已经存在,体育、金融、天气都在里面。未来的SEO,一部分战场会直接消失。

四、新旧格式对比表(一张图看懂)

维度 旧格式(8月16日前) 新格式(8月20日起)
结构 结构化 JSON 竖线分隔的紧凑文本行
站点限定 site: 操作符写在查询词里 独立域名槽位
新鲜度控制 无明确参数 第三个数字字段(2~90天)
垂直类型 单一 web 搜索 fast / product / business / image / genui_run 多垂直
文本量控制 response_length 字段 `length
内容抓取 整页 多为摘录片段(取决于 length)

五、独立站卖家的行动清单(Neo整理版)

  1. 30天内容保鲜:把你所有回答“购买决策”问题的页面列出来——产品页、定价页、对比页——设定30天滚动更新周期,做真实更新并显示日期。
  2. 产品目录自查:问 ChatGPT 你的品类(带上“best”“top”这类词),看有没有你的产品卡片。没有卡片?研究一下怎么进入它的商品数据源(对 Shopfiy 卖家,重点是 Merchant Center / 商品结构化数据)。
  3. 品牌探测:用客户的话术问问题,抓 ChatGPT 的调用(可以用 FanoutFox 这类工具),看品牌集合里有没有你、域名槽位是不是你的域名。
  4. 域名槽位校准:如果你换过域名、改过品牌、用过国家域名,务必检查 AI 记忆里的域名是否正确——错一个槽位,就浪费一次探测机会。
  5. 把关键答案放到摘录位置:既然搜索多抓摘录,把每个页面的核心答案写在开头(前50-100字),别埋在页面深处。
  6. 避开 widget 战场:如果你的核心关键词是“股价、比分、汇率”这类可组件化的问题,尽早转型,把内容往“解读、分析、对比”这些 widget 替代不了的方向做。

Neo的解读

说真的,这是我近几个月看到的最有价值的一篇 ChatGPT 机制拆解,不是因为格式细节多酷,而是因为它第一次把“ChatGPT 怎么选你”这个黑盒,拆成了一行行可读的指令。

我最在意的三个点:

第一,“新鲜度窗口”这个东西一旦坐实,将改变内容更新的经济学。 过去我们说“内容要常更新”,更多是感觉;如果 ChatGPT 真有30天窗口,那更新就不再是玄学——超过30天没动的商业页,直接掉出默认检索窗口。这会让“定期更新关键商业页面”从“建议”变成“生死线”。同时它也能解释一个现象:为什么有些老页面权重很高,但 AI 就是不引用——可能不是不认可你,而是你的内容在窗口外面。

第二,产品目录和网页搜索的分离,是2026年最被低估的变局。 很多独立站卖家还在死磕“内容+外链”,但 ChatGPT 买实物商品的推荐路径根本不走网页——它先查目录。这意味着:你的商品数据能不能进目录(有没有结构化数据、有没有被 Merchant Center 收录、报价和评分全不全),比你写100篇博客都重要。 内容玩家和目录玩家,正在变成两条完全不同的赛道。

第三,域名槽位这个细节,暴露了 AI 时代的残酷真相:模型对品牌的“记忆”是会出错的,而且出错的方式很蠢——去访问一个错误的域名。 但反过来说,这也给了我们机会:AI 的记忆是可以“纠正”的,前提是你得先知道它记错了。主动监测、主动校准,会成为AI时代独立站的新日常。

最后说句实在话:OpenAI 四天就重写一次底层格式,说明 ChatGPT 搜索远未定型。今天这篇的细节可能几个月后就过时了——但“模型会先写品牌集合再搜索、有新鲜度窗口、实物走目录、答案会组件化”这些趋势方向,短时间不会变。 抓住方向,比追格式重要得多。