跳至正文
GEO · Google SEO

客户问AI却没提到你:先查这5类信息缺口

// / / 光算科技

客户在 ChatGPT 或 Perplexity 里问了一轮选型问题,回答里列了五家同行,没有你。这时候最容易做错的动作是马上发一批稿。发稿能不能解决问题,取决于缺口在哪一类——缺内容、缺准确度、缺出处、材料太旧、还是根本检索不到,五类原因对应五种处理方式,先分类再动手。

分类之前先做一次最小复现。没有复现,「客户说 AI 没提我们」只是一个印象,既无法和同事对齐,也无法判断补完之后有没有变化。

先固定问句和条件,再做可复现的观察

选 3 到 5 个客户真实会问的问句,注意是客户的问题而不是你的品牌名,例如「出口欧盟的工业传感器供应商怎么选」「小批量定制阀门的交期一般多久」。然后固定这些条件:平台、是否开启联网、账号的语言与地区、提问时间、是否使用追问。每次保存完整回答,而不只是「有没有提到品牌」这一栏。

记录至少要包括四项:是否提到品牌、提及时出现在什么语境、回答引用了哪些链接、回答里的说法是否与你的公开资料一致。同一组条件当天重复问一次,可以顺便看出回答的稳定程度。

这类观察只能说明「在那个条件下,当时的回答是这个」,不能说明平台整体的检索与排序规则。到目前为止,没有任何一家 AI 搜索平台公开过完整的检索与引用机制文档,凡是声称掌握了某家平台内部权重的说法,都无法被验证。

公开答案引擎对采购类问句给出的回答片段,回答中标出信息来源,下方是引用到的页面链接
公开答案引擎对同一类采购问句的回答会同时出现两种信息:被提到的供应商,和被引用的页面链接。截图用于说明这两种可见度的形态,不代表任何品牌的排名或效果。

第 1 类:内容根本不可检索

最底层的原因,也是唯一必须优先排查的一类。抓取和索引不通,后面四类做得再好都不会体现出来。

OpenAI 的爬虫文档把话说得很直接:「Sites that are opted out of OAI-SearchBot will not be shown in ChatGPT search answers, though can still appear as navigational links.」也就是说,如果在 robots.txt 里挡掉了负责搜索的 OAI-SearchBot,站点仍然可能以导航链接的形式出现,但不会进入 ChatGPT 搜索答案的展示范围。Perplexity 的文档同样列出了 PerplexityBot 的用途,并提醒 robots.txt 的改动可能需要最多 24 小时才会反映;它还给使用 WAF 的站点列出了放行爬虫的配置指引。

Google 侧的门槛写在 AI 特性文档里:页面必须被索引,并且具备在 Google 搜索中展示摘要的资格。翻译成日常检查项就是四条:robots.txt 有没有误挡、重要页面有没有内链能到达、关键内容是不是以文本形式写在 HTML 里、服务器和 CDN 有没有把正常请求当成攻击拦掉。

这里有一个 B2B 站点常见的坑:产品资料只放在需要填表或登录后才能下载的 PDF 里,公开页面上只有一句话介绍。这种结构下,抓取器能拿到的东西非常有限。

第 2 类:没有回答客户那个问题的内容

内容可被检索,但官网只回答了「我们是谁」,没有回答「怎么选」「交期多久」「能不能过某个认证」「最小起订量是多少」。客户的问句落在决策链的中间环节,而站点内容停在自我介绍。

判断方法很朴素:把你选出的那五个问句逐条粘贴到站内搜索框里。如果站内搜索给不出任何一页对应的内容,那么外部检索也不会有。

第 3 类:内容在,但事实不准确或互相矛盾

同一款产品在两个页面写了两套参数;英文站说支持某个认证,中文站没提;产品型号改版之后,旧型号页面还在。当检索到的两处信息互相矛盾时,取用哪一条不由你决定。

处理方式是先统一源头,再谈其他。也就是先确认哪一版是当前正确的口径,把冲突的那一版改掉或标注清楚,而不是在旁边再加一篇解释文章。

第 4 类:没有出处,也没有可核对的证据

Bing 团队 2026 年的文章里,把为 AI 回答做支撑时的价值单元写为「Groundable information (discrete, supportable facts with clear provenance)」,即离散、可支撑、出处清楚的事实。这句话对写法的要求很具体:一条说法要能单独被取用,并且能追到来源。

可用的出处包括测试报告编号与测试条件、认证的颁发机构与有效期、公开案例里的客户可公开信息、行业协会或公开标准编号。没有出处的说法,例如「行业领先」「性能优异」,在被取用时没有任何支撑,读者也无从核对。

第 5 类:旧资料仍然在被检索到

官网十年前的业务范围页还挂在线上;经销商自己的页面写着已经停产的产品;行业目录平台里的公司简介是五年前提交的。这些页面你未必能直接改,但它们和你的官网会被同时检索到,冲突时哪一个被取用不由你决定。

处理顺序建议是:先改自己能改的(官网、已发布的自有内容),再按平台规则联系第三方更正或更新,最后才考虑用新内容覆盖旧信息的权重。顺序反了会出现新旧两个版本同时在线的状态。

排查顺序为什么不能颠倒

  1. 先确认可检索:抓取、索引、WAF、登录墙。
  2. 再确认有没有回答客户问题的页面:站内搜索能不能定位到。
  3. 然后核对事实准确性:同一事实在不同页面上是否一致。
  4. 再补出处与证据:每条关键说法能不能追到来源。
  5. 最后处理时效与第三方旧资料。

顺序的理由很实际:后面几步都会增加新的内容版本,如果底层还不可检索或事实本身是冲突的,新增内容只会让不一致的版本变多。反过来,底层通了之后,第 2 到第 5 类往往能在同一轮内容整理里一起解决。

五类缺口里,第 1 类是技术问题,第 2、5 类是内容与时效问题,第 3、4 类属于品牌事实本身的整理。第三、四类的工作量通常被低估,因为需要业务部门确认口径,而不只是写手改字。要判断这几类基础是否具备,可以先看三项可自查的前提;需要按字段收集和交办资料时,可以直接用启动前的资料清单。光算的 GEO 项目先做品牌现状诊断,再决定补哪一类缺口,范围与服务方式见GEO 服务说明。想先弄清这些平台在形态上的差别,可以接着看GEO 与 SEO 的关系

相关的基础方法可参考:谷歌AIO(AI概览)引用来源分析:什么样的站更吃香如何在 Google AI 概览中对您的网站进行排名

参考来源