生成式引擎优化:AI 先引用谁看四道门槛
GEO 的竞争,发生在两个页面都已被检索到之后。SIGIR 2026 收录的一项研究用 25.2 万次配对实验证明:主题吻合、写明具体价格、带近期日期、检索位置靠前,四道门槛任何一项不达标,页面基本出局;而把同一页重新排版美化,赢面不变。
这项研究叫《What Gets Cited》(arXiv:2605.25517),作者是 Sprinklr 团队,2026 年 7 月在墨尔本 SIGIR 会议发表。它的问法和多数 GEO 文章不同:不问「怎么才被 AI 引用」,而问「两个都够格的候选源摆在模型面前,先翻谁的牌子」。
四道门槛:决定 AI 先引用哪一页
研究者搭了一个双文档注入的 RAG 测试台,把两个候选页面同时塞进模型上下文,记录引用标记先落在谁头上。每次配对只改一个变量,品牌名匿名化,来源顺序做平衡设计,避免位置偏好与品牌知名度混进来,最后用混合效应模型统计。覆盖六款模型、18 个内容因子,合计 25.2 万次试验。
结论是存在四道门槛因子,六款模型一致:
- 主题吻合:页面回答的是买家真正问的那个问题。答偏了直接出局。
- 写明具体价格:一个候选页给出价格数字、另一个写「请联系我们报价」,前者优先。
- 近期时间戳:标注 2026 年的页面,胜过标注 2019 年或没有日期的页面。
- 检索位置:在候选清单里排前者占优。
排在门槛之后的才是加分项:规格是否齐全、有无竞品对比、语气是否笃定、结论有无证据、深度够不够。它们能改变胜率,但单独一项决定不了胜负。
最反直觉的一条是排版。内容结构因子的优势比落在 0.79 到 1.25 之间,跨过 1.0 这条「无影响」线,把信息打散会造成损害,但远达不到门槛级别。研究者的解释很直接:语言模型不跳读,整个段落都在上下文里,它比较的是两个候选说了什么,不是谁长得整齐。
一个关键边界:先被检索到,才有资格谈引用
这里必须说清适用范围,否则容易被读成「SEO 没用了」。实验里的两个页面是已经进入模型上下文的,测的是出线之后的竞争,不是出线本身。真实答案引擎还有抓取、索引、域名信任、查询改写、平台各自的检索系统在起作用,这些都不在射程里。
正确的读法是分两层:
- 进池子:页面能被抓取、能被索引、有资格出现在搜索摘要里——这一层由 SEO 与站点技术底座决定。
- 赢了竞争:进池之后靠前三个内容因子把对手挤掉。
SIGIR 研究里「检索位置」是门槛因子,也从侧面说明了这层依赖:位置靠前本身就是优势,而位置来自检索系统。底子没打好,第二层无从谈起。
怎么落到外贸独立站的页面上
挑三件性价比高的事:
- 先给价格一个数字。外贸产品页常年写「Contact us for quote」,这在 AI 侧等于把门槛让给对手。报价敏感可以退一步:写价格区间、起订量、阶梯价条件、运费计费口径,总之页面必须有一个可提取的数字。
- 让近期日期出现在页面上。给产品页与方案页标注更新时间,成本近乎为零。但别只改模板里的时间戳而不动内容——判断依据是页面信息本身是否更新。
- 把主题对准买家真正问的那句。产品线有几个,就别在一页里都写一点;一页对应一个明确的采购问题,比一页罗列八个产品更容易赢。
至于把页面重新排版、堆砌小标题这类动作可以提升阅读体验,但别把它当成提升 AI 引用的手段排进预算。站点的技术底座与索引健康度,可以对照 外贸独立站建设 的基础项先自查一遍。
三条自己做站时踩出来的判断
其一,AI 侧的内容优化,本质是把「可核对的事实」放上页面。价格、规格、日期、认证编号、检测参数——这类信息的共同点是能被核对,因此也能被引用。形容词换不来引用,「质量可靠、交期稳定」在模型眼里是零信息。这跟我们做 Google SEO 时改产品页的经验一致:先补事实,再谈表达。
其二,别把官网当成仅有的战场。一份 900 万条 AI 回答的行业数据(NP Digital,2026-09-30)显示:涉商业意图的提问里,自有域名只占引用来源的约 3%。官网的任务是说清「你是谁、卖什么、按什么条件卖」,第三方报道与独立评测负责让 AI 确认这些话,两件事要分开排预算。
其三,把「改了排版」从效果报告里拿掉。这项研究最有用的地方是挤水分——它用一个干净的对照实验说明,便宜好卖的动作不一定有效。做交付说明时,与其写一堆格式规范,不如把口径定在「补齐了哪些可核对事实、覆盖了哪些买家问题」,这些能验证。
常见问题
Q:内容越长越容易被 AI 引用吗?
不是。这项研究把「深度与完整度」列为门槛之后的加分项,它影响胜率但不决定胜负。真正决定的是主题是否答对、有没有关键事实(尤其价格与日期)。把 800 字的页面稀释到 3000 字,反而可能让答案被埋进无关内容里。
Q:外贸独立站必须写出真实价格吗?报价敏感怎么办?
不必公开底价。可选做法是给区间、给起订量、给阶梯条件,或者写明「FOB 上海,MOQ 500 件,1 万件以上另有阶梯价」这类可执行信息。关键是页面要有一个可被提取的具体数字,而不是只剩一句「请联系我们」。
Q:能直接套到 Google AI Overviews 和 ChatGPT 上吗?
要谨慎。该实验是受控的双文档 RAG 测试台,不是线上答案引擎,受品牌匿名化与固定候选集约束,也没覆盖检索环节。可以把它当作优先级信号——先补价格、日期、主题吻合度,再考虑其他动作;但不要当作线上效果的保证。另需注意作者来自 Sprinklr,该机构同时经营 AEO 相关产品。
Q:那 SEO 还值得做吗?
值得,而且是前置条件。页面要先能被抓取、能被索引、有资格出摘要,才有机会进入这场比较。「检索位置」本身是门槛因子,位置来自检索系统,因此 SEO 底子决定参赛资格,GEO 决定参赛之后能不能赢。
Q:改完这些,多久能看到变化?
日期与价格这类事实性补齐,通常随抓取与索引刷新即可生效;主题吻合度调整需要内容重写,周期更长。但 AI 引用本身波动大,不建议用单次查询结果判断成败,建议按月做同题复测并记录来源结构。









