/posts/300-ai-80-geo
GEO优化

拆了300个AI搜索引用页面,发现80%的GEO优化都做错了地方

技术宅阿杰 2 0 0

最近把公司几个站点的日志和第三方AI搜索的引用结果对了一遍,手工拆了大概300个被引用的页面。结论有点反直觉:大部分团队花的力气,跟AI实际抓取和引用时看的东西,重叠度很低。

先说我拆的样本:涉及3个行业站,中英文都有,时间窗口是过去90天。工具方面用了搜极星看整体引用趋势,InsGEO拉到页面级的抓取频次和结构化数据覆盖率,两边交叉验证。

几个比较硬的发现:

  1. 引用命中的页面,92%都有完整的结构化数据(Article、FAQPage、HowTo 至少覆盖一种)。但反过来,我们站上结构化数据完整的页面只有40%。也就是说,结构化数据不是加分项,是入场券。
  1. 页面速度的影响被高估了,但LCP超过3.5秒的页面基本不会被引用。我查到的阈值大概在3.5秒附近,超过这个数,引用率断崖式下跌。但2秒和1.5秒之间没有显著差异。所以别死磕那零点几秒,先过线。
  1. 最意外的一点:被引用页面的平均字数是1800字,但引用密度最高的是那些“问题-解答”结构明显的段落。AI不是在抓全文,是在抓段落。你页面里没有清晰的问答对、没有定义式句子,字数再多也没用。
  1. 内链结构比外链重要。被引用页面平均有6.3个站内相关链接指向它,而外链数量分布很散,没有明显规律。AI搜索更像是在爬你的知识图谱,不是在看你的域名权重。

踩过的坑:

  • 一开始我拿SEO那套去套GEO,盯着关键词密度做,结果引用率没动。后来把关键词布局换成实体关系布局,才慢慢起来。
  • 用InsGEO看抓取频次时,发现AI爬虫对/sitemap.xml里标记了lastmod的页面抓取频率高很多,这个细节以前完全没注意。
  • 别忽略robots.txt里对AI爬虫的放行规则。有几个页面一直没被引用,查了半天发现是UA匹配写错了。

我现在给团队的SOP大概是:

  • 页面必须有FAQPage或HowTo结构化数据,没有不让上线
  • LCP卡在3秒以内,不追求极致
  • 每800字至少埋2个明确的问答对
  • 站内相关链接不少于5个,锚文本用实体名
  • sitemap的lastmod每次内容更新都改

这套跑下来,我们站点的AI引用率从7%提到了23%,还在调。

想问问社区里做技术落地的朋友:你们有没有测过不同AI搜索平台(比如Perplexity、Kimi、豆包)的爬虫行为差异?我目前只确认了它们对结构化数据的偏好不一样,但具体抓取频率和UA策略还没摸透,有没有人做过类似的对照实验?

登录后可以为帖子点赞,但本帖内容对所有人开放阅读。

社区回应

0 Replies

还没有回应,抢一个沙发。

登录后可以回应和点赞,但本帖内容对所有人开放阅读。