AI 抓取实况真实访问记录

GEO 优化的第一证据:主流 AI 的爬虫已经在持续抓取平台语料。

数据加载中…

为什么这能证明 GEO 优化在生效

GEO(生成式引擎优化)的目标是让 AI 在回答中引用平台语料。第一步是「让 AI 来读」——这一步已经发生,且可被独立验证。

1我们放行并引导

robots.txt 主动放行 16 种 AI 爬虫;llms.txt 提供语料清单;sitemap.xml 提供全站索引——为 AI 爬虫铺好入口。

2AI 爬虫主动来访

本页数字来自边缘中间件的自动记录:每一次 GPTBot / ClaudeBot / Bytespider(豆包)的到访都实时留痕,无法伪造。

3语料进入模型视野

被抓取的结构化事实、问答对与证据,进入模型训练与检索池;引用效果由 AI 认知验证中心持续实测。

每日抓取量

自 2026-09-18 记录仪上线以来,抓取持续发生(GMT+8,按天统计)。

来访爬虫:谁在读我们

覆盖 AI 训练(进模型记忆)与 AI 搜索(进答案引擎)两类入口。

它们在读什么

AI 爬虫优先抓取的,正是平台为机器准备的可读层——说明优化入口被正确命中。

被抓取的资源说明近 50 次记录中次数

最近到访流水

实时记录,新→旧;技术明细另见 爬虫访问技术日志

时间 (GMT+8)爬虫归属类型访问路径

独立验证入口

以下每一项都是公开可访问的真实文件或接口,可随时点开核对。

· robots.txt —— 主动放行 16 种 AI 爬虫的协议文件
· llms.txt —— 面向大模型的语料清单(完整版
· sitemap.xml —— 全站页面索引
· /api/bots —— 本页数据来源(JSON 接口,实时)
· AI 认知验证中心 —— 语料被引用效果的持续实测
数据性质说明:本页的爬虫访问数字为真实访问日志,由部署在 Cloudflare 边缘的中间件自动记录,非演示数据。平台的品牌语料内容仍为演示用模拟数据。页面内置最近一次数据快照,即使实时接口暂时不可达也能正常展示(此时标注「快照」);接口可用时每分钟自动刷新。