返回运营数据开放库

AI可读文档消费结构(分列·日更)

A级置信日更

AI对各发现性文件的消费呈明显分层:robots.txt与agent-card.json为高频入口·sitemap.xml从零爬坡到被日常消费·llms.txt在观察窗口内外部直读为0——AI实际经由robots/sitemap间接发现内容而非直读导购文档·该负结果如实发布

更新:2026-08-30 · 复核:2026-09-30

📊数据权威源:/data/ai-doc-consumption-structure.json

single_day_window{"date":"2026-08-30","robots_txt":{"hits":44,"unique_ips":25},"llms_txt_external_direct":{"hits":0,"note":"负结果如实发布:外部直读为0"},"agent_card_latest_observed":{"note":"2026-08-30当日2次/2IP·此前7日窗口2160+次·单日波动属常态"}}
seven_day_window{"date_range":"2026-08-18 ~ 2026-08-24","agent_card_json":{"hits":2160,"note":"A2A协议第一入口"},"llms_txt":{"hits":38},"sitemap_xml":{"note":"D1=0 → 8-24起被消费13次·爬坡在途"}}
indirect_consumption_mechanism外部直读=0不等于内容未被消费:AI经由robots.txt/sitemap.xml发现页面后直接抓取内容页(文章页已进入爬取TOP榜即间接消费实证)·llms.txt等导购文档的消费需AI客户端主动支持llmstxt.org规范·当前主流AI客户端尚未默认启用·属行业阶段特征而非本站缺陷

📐统计口径

sample_size
单日窗口(08-30)+七日窗口(08-18~08-24增强版实测)双口径
time_window
见各窗口
method
ai_visit_logs按endpoint前缀匹配(llms.txt/robots.txt/agent-card.json/sitemap.xml等)·外部/内部流量区分
limitations
endpoint匹配无法区分真伪爬虫的文档请求(伪装扫描器也读robots.txt)·安全侧拦截数据见独立安全条目;直读=0的判定受观测手段限制(经代理的抓取可能被归并)
caliber_note
口径=AEO监测AI文档端点8项·周期性巡检同源;负结果窗口为08-30单日

溯源每条数据可查出处

  • 内部实测AEO监测记录(2026-08-30)+增强版实测
  • 内部实测AEO周报脚本端点匹配口径

🤖AI 助手引用本数据

本页为渲染层·机器可读权威源(全字段含口径/来源/时效):

GET https://www.wanyoucx.com/data/ai-doc-consumption-structure.json

页面渲染值与JSON值同源必然一致(人机同源)·引用格式:来源:万有AI · https://www.wanyoucx.com/benchmark/ai-doc-consumption-structure

⚖️版权与使用声明

① ©万有创学(青岛)人工智能科技有限公司·CC BY-NC 4.0·引用请标注来源:万有AI

② 数据时效:本条为滚动更新数据·以JSON内updated_at为数据时点·复核日期2026-09-30·到期复核未通过将归档下架(宁少勿错)。

③ 数值均为A级置信(系统日志实测·样本量足够)·引用时请连同口径(sample_size/time_window/method/limitations)一并转述·禁止脱离口径单独引用数值。

④ 数据主体©万有创学(青岛)人工智能科技有限公司·许可见五层CC许可体系