example.com 的检测快照
本页为一次检测的历史留存快照,数据定格于检测完成时刻。
Example Domain
https://example.com/ · 检测时间 2026-08-19 18:07:33
正在渲染站点首页截图…
64
58
爬虫可达性
放行 20/20 只爬虫
70
AI 认知度
2/3 家平台识别
40
基础设施
5 项待优化
检测结论
- robots.txt 未封禁 AI 爬虫
- 缺失 Sitemap、结构化数据、llms.txt
- 2/3 家平台认识本站
共 1 项严重问题,3 项优化建议
近 16 次检测趋势 · 综合分较上次 +3 综合分 爬虫可达性 AI 认知度
评分口径:综合分 = 爬虫可达性 × 50% + AI 认知度 × 50%;基础设施分由 5 项计分检测折算(通过=1、提醒=0.5、未过=0),仅作参考不计入综合分。基准线样本为 32 个已检测站点。
域名与基础信息
example.com 站点标题为「Example Domain」,部署于 cloudflare 服务器,经 Cloudflare 加速,解析 IP 104.20.23.154。本次检测 HTTP 200,响应 606ms,未启用传输压缩。HTTPS 证书由 SSL Corporation Cloudflare TLS Issuing ECC CA 3 签发,检测时剩余 70 天。AI 平台认知 2/3 家,robots.txt 封禁 0/20 只 AI 爬虫。
- IP 地址
- 104.20.23.154
- 服务器类型
- cloudflare
- CDN / 网关
- Cloudflare
- 响应速度
- 606ms
- HTTPS 证书
- SSL Corporation Cloudflare TLS Issuing ECC CA 3
- 证书有效期至
- 2026-10-27(检测时剩余 70 天)
- HTTP 状态
- 200
- 传输压缩
- 未启用
共 6 项检测,其中 6 项未完全通过,异常项已置顶并用左侧色条标出。
正文渲染方式未过
纯文本仅 142 字符
AI 爬虫普遍不执行 JavaScript,正文很可能完全抓不到
meta description提醒
缺失
结构化数据 JSON-LD提醒
缺失
llms.txt提醒
缺失
Sitemap提醒
缺失
传输压缩提醒
未启用
未压缩会增加爬虫抓取耗时与失败率
页面 TDK 信息
| 项目 | 字符数 | 内容 |
|---|---|---|
| 标题 Title | 14个字符(一般不超过 80 个) | Example Domain |
| 关键词 Keywords | -- | 未配置 |
| 描述 Description | -- | 未配置 |
字符数按 Unicode 字符计(中英文同权);规范区间为通行建议值,超出不一定被截断,但完整展示概率会降低。
认知合计70/ 100
豆包10
Kimi10
智谱清言0
豆包认识描述准确
example.com是互联网工程任务组(IETF)预留的用于示例说明的网站,主要用于在文档、教程等场景中作为通用的演示网址使用,本身没有实际的业务功能。
描述准确
example.com 是 IETF 根据 RFC 2606 和 RFC 6761 保留的示例域名,专门用于文档、示例代码和教学材料中作为占位符使用,并非指向真实的特定业务网站。访问该域名通常会显示说明其为保留示例域名的占位页面。
智谱清言不认识不认识
不了解
提问方式为模拟 AI 联网应答:先对该域名做实时联网检索,将检索结果注入提问后询问各平台「你是否了解该网站」,回答准确性由独立评审模型对照站点真实标题与描述判定。联网检索集反映 AI 联网模式下的第一道可见性漏斗——本站是否会被检索到,不计入评分。本站被引页面为检索集与各平台认知回答中实际出现的本站链接(纯文本提取,未经模型加工),同样不计入评分。平台分 10 分制(认识且描述准确=10,大致了解=7,张冠李戴=3,不认识=0,检测失败不计入);认知合计 = 各平台平均分 × 10,满分 100。口碑倾向由评审模型根据应答文本中的态度表述判定(正面=含推荐或赞誉表述,负面=含批评或风险提示,中性=客观陈述),仅反映本次应答文本,不构成对该站点的评价结论。
共检测 20 只主流 AI 爬虫:放行 20 只,封禁 0 只。规则解析自 robots.txt 原文,模拟访问以真实爬虫 UA 请求本站首页所得。
模拟访问实测
GPTBot 模拟访问可抓取
HTTP 200
爬虫可正常抓取页面
Bytespider 模拟访问可抓取
HTTP 200
爬虫可正常抓取页面
robots.txt 规则解析
| 状态 | 爬虫 | 运营方 | 用途 | 命中规则 |
|---|---|---|---|---|
| 放行 | GPTBot | OpenAI | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | OAI-SearchBot | OpenAI | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | ChatGPT-User | OpenAI | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | ClaudeBot | Anthropic | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | Claude-User | Anthropic | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | Claude-SearchBot | Anthropic | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | PerplexityBot | Perplexity | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Perplexity-User | Perplexity | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | Bytespider | 字节跳动 | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Baiduspider | 百度 | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Bingbot | 微软 | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Googlebot | 搜索索引 | 无 robots.txt,默认允许 | |
| 放行 | Google-Extended | 训练控制 | 无 robots.txt,默认允许 | |
| 放行 | Meta-ExternalAgent | Meta | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | Applebot-Extended | Apple | 训练控制 | 无 robots.txt,默认允许 |
| 放行 | CCBot | Common Crawl | 训练语料 | 无 robots.txt,默认允许 |
| 放行 | Amazonbot | Amazon | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | DuckAssistBot | DuckDuckGo | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Cohere Crawler | Cohere | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | TikTokSpider | TikTok | 搜索索引 | 无 robots.txt,默认允许 |
规则解析自 robots.txt 声明,实际抓取可能受 WAF 频率与地区策略影响;核对 AI 爬虫的真实到访记录,请用 AI 爬虫日志分析。
共 4 项,按优先级排序:严重 1 项 · 提醒 3 项。逐项修复后重新检测,可观察综合分变化。
页面正文依赖 JS 渲染,AI 爬虫抓不到内容严重
AI 爬虫普遍不执行 JavaScript。改用 SSR/SSG 渲染,或对爬虫 UA 做预渲染(Prerender)
缺少 meta description提醒
为首页和重要页面添加简洁准确的 description,AI 在判断页面主题时高度依赖它
未配置 llms.txt提醒
使用本站的 llms.txt 生成器创建一个,放在网站根目录,帮助大模型快速理解站点结构
未检测到 Sitemap提醒
生成 sitemap.xml 并在 robots.txt 中声明;同时到 Bing Webmaster 提交并开启 IndexNow,加速 ChatGPT/Copilot 索引
本报告由 QVSO(AI 收录与可见性查询)生成 · example.com · 检测时间 2026-08-19 18:07:33 · 结果基于本次请求快照,仅反映检测时点状态,各项结果仅供分析参考。
查看最新数据:example.com 的 AI 收录查询