example.com 的检测快照
本页为一次检测的历史留存快照,数据定格于检测完成时刻。
- robots.txt 未封禁 AI 爬虫
- 缺失 Sitemap、结构化数据、llms.txt
- 5 家 AI 平台均可识别
优化建议
针对页面正文依赖JS导致AI爬虫抓不到内容的问题,将核心正文内容直接渲染在HTML静态源码中,避免仅通过JS加载正文内容。
先补全meta description标签,再补充Open Graph的title、description、type、image四个缺失字段,完善页面社交分享与搜索引擎识别信息。
在首页添加符合规范的JSON-LD结构化数据,同时在网站根目录创建llms.txt文件,声明AI爬虫的访问规则。
生成并提交XML格式的Sitemap文件到搜索引擎平台,同时在根目录添加Agent接入声明文件,明确AI代理的访问权限。
域名与基础信息
example.com 站点标题为「Example Domain」,部署于 cloudflare 服务器,经 Cloudflare 加速,解析 IP 104.20.23.154。本次检测 HTTP 200,响应 1191ms,启用 br 传输压缩。HTTPS 证书由 SSL Corporation Cloudflare TLS Issuing ECC CA 3 签发,检测时剩余 50 天。AI 平台认知 5/5 家,robots.txt 封禁 0/39 只 AI 爬虫。
- IP 地址
- 104.20.23.154
- 服务器类型
- cloudflare
- CDN / 网关
- Cloudflare
- 响应速度
- 1191ms
- HTTPS 证书
- SSL Corporation Cloudflare TLS Issuing ECC CA 3
- 证书有效期至
- 2026-10-27(检测时剩余 50 天)
- HTTP 状态
- 200
- 传输压缩
- br 压缩
共 11 项检测(含 1 项参考项,不计分),其中 6 项未完全通过,异常项已置顶并用左侧色条标出。
AI 爬虫普遍不执行 JavaScript,正文很可能完全抓不到
首页未发现 JSON-LD,补充 WebSite/Organization 等 Schema 类型可提升 AI 对站点实体的理解
og:title/description/type/image 是 AI 与社交平台生成分享摘要的基础字段
H1 唯一且明确,利于 AI 快速识别页面核心主题
未设置 meta robots,默认允许索引与抓取
未发送 X-Robots-Tag 响应头,默认允许索引与抓取
响应 Body 经压缩传输,爬虫抓取更快
llms-full.txt、AGENTS.md、openapi.json、MCP 清单等新兴 Agent 协议文件;缺失不影响当前 AI 可见性,是面向 Agent 时代的加分项
页面 TDK 信息
| 项目 | 字符数 | 内容 |
|---|---|---|
| 标题 Title | 14个字符(一般不超过 80 个) | Example Domain |
| 关键词 Keywords | -- | 未配置 |
| 描述 Description | -- | 未配置 |
页面语义信号
- 1example.com - WikidataWikidata
- 2Whois example.comWhois.com
- 3example.com_whois查询_域名查询阿里云
- 4Example values · Cloudflare Style GuideCloudflare
- 5example邮箱是哪个公司的php.cn
- 6example邮箱是哪个软件php.cn
- 7example.com域名意外流量的技术解析与启示CSDN博客
- 8¿Qué es una URL?MDN Web Docs
豆包认识example.com是IANA为文档示例、教学演示保留的示例域名,并非真实可用于建站、注册使用的网站,仅用于展示域名使用规范。
智谱清言认识example.com 是由互联网工程任务组(IETF)和互联网名称与数字地址分配机构(ICANN)保留的域名,专门用于文档编写和技术示例中作为占位符使用,它并非一个提供实际服务的真实网站。
DeepSeek认识example.com 是互联网号码分配机构(IANA)保留的示例域名,主要用于技术文档、规范说明和表单演示,并非一个提供实际内容的网站。
知道。example.com 是由互联网号码分配机构(IANA)依据 RFC 2606/RFC 6761 保留的示例域名,专门用于在文档、教程和技术示例中充当占位符,避免使用真实域名造成混淆。访问该网站只会看到一个简单的"Example Domain"说明页面,它本身不提供任何实际的网络服务。
通义千问认识example.com 是一个由 IANA 保留、主要用于技术文档和示例的占位域名,通常会显示一个简单的“Example Domain”示例页面。它不是某个公司的真实网站,也不提供邮箱或注册登录等服务。
共检测 39 只主流 AI 爬虫:放行 39 只,封禁 0 只。规则解析自 robots.txt 原文,模拟访问以真实爬虫 UA 请求本站首页所得。
模拟访问实测
爬虫可正常抓取页面
爬虫可正常抓取页面
robots.txt 规则解析
| 状态 | 爬虫 | 运营方 | 用途 | 命中规则 |
|---|---|---|---|---|
| 放行 | GPTBot | OpenAI | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | OAI-SearchBot | OpenAI | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | ChatGPT-User | OpenAI | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | ChatGPT Agent | OpenAI | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | ClaudeBot | Anthropic | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | Claude-User | Anthropic | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | Claude-SearchBot | Anthropic | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | PerplexityBot | Perplexity | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Perplexity-User | Perplexity | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | Bytespider | 字节跳动 | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | DeepSeekBot | DeepSeek | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | KimiBot | 月之暗面 | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | Kimi-SearchBot | 月之暗面 | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Kimi-User | 月之暗面 | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | ChatGLM-Spider | 智谱 | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | TongyiBot | 阿里 | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | PanguBot | 华为 | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | Baiduspider | 百度 | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | YiyanBot | 百度 | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Bingbot | 微软 | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Googlebot | 搜索索引 | 无 robots.txt,默认允许 | |
| 放行 | Google-Extended | 训练控制 | 无 robots.txt,默认允许 | |
| 放行 | Google-CloudVertexBot | 模型训练 | 无 robots.txt,默认允许 | |
| 放行 | GoogleOther | 模型训练 | 无 robots.txt,默认允许 | |
| 放行 | Meta-ExternalAgent | Meta | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | Meta-ExternalFetcher | Meta | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | Applebot-Extended | Apple | 训练控制 | 无 robots.txt,默认允许 |
| 放行 | CCBot | Common Crawl | 训练语料 | 无 robots.txt,默认允许 |
| 放行 | Amazonbot | Amazon | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | DuckAssistBot | DuckDuckGo | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Cohere Crawler | Cohere | 模型训练 | 无 robots.txt,默认允许 |
| 放行 | TikTokSpider | TikTok | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | MistralAI-User | Mistral | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | Amzn-User | Amazon | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | PetalBot | 华为 | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | Manus-User | Manus(蝴蝶效应) | 实时抓取 | 无 robots.txt,默认允许 |
| 放行 | ExaBot | Exa | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | TavilyBot | Tavily | 搜索索引 | 无 robots.txt,默认允许 |
| 放行 | LinkupBot | Linkup | 搜索索引 | 无 robots.txt,默认允许 |
高级检测:Agent 接入声明(0/6 已提供)面向 Agent 时代的协议文件,缺失不影响当前评分
| 状态 | 文件 / 端点 | 用途 | HTTP |
|---|---|---|---|
| 未提供 | llms-full.txt | llms.txt 的完整内容版,供 AI 直接读取全站核心内容 | 404 |
| 未提供 | AGENTS.md | Agent 行为边界与工具使用说明,编码/自动化 Agent 的接入约定 | 404 |
| 未提供 | ai-plugin.json | ChatGPT 插件清单,定义插件元数据、认证方式与 API 规范入口 | 404 |
| 未提供 | openapi.json | OpenAPI 规范文件,Agent 据此理解并调用站点 API | 404 |
| 未提供 | mcp.json | MCP 协议清单,声明站点提供的 MCP Server 能力 | 404 |
| 未提供 | MCP 端点 | MCP Server 实际端点,Agent 通过它调用站点工具 | 404 |
| # | 信源域名 | 提及平台 | 平台数 |
|---|---|---|---|
| 1 | 豆包智谱清言DeepSeekKimi通义千问 | 5 | |
| 2 | 豆包智谱清言DeepSeekKimi通义千问 | 5 | |
| 3 | 豆包智谱清言DeepSeekKimi通义千问 | 4 | |
| 4 | 豆包智谱清言DeepSeekKimi通义千问 | 3 | |
| 5 | 豆包智谱清言DeepSeekKimi通义千问 | 3 | |
| 6 | 豆包智谱清言DeepSeekKimi通义千问 | 2 | |
| 7 | 豆包智谱清言DeepSeekKimi通义千问 | 2 | |
| 8 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | |
| 9 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | |
| 10 | 豆包智谱清言DeepSeekKimi通义千问 | 1 |
| # | 关键词 | 提及平台 | 平台数 | 操作 |
|---|---|---|---|---|
| 1 | example.com | 豆包智谱清言DeepSeekKimi通义千问 | 5 | 实测排名 |
| 2 | 示例域名 | 豆包智谱清言DeepSeekKimi通义千问 | 5 | 实测排名 |
| 3 | example 网站 | 豆包智谱清言DeepSeekKimi通义千问 | 2 | 实测排名 |
| 4 | 测试域名 | 豆包智谱清言DeepSeekKimi通义千问 | 3 | 实测排名 |
| 5 | 示例网站 | 豆包智谱清言DeepSeekKimi通义千问 | 2 | 实测排名 |
| 6 | Example Domain | 豆包智谱清言DeepSeekKimi通义千问 | 2 | 实测排名 |
| 7 | example domain | 豆包智谱清言DeepSeekKimi通义千问 | 2 | 实测排名 |
| 8 | 测试网站 | 豆包智谱清言DeepSeekKimi通义千问 | 2 | 实测排名 |
| 9 | 测试网址 | 豆包智谱清言DeepSeekKimi通义千问 | 2 | 实测排名 |
| 10 | example 官方网站 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
| 11 | 测试示例域名 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
| 12 | example域名官网 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
| 13 | example官方域名 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
| 14 | 示例网站example | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
| 15 | example基础网站 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
| 16 | 示范域名 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
| 17 | example 首页 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
| 18 | 网页示例 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
| 19 | example 官网 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
| 20 | example domain 是什么 | 豆包智谱清言DeepSeekKimi通义千问 | 1 | 实测排名 |
共 7 项,按优先级排序:严重 1 项 · 提醒 6 项。逐项修复后重新检测,可观察综合分变化。
为首页添加 WebSite/Organization Schema,内容页补 Article/FAQPage,帮助 AI 建立对站点实体与内容关系的理解
GEO 优化指南补齐 og:title/og:description/og:type/og:image 四要素,AI 与社交平台生成分享摘要时直接取用这些字段
GEO 优化指南未在常见路径与 robots.txt 中发现 Sitemap(大型站点可能使用非标准位置,请先确认实际配置)。如确未配置:生成 sitemap.xml 并在 robots.txt 中声明;同时到 Bing Webmaster 提交并开启 IndexNow,加速 ChatGPT/Copilot 索引
AI 收录指南在 llms.txt 之外,可补充 AGENTS.md、openapi.json 或 /.well-known/mcp.json,让 AI Agent 更好地理解与调用站点能力(不影响当前可见性评分)
llms.txt 生成查看最新数据:example.com 的 AI 收录查询