抓取与索引
25 分HTTP 响应、robots 规则、AI 抓取控制、noindex、canonical、站点地图和服务端正文。
输入公开网址,CiteCheckup 会检查抓取访问、页面结构、直接答案、来源和发布者信息,并告诉你应该先改哪里。
本审计只使用公开页面信号,不查询实时 AI 回答,不监测引用,也不预测引用概率。
怎么使用
支持 HTTP 和 HTTPS。需要时可以手动指定品牌名或主题。
系统会读取 robots 规则、元数据、HTML 结构、正文、链接、作者和日期。
每个问题都会列出检查到的内容和修改方法。取不到的数据会标为未知,不会直接扣成失败。
网页得分
72/ 100
检查覆盖率
92%
网页可以正常访问,但开头答案和发布者信息还需要补充。
发现的问题
规范网址通过
页面元数据中发现指向自身的 canonical。
直接回答提醒
页面有有用细节,但开头没有明确给出答案。
作者与发布者未通过
未发现清楚的公开作者或发布者字段。
所有判断都来自公开网页。无法确认的项目会标为未知并降低覆盖率,不会冒充已经失败。
HTTP 响应、robots 规则、AI 抓取控制、noindex、canonical、站点地图和服务端正文。
标题、描述、语言、标题层级、结构化数据、列表、表格、FAQ、作者和日期。
直接回答、主题覆盖、问题、事实、来源、对比、步骤、总结和定义。
品牌名称、实体结构化数据、作者或发布者、更新时间以及关于和联系入口。
如果已经知道问题出在哪,可以直接检查对应的文件或标记。
抓取或粘贴 robots.txt,测试指定路径和用户代理,查看最终命中的规则。
检查 robots.txt解析 JSON-LD,检查类型和字段值,并把 Schema.org 结构与 Google 富结果资格分开说明。
测试结构化数据生成或验证带章节和链接的 llms.txt。该格式属于社区提案,不能决定排名。
生成 llms.txt抓取工具能访问页面,不代表读者能快速找到答案。先回答,再补背景。
范围过大的 Disallow 可能屏蔽重要页面。请用具体路径和用户代理测试。
JSON 能解析只是第一步,类型、字段值和页面可见内容仍需一致。
让读者能找到发布者、作者、更新时间,以及关于我们或联系方式。
不是。这里只检查网页本身,不会查询 ChatGPT、Gemini、Perplexity 或 Google AI Overviews,也不显示实时引用。
包括网页访问、元数据、HTML 结构、直接答案、robots 规则、链接、品牌名称、作者和日期。
不需要。检测只处理当前请求,浏览器最多可保存 10 份经过清理的本地报告。
不能。高分表示网页通过了更多公开检查项,不能预测某个服务会选择哪些来源。
优先检查产品、价格、对比、文档或政策等真正回答用户重要问题的页面。
粘贴公开网址,查看具体问题、已检查到的内容和修改方法。
检查网址