这份清单用于把官网技术、事实内容、发布维护和 AI 回答观察分别记录。每项填写检查对象、时间、证据和结果;结果分为符合、待处理、不适用、未验证。下方的齿讯自站示例只说明本次实际检查,不作为客户案例或平台引用成绩。
官网基础检查表
| 检查项 | 怎样检查 | 留存什么 |
|---|---|---|
| 页面访问 | 未登录请求正式 URL,核对状态码与最终地址 | URL、时间、状态码、跳转结果 |
| 初始正文 | 读取初始 HTML,核对标题、核心正文和链接 | HTML 或对应片段 |
| 规范地址 | 比对页面 canonical 与实际内容地址 | 正式 URL、canonical 值 |
| 索引标记 | 查看 robots 元标记、响应头及抓取规则 | 指令及检查时间 |
| 页面入口 | 从首页、栏目和正文查找重要页面 | 来源页与目标链接 |
| 网站地图 | 核对有效网址、草稿与实质更新日期 | XML 内容、异常条目 |
| 移动端阅读 | 检查菜单、标题、表格、图片和联系入口 | 测试尺寸、截图与交互结果 |
正常响应和允许抓取只是受检条件;实际访问限制还可能随网络、频率或来源变化,不能只凭修改 User-Agent 证明真实平台爬虫已访问。
事实与内容检查表
| 检查对象 | 应核对的内容 |
|---|---|
| 企业与门店 | 全称、简称、地址、联系方式及服务范围是否一致 |
| 医生与设备 | 是否对应实际门店,有无跨店混用或过时记录 |
| 服务与价格 | 包含什么、适用对象、时间条件和额外费用是否清楚 |
| 数据与案例 | 是否有来源、统计口径、周期及可公开范围 |
| 图片 | 是否能确认机构身份、使用范围及文字与正文一致 |
| 内容关系 | 问具体业务时是否能到达相应服务或资料页 |
发布与更新检查表
发布后重新访问目标页面,核对正文、图片、状态码和规范地址;查看栏目、相关入口及完整网站地图是否同步。RSS 与最新内容索引按各自保留范围检查,不用“未进入最近条目”直接认定页面丢失。
修改旧文时保留网址与首次发布时间;实质内容变化才更新修改日期。平台提交回执、页面回读和实际收录分别记录。
齿讯自站技术核验示例
核验对象:https://www.chixunkeji.com/ 。时间:2026 年 9 月 26 日 12:59(北京时间)。方法:本机直接 HTTP 请求 XML 地图及其中页面,解析响应头、HTML 标题、正文、链接和结构化数据,并与当时本地静态输出比对。
| 项目 | 本次记录 |
|---|---|
| 地图 URL | 64 个不同页面 |
| 页面构成 | 36 篇资讯、16 个资料页,另有首页、索引、分类和分页 |
| 响应与规范地址 | 64 个页面返回 200,未重定向,canonical 均指向自身 |
| 正文与标记 | 初始 HTML 有正文;受检响应头和元标记未发现 noindex;每页一个 H1 |
| 首页发现路径 | 八个重点资料页均可通过首页链接一次点击到达 |
| 客户端抽样 | 官网建设页的移动端、Baiduspider 和 Bytespider 名称模拟请求返回相同正文 |
| 内容组织问题 | 部分导航仍为首页锚点、服务页标题偏宣传语、方案内容不完整,列入升级范围 |
本示例是升级前的技术快照,不代表任意时间、网络或平台的访问结果。未读取真实平台爬虫日志,未据此判断豆包、DeepSeek、Kimi 或文心是否收录或引用。
AI 回答观察怎样留档
固定原始问题,每题保留约定次数的新会话样本;记录平台、日期、联网模式、完整回答、参考资料 URL、正文引用 URL 及事实错误。来源列表和正文引用分栏保存,不重复计算同一页面的参数或片段。
样本不足、无法打开来源或没有测试时,标注未验证。前后对比要保留相同问题及环境说明,不只展示有利样本。查看完整诊断方法
如何使用检查结果
访问或正文错误交给网站维护处理;机构事实错误回到知识库修正;页面主题不足补充具体服务说明;索引或引用未验证的项继续通过对应记录核对。每项问题标明责任与下次复查时间。
