SEO 分析工具会检查哪些项?
主要是页面级的可控项:title 与 description 的存在性和长度、H1 是否唯一、canonical 是否自指、robots meta 是否意外 noindex、Open Graph 与 Twitter Card 完整性、结构化数据能否解析、图片 alt 缺失比例、内外链数量。它不替代 Google Search Console——后者给的是真实索引和查询数据,这里给的是页面本身有没有硬伤。
从外部视角看浏览器和爬虫实际拿到了什么,而不是你以为发出去了什么。
点开即用,多数工具已预填示例数据。
网站上线之后的问题往往不在代码里,而在「浏览器和爬虫实际拿到了什么」:响应头带没带缓存策略、title 和 canonical 是不是被覆盖了、有多少条内链已经指向 404。这组工具就是从外部视角把这些拉出来看。
15 款工具分三条线——收录与内容(SEO 要素体检、死链扫描、favicon 与 OG 抓取)、性能与网络(Core Web Vitals、响应头、WebSocket 连通性)、前端零碎(URL 解析、Slug 生成、MIME 查询、颜色格式互转)。
涉及抓取目标站点的工具需要经服务端发起请求,结果只用于本次展示。若目标站点有登录墙或 robots 限制,抓取会失败,这属于预期行为。
新站上线自检
跑一遍 SEO 要素体检,确认 title、description、canonical、H1 和结构化数据都在。
改版后清理
用死链扫描找出改版遗留的 404 内链,避免抓取预算浪费在无效地址上。
性能优化
用性能分析看 LCP、CLS、TBT 三项指标,定位是图片没压缩还是主线程被脚本占满。
排查缓存
用 HTTP 头分析确认 Cache-Control、ETag 和 CDN 的命中情况。
主要是页面级的可控项:title 与 description 的存在性和长度、H1 是否唯一、canonical 是否自指、robots meta 是否意外 noindex、Open Graph 与 Twitter Card 完整性、结构化数据能否解析、图片 alt 缺失比例、内外链数量。它不替代 Google Search Console——后者给的是真实索引和查询数据,这里给的是页面本身有没有硬伤。
常见原因有四类:站点在 robots.txt 里禁止了抓取;返回 403 拦截了非浏览器 UA;内容完全由 JavaScript 渲染且首屏 HTML 为空;或者需要登录。前两种是站点的主动策略,属于正常拒绝;第三种说明你的页面对爬虫同样不友好,值得单独优化。
Google 的「良好」阈值取真实用户数据的 75 分位:LCP ≤ 2.5 秒、INP ≤ 200 毫秒、CLS ≤ 0.1。注意 2024 年 3 月起 INP 已正式取代 FID 成为响应性指标。工具跑的是实验室数据,只能作为优化方向参考,最终以 Search Console 里的实地数据(CrUX)为准。
每个页面的 canonical 应指向它自己的唯一版本,用完整绝对地址,并统一 www 与非 www、http 与 https。同一内容存在多个地址时(带 UTM 参数、短链别名、分页),全部指向同一个主地址。最常见的错误是整站 canonical 都写成了首页,那会让内页全部失去独立收录机会。
扫描有并发限制和请求间隔,正常站点不会受影响。但仍建议只扫自己有权限的站点,且避开业务高峰。如果你的站有几万个页面,建议按目录分批扫描,而不是一次全站跑完。
URL 里的可读短语能帮搜索引擎和用户理解页面主题,也让链接在社交平台分享时更可信。生成器会把标题转成小写、用连字符分词、去掉停用词和特殊字符。中文标题建议转成拼音或对应英文词,不要直接用中文做 URL——会被百分号编码成一长串,分享出去很难看。