跳到内容

🗺️ sitemap.xml 验证器

获取 sitemap.xml,分析语法并检查 URL 数、lastmod / changefreq / priority、hreflang、图像/视频/新闻扩展、大小和 50k URL / 50 MB 限制。

完全免费 无需注册 服务器处理 无日志 / 数据库 限速 5 种语言 深色模式

⚠️ 请求从 DevLab 服务器发起。不允许私有 IP 地址和 localhost。

📖 本诊断能告诉你什么

本诊断会实际抓取 sitemap.xml,确认其能否作为 XML 解析,统计 URL 数量、lastmod / changefreq / priority 的填写率,并列出 sitemapindex 的子站点地图。即便全部为绿色,也不保证所列 URL 会被收录,因为站点地图对谷歌而言只是发现线索,而非指令。

检查项 含义 未通过时的处理
50,000 URL / 50MB 上限 单个文件最多容纳 50,000 个 URL、未压缩 50MB。超出部分不是被忽略,而是整个文件被判为错误。即使以 gzip 提供也无济于事,判定依据的是解压后的大小。 请用 sitemapindex 拆分。索引文件本身同样上限 50,000 条,理论上可覆盖 25 亿个 URL。拆分标准与其按目录,不如按更新频率(文章 / 商品 / 静态页)划分,后续维护 lastmod 会轻松得多
lastmod 全部是同一日期 不少 CMS 每次生成时都会把所有 URL 的 lastmod 写成今天,一旦如此,谷歌会判定该值不可信,并在整站范围内忽略 lastmod;写入未来日期同理。它作为更新信号的价值就此消失。 请输出内容真正被修改的时间,采用带时区的 W3C Datetime(2026-07-26T10:00:00+09:00)。原则上仅改动了页眉页脚的页面,其 lastmod 不应变动。若难以判断,不输出 lastmod 反而危害更小。
混入了不该收录的 URL 站点地图中应只放希望被收录的规范 URL。若混入 noindex 页面、canonical 指向别处的页面、会跳转的 URL 或 404,会浪费抓取预算,并使 Search Console 的排除报告难以阅读。 生成时按三个条件筛选:返回 200、非 noindex、canonical 指向自身。changefreqpriority谷歌已明确表示不使用的字段,留空并不扣分,省略以缩小文件体积反而更实际。

仅仅把 URL 放进站点地图并不会提升排名。真正有用的是发现内部链接稀少的新页面,以及大型站点的抓取效率。请在 robots.txt 中写入 Sitemap: https://example.com/sitemap.xml,并同时在 Search Console 提交,这样就能看到哪些 URL 被排除以及原因。

🔗 相关工具