CANON

URL 规范化

按固定归一化规则比较 URL 字符串

SEO 与结构化数据
🔒 100% 本地运行 — 你的数据不会离开当前页面
由 Evan 维护•最近更新:2026年9月29日
选项模式
URL 输入

每行输入完整 URL,按固定规则处理参数名顺序和非根路径尾斜杠。结果不会替网站确定 canonical。

归一化结果
归一化后的 URL 会显示在这里
🔒 浏览器内本地处理
页面阅读模式

完整说明还包括常见问题处理、操作示例、代码片段、FAQ 和相关工具,便于核对结果或排查问题。

工具说明

按固定规则比较完整 URL 字符串:规范主机写法、移除指定追踪字段、按查询参数名排序,并移除非根路径末尾的一个斜杠。重复参数值和片段会保留。输入时即时更新结果,无法解析的行带有 INVALID 标记。输出供复核字符串差异,不代表搜索引擎应索引哪个网址。输入会保存为本地草稿,清空可移除。

失败门诊(高频踩坑)

归一化后的地址指向不同资源

原因:部分网站区分 /docs 与 /docs/,依赖参数顺序,或对原始 Query 字节签名。当前固定规则会改动这些表示,且没有逐项开关。

修复:这些差异有业务含义时保留原地址。仅靠字符串归一化无法证明两个资源等价。

生产可用片段

固定归一化规则及其边界

text

输入:
HTTPS://Example.COM:443/docs/?b=2&a=1&a=0&utm_source=mail#intro

输出:
https://example.com/docs?a=1&a=0&b=2#intro

重复的 a 值和 #intro 保留。
单次处理把 /docs/// 变为 /docs//;根路径 / 保持不变。

场景配方

01

比较导出清单中的两种地址写法

目标:判断差异是否来自主机大小写、追踪字段或参数名顺序。

  1. 每行粘贴完整 URL;此工具要求显式协议,例如 https://。
  2. 对照输出各行。固定规则按参数名排序,保留重复值,并移除非根路径末尾的一个斜杠。
  3. 要将结果用于 canonical 标签或重定向规则,先核对网站实际路由与跳转行为。

结果:输出相同只说明这些字符串在当前规则下收敛。工具不抓取页面、不比较内容、不跟随重定向,也不替 Google 选择 canonical。

常见问题

移除哪些追踪参数名?

以 utm_ 开头的名称,以及完整名称 fbclid、gclid、msclkid,匹配时不区分大小写。gclid_extra 等名称会保留。

重复查询参数会去重吗?

不会。同名参数的全部值均按原相对顺序保留。参数名按浏览器的本地化比较规则排序,因此不适合作为密码学签名的规范化算法。

归一化会改变哪些编码写法?

URLSearchParams 会重新序列化 Query:空格变成 +,没有等号的 flag 变成 flag=,部分字符改为百分号编码。浏览器也会规范主机名和默认端口。

基础和高级模式有什么区别?

两种模式使用相同固定规则。高级模式仅展示场景与无效行明细,不提供排序、去重或尾斜杠策略开关。

继续浏览