URL 解析工具

输入 URL 即可将其拆解为协议、主机、路径、查询参数和片段。还能自动识别 utm_source 等跟踪参数。

URL 结构一览

组成部分 示例 说明
协议(Scheme) https: 表示通信方式。网页使用 http:/https:,邮件链接使用 mailto: 等,始终位于 URL 最前端。
用户信息 user:pass@ Basic 认证中使用的用户名和密码,以明文形式保留,共享含此信息的 URL 时需格外小心。
主机名 example.com 目标服务器的域名或 IP 地址。
端口号 :8080 目标端口号。http 默认为 80,https 默认为 443,因此通常省略。
路径 /users/123 表示服务器上资源位置的层级结构字符串。
查询字符串 ?id=123&sort=asc 紧跟在“?”之后的 key=value 参数组,多个参数用“&”连接。
片段 #section2 指向页面内特定位置的标识符。“#”之后的内容不会发送到服务器,仅在浏览器内处理。

常见跟踪查询参数

参数名 说明
utm_source 用于 Google Analytics 等工具识别流量来源(如 newsletter、google、twitter)。UTM 是 Urchin Tracking Module 的缩写。
utm_medium 用于识别流量的媒介(如 email、cpc、social),通常与 utm_source 搭配使用。
utm_campaign 用于识别营销活动的名称,便于衡量特定推广活动的效果。
utm_term 用于识别付费搜索广告(PPC)中使用的关键词。
utm_content 用于区分同一广告内的多个链接或素材。
gclid Google 广告(Google Ads)发放的点击 ID,用于转化跟踪。
fbclid Facebook 广告发放的点击 ID,用于 Meta 的广告效果测量。

什么是 URL 解析器

URL 解析器是把输入的 URL 拆解为方案(协议)、主机名、端口、路径、查询参数、片段等构成要素并列表显示的工具。它不必让您用眼睛追着长 URL 手动解读,而是使用浏览器标准的 URL API 精确拆分,并自动检出 utm_source、gclid、fbclid 等追踪用参数。

输入的 URL 全部在浏览器内的 JavaScript 中处理,不会发送至服务器。即便是含有认证信息的 URL 或带密码的 URL(user:pass@host 形式),也能在不向外泄露内容的前提下安全地确认其结构。

URL 解析器的使用方法

  1. 把 URL 粘贴到输入栏 请输入含有方案(https:// 等)的完整 URL。相对路径或省略方案的 URL 无法解析。
  2. 确认构成要素的列表 协议、主机名、端口、路径、片段等会被自动拆解,并分别显示在各自的行中。
  3. 确认查询参数 键与值的组合会以列表显示,utm_source 等追踪用参数会带有专用徽标。
  4. 判断哪些参数不需要 查看带有追踪徽标的参数,判断在分享之前是否应当删除。

用好本工具的小技巧

  • 在社交媒体分享 URL 之前,先用此工具检查是否含有 utm_source 等跟踪参数。删除不需要的参数后分享的链接会更简洁。
  • 输入的 URL 全部在浏览器内通过 JavaScript 处理,不会发送到 toolbase.cc 的服务器,因此即使包含账号密码信息也可以安全检查。
  • 当查询字符串中同一个键出现多次时(例如 ?tag=a&tag=b),每一次出现都会作为独立的一行显示。
  • 片段(“#”之后的部分)不会发送到服务器,只在浏览器内用于页内锚点跳转或单页应用的路由,仅查看服务器日志无法获取这部分信息。
  • 当端口栏显示为空时,表示使用了默认端口(http 为 80,https 为 443),因此在 URL 中被省略了。

URL 解析器的应用场景

社交分享前的追踪确认

在分享链接之前确认其中是否含有 utm_source 等,必要时可去除后分享干净的 URL。

理解长 URL 的结构

即便是串接了大量查询参数的长 URL,由于会按键与值逐一拆解,也能一眼看出各自指定了什么。

服务端实现的调试

在实现路由或重定向处理时,可以浏览器 URL API 相同的行为,确认实际 URL 会被如何拆解。

广告点击 ID 的调查

收到带有 gclid、fbclid 等参数的链接时,可作为判别其来自哪个广告平台的线索。

URL 构成要素的术语

源(origin)
指方案、主机名与端口的组合。是否为同源,是浏览器安全控制(CORS 等)的判定基准。
查询字符串
指 URL 中「?」之后所接的 key=value 形式的参数群。可用「&」串接多个参数。
片段(fragment)
指 URL 中「#」之后的部分。它不会发送至服务器,而用于浏览器内的页内链接与 SPA 的路由。
百分号编码
为在 URL 中处理非 ASCII 字符,把 UTF-8 的字节序列转换为 %XX 形式的机制,也称为 URL 编码。
UTM 参数
指 utm_source 等,供访问分析工具识别流量来源的一系列查询参数的统称。
点击 ID
指如 gclid、fbclid 那样由广告平台按点击发放的标识符,用于转化衡量。

常见问题

大多数情况下删除后不会影响页面的显示和功能,因为它们主要用于访问统计分析,很少参与服务器端的路由逻辑。但极少数网站会用查询参数做条件判断,因此建议删除后先确认链接仍可正常打开再分享。

这是百分号编码(URL 编码)的结果。由于 URL 无法直接包含非 ASCII 字符,因此会将 UTF-8 字节序列转换为 %XX 形式表示。本工具会通过 URLSearchParams 自动解码后显示。

本工具使用浏览器原生的 URL API,只能解析包含协议(如 http://)的完整 URL。若要检查类似 localhost:3000/path 的地址,请在前面加上 http://,写成 http://localhost:3000/path。

不会。片段是浏览器在页面加载之后才处理的部分,并不包含在 HTTP 请求本身中,因此不会到达服务器。它主要用于页内锚点跳转和单页应用的路由。

这些是广告平台发放的点击 ID,目标网站会用该 ID 向 Google 或 Meta 报告“此次访问来自哪个广告”,用于转化效果跟踪。这本身不属于个人信息,但确实能让广告平台追踪到访问来源的广告渠道。
工具君

闲话 ― 为什么 URL 里的跟踪参数越来越多

像 ?utm_source=... 这样的查询参数,最早源自 2005 年 Urchin 公司提供的一项统计分析服务所用的标识符“Urchin Tracking Module”。Google 收购 Urchin 后将其发展为 Google Analytics,“UTM 参数”这一叫法由此成为行业标准。

2010 年代以后,Google、Facebook 等广告平台开始各自添加专属的跟踪参数(如 gclid、fbclid),导致一个 URL 上同时叠加多个跟踪参数的情况越来越常见。社交媒体上分享的链接看起来异常冗长,往往正是这种叠加造成的。

一些浏览器和注重隐私的工具已具备自动清除这些参数的功能。不过统计分析本身对许多正规网站而言是重要功能,并非单纯的“坏东西”,如何在营销效果测量与个人隐私之间取得平衡,至今仍是持续讨论的话题。