EXU

URL 提取

从粘贴文本中查找 HTTP(S) 地址候选

信息提取
🔒 100% 本地运行 — 你的数据不会离开当前页面
由 Evan 维护•最近更新:2026年9月29日
选项模式
输入文本

把日志、Markdown 或 JSON 直接贴进来点 Extract URLs,先拿到去重链接列表;域名分布和场景说明可在高级模式查看。

Extracted URLs
提取到的 URL 将显示在这里
🔒 浏览器内本地处理
页面阅读模式

完整说明还包括常见问题处理、操作示例、代码片段、FAQ 和相关工具,便于核对结果或排查问题。

工具说明

扫描日志、聊天或源码文本中的 HTTP/HTTPS 前缀候选,移除部分句末标点,再按完整字符串去重并排序。查询参数或大小写不同的值分别保留。这是文本扫描,不会执行 HTML、Markdown、JSON 或 URL 语法验证;转义字符串和带结束分隔符的地址可能需要人工修正。输入会保存为此浏览器中的草稿,点击清空可移除。

生产可用片段

原值相同才去重,查询参数不同仍分别保留

text

输入
GET https://b.example.org/p?id=1
Retry https://b.example.org/p?id=1.
See https://a.example.org/help and https://b.example.org/p?id=2
裸域名 example.org 和 ftp://files.example.org 不会提取。

输出
https://a.example.org/help
https://b.example.org/p?id=1
https://b.example.org/p?id=2

常见问题

会识别哪些字符串?

查找以 http:// 或 https:// 开头的候选,前缀匹配不区分大小写。跳过裸主机名、相对路径和 ftp:// 地址,不解码 JSON 转义或 HTML 实体。

清理和去重会改变什么?

右括号等结束分隔符会终止匹配,尾部句号、逗号、分号、叹号或问号会被移除。剩余完整字符串去重并排序,不执行规范 URL 合并。

域名分布统计什么?

把唯一 URL 中能被解析的值按完整主机名分组。格式有问题的候选可能仍在 URL 清单中,但不进入分布统计;不会按可注册主域名合并,也不统计原文重复次数。

会访问或验证提取到的 URL 吗?

不会。不会抓取目标、判断安全性或确认可达性。采取操作前请保留来源上下文并另行验证目标。

工具会保留我的输入吗?

会。输入草稿保存于此浏览器的本地存储,再次打开时恢复。点击清空可移除草稿。处理在本地完成,不把文本发送给服务器。

继续浏览