URL 提取
从粘贴文本中查找 HTTP(S) 地址候选
信息提取
🔒 100% 本地运行 — 你的数据不会离开当前页面由 Evan 维护•最近更新:2026年9月29日
页面阅读模式
完整说明还包括常见问题处理、操作示例、代码片段、FAQ 和相关工具,便于核对结果或排查问题。
工具说明
扫描日志、聊天或源码文本中的 HTTP/HTTPS 前缀候选,移除部分句末标点,再按完整字符串去重并排序。查询参数或大小写不同的值分别保留。这是文本扫描,不会执行 HTML、Markdown、JSON 或 URL 语法验证;转义字符串和带结束分隔符的地址可能需要人工修正。输入会保存为此浏览器中的草稿,点击清空可移除。
生产可用片段
原值相同才去重,查询参数不同仍分别保留
text
输入
GET https://b.example.org/p?id=1
Retry https://b.example.org/p?id=1.
See https://a.example.org/help and https://b.example.org/p?id=2
裸域名 example.org 和 ftp://files.example.org 不会提取。
输出
https://a.example.org/help
https://b.example.org/p?id=1
https://b.example.org/p?id=2常见问题
会识别哪些字符串?
查找以 http:// 或 https:// 开头的候选,前缀匹配不区分大小写。跳过裸主机名、相对路径和 ftp:// 地址,不解码 JSON 转义或 HTML 实体。
清理和去重会改变什么?
右括号等结束分隔符会终止匹配,尾部句号、逗号、分号、叹号或问号会被移除。剩余完整字符串去重并排序,不执行规范 URL 合并。
域名分布统计什么?
把唯一 URL 中能被解析的值按完整主机名分组。格式有问题的候选可能仍在 URL 清单中,但不进入分布统计;不会按可注册主域名合并,也不统计原文重复次数。
会访问或验证提取到的 URL 吗?
不会。不会抓取目标、判断安全性或确认可达性。采取操作前请保留来源上下文并另行验证目标。
工具会保留我的输入吗?
会。输入草稿保存于此浏览器的本地存储,再次打开时恢复。点击清空可移除草稿。处理在本地完成,不把文本发送给服务器。
继续浏览