HTML 链接提取
提取 a 标签中带引号的 href 原值
信息提取
🔒 100% 本地运行 — 你的数据不会离开当前页面由 Evan 维护•最近更新:2026年9月30日
页面阅读模式
完整说明还包括常见问题处理、操作示例、代码片段、FAQ 和相关工具,便于核对结果或排查问题。
工具说明
粘贴 HTML 片段以提取 a 标签中带引号的 href 原值。结果保留每个相同字符串首次出现的位置,包括相对路径、片段和非 HTTP 协议。不输出锚文本或 rel 属性,不解码 HTML 实体、不根据基准 URL 补全路径,也不访问目标地址。匹配使用轻量模式,不是完整 HTML 解析器。
生产可用片段
相对 href 保留原值,重复目标只出现一次
text
输入
<a href="/guide">Guide</a>
<a href="/guide" rel="nofollow">Another label</a>
<a href="mailto:[email protected]">Email</a>
<a data-href="/not-an-href">Placeholder</a>
输出
/guide
mailto:[email protected]常见问题
会提取哪些属性?
仅提取 a 标签中带引号的 href,并移除值的首尾空白。不会导出 data-href、图片 src、无引号 href、锚文本或 rel。
怎样去重?
按提取出的完整字符串去重,保留首次出现顺序。不会规范化大小写、片段、实体写法或查询参数。
会补全相对地址或解码 HTML 实体吗?
不会。/guide、#section、mailto:[email protected] 和字面的 & 都保留原样。需要时请结合来源页面另行解析。
会访问网页或检查坏链吗?
不会。只扫描粘贴的源码,不访问 URL,也不执行 JavaScript。注释或脚本中的文本可能形似链接,损坏标记也可能造成遗漏或误匹配。
继续浏览