内部链接提取器

粘贴URL或原始HTML代码后,提取工具会自动提取所有锚点标签,区分内部(同一主机)与外部链接,并记录锚文本、rel属性、目标地址、nofollow状态以及在文档中的位置。该功能适用于SEO审计、孤立页面排查以及检测重要内部链接中意外出现的rel="nofollow"标记。

如何提取内部链接

  1. 1

    输入网址或粘贴 HTML

    对于实时URL,该工具会获取并解析DOM;而粘贴的HTML代码则会在您的浏览器中本地解析。

  2. 2

    请参阅链接表

    目标URL、锚文本、rel属性、target属性、nofollow标签以及链接位置(页眉/正文/页脚)。

  3. 3

    仅内部过滤

    切换“仅限内部”过滤器,隐藏离开当前主机的链接。

  4. 4

    导出

    可复制为CSV或 JSON 格式,用于网络爬虫或电子表格审计。

内部链接对SEO为何如此重要

内部链接关乎谷歌关注的三个关键方面:

  1. 爬取发现。 机器人通过跟随已知页面上的链接来访问新页面。
  2. PageRank分布。 每个内部链接都会将源页面的部分权威值传递给下游页面。关键页面应获得更多的入站内部链接。
  3. 上下文相关性。 主文本及周边段落向谷歌说明目标页面的内容主题。

该工具会标记哪些内容

标志 含义
内部/外部 与页面的主机(包括子域名)进行比较。
Nofollow 存在 rel="nofollow",不传递排名信号。
赞助内容 / 用户生成内容 rel="sponsored"rel="ugc",行为模式相同。
目标空白页 target="_blank",在新标签页中打开。
空锚点 无可见文本(仅图像或空白区域)。
仅哈希 #section 等片段链接,请勿跨页面使用。
位置 头部 / 导航栏 / 主内容区 / 尾部。

解决提取器界面常见的问题

  • 导航栏中的内部无跟随链接。 有时模板会将 rel="nofollow" 应用于所有内部链接,请将其移除。
  • 过多的精确匹配锚点。 若有40个内部链接指向带有“定价”锚点的/blog/pricing,这可能显得存在操纵嫌疑。
  • 孤立页面。 全局扫描网站,检查哪些URL的内部链接数量为零。
  • 仅图像锚点。 <a><img alt="..."></a> 可以接受,但 Google 会将 alt 的文本识别为锚点,请确保该文本具有实际意义。

何时使用 URL 获取而非粘贴的 HTML

  • 对公开页面及快速审核,请使用URL获取功能
  • 在经过身份验证的页面(使用HTTP基本认证后的预发布站点)、JavaScript渲染后的动态SPA页面或已下载页面的离线分析场景中,可使用粘贴的HTML代码

常见错误

  • 将子域名链接视为外部链接。搜索引擎通常如此处理,位于 blog.example.com 的博客与位于 example.com 的主站点会分别分配权重。
  • 缺失<link>元素(标准型与替代型)。这些元素未在此范围内涵盖;它们虽被视为内部引用,但在语义上与锚点存在差异。
  • rel="noopener"rel="nofollow" 混淆。前者属于安全属性,不影响搜索引擎优化(SEO)。

常见问题

目标主机与当前页面主机相匹配的锚点。默认情况下,子域名被视为外部域名;启用“包含子域名”选项可将其计入单一品牌审计中的内部域名统计。

当你获取一个URL时,并非直接处理,而是解析原始HTML响应。对于使用JavaScript渲染的SPA页面,请打开页面、加载后查看源代码,并将DOM标记内容粘贴到工具中。

并非通过URL获取(服务器会返回登录页面)。登录后复制渲染后的HTML代码,并将其粘贴至工具中进行本地分析。

是的。可复制为CSV格式用于电子表格处理,或 JSON 为脚本输入格式,每条链接对应一行数据,包含URL、锚文本、rel属性及位置信息。

相关工具

此工具还提供其他语言版本