元数据提取器

输入一个URL后,提取器将获取该页面内容,解析<head>字段,并整理出影响链接在其他平台显示效果的所有关键信息:SEO标题与元描述、规范URL、Facebook和LinkedIn用于链接预览的Open Graph标签、Twitter卡片标签、网站图标及应用图标、 JSON-LD结构化数据(Schema.org格式,包括文章、产品、常见问题解答)。这些信息对SEO审计、链接预览调试以及验证新发布页面实际向爬虫暴露的内容非常有用。

如何提取元数据

  1. 1

    输入网址

    包含协议的完整URL。该工具仅执行一次重定向。

  2. 2

    该页面已从服务器端获取

    原始HTML已解析;使用JavaScript渲染的页面可能不会暴露客户端元数据。

  3. 3

    按标准分组的章节

    搜索引擎优化(SEO)、开放图谱、Twitter、Schema.org、图标、移动端、PWA。

  4. 4

    每个条目均显示其值和长度。

    标题和描述若超出谷歌或推特的字数限制,将会收到长度警告。

  5. 5

    预览链接卡

    根据提取的标签生成模拟版的Facebook/LinkedIn/Twitter分享卡片。

<head>中有哪些关键成分?

核心SEO

标签 目的
<title> 浏览器标签页,谷歌搜索结果标题
<meta name="description"> Google搜索结果片段(备用版本)
<link rel="canonical"> 标准URL,重复内容信号
<meta name="robots"> 索引/无索引规则,遵循/不遵循规则
<meta name="viewport"> 移动视口

开放图谱(Facebook、LinkedIn、Discord、Slack)

标签 目的
og:title 共享卡名称
og:description 共享卡描述
og:image 共享卡片图像(推荐尺寸:1200×630 像素)
og:type website / article / video.other
og:url 用于分享的规范网址
og:site_name 卡片上显示的网站名称

推特卡片

标签 目的
twitter:card summary / summary_large_image
twitter:title 退回到 og:title
twitter:description 退回到 og:description
twitter:image 大尺寸图像卡
twitter:site / twitter:creator 出版商/作者信息

Schema.org(JSON-LD)

<script type="application/ld+json">
{
  "@context": "https://schema.org",
  "@type": "Article",
  "headline": "...",
  "author": { "@type": "Person", "name": "..." },
  "datePublished": "2026-04-18"
}
</script>

文章、产品、食谱、常见问题解答、活动、组织信息以及面包屑导航对提升搜索结果的展示效果最为显著。

审计中的警示信号

  • 缺少 og:image 将链接分享至 Slack 或 Discord 时,链接会显得很单薄。
  • 标题长度超过 60 个字符。 在谷歌搜索结果中会被截断。
  • 描述长度超过160个字符。 在Google摘要中会被截断。
  • 缺少规范标签(canonical)。 /page/page/ 之间存在重复内容,可能导致排名混淆。
  • og:imagetwitter:image 均缺失。 无法显示社交预览卡。
  • noindex”出现在本应排名的页面上。这种情况在未移除该标签的情况下上线的测试服务器上屡见不鲜。

调试工作流程

  1. 首先提取页面的URL。
  2. 部署完成后,请核对实时URL。
  3. 更改设置后,请清理Facebook的爬虫缓存(共享调试器)和Twitter的卡片验证器,这些组件存在过度缓存现象。
  4. 在无痕窗口中进行测试,以确认登录状态下的Cookie是否显示不同内容。

常见问题

部分如此。该提取器会获取服务器渲染的HTML内容。如果您的元标签是通过客户端JavaScript(不支持SSR的SPA框架)注入的,则这些标签不会显示出来,这正是Google在首次抓取时未执行JavaScript的情况下对页面的呈现方式。

常见原因:网址需通过登录页面访问、图片尺寸过小(< 200×200像素),或Facebook缓存了旧版本。请在共享调试器中清除缓存后重试。

该功能适用于特定内容类型(文章、产品、食谱、常见问题解答、面包屑导航),因为谷歌会利用它生成丰富的搜索结果;而通用营销页面则无需使用。当内容类型具有对应的丰富结果格式时,请添加相关数据模式。

<link rel="canonical">用于告知搜索引擎应索引页面的哪个版本;og:url则用于告知社交平台该分享链接对应的网址。这两个参数通常相同,但并非必须一致。

通过服务器端获取器,由于 CORS 限制,您的浏览器无法访问任意外部URL。该获取器使用通用用户代理且不进行身份验证。

相关工具

此工具还提供其他语言版本