元数据提取器
输入一个URL后,提取器将获取该页面内容,解析<head>字段,并整理出影响链接在其他平台显示效果的所有关键信息:SEO标题与元描述、规范URL、Facebook和LinkedIn用于链接预览的Open Graph标签、Twitter卡片标签、网站图标及应用图标、 JSON-LD结构化数据(Schema.org格式,包括文章、产品、常见问题解答)。这些信息对SEO审计、链接预览调试以及验证新发布页面实际向爬虫暴露的内容非常有用。
如何提取元数据
-
1
输入网址
包含协议的完整URL。该工具仅执行一次重定向。
-
2
该页面已从服务器端获取
原始HTML已解析;使用JavaScript渲染的页面可能不会暴露客户端元数据。
-
3
按标准分组的章节
搜索引擎优化(SEO)、开放图谱、Twitter、Schema.org、图标、移动端、PWA。
-
4
每个条目均显示其值和长度。
标题和描述若超出谷歌或推特的字数限制,将会收到长度警告。
-
5
预览链接卡
根据提取的标签生成模拟版的Facebook/LinkedIn/Twitter分享卡片。
<head>中有哪些关键成分?
核心SEO
| 标签 | 目的 |
|---|---|
<title> |
浏览器标签页,谷歌搜索结果标题 |
<meta name="description"> |
Google搜索结果片段(备用版本) |
<link rel="canonical"> |
标准URL,重复内容信号 |
<meta name="robots"> |
索引/无索引规则,遵循/不遵循规则 |
<meta name="viewport"> |
移动视口 |
开放图谱(Facebook、LinkedIn、Discord、Slack)
| 标签 | 目的 |
|---|---|
og:title |
共享卡名称 |
og:description |
共享卡描述 |
og:image |
共享卡片图像(推荐尺寸:1200×630 像素) |
og:type |
website / article / video.other |
og:url |
用于分享的规范网址 |
og:site_name |
卡片上显示的网站名称 |
推特卡片
| 标签 | 目的 |
|---|---|
twitter:card |
summary / summary_large_image |
twitter:title |
退回到 og:title |
twitter:description |
退回到 og:description |
twitter:image |
大尺寸图像卡 |
twitter:site / twitter:creator |
出版商/作者信息 |
Schema.org(JSON-LD)
<script type="application/ld+json">
{
"@context": "https://schema.org",
"@type": "Article",
"headline": "...",
"author": { "@type": "Person", "name": "..." },
"datePublished": "2026-04-18"
}
</script>
文章、产品、食谱、常见问题解答、活动、组织信息以及面包屑导航对提升搜索结果的展示效果最为显著。
审计中的警示信号
- 缺少
og:image。 将链接分享至 Slack 或 Discord 时,链接会显得很单薄。 - 标题长度超过 60 个字符。 在谷歌搜索结果中会被截断。
- 描述长度超过160个字符。 在Google摘要中会被截断。
- 缺少规范标签(canonical)。
/page与/page/之间存在重复内容,可能导致排名混淆。 og:image和twitter:image均缺失。 无法显示社交预览卡。- “
noindex”出现在本应排名的页面上。这种情况在未移除该标签的情况下上线的测试服务器上屡见不鲜。
调试工作流程
- 首先提取页面的URL。
- 部署完成后,请核对实时URL。
- 更改设置后,请清理Facebook的爬虫缓存(共享调试器)和Twitter的卡片验证器,这些组件存在过度缓存现象。
- 在无痕窗口中进行测试,以确认登录状态下的Cookie是否显示不同内容。
常见问题
部分如此。该提取器会获取服务器渲染的HTML内容。如果您的元标签是通过客户端JavaScript(不支持SSR的SPA框架)注入的,则这些标签不会显示出来,这正是Google在首次抓取时未执行JavaScript的情况下对页面的呈现方式。
常见原因:网址需通过登录页面访问、图片尺寸过小(< 200×200像素),或Facebook缓存了旧版本。请在共享调试器中清除缓存后重试。
该功能适用于特定内容类型(文章、产品、食谱、常见问题解答、面包屑导航),因为谷歌会利用它生成丰富的搜索结果;而通用营销页面则无需使用。当内容类型具有对应的丰富结果格式时,请添加相关数据模式。
<link rel="canonical">用于告知搜索引擎应索引页面的哪个版本;og:url则用于告知社交平台该分享链接对应的网址。这两个参数通常相同,但并非必须一致。
通过服务器端获取器,由于 CORS 限制,您的浏览器无法访问任意外部URL。该获取器使用通用用户代理且不进行身份验证。
相关工具
坏链检查器
粘贴页面 URL,检查其出站链接中的 404 和其他 HTTP 错误,并显示每个链接的状态码。
HTTP安全头检查器
粘贴 HTTP 响应标头,在浏览器本地检查 HSTS、CSP、点击劫持、MIME、referrer 和跨源策略。
XML 站点地图检查器
在浏览器中检查站点地图 XML,发现解析错误、缺少地址、重复 URL 以及常用站点地图字段值问题。
元描述长度检查器
测量元描述的字符数和估算像素宽度,对照编辑参考,并查看桌面端与移动端版式示意。
规范URL验证器
粘贴页面的 HTML 并检查其 rel=canonical 标签:是否存在、是否为有效的绝对 URL、是否与页面 URL 一致。
外部链接提取器
粘贴原始HTML,可选设置基础URL,即可获得代码中所有外部 http/https 链接的干净、去重列表,用于链接审计和SEO审查。
此工具还提供其他语言版本
- Extractor de Metadatos [ES]
- Extracteur de métadonnées [FR]
- メタデータ抽出ツール [JA]
- Extrator de Metadados [PT]
- Metadata-extraktor [SV]
- เครื่องมือสำหรับดึงข้อมูลเมตาดาต้า (Metadata Extractor) [TH]
- Công cụ trích xuất siêu dữ liệu [VI]
- أداة استخراج البيانات الوصفية (Metadata Extractor) [AR]
- Metadaten-Extraktor [DE]
- 메타데이터 추출기 [KO]
- Ekstraktor Metadata [ID]
- Metagegevensextracteur [NL]
- Ekstraktor metadanych [PL]
- Инструмент для извлечения метаданных [RU]
- Meta Veri Çıkarma Aracı [TR]
- Metadata Extractor [EN]
- Estrazione Metadati [IT]