claude-seo 多语言站点内容对等性Content Parity审计完整指南矩阵、新鲜度与评分方法【免费下载链接】claude-seoUniversal SEO skill for Claude Code. 25 sub-skills 18 sub-agents covering technical SEO, E-E-A-T, schema, GEO/AEO, backlinks, local SEO, maps intelligence, semantic clustering, e-commerce SEO, international SEO, Google APIs, and PDF/Excel reporting. Optional DataForSEO, Firecrawl, and Banana extensions.项目地址: https://gitcode.com/gh_mirrors/cl/claude-seo内容对等性Content Parity审计用于确保一个站点的所有语言版本提供等价的价值与 SEO 信号——不仅页面存在还要在结构、信息量、Schema、文化与时效性上保持一致。本文以 claude-seo 项目中seo-hreflang子技能的内容对等性参考文档为核心完整讲解其对等性矩阵、新鲜度阈值、字数比例、文化适配关卡与百分制评分方法并结合仓库源码说明这套方法在/seo hreflang audit命令中的实际落地路径。读完本文你将能独立对一个多语言站点或本地内容目录执行可量化、可复现、可排优先级的对等性审计并输出跨语言矩阵报告。背景为什么 hreflang 正确还不够在 claude-seo 的seo-hreflang子技能中skills/seo-hreflang/SKILL.md负责 hreflang 标签的校验与生成但 hreflang 只解决了搜索引擎知道哪个页面是哪个语言的对应版本这一层问题。它无法回答更关键的业务问题德文版是否真的提供了和英文版等价的深度日文版是否只是机器翻译的空壳英文版更新后法文版是否还停留在三个月前的内容这正是内容对等性Content Parity审计要解决的层面。skills/seo-hreflang/references/content-parity.md本文核心文档原始概念来自 Chris Muller 的 Pro Hub Challenge定义了一整套量化方法对存在于多个语言版本的每一个页面从页面存在性、章节结构、FAQ、图片、图表、字数、Schema、标题、Meta 描述九个维度逐项比对并结合内容新鲜度、文化适配和加权评分最终输出每个页面的对等性得分与行动优先级。在 claude-seo 中该参考文档由seo-hreflang技能按需加载Load this reference when auditing content parity across language versions of a site驱动/seo hreflang audit directory-or-url命令执行审计。内容对等性矩阵九大比对维度对于每个存在于多种语言的页面需要逐一检查以下维度。注意可接受偏差并非宽松标准而是明确了哪些维度零容忍、哪些维度允许少量波动维度比对内容可接受偏差失败严重度页面存在性所有声明支持的语言是否都存在对应页面0% —— 所有已声明语言必须有此页面高High章节结构H2/H3 章节数量是否一致允许 ±1 个章节中MediumFAQ 条目FAQ 问题数量是否一致允许 ±2 个条目中Medium图片图片数量一致且 alt 文本已本地化必须完全一致中Medium图表/SVG图表在所有语言版本中是否都存在必须完全一致低Low字数与语言扩展比是否成比例期望比例的 ±30% 以内低LowSchema 标记JSON-LD 是否在所有版本中存在并已本地化类型与关键属性必须一致高High标题标签是否已用目标语言本地化并包含当地关键词必须本地化不得残留英文高HighMeta 描述是否已本地化且符合字符数限制必须本地化中Medium如何解读这张矩阵零容忍维度高严重度页面存在性、Schema 标记、标题标签。这三项直接影响搜索引擎对语言版本的识别与展示。例如一个页面缺少德文版等于在hreflang集合中留下空洞导致 Google 无法确认de用户应该被指向哪里JSON-LD 中的name、description、inLanguage若仍是英文既削弱本地相关性也会被后续的机器翻译质量检查标记见skills/seo-hreflang/references/machine-translation-qa.md中对inLanguage字段缺失或错误的 Medium 级告警。结构维度中严重度章节数与 FAQ 条目允许小幅偏差±1 / ±2是因为翻译过程中局部合并或拆分章节是合理编辑行为但若偏差过大例如英文版有 8 个 H2、日文版只有 2 个则几乎可以断定内容被大幅删减。资源维度中/低严重度图片数量必须完全一致每张图都应有本地化 alt图表必须逐版本对应。这里有一个反直觉的要点图表、截图这类视觉内容经常在翻译中被整块丢弃而它们恰恰是 E-E-A-T 信号的重要载体。字数维度低严重度见下文字数比例校验它是唯一一个允许按语言特性放大或收缩的维度。新鲜度追踪检测陈旧翻译对等性审计不能只看有没有内容还要看内容是否跟上了源语言的更新。content-parity.md给出了三种检测陈旧翻译stale translation的手段文件修改时间戳对比若英文版在德文版之后更新德文版很可能已陈旧Frontmatter 日期对比跨语言版本比较date_modified或lastmod字段对使用 Hugo、Jekyll、Astro 等静态站生成器的站点尤其适用内容哈希对比若源语言内容哈希在上次翻译之后发生了变化则目标语言版本需要重新翻译。检测到源语言更新时间后按时间差划分四个档位状态距源语言更新的天数处理建议Fresh新鲜≤ 7 天无需处理OKAging老化8–30 天低优先级更新Stale陈旧31–90 天中优先级更新Outdated过时90 天以上高优先级更新在实施层面本地目录审计可以借助 Git 的提交历史或文件系统 mtime 来自动化这一检查而针对线上站点则需依赖页面中的lastmod/dateModified元数据。无论哪种方式新鲜度本质上是一个相对指标——必须以源语言版本的更新时间作为参照系单独的翻译时间戳没有意义。字数比例校验用扩展比识别缩水与注水不同语言表达同一信息所需的字数天然不同德语、法语等欧洲语言普遍比英文更长而日文、中文等 CJK 语言更紧凑。content-parity.md提供了一张以英文为基准的期望比例表目标语言期望比例可接受范围德语DE1.25–1.35x1.10–1.50x法语FR1.15–1.25x1.00–1.40x西班牙语ES1.15–1.25x1.00–1.40x日语JA0.75–0.90x0.60–1.00x中文ZH0.70–0.80x0.55–0.95x该表格附带了两个极具实战价值的判定规则比英文原文更短的德文翻译几乎必然缺内容——德语正常会膨胀 25–35%若反而变短说明有段落被删除比英文更长的日文翻译几乎必然有冗余填充——日语正常会收缩 10–25%若反而变长通常是机翻同义反复或未删减的注释性内容。更完整的语言扩展比可参见同一技能下的skills/seo-hreflang/references/locale-formats.md德语 25–35%、法语/西语/意语/葡语 15–25%、荷兰语 10–20%、日语 −10–25%、韩语 −10–20%、中文 −20–30%。这套比例不仅用于对等性校验还直接指导排版预算——德语版需要为更长的标题和按钮文字预留空间。文化适配质量关卡超越直译的本地化检查对等性不只是字数与结构还要求内容真正本地化而非直译。content-parity.md定义了六个文化标记检查项检查项查找内容严重度外国品牌引用非美国页面上出现美国特有品牌如 de-DE 页面的 Walmart中Medium外国统计数据本地化页面上引用仅美国有效的数据如 80% of Americans中MediumCTA 攻击性正式文化页面上出现激进的 CTA如 ja-JP 页面的 BUY NOW!低Low法律引用引用错误司法辖区的法律如 de-DE 页面引用 CCPA 而非 DSGVO高High货币/单位不匹配EUR 页面标 USD 价格、公制页面出现英制单位高High未翻译元素导航、按钮、alt 文本、Schema 中残留英文中Medium其中法律引用错误与货币/单位不匹配被列为最高严重度——它们不只是体验问题而是合规风险引用错误的隐私法可能误导用户并触碰监管红线。要执行上述文化适配检查需要具体市场的文化基准。seo-hreflang技能为此提供了预置画像文件skills/seo-hreflang/references/cultural-profiles.md覆盖 DACH德语区、法语区、西语区与日本四大市场。以 DACH 画像为例正式度高必须使用 Sie 敬称CTA 风格倾向间接表达Jetzt entdecken去发现优于Jetzt kaufen去买信任信号TUV/ISO 认证、Datenschutz隐私声明、法律强制的 Impressum版权页法律Impressum 页强制、DSGVOGDPR、Widerrufsrecht撤销权数字/日期1.000,00千位点、小数逗号、DD.MM.YYYY货币EURDE/AT、CHFCH品牌替换示例Walmart → MediaMarkt、Home Depot → Hornbach、Amazon → Otto/Zalando字数膨胀相对英文 25–35%。日文画像则强调敬语Keigo、委婉 CTAOtoiawase 即咨询而非直接立即购买、APPI 个人信息保护法与特定商取引法、¥符号前置且无小数、字数收缩 −10–25% 等。对于未列入画像的语言cultural-profiles.md提供了 Default Profile 检查清单正式语域研究、RTL/LTR 文字方向、CLDR 数字日期格式、当地法律要求、扩展比、支付偏好、颜色语义并明确要求审计时对无预置画像的语言注明基于通用准则而非预置画像。对等性评分100 分制的加权计算将上述所有维度汇总为一个可比较的数字content-parity.md定义了加权评分满分 100评分维度分值页面存在性对等30 分SEO 元素对等标题、Meta、Schema30 分内容结构对等章节、图片、FAQ25 分新鲜度对等15 分分数解读分数区间判定90–100所有语言版本对等性优秀70–89对等性良好存在少量待修复缺口50–69对等性问题显著影响部分语言版本 50重大对等性失败需立即处理这一加权结构本身传递了优先级信息存在性与 SEO 元素合计占 60 分意味着页面不存在或标题/Meta/Schema 未本地化比字数偏差或图表缺失严重得多而新鲜度占 15 分保证内容更新节奏也被纳入考核避免出现结构完整但半年未更新的陈旧版本获得高分。输出格式跨语言矩阵报告审计结果以矩阵表形式呈现content-parity.md给出了标准模板| Page | EN | DE | FR | ES | JA | Parity Score | |------|----|----|----|----|----| -------------| | /about | ✅ | ✅ | ✅ | ❌ | ✅ | 80/100 | | /pricing | ✅ | ✅ | ⚠️ | ❌ | ❌ | 45/100 |其中✅表示对等、⚠️表示存在偏差、❌表示缺失或失败。这样的矩阵在同一张表中同时暴露两个层面的信息按行看每个页面的跨语言完整度/pricing的西语、日语版本缺失导致 45 分按列看每种语言的整体覆盖水平哪门语言被维护得最差。结合百分制分数报告可以直接转化为行动清单低于 50 分的页面立即修复50–69 分的排入下一迭代70 分以上仅需修补细节。在 claude-seo 中的落地/seo hreflang audit这套方法并非孤立的理论文档而是seo-hreflang子技能工作流的一环。在skills/seo-hreflang/SKILL.md中内容对等性审计被定义为一个独立命令Command:/seo hreflang audit directory-or-url该命令对站点或本地内容目录执行跨语言对等性审计明确检查以下内容所有已声明语言的页面存在性章节结构等价性H2/H3 数量SEO 元素对等性标题、Meta、Schema 本地化字数比例校验DE 应比 EN 长 25–35%JA 应短 10–25%新鲜度追踪通过时间戳检测陈旧翻译文化标记扫描外国品牌、错误法律引用、未翻译元素。输出为带每页分数的对等性矩阵表与优先处理动作项。该技能还遵循按需加载参考文件、不在启动时全量加载的设计原则Load references/cultural-profiles.md、references/locale-formats.md、references/content-parity.mdas needed并由skills/seo-hreflang/SKILL.md的错误处理表约束审计行为例如内容目录为空时报告无内容文件、建议核对路径或改用 URL 分析线上站点而不是猜测站点结构。源码级支撑矩阵数据从哪来对等性矩阵的多数维度需要页面级结构化数据H2/H3 数量、图片与 alt、hreflang 集合、标题、Meta、字数。在 claude-seo 仓库中这些数据由 scripts/parse_html.py 提供。该脚本解析页面时维护的结果结构中直接包含矩阵所需的字段h2/h3章节标题列表对应章节结构维度见 scripts/parse_html.pyimages每张图的src、alt、width、height、loading对应图片数量与 alt 本地化维度见 scripts/parse_html.pyhreflang从link relalternate hreflang...提取的语言与目标 URL 对对应页面存在性维度的 hreflang 集合识别见 scripts/parse_html.pyword_count页内字数对应字数比例校验维度见 scripts/parse_html.pytitle/meta_description/schema/canonical对应标题标签 / Meta 描述 / Schema 标记维度。也就是说对本地目录执行审计时Agent 可以对每个语言版本分别运行该类解析逻辑再按content-parity.md的矩阵逐字段对齐比对。对于线上站点claude-seo 还提供scripts/fetch_page.py完成带 SSRF 保护的页面抓取scripts/render_page.py则被 hreflang 等技能复用以处理需要渲染的页面其模块注释明确列出geo, local, ecommerce, hreflang, images均调用该模块。机器翻译质量与 QRG 的衔接seo-hreflang技能将内容对等性审计与 2025 年 1 月 Google 质量评估指南QRG的更新关联起来。skills/seo-hreflang/references/machine-translation-qa.md指出未经人工审校的机器翻译内容被 QRG §4.6.5 列为规模化内容滥用scaled content abuse。该参考文档定义了审计应当浮出水面的信号例如多个 hreflang alternate 指向正文除页头外壳外完全相同的内容Critical说明只有模板包装、正文未翻译、html lang与正文语言不匹配High、自动翻译的 meta description 超过 160 字符未截断Medium、Schema 的inLanguage缺失或错误Medium等——这些信号与content-parity.md的章节结构偏差过大 / 未翻译元素残留 / Schema 未本地化等检查项互为印证。同时它划定了不应误报的边界明确标注为 MT 的人工翻译兜底模式、机器翻译的 UI 字符串属于 i18n 而非内容都不应被标记。仓库测试 tests/test_gbp_lint_and_polish.py 对该参考文档的存在性与关键内容做了断言确保审计能力随时间演进不退化。跨技能协作对规模化内容的更深层评分翻译页面的信息熵、正文中的 AI 痕迹检测machine-translation-qa.md明确建议委派给seo-content技能通过python3 scripts/content_quality.py执行Google 自动翻译 widget 的检测则依赖.goog-te-banner-frameiframe 特征。agents/seo-technical.md也在技术审计代理中约定详细的 hreflang 校验委派给 seo-hreflang 子技能形成职责清晰的代理协作链路。实战执行清单将本文方法落地为一个可复现的审计流程建议按以下顺序执行确定语言集合从站点结构子目录、子域名、ccTLD或hreflang标签中枚举所有已声明语言构建页面映射为每个页面找到其在所有语言中的对应版本缺失的即计入页面存在性失分逐页面提取结构化数据对每个语言版本抓取/解析页面得到 H2/H3、图片与 alt、FAQ、Schema、标题、Meta、字数可复用 scripts/parse_html.py 的数据结构逐维度比对按九维矩阵计算各维度偏差特别注意零容忍维度存在性、标题本地化、Schema 本地化新鲜度追踪比较源语言与各翻译版本的lastmod/date_modified/文件时间戳套用 7/30/90 天阈值分级字数比例校验以英文为基准用 DE 1.25–1.35x、FR/ES 1.15–1.25x、JA 0.75–0.90x、ZH 0.70–0.80x 判定缩水或注水文化适配检查加载 skills/seo-hreflang/references/cultural-profiles.md 中的对应画像检查 CTA 风格、法律引用、货币/单位、品牌引用格式一致性核对参考 skills/seo-hreflang/references/locale-formats.md加权评分按 30/30/25/15 计算每页对等性得分输出跨语言矩阵报告生成行动项按分数区间排序50 立即处理、50–69 排入迭代、70–89 修补细节并结合 skills/seo-hreflang/references/machine-translation-qa.md 的信号优先处理疑似未审校机翻的高危页面。小结内容对等性审计回答的是国际 SEO 中hreflang 之外的最后一公里问题语言版本是否在价值、结构、文化适配与时效性上真正等价。claude-seo 通过skills/seo-hreflang/references/content-parity.md提供了完整的九维矩阵、四级新鲜度阈值、语言字数比例、六大文化关卡与 100 分制加权评分并通过seo-hreflang子技能的/seo hreflang audit命令与 scripts/parse_html.py 的页面解析能力将其工程化。这套方法既能用于线上站点审计也能对本地内容目录如静态站生成器源码直接执行是维护多语言站点内容健康度、避免机翻空壳损害站点信任度的可量化工具。【免费下载链接】claude-seoUniversal SEO skill for Claude Code. 25 sub-skills 18 sub-agents covering technical SEO, E-E-A-T, schema, GEO/AEO, backlinks, local SEO, maps intelligence, semantic clustering, e-commerce SEO, international SEO, Google APIs, and PDF/Excel reporting. Optional DataForSEO, Firecrawl, and Banana extensions.项目地址: https://gitcode.com/gh_mirrors/cl/claude-seo创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考