先给结论:链接数量不是问题,证据覆盖和来源集中度才是
我们以 2026 年 8 月 24 日发布前的 main 提交 f7f53e94ae225367fc753c4ebed535d16e05354c 为固定样本,检查 sitemap 中 25 篇文章正文里的外部链接。共识别到 68 次外部链接引用,去重后是 60 个 URL、16 个主机名;13 篇文章包含外部来源,12 篇没有外部来源。60 个唯一 URL 全部使用 HTTPS,也没有出现“点击这里”“了解更多”这类无法说明目标内容的通用锚文本。
这组结果不能简单解释成“有外链的文章更好”。趋势、平台能力、结构化数据规则和抓取规范,需要一手资料支撑;品牌自测教程、站内方法框架和基于本站文件得到的实测结果,可以由测试记录、页面事实和可复算方法构成证据。真正需要关注的是两点:第一,自动检查仍有 2 个百度资料页无法确认公开内容,不能把它们写成已经失效;第二,Google 官方域名贡献了 25 个唯一来源,占 41.7%,前三组来源机构合计占 68.3%,证据结构明显集中。
一、这次实测到底检查什么
这里的“外部证据链接”有明确边界。我们只统计文章正文区域内、指向 geoc.ai 以外网站的 HTTP 或 HTTPS 链接,不统计导航、页脚、微信二维码、站内相关阅读、canonical、Open Graph、结构化数据里的 URL,也不把邮箱地址算作来源。这样得到的数字回答的是“作者在正文中让读者能够继续核验哪些外部资料”,而不是整张页面发出了多少网络请求。
每个链接记录四项信息:所在文章、目标 URL、锚文本、主机名。随后对 HTML 实体进行还原,按完整 URL 去重,再把主机名归入发布机构。比如 developers.google.com、blog.google 与 support.google.com 都归入 Google;openai.com 与 help.openai.com 归入 OpenAI;developers.cloudflare.com 与 blog.cloudflare.com 归入 Cloudflare。GitHub Actions 运行页被单独视为本站自有的原始操作记录,不等同于 GitHub 对文章结论的第三方背书。
链接可访问性在 2026 年 8 月 24 日重新观察。公共网页检查器能读取正文时,记为“公开检查可确认”;发生跳转时记录目标;公共检查器无法读取时,再根据可用的一手连接器核验对象是否存在。无法确认不等于 404,存在也不等于页面内容仍然支持文章里的具体结论。本文因此把“URL 存在”“内容可读取”“论据支持结论”严格分开。
二、测试样本与复算方法
样本来自固定提交,而不是不断变化的线上首页。我们先读取 public/sitemap.xml,取出 basics、tests、methodology 三个文章目录下的详情页,排除三个分类首页,得到 25 个文章 URL;再读取这些页面在同一提交中的 HTML。固定提交的意义是:任何人以后复算时,即使网站已经新增文章,也能知道本文的数字对应哪个版本。
| 检查层 | 口径 | 本次结果 |
|---|---|---|
| 文章范围 | sitemap 中的文章详情页 | 25 篇 |
| 链接范围 | 文章正文中的站外 HTTP(S) 链接 | 68 次 |
| 去重口径 | 完整 URL 完全一致 | 60 个唯一 URL |
| 传输协议 | 检查是否仍使用 HTTP | 60/60 为 HTTPS |
| 锚文本 | 精确匹配通用词黑名单 | 0 个通用锚文本 |
| 页面覆盖 | 至少出现一个正文外部链接 | 13 篇有、12 篇无 |
锚文本检查使用的是保守规则:把“这里”“点击这里”“查看详情”“了解更多”“来源”“官方文档”“参考资料”“官网”等单独出现的词视为通用锚文本。结果为零,说明链接文字至少能指出具体机构、规则或页面主题。但这不代表所有锚文本已经完美,也不代表机器只凭锚文本就能判断引文关系;它只是排除了最明显的无语义链接。
三、68 次引用为什么只对应 60 个 URL
重复引用不一定是冗余。共有 6 个 URL 被两篇或三篇文章重复使用,合计出现 14 次;其余 54 个 URL 各出现一次。重复最多的两项分别是 Google 的 AI 搜索页面说明和 OpenAI 的发布者 FAQ,各被 3 篇文章引用。它们重复出现,是因为不同文章分别讨论来源链接、站点可读性、个性化搜索、引用指标、错误纠正和爬虫治理,而这些官方说明确实承担多个主题的共同基础。
其余重复来源包括 Google 生成式 AI 内容指南、Google 结构化数据通用规范、Google Organization 结构化数据规范,以及 Cloudflare 的 AI 爬虫管理文档。每个都出现 2 次。从引用网络看,这些页面是站内多篇文章共享的“基础规范节点”。如果这些页面修改路径或改变表述,影响的不是一篇文章,而是一组相关内容。
因此,去重后的 60 个 URL 适合衡量来源广度,68 次引用适合衡量维护工作量。做定期检查时不能只保留 URL 清单,还要记录“哪些文章使用了它”。同一个来源失效时,维护者需要知道所有受影响页面;同一个来源更新时,也不能默认每篇文章都需要同样修改,因为它们引用的可能是不同段落和不同事实。
四、来源都很官方,但这不等于证据已经多元
按发布机构归类,60 个唯一 URL 都来自平台官方页面、官方开发文档、开放标准组织或本站自有操作日志,没有把聚合转载、营销软文和无法识别出处的页面当作规则依据。Google 相关域名有 25 个,OpenAI 有 9 个,Cloudflare 有 7 个;三组相加是 41 个,占全部唯一 URL 的 68.3%。Schema.org 有 5 个,Bing 有 4 个,GitHub 有 4 个,百度有 3 个,Anthropic/Claude 有 2 个,IndexNow 有 1 个。
“一手”解决的是来源身份问题,不自动解决视角集中问题。Google 文档数量多,一方面是因为站内已有多篇文章讨论搜索、结构化数据、网站抓取和 AI Mode,Google 的公开资料确实更完整;另一方面也说明现有证据对 Google 生态依赖较高。对中国企业而言,只用 Google 资料推导豆包、DeepSeek、Kimi 或百度的具体行为是不成立的。文章可以借 Google 文档解释开放网页的一般机制,却必须明确哪些结论只适用于 Google 产品。
平台官方资料也有自己的边界。产品公告擅长说明“平台宣布了什么”,不等于第三方已经验证实际覆盖;开发文档擅长说明允许的标记与抓取规则,不等于页面一定被收录、引用或推荐;本站 GitHub Actions 日志能证明某次工作流怎样执行,不等于百度已经建立索引。证据层级清楚,比来源看起来“权威”更重要。
五、不同来源机构实际承担了什么证据责任
| 来源组 | 唯一 URL | 主要承担的证据 | 不能推出的结论 |
|---|---|---|---|
| 25 | 搜索、结构化数据、抓取和产品更新 | 不能代表所有中国模型的行为 | |
| OpenAI | 9 | ChatGPT 产品、代理能力和发布者规则 | 不能证明其他平台采用同样机制 |
| Cloudflare | 7 | 边缘改写、缓存与 AI 爬虫管理 | 不能证明源站或模型已经引用页面 |
| Schema.org | 5 | 通用词汇与属性定义 | 不能保证搜索产品展示增强结果 |
| Bing | 4 | Copilot Search、站长工具和 URL 检查 | 不能把引用次数解释成排名 |
| GitHub | 4 | Git 数据接口和本站工作流原始记录 | 私有日志不能自动成为公开证据 |
| 百度 | 3 | 普通收录与资源平台说明 | 提交成功不等于建立索引 |
| Anthropic/Claude | 2 | Claude 爬虫角色与站点控制 | 不能代表全部代理访问 |
| IndexNow | 1 | 变更通知协议 | 通知不等于抓取、索引或引用 |
这张表比“官方来源占比”更重要,因为它把每组来源的证据责任限定下来。官方文档经常只说明产品允许什么、怎样配置或当前公布了什么;一篇文章如果把它扩写成“所有模型都会这样做”或“完成配置后一定有效”,错误发生在推理环节,而不是链接环节。审计来源时必须同时保留“支持什么”和“不能支持什么”两列。
机构数量也不能直接当作多元性指标。Google 的开发文档、产品博客和帮助中心属于不同主机名,却仍由同一机构发布;Anthropic 旧帮助中心和 Claude 新帮助中心是同一文档的域名迁移;GitHub Docs 与本站私有 Actions 日志同在 GitHub 域名,但一个是平台技术规范,一个是用户仓库产生的操作证据。只按域名计数,会把组织多样性高估,也会把证据类型混在一起。
反过来,同一家机构可以为不同命题提供足够的一手资料。讨论 Google 结构化数据要求时,没有必要为了追求“至少三个来源”再找两篇转述文章。来源多元性只在结论跨平台、涉及实际效果或包含争议判断时更关键。对单一产品规则,准确引用负责该规则的官方页面,通常比堆叠多个二手来源更可靠。
读者可以从四类代表性原始页面复核本文所说的来源身份与规则边界:Google 的 AI 搜索与网站说明、OpenAI 发布者与开发者 FAQ、Cloudflare AI 爬虫管理文档和Claude 爬虫官方说明。它们只是 60 个唯一来源中的代表,不用于把各平台机制合并成同一套规则。
六、12 篇没有外部链接,应该全部补上吗
答案是否定的。没有外部链接首先是一个观察,不是缺陷判定。这 12 篇包含基础 FAQ、自测教程、站内方法框架、早期模型提问记录和基于本站文件完成的内链审计。像“怎样自己测试品牌回答”这类文章,核心证据是步骤能否执行、记录字段是否完整;像“19 篇文章的站内引用网络”这类实测,核心证据是固定提交、文件清单和可复算规则。硬塞一个不直接支持结论的官方链接,反而会让读者误以为外部机构为本站方法背书。
但“无需外链”也不能成为逃避证据的借口。只要文章写到当前平台功能、具体抓取规则、结构化数据字段要求、产品发布日期、平台覆盖范围或官方政策,就应给读者可以核验的一手入口。文章声称“我们观察到某模型这样回答”时,至少需要说明模型、日期、提问条件和样本边界;如果不能公开原始记录,应明确证据无法公开,而不是用一篇泛泛的官方公告代替。
更合理的判断问题不是“每篇文章有没有三条外链”,而是“标题所依赖的每一项可争议事实,是否有与它匹配的证据”。定义、规范和平台能力通常适合外部一手来源;品牌自己的价格、服务范围和产品状态适合品牌权威页;模型回答实测适合原始问题、完整回答和测试条件;站内技术审计适合固定提交、文件路径和复算方法。
七、可访问性检查发现了什么
60 个唯一 URL 中,公共网页检查器在本次观察时能够读取 56 个。另有 2 个 GitHub Actions 运行页因为属于私有仓库,公共网页检查器不能读取,但通过已授权的 GitHub 连接确认对象存在:一个运行结果为成功,另一个运行结果为失败,它们正是百度推送复盘文章所讨论的两次不同状态。私有可核验与公开可核验必须分开写,不能因为作者能访问,就声称所有读者都能打开。
剩余 2 个百度搜索资源平台资料页在公共检查中没有返回可读取内容。本次没有观察到明确的 404 页面,也没有足够证据证明它们仍正常公开,因此结论只能是“未确认”。这类链接应进入人工复核队列:先用正常浏览器确认是否需要登录、是否由脚本渲染、是否迁移到新地址,再决定保留、替换或移除。直接把检查器失败写成“死链”,会制造新的错误。
此外有 1 个 Anthropic 帮助中心旧域名自动跳转到 Claude 帮助中心的新域名。内容仍能读取,但旧地址增加了一次重定向,也让同一文档在统计中被算成两个 URL。我们在本次发布中把旧文章的链接更新为最终地址,并保留文章原来的测试结论。这是链接审计最适合立即修复的一类问题:事实关系明确、替换风险低、结果可复核。
链接检查失败不能直接等同于死链;私有页面、登录要求、脚本渲染、客户端限制和临时网络问题都会让自动工具无法读取。可靠审计至少要区分“确认可读”“确认存在但不公开”“发生跳转”“暂未确认”和“明确失效”。
八、为什么不能只报告“有效率”
如果把公共检查器能读取的 56 个 URL 除以 60,可以得到一个数字,但这个数字会混合不同性质的情况:私有 GitHub 日志本来就不面向匿名用户,百度资料页只是工具未确认,Anthropic 旧地址虽然跳转却仍能到达内容。把它们全部塞进“成功/失败”二元表格,看起来简洁,实际上会误导维护决策。
更实用的是状态矩阵。确认可读的链接继续保留,并记录观察日期;发生永久跳转的链接优先改成最终地址;确认存在但权限受限的来源,需要在正文中标明访问边界,并考虑补充可公开复核的摘要或截图;暂未确认的链接进入人工复核;只有拿到明确 404、410、域名失效或内容完全替换的证据,才标记为失效。链接恢复后也不要抹掉历史状态,保留检查日期才能解释前后差异。
同样,“有效”只说明地址层面可到达,不说明文章引用正确。页面可能仍然在线,却已经修改了关键段落;标题可能不变,产品能力已经更新;旧公告可能记录历史状态,不能支撑“现在仍然如此”。因此链接维护至少有三层:地址是否可达、内容是否仍是原页面、具体论据是否仍支持文章结论。
九、来源集中度怎样转化为维护优先级
Google 相关来源占 41.7%,并不意味着要机械减少 Google 链接。更好的做法是把集中度当作风险提示:凡是结论涉及多个平台,都检查是否错误地用 Google 规则代表整个行业;凡是针对中国平台的判断,都寻找相应平台的一手资料或明确写成本站观察;凡是平台没有公开规则的地方,都停止用类比填补事实空白。
维护顺序可以按“影响文章数 × 事实时效 × 来源稳定性”排序。被 3 篇文章引用的基础规范页,路径变化会影响多个页面,应优先监测;产品发布与退役信息时效高,即使只被一篇文章引用,也应定期复查;Schema.org 这类相对稳定的标准页变化慢,可以降低频率;私有日志不会因为公开网页检查失败就反复报警,但需要保证授权和证据留存。
还要避免另一种形式的集中:同一结论只引用同一家公司的产品公告和帮助中心,看似有两个 URL,实际上仍是单一来源。对“平台宣布了什么”,单一官方来源通常足够;对“市场是否普遍采用”“效果是否提升”“用户是否接受”,只有官方公告远远不够,需要独立数据、公开方法和可复算样本。
十、一套可以复用的外部证据链接审计流程
第一步固定版本。记录提交 SHA、文章清单生成方式和观察日期,避免今天查 25 篇、明天网站新增一篇后却继续沿用旧分母。第二步限定正文区域,排除导航、页脚、统计脚本和结构化数据,确保统计对象真的是读者可见的证据入口。第三步标准化 URL,解码 HTML 实体,保留查询参数,识别重定向与同一页面的多种写法。
第四步建立来源台账。至少记录文章 URL、来源 URL、锚文本、发布机构、支持的具体命题、公开或私有、最后确认日期和当前状态。第五步先做自动检查,再处理例外;不要对登录页、私有仓库和脚本页面无限重试。第六步回到语义层,确认来源内容仍支持紧邻它的结论,尤其检查“当前”“已经”“全部”“保证”等高风险词。
第七步按风险修复。明确跳转且目标一致时更新 URL;明确失效时寻找同机构的新页面,找不到就收缩或删除结论;来源存在但不公开时补充公开证据或写清边界;来源过度集中时检查跨平台泛化。第八步同步修改日期、feed 与 sitemap,并在修复后复查公开页面,保证仓库内容和线上版本一致。
十一、最常见的六种错误判断
第一,把外链数量当成文章质量。引用十个不相关页面,不如一个直接支持核心结论的一手来源。第二,把官方链接当成效果证明。官方文档能说明规则,不能证明品牌采用规则后一定被 AI 引用。第三,把检查器超时当成 404。工具失败只说明本次无法确认,除非拿到明确响应或页面状态。
第四,只检查 URL,不检查论据。在线页面可能已经更新,旧文章仍在引用过时含义。第五,为了让每篇文章看起来“有研究”,给自有方法和站内测试硬塞外部链接。第六,只在新文章发布时加来源,从不维护旧文;结果是内容越多,跳转、退役公告和政策变化积累得越快。
还有一个容易忽略的问题:锚文本虽然不是“点击这里”,却可能夸大来源。比如把官方页面链接在“平台保证收录”上,即使锚文本写得很具体,仍然是错误引用。锚文本检查只能发现结构问题,不能代替事实核对。
十二、适用于内容团队的判断框架
遇到一个待引用的结论,可以连续问四个问题。它是外部可验证事实,还是本站方法建议?如果是外部事实,谁对它拥有第一手信息?这个来源证明的是规则、历史事件、测试结果还是效果?读者在不相信我们的情况下,能否沿着链接复核同一命题?四个问题中任何一个答不上来,都说明引用关系还不完整。
平台能力和政策优先找平台官方文档;技术标准优先找标准组织;企业自身事实优先找企业权威页;跨平台比较需要分别找各平台资料;真实效果需要公开样本、方法与限制。媒体报道可以帮助理解背景,但不应替代可获得的一手材料。用户经验可以说明个案,却不能被包装成普遍规律。
这也解释了为什么本站 12 篇无外链文章不应一键判错。它们需要的是逐条命题审计,而不是链接数量补齐。对早期模型实测,优先补测试日期、模型和原始问题;对方法论,优先明确它是建议而非平台规则;对基础 FAQ,优先把承诺边界写清楚。只有出现外部事实时,才补对应来源。
外部证据链接发布检查清单
- 是否固定了文章样本、提交版本和观察日期。
- 是否只统计正文证据链接,排除了导航、页脚和机器元数据。
- 每个外部链接是否对应附近的一项具体命题。
- 平台能力、规则和产品状态是否优先引用一手公开资料。
- 是否区分官方规则、本站观察、第三方评价和效果数据。
- 是否检查 HTTP、跳转、权限限制与最终目标地址。
- 自动工具无法读取时,是否避免直接宣布“死链”。
- 锚文本是否说明机构或目标内容,而非“这里”“详情”。
- 是否检查同一来源影响了哪些文章,避免漏改。
- 来源是否过度集中,跨平台结论是否被单一平台规则代替。
- 修改旧链接后,是否同步 dateModified、feed 和 sitemap。
- 报告是否明确:链接可访问不等于结论正确,更不等于 AI 会采用。
十三、边界与局限
这次审计只读取显式的 HTML 链接,没有识别纯文本里未做成链接的书名、机构名、截图文字和附件内容;也没有判断图片是否保存了完整测试证据。主机名归类由我们按发布机构完成,同一机构可能使用更多未纳入的域名。60 个 URL 的公开状态只代表 2026 年 8 月 24 日这次观察,之后可能跳转、恢复或失效。
公共网页检查器能够读取页面,不等于从中国大陆所有网络环境都能稳定访问;连接器确认私有 GitHub 运行存在,也不代表普通读者有权限打开。对 2 个百度资料页,本次只能给出“未确认”,不能给出 404 结论。本文没有逐句重新证明 25 篇文章的所有论点,而是检查来源结构、链接状态和可维护性;事实一致性仍需结合正文语境人工复核。
最后,外部引用也不是生成式搜索的收录开关。清楚的一手来源、稳定 URL 和准确锚文本能帮助读者与机器理解证据关系,但是否抓取、索引、引用和怎样生成答案仍由具体平台决定。链接审计的价值是减少可以由网站自己控制的证据缺口,不是制造“加链接就会被推荐”的承诺。
在固定提交的 25 篇 GEOC 文章中,正文共有 68 次外部链接引用,对应 60 个唯一 HTTPS URL 和 16 个主机名;13 篇含外部来源,12 篇不含。Google 相关官方域名占唯一来源的 41.7%,Google、OpenAI、Cloudflare 三组来源合计占 68.3%。公共检查确认 56 个页面可读取,2 个私有 GitHub 运行由授权连接确认存在,另有 2 个百度资料页暂未确认,不能据此判定失效。
十四、下一步怎么做
本次最明确、风险最低的修复已经同步完成:把 Anthropic 帮助中心旧域名改为跳转后的 Claude 帮助中心地址,并在原有GEOC 官网 AI 可读性实测中补充这次证据链接审计入口。接下来应人工复核 2 个百度资料页,再为高时效文章建立“来源—命题—最后确认日期”台账,而不是批量给 12 篇无外链文章添加装饰性引用。
如果需要继续理解链接之外的证据关系,可以阅读GEO 证据链的来源分级与引用方法;如果准备检查本站文章之间是否存在孤岛和单向关系,可参考GEOC 文章站内引用网络实测。外部证据和站内关系解决的是两个不同问题:前者说明结论从哪里来,后者说明读者怎样继续理解。