先给结论:按使用结算值得关注,但现在更像市场实验,不是新的 GEO 收费标准

AI 搜索的内容交换正在出现一个重要变化:计量单位不再只盯着爬虫访问了多少次,也开始讨论内容是否真正进入一次查询结果、一次回答或一次代理任务。Cloudflare 在 2026 年 7 月公开提出,把 Pay Per Crawl 继续推进为 Pay Per Use,并与 Ceramic.ai、You.com 等参与方测试按查询、结果或特定内容使用付费的不同模式。这个方向试图解决一个长期矛盾:一次抓取可能被重复用于大量回答,也可能从未产生实际使用,仅按抓取次数收费难以对应内容创造的价值。

但“按使用”目前没有统一定义,更没有形成所有 AI 搜索平台都采用的结算网络。一次内容进入候选结果、出现在搜索结果、被摘要引用、支持最终答案、带来访问或促成业务结果,代表不同程度的使用。由谁判定、怎样去重、如何归因、内容方能看到哪些证据,都仍在实验。企业不应把新闻公告改写成“AI 引用已经可以变现”,也不应为了尚未确定的收益模型封锁所有公开内容。

对 GEO 更现实的启示是:价值衡量要从“有没有被抓”继续向后延伸。抓取说明机器到过,查询返回说明内容进入结果集,引用说明内容被展示为来源,引荐说明用户进入网站,转化才说明业务目标发生。五个环节彼此相关,却不能互相替代。按使用结算若逐步成熟,只会让这种分层更重要。

截至 2026 年 9 月 28 日,Cloudflare 的 Pay Per Crawl 仍标注为封闭测试;Pay Per Use 被其公告明确描述为实验。Ceramic 表示自己是该计划的启动合作方,而 You.com 的公开文档主要说明代理怎样按请求购买搜索与页面内容能力。它们共同展示了方向,却不能证明普通网站已经能够稳定获得此类收入。

可引用要点:抓取是访问成本,查询返回是分发事件,引用是可见结果,点击是用户行为,转化是业务结果。只有先把这些单位拆开,才谈得上按使用计量内容价值。

为什么“抓取一次”不是可靠的内容价值单位

抓取容易记录。服务器知道某个请求何时到达、请求哪个 URL、返回什么状态码,也可以识别部分爬虫身份。Cloudflare 的 Pay Per Crawl 因而把成功内容交付作为收费事件:AI 爬虫表达支付意向,成功获得 HTTP 200 内容时产生费用;站点可以对爬虫选择允许、收费或阻止。这套机制清楚、可执行,也便于从网络边缘实施。

问题在于抓取与使用并不一一对应。同一页面可能被重复抓取却没有进入任何答案,也可能只抓取一次,随后长期保存在索引中并支持许多查询。若按每次抓取收费,抓取方会承担重复获取未变化页面的成本,内容方则可能因为缓存和索引效率提高而获得更少结算,即使内容仍在持续创造结果价值。

抓取次数还受技术策略影响。不同系统的缓存期限、索引架构、刷新频率和重试机制不同;页面体积、错误响应和更新信号也会改变请求量。内容完全相同,仅因为某个爬虫实现得更低效,就可能产生更多收费。这个数字反映流量与交付,并不能单独说明内容质量、答案贡献或用户价值。

因此,按抓取计费更像访问层的交易:站点决定自动化访问是否需要付费,抓取方决定价格是否值得。它可以增强控制和成本透明度,却不是引用费、版权结论或效果分成。把三个概念混在一起,会让团队误以为收取抓取费就能证明内容已被模型使用,或者以为允许免费搜索抓取就等于允许训练和全文再分发。

Pay Per Use 想把计量点移到哪里

Cloudflare 公告提出的核心转向,是从网页被访问时收费,移动到内容实际帮助一次搜索或代理任务时计量。Ceramic 的公开说法是,参与计划的内容方在其内容作为搜索结果返回时获得补偿;Cloudflare 将这种方式称为 pay-per-query,并表示还在测试 pay-per-result 等模式。You.com 则展示了另一侧:代理可以按请求购买搜索能力,获取实时结果、摘要或页面内容。

这里至少存在三种不同的“使用”。第一种是进入检索结果,无论最终答案是否引用;第二种是内容片段或事实被选为回答依据;第三种是代理为了完成任务而临时购买某份完整或高级内容。它们的价值强度不同,所需证据也不同。一个 URL 出现在二十条候选结果里,和它成为最终答案的主要依据,不应天然使用同一种价格。

按使用的吸引力在于更接近结果。内容方有机会看到哪些查询触发了自己的页面、返回了哪个片段、处于什么位置;搜索服务则可以把成本放到真实查询,而不是无差别抓取。若同时利用更新时间和页面变化信号,未变化内容可以减少重复访问,最新内容也可能更快进入检索。这是效率与价值分配的双重尝试。

但它把困难从“记录请求”转移到“解释贡献”。一次答案通常组合多个来源,系统还可能依赖预训练知识、用户上下文和模型推理。若三个来源共同支持一句结论,结算如何分配?如果内容只帮助排除一个错误选项,算不算使用?如果系统展示了链接但用户没有点击,内容方提供的价值怎样衡量?这些问题尚无通用答案。

五个必须分开的计量单位

  1. 抓取:自动化系统成功获取页面,证明发生了内容交付。
  2. 查询返回:页面或片段进入某次检索的候选或结果集合。
  3. 答案引用:页面作为来源被最终回答展示、链接或明确采用。
  4. 引荐访问:用户从 AI 结果进入站点,产生可观察会话。
  5. 业务结果:用户完成咨询、订阅、购买或其他已定义目标。

“进入结果”为什么不能直接等同于“被引用”

搜索和生成式回答通常先检索,再排序、读取和综合。页面进入检索结果,说明它与查询存在匹配并通过某些基础条件;最终回答是否引用,还取决于其他来源、内容完整性、冲突情况、回答长度和产品展示规则。按查询返回付费可以奖励被检索到的内容,但不能自动证明它影响了最终措辞。

反过来,引用也不等于点击。AI 界面可能在答案旁显示来源,用户已经获得所需信息,不再打开页面;也可能因为问题高风险、答案需要核验而点击深读。来源链接承担透明度和复核作用,即使没有点击也可能有价值,但网站不能用引用次数推算访问量。

点击更不等于业务结果。AI 带来的访问可能停留时间长、转化意图强,也可能只是核查一句事实。若企业把按使用收入、引用曝光和站内转化混成一个总数,就无法判断内容究竟在“被检索”“被信任”还是“促成行动”阶段产生作用。

因此,任何新的结算或报告都应保留事件定义。报告说“appearance”时,要确认是候选结果、可见结果还是最终答案;说“query”时,要确认同一用户的多轮检索如何计算;说“use”时,要确认缓存复用、摘要、全文读取和派生回答是否分别计量。没有口径的数字无法跨平台比较。

谁来证明内容确实被使用

抓取证据主要掌握在站点或边缘网络,查询与回答证据主要掌握在搜索服务。内容方能看到请求日志,却通常看不到某次内部检索是否采用了页面;搜索服务能看到答案链路,却需要证明报告没有重复计算或遗漏。按使用市场要成立,双方之间必须存在可信的事件记录。

最小记录应包含事件时间、查询或匿名化查询标识、返回 URL、使用层级、片段或字段范围、平台、计费规则和去重标识。涉及用户隐私时,不应把完整敏感问题直接交给内容方;但如果只给汇总数字,又难以复核内容是否真的进入结果。透明度和隐私需要通过分级报告、最小披露和审计机制平衡。

归因还要处理内容重复。同一事实可能出现在原创页面、转载页、聚合页和模型缓存中。若系统只按最终 URL 结算,原创来源可能没有收益;若尝试识别事实来源,又会遇到发布时间、授权关系和共同知识的争议。规范化链接、发布日期和清楚引用能提供线索,但不能自动解决所有权。

内容更新也会影响结算。旧版本被使用后,平台何时停止计费?页面改写一段后是同一内容还是新版本?如果错误内容被引用,内容方是否仍获得结算?成熟机制需要版本标识、撤回、纠错与争议处理,而不只是一个累计金额。

这会怎样改变 GEO 的内容工作

第一,内容必须能够被定位到具体贡献。一个页面若混合多个产品、版本和政策,搜索系统难以判断某段事实适用于谁,使用报告也难以说明哪部分产生价值。企业应让名称、对象、版本、条件、日期和来源清楚出现,同时保留稳定 URL,使一次查询结果能够回到明确责任页面。

第二,原创性需要从口号变成可核验资产。按使用模式若只奖励可以替代的通用描述,价格会迅速趋近于零。更有持续价值的通常是独有数据、持续更新的目录、经过验证的方法、专业判断、原始文件和明确许可。原创不等于写得新奇,而是事实来源、采集方法和更新责任可以说明。

第三,公开摘要与高价值内容需要分层。完全封闭会失去发现入口,全部免费暴露又可能无法支撑高成本生产。企业可以公开对象说明、结论摘要和核验路径,把需要持续采集、完整数据或专业解释的部分放在授权层。公开层必须仍然有独立价值,不能只留下诱导点击的空壳。

第四,内容更新信号会成为基础设施。Cloudflare 的研究计划明确关注哪些页面真正发生变化,并希望减少对未变化页面的重复抓取。对 GEO 团队而言,稳定 URL、准确修改日期、站点地图、订阅源和变更记录的重要性会上升。伪造更新时间只会破坏信号可信度,并增加无意义抓取。

内容不能只按“被用了几次”定价

使用次数是数量,不是完整价值。实时行情、专业数据库、独家研究与通用帮助文档的生产成本和替代性不同;同一内容对购物比较、医疗研究和娱乐问答的风险也不同。若所有页面使用相同单价,平台会倾向选择便宜、可替代的内容,内容方也可能追逐高频而降低质量。

更合理的价值框架至少考虑四项:稀缺性决定是否容易找到替代来源,更新成本决定保持准确需要多少投入,任务重要性决定错误会造成多大后果,授权范围决定结果可以摘要、引用还是完整再分发。价格可以是这些条件的结果,但内容团队应先完成分类,而不是先给每篇文章标金额。

也要防止“每次被用都收费”诱导内容拆分。若结算按 URL 或结果数计算,发布者可能把一个完整答案切成多个薄页面,搜索服务也可能限制结果数量。成熟机制需要质量门槛、去重和反滥用;GEO 团队不应利用实验性规则制造页面农场,否则会同时伤害用户体验和来源可信度。

某些内容本就适合免费公开。安全公告、联系方式、基础产品状态、公共政策和纠错说明的首要目标是让事实及时传播;对这些页面设置访问价格,可能降低发现效率。内容价值不只有直接收入,也包括减少误解、支持客户和建立信任。

不同内容类型的开放与计量思路
内容类型主要价值适合的开放方式优先指标
公共事实与帮助减少错误、支持发现公开抓取与稳定回链正确引用、问题解决
原创研究摘要传播结论、建立信任公开摘要,完整报告可授权查询出现、引用、深度访问
持续更新的数据集新鲜度、结构与覆盖按 API、查询或结果授权有效查询、版本、错误率
专业解释与判断方法、责任与风险控制公开框架,完整分析分级核验使用、合格线索、复购
账户与交易数据完成用户任务身份授权,不作为公开内容任务成功、安全与审计

品牌网站现在应不应该收费或封锁

多数普通品牌网站不应从“能否收费”开始决策。首页、产品说明、服务范围、帮助文档和公开政策承担发现与核验功能,阻止搜索型抓取可能直接降低可见性。Cloudflare 自己的文档也提醒,对搜索引擎爬虫选择阻止或收费可能影响索引表现。企业应先识别爬虫用途和内容类型,而不是对所有自动化流量使用同一规则。

拥有高成本原创数据库、付费出版物或实时专业内容的组织,更有理由评估访问收费。即使如此,也应先小范围测试:保留公开入口和说明页,只对明确的高级路径设置规则;记录抓取量、收入、索引变化和人工支持成本;为合法合作方保留授权方式。一次性全站切换会让因果难以判断。

没有独有内容、访问量很小的网站,不应把商业化基础设施当成优先项目。接入支付、身份、价格、争议与报表会带来持续成本。相比等待按使用收入,先把产品事实、版本、证据和更新做清楚,更能改善现有搜索与用户体验。

最重要的是区分搜索、训练和用户代理访问。允许搜索发现不等于同意训练,允许用户触发读取不等于允许长期存储。现有AI 爬虫用途分层治理框架可以帮助团队先建立权限基线;结算只能建立在身份与用途可识别的前提上。

怎样建立不依赖单一平台的价值账本

企业可以从四张表开始。第一张是访问表,记录机器人身份、URL、状态、时间和用途分类;第二张是可见表,记录查询、平台、页面、片段和展示位置;第三张是引荐表,记录带来源的平台访问及站内行为;第四张是业务表,记录经过合规归因的咨询、注册或购买。四张表之间用时间、URL、活动或匿名标识连接,但保留各自口径。

报告必须把平台提供与站点自有数据分开。平台说某页面出现在查询结果中,应标注平台名称和报告定义;服务器日志证明内容被抓取,应保留用户代理与验证方式;站内转化则由分析或业务系统负责。不能把平台估算写成站点事实,也不能把无法识别来源的直接访问强行归入 AI。

计算收益时同时记录成本。原创内容包括采集、审核、更新与权利处理成本;技术侧包括带宽、索引、接口、支付和审计成本。按使用带来的收入若低于这些增量成本,仍可能因品牌发现和客户支持产生间接价值,但要明确是哪一种价值,而不是用“曝光”掩盖亏损。

价值账本也应记录无法确定的部分。模型可能没有传递引荐信息,引用可能在不同用户界面变化,查询报告可能只覆盖参与计划的平台。未知不是零,也不是可以随意估算的数字。把覆盖范围写清楚,长期趋势才有可比性。

一次可执行的小范围试验

第一步,选择一个内容集合,不要全站开始。适合试验的是有明确边界、更新责任和真实需求的资料,例如技术文档、行业数据库或完整研究;排除账户数据、法律限制不清和必须广泛公开的基础事实。

第二步,为内容建立清单:规范 URL、标题、版本、发布时间、修改时间、权利状态、公开摘要、授权范围和负责人。没有权利说明与版本记录,后续即使出现使用报告,也难以判断结算对象是否正确。

第三步,固定基线期,记录当前抓取、搜索展示、AI 引荐和业务行为。若直接启用收费而没有基线,流量下降、抓取减少或收入变化都无法解释。基线至少覆盖正常更新周期,并排除发布活动或故障影响。

第四步,只改变一个条件。可以对少数高级路径设置收费,对其余页面保持公开;也可以先加入某个按使用计划而不改变抓取权限。同步记录搜索可见性、查询出现、来源引用、访问、收入、错误与支持工单。

第五步,在预定时间复盘,而不是看到一次收入就下结论。判断内容是否被更有效地使用、重复抓取是否减少、公开发现是否受损、报告是否可核验,以及运营成本是否可接受。若平台无法解释计量口径,数字再好看也不能作为扩大范围的唯一理由。

常见错误与反例

错误一:把 Pay Per Use 写成已普及的行业标准。目前公开方案仍是特定平台与合作方的实验,覆盖范围和规则都可能变化。

错误二:把查询返回写成最终引用。进入结果集合只能证明被检索到,不能证明影响了答案,更不能证明用户点击或转化。

错误三:看到按使用付费就全站封锁。公共产品事实失去发现入口,可能造成的业务损失远高于实验性内容收入。

错误四:只按 URL 数量追求结算。拆分薄页面、重复内容和夸张标题可能短期增加事件,长期降低检索质量与信任。

错误五:没有权利状态就出售访问。转载、客户资料、第三方图片或授权范围不明的数据不能因为技术上可收费就视为有权再许可。

错误六:把 AI 平台账单当成内容方收入。You.com 等服务的按请求收费首先说明代理购买搜索能力,不代表费用会自动分配给所有结果来源。

错误七:忽略纠错与撤回。错误内容被持续使用时,仅统计收入会掩盖事实风险。使用系统必须能够识别版本并停止分发旧信息。

错误八:用收入证明内容正确。高频使用说明有需求,不证明事实准确、表达公正或适合所有情境。

边界与局限

本文分析的是截至 2026 年 9 月 28 日公开可核验的产品说明与实验方向,不是法律意见、版权定价建议或对任何平台收益的预测。内容授权涉及合同、版权、数据库权利、隐私和地区法规,实际部署应由具备相应责任的人员审查。

Cloudflare 的数据与方案来自其网络和合作计划,不能代表全部互联网;Ceramic 和 You.com 的公开资料说明各自产品与合作角色,也不能推导其他 AI 搜索系统采用相同机制。文章只把它们作为正在发生的案例,不估算市场规模或平均收益。

按使用报告可能比传统抓取日志更接近价值,但仍由平台定义和生成。没有独立事件证据、抽样核验与争议处理时,内容方无法完全验证每次计费。将来即使形成行业协议,也仍需要审计和反作弊。

最后,机器可读、可查询或可付费都不保证内容被选择。内容是否进入答案仍受问题、平台、索引、用户情境、来源质量和竞争信息影响。GEO 能做的是提高事实清晰度、来源可核验性和测量完整性,不能承诺模型引用或收益。

实施前检查清单

  • 是否明确区分抓取、查询返回、答案引用、引荐访问和业务结果?
  • 平台报告中的“使用”究竟指候选结果、可见结果、引用还是完整内容读取?
  • 内容是否拥有清楚权利状态、版本、负责人和授权范围?
  • 公共发现内容与高价值授权内容是否合理分层?
  • 是否保留稳定 URL、真实修改日期、站点地图和变更记录?
  • 搜索、训练、代理访问与全文再分发是否采用不同规则?
  • 是否建立启用前基线,并一次只改变一个条件?
  • 是否同时记录收入、索引变化、引荐、转化和运营成本?
  • 查询与用户信息是否采用最小披露并保护隐私?
  • 是否能处理重复内容、缓存复用、版本变化、撤回与纠错?
  • 是否避免把平台实验写成普遍标准或稳定收益?
  • 报告无法覆盖的部分是否明确标记为未知,而不是估算成确定数字?

可引用要点

  • 按抓取计费衡量内容交付,按使用结算试图衡量内容对具体查询或任务的贡献,两者不是同一事件。
  • 查询返回、最终引用、用户点击和业务转化必须分别计量,任何一层都不能自动证明下一层发生。
  • 按使用模式的关键难题不是支付接口,而是贡献归因、事件核验、隐私、版本和争议处理。
  • 普通品牌网站应优先保证公共事实可发现;高成本、稀缺且权利清楚的内容才更适合小范围测试授权或收费。
  • 新的内容市场可能扩展 GEO 的价值衡量,但不能把可抓取、可付费或结构化数据写成引用与收益保证。

资料来源与下一步阅读

本文对 Pay Per Use 的描述依据 Cloudflare 2026 年 7 月 1 日发布的“Making AI search smarter”公告。公告说明其研究计划将探索页面变化与新鲜度信号,并与 Ceramic.ai、You.com 等测试 pay-per-query、pay-per-result 和按需内容访问;公告同时明确这些仍是实验,并未声称已经成为全行业结算标准。

Pay Per Crawl 的机制与状态依据 Cloudflare AI Crawl Control 官方文档:该功能仍为封闭测试,成功内容交付是收费事件,站点可按爬虫选择允许、收费或阻止。其文档也提醒,对搜索引擎爬虫收费或阻止可能影响索引表现。

Ceramic 的参与角色依据其公开 FAQ;You.com 按请求与页面提取收费的描述依据其机器支付文档。本文没有把代理购买搜索 API 的费用推断为所有来源网站都能获得的分成。

如果你正在建立衡量体系,可继续阅读引用、引荐与业务结果的分层指标;若需要区分自然引用、商品推荐与广告曝光,可参考AI 搜索商业化的分账框架。下一步不是给全站定价,而是选一个权利清楚的内容集合,建立基线并验证平台所谓“使用”究竟记录了什么。