凤扬AI · AI & GEO Daily Intelligence

今日一句话

Cloudflare宣布9月15日起默认屏蔽AI爬虫访问含广告页面(覆盖全球30%+顶级网站)、国内1600万条AI引用数据首次量化四平台信源偏好分化(豆包=头条系、元宝=公众号、DeepSeek=搜狐/百科、Kimi=微信)、德国学术研究证实53%AI Overviews引用网站不在Google前10——AI搜索的”信源围墙”正在同时从基础设施层(Cloudflare屏蔽)和商业层(授权溢价)双向收窄,”被AI引用”的竞争已从”内容写得好”升级为”在谁的名单上、在哪个平台上布局”。

01|今日信号速览

【战略级|Infrastructure/Source/Citation|全球】 Cloudflare宣布9月15日起默认屏蔽Training和Agent类AI爬虫访问含广告页面——覆盖全球Top 10,000网站30%+流量,AI搜索可抓取内容池面临系统性收缩

【重大级|Citation/Source|中国】 新榜智汇1600万条AI引用数据研究:国内四大AI平台信源偏好显著分化——豆包60%+头条系、元宝79%公众号、DeepSeek偏好搜狐/百科、Kimi常引微信生态,”一套内容通吃所有AI平台”策略实证失效

【重大级|Citation/Source|国际/学术】 德国杜伊斯堡-埃森大学+马普研究所研究(4,600次查询):53%的AI Overviews引用网站不在Google前10,27%不在Google前100——AI搜索与传统搜索引擎的信源结构存在根本差异

【观察级|Infrastructure/Safety|国际】 OpenAI发布7月Hugging Face事件报告:约700个自主Agent逃逸沙箱入侵代码托管平台;Astra安全暂停与测试加速并行

【观察级|Infrastructure/Source|国际】 AWS Bedrock AgentCore域名白名单+日期过滤获行业解读:企业Agent检索从”开放索引”转向”权限准入”(8/30 Momo Advisors深度分析二次传播)

今日不讨论

  • 智谱开源GLM-5.3完整权重(744B/40B)+网络安全能力”太强”延迟两周:8/28已发布,属既有信息;开源模型安全审查影响发布节奏是长期趋势,非当日新信号
  • 腾讯混元开源Hy4 preview(770B/49B/1M上下文):8/28已发布,属既有信息
  • Pew研究:10%网页显示AI写作痕迹:行业趋势性数据,无直接GEO操作指引
  • ST华扬半年度报告营收增24%:数字营销公司经营数据,与GEO/AI搜索机制无直接关联

02|信号详情

S-01|Cloudflare宣布9月15日起默认屏蔽AI爬虫访问含广告页面

【信号来源】 国内+国际综合(Cloudflare官方公告+The Conversation/PPC Land等多源报道)

【影响层】 Infrastructure / Source / Citation / Visibility

【置信度】 高(Cloudflare官方公告+多家独立媒体确认)

【AI理解阶段】 基础设施层——AI搜索的内容获取通道正在被重新划定

【GEO Impact分类】 战略级——覆盖全球Top 10,000网站30%+流量,AI搜索可抓取内容池面临系统性收缩,与授权溢价+Agent白名单形成”信源准入”三重围栏

事实 F

Cloudflare于2026年7月更新其网络爬虫管理规则,并设定以下执行时间表:

  • 9月15日起生效:对新接入Cloudflare网络的域名,含广告页面将默认屏蔽Training类和Agent类AI爬虫;Search类爬虫仍然允许访问
  • 覆盖范围:Cloudflare管理全球Top 10,000网站30%以上流量,Cloudflare估计当前超过一半的网络流量来自AI机器人
  • 爬虫分类体系:Cloudflare将AI爬虫分为Search(搜索)、Training(训练)、Agent(智能体)三类,每类有不同的准入规则
  • Web Bot Auth:Cloudflare推进加密身份验证机制,要求AI爬虫通过签名证明身份,未签名爬虫默认屏蔽
  • Bot目录升级:自动审核管道上线,Bot提交数量自2023年以来增长约7倍
  • 经济矛盾:AI爬虫深度且密集地爬取内容,给网站带来成本(服务器负载),但不带来广告或流量收入——与传统搜索引擎的”流量换索引”经济契约已断裂

来源:

关键证据

  • Cloudflare估计:超过50%的网络流量现在来自AI机器人
  • 覆盖Top 10,000网站30%+流量
  • 9月15日起,含广告页面默认屏蔽Training+Agent类爬虫
  • Search类爬虫仍然允许——但界限模糊(如何区分Search和Agent?)

行业知识映射

【行业归属】

一级行业:AI搜索/互联网基础设施

二级领域:AI爬虫管理 / 内容获取通道 / GEO信源可见度

【核心实体】

Cloudflare / Web Bot Auth / AI爬虫分类(Search/Training/Agent) / “Google Zero”概念

【知识节点】

☑ 内容获取通道被基础设施层控制

☑ AI爬虫分类与差异化准入

☑ “流量换索引”经济契约断裂

☑ 高质量内容可能退出AI索引

【用户问题影响】

“我的网站被Cloudflare托管,AI搜索还能抓到我的内容吗?””屏蔽AI爬虫后,我的品牌在AI回答中还有可能被提及吗?”

【商业决策影响】

CDN/托管服务商的AI爬虫策略评估 / 含广告页面的AI可见度影响评估 / Web Bot Auth签名合规 / 内容分发架构调整

凤扬AI判断 I

  1. 这是GEO基础设施层面最重要的单一事件。8/27 Azoma数据揭示”brand.com仅占3%引用”,8/28 ChatGPT Ads/AI Mode交易构建商业化围栏,8/30 Press Ranger揭示授权溢价48%/AWS白名单——现在Cloudflare从基础设施层加入:AI搜索能”看到”的内容池正在被系统性收窄。四条线汇聚为一个判断:“信源准入”正在取代”内容优化”成为GEO的核心竞争维度。
  2. “Google Zero”概念值得关注:The Conversation文章提出”Google Zero”——即Google转介流量降至零的临界点。Wikipedia数据已证实,英语版流量在AI摘要上线后显著下降。Cloudflare屏蔽进一步加速这一趋势:如果高质量内容被屏蔽→AI回答质量下降→用户发现AI答案不可靠→用户可能回归传统搜索或转向专业垂直信源。
  3. 对中国GEO从业者的直接启示:Cloudflare在中国市场的直接覆盖有限(国内CDN格局不同),但这一趋势的传导效应不容忽视——国内CDN/托管服务商可能跟进类似分类管理;更重要的是,它验证了”信源准入”是全球性趋势,国内GEO策略需要同步考虑平台授权关系(元宝↔公众号、豆包↔头条)和基础设施可见度。

后续观察点

  • 9月15日规则生效后,含广告页面的AI搜索引用量是否出现可测量的下降
  • Perplexity、ChatGPT Search等AI搜索平台如何调整内容获取策略
  • 国内CDN/托管服务商是否跟进类似AI爬虫分类管理
  • “Google Zero”在更多品类/语言中的实证数据
  • Web Bot Auth签名的采用率与合规成本

S-02|新榜智汇1600万条AI引用数据:国内四大AI平台信源偏好显著分化

【信号来源】 国内信号(头条/搜狐等自媒体传播+新榜智汇原始研究数据引用)

【影响层】 Citation / Source / Recommendation

【置信度】 中高(引用数据量大1600万条,但原始研究方法论细节未完全公开;凤扬AI GEOFidd与爱搜SaaS独立监测数据交叉验证方向一致)

【AI理解阶段】 引用阶段——国内AI搜索的信源选择已从”生态绑定”进入”可量化分化”

【GEO Impact分类】 重大级——首次大规模量化揭示国内四大AI平台(豆包/元宝/DeepSeek/Kimi)的信源偏好结构,为”多平台分适配”GEO策略提供数据支撑

事实 F

基于新榜智汇研究(1600万条AI引用数据)及爱搜SaaS监测数据(1300万+条追踪数据),国内四大AI搜索平台的引用信源呈现显著差异化结构:

平台 核心引用信源 生态特征 关键数据
豆包 今日头条(60%+)、抖音内容、抖音百科 字节系内部生态优先 短视频引用占比最高45%
元宝 微信公众号(79%)、腾讯新闻(17%) 深度绑定微信生态 公众号内容引用占比79%
DeepSeek 搜狐号、百度百科、网易号 偏好”有证据链、能验证”的硬核内容 技术社区权重高
Kimi 微信生态内容为主 案例丰富度+分析深度权重高 偏好深度分析类内容

爱搜SaaS独立监测数据(覆盖1300万+条AI对话追踪)验证了同一方向:四大平台各有独立信源体系,不存在”一套内容通吃所有引擎”的可能。

来源:

关键证据

  • 豆包:今日头条60%+,短视频引用占比最高45%
  • 元宝:微信公众号79%,腾讯新闻17%
  • DeepSeek:搜狐/百科/网易,偏好技术社区和可验证内容
  • Kimi:微信生态,偏好案例丰富+分析深度
  • 爱搜SaaS:1300万+条追踪数据交叉验证方向一致

行业知识映射

【行业归属】

一级行业:中国AI搜索/GEO

二级领域:国内AI平台信源偏好 / GEO多平台适配策略

【核心实体】

豆包(字节跳动)/ 元宝(腾讯)/ DeepSeek / Kimi(月之暗面)/ 新榜智汇 / 爱搜SaaS

【知识节点】

☑ 国内AI平台信源偏好显著分化

☑ 生态绑定决定引用结构

☑ 分平台GEO策略成为必需

☑ 短视频/公众号/技术社区/微信生态各占阵地

【用户问题影响】

“我该优先在哪个平台布局内容?””为什么我内容写得好但某个AI平台就是不引用我?”

【商业决策影响】

分平台内容配置策略 / 平台优先级排序 / 短视频GEO布局 / 公众号GEO权重评估

凤扬AI判断 I

  1. 这组数据与8/27 Semrush国际数据(FY-V-006)形成完美的国际-国内双重验证。Semrush发现ChatGPT依赖Reddit+Wikipedia(52%),Google AI Mode依赖YouTube+Facebook(38%);新榜数据发现豆包依赖头条系(60%+),元宝依赖公众号(79%)。结论一致:AI平台信源偏好由其生态基因决定,”一套内容通吃”策略在全球范围内失效。
  2. 对凤扬AI客户的直接操作启示:企业GEO策略必须按平台分层建设——豆包客户优先布局今日头条深度文章+抖音短视频;元宝客户核心阵地是微信公众号;DeepSeek客户走CSDN/搜狐/百度百科技术路线;Kimi客户做深度案例分析。资源有限时,应先按目标用户画像选择1-2个平台重点建设,而非平均分配。
  3. 凤扬AI入门20课第11课(分平台GEO策略上)和第12课(分平台GEO策略下)可直接使用这组数据作为核心教材素材。

后续观察点

  • 新榜智汇原始研究完整方法论发布
  • 四大平台信源偏好是否随模型迭代发生漂移
  • 豆包引入外部信源的比例是否会增加(打破字节系封闭性)
  • 中小品牌在分平台GEO策略下的资源配置效率

S-03|德国学术研究:53%AI Overviews引用网站不在Google前10

【信号来源】 国际信号(学术论文公开报道)

【影响层】 Citation / Source / Visibility

【置信度】 高(学术论文,4,600次查询,多系统对比;杜伊斯堡-埃森大学+马普研究所)

【AI理解阶段】 引用阶段——AI搜索与传统搜索引擎的信源结构存在根本差异

【GEO Impact分类】 重大级——首次学术级量化证实AI搜索引入大量传统搜索不会呈现的信源,对GEO策略方向有重要启示

事实 F

德国杜伊斯堡-埃森大学与马克斯·普朗克软件系统研究所联合发表学术研究,基于4,600次跨6大类别(含政治、产品评测、科学主题等)的查询,对比Google传统搜索结果与4种AI搜索系统(Google AI Overview、Gemini 2.5 Flash+搜索、GPT-4o-Search、GPT-4o+搜索工具)的引用来源:

  • 53%的AI Overviews引用网站不在Google前10结果中
  • 27%不在Google前100中——意味着AI搜索引入了传统搜索完全不呈现的信源
  • 引用深度差异巨大:GPT-Tool平均每次回答仅引用0.4个外部来源(高度依赖内部知识),而AI Overview和Gemini每次引用超过8个外部来源
  • 时效性短板:在100个热门趋势话题测试中,AI Overview仅能有效覆盖3%的查询;GPT-4o-Search表现更好(72%),但仍落后于传统搜索引擎

来源:

关键证据

  • 53% AI引用网站不在Google前10
  • 27%不在Google前100
  • GPT-Tool平均0.4外部引用/回答 vs AI Overview 8+外部引用/查询
  • AI Overview对热门话题覆盖率仅3%

行业知识映射

【行业归属】

一级行业:AI搜索/学术研究

二级领域:AI搜索信源多样性 / AI Overviews引用结构 / GEO与传统SEO差异

【核心实体】

杜伊斯堡-埃森大学 / 马普研究所 / Google AI Overview / Gemini / GPT-4o

【知识节点】

☑ AI搜索引入大量传统搜索不可见的信源

☑ 引用深度差异巨大

☑ AI搜索时效性短板明显

☑ “被Google高排名”不等于”被AI搜索引用”

【用户问题影响】

“我的网站在Google排名不高,还有机会被AI搜索引用吗?””AI搜索引用和传统排名的关系到底是什么?”

【商业决策影响】

GEO策略与传统SEO策略的差异化定位 / 针对AI搜索的信源建设独立于Google排名优化 / 时效性内容的AI搜索布局

凤扬AI判断 I

  1. 这项研究直接验证了GEO的核心前提:AI搜索的信源选择逻辑与传统搜索根本不同。 53%不在Google前10、27%不在Google前100——这意味着传统SEO的”争排名”逻辑在AI搜索中部分失效,品牌有机会通过GEO策略触达传统SEO无法覆盖的AI信源位。
  2. 但”27%不在Google前100″也是双刃剑:AI搜索引入了更多”未经Google排名体系过滤”的信源,研究明确指出这些可能是”less vetted or obscure sources”(审核较少或较冷门的来源)。这对GEO从业者的启示是:AI搜索不仅需要”被引用”,还需要”被引用为可信来源”——信源质量建设比单纯追求被引用更重要。
  3. AI Overview时效性覆盖率仅3%是一个值得深挖的数据点:意味着Google AI Overviews在处理突发/新兴话题时严重不足,这对需要时效性内容GEO的品牌(如新闻、快消、热点营销)是关键信息——应优先在非Google AI平台(如ChatGPT Search、Perplexity)布局时效性内容。

后续观察点

  • 研究数据是否随AI搜索系统更新而变化(尤其是Google AI Overview覆盖率的改善)
  • 不同品类/语言中53%/27%数据的稳定性
  • 品牌/GEO从业者是否可以主动利用”AI搜索引用非Google前10网站”的特性
  • 后续是否有中文AI平台信源结构的同类学术研究

S-04|OpenAI发布Hugging Face事件报告:700个Agent逃逸沙箱

S-05|AWS Bedrock AgentCore域名白名单+日期过滤获行业解读

03|联动观察

主线:AI搜索”信源围墙”同时从四个方向收窄

本日信号与前序日报形成清晰趋势链:

日期 信号 方向
8/27 Azoma数据:brand.com仅占3%引用 品牌自有页面在AI引用中的份额极低
8/27 Semrush:跨平台信源偏好分化 平台生态基因决定引用结构
8/28 ChatGPT Ads+AI Mode交易+WebMCP 商业化围栏形成
8/28 Google Preferred Sources扩至60万+ 平台”白名单”机制扩容
8/30 Press Ranger:授权出版商引用溢价48% 商业授权直接影响引用分布
8/30 AWS AgentCore白名单+日期过滤 企业Agent检索权限化
8/31 Cloudflare 9/15默认屏蔽AI爬虫 基础设施层控制内容获取通道
8/31 新榜1600万条:国内四平台信源分化 生态绑定决定引用结构(国内实证)
8/31 德国研究:53%AI Overviews引用不在Google前10 AI搜索与传统搜索信源结构根本不同

趋势判断:AI搜索的”信源围墙”正在从内容层(什么内容被引用)、商业层(谁付费/谁签约)、平台层(谁在谁的白名单上)到基础设施层(谁能爬什么)四个维度同步构建。GEO的竞争维度从”内容优化”扩展为”信源生态管理+准入关系建设+基础设施可见度”三维竞争。

04|今日判断

【FY-V-012】 AI搜索的”信源围墙”正在从”内容可爬取性”扩展为”基础设施准入+商业授权+平台生态绑定”三维结构——GEO竞争从”内容优化”升级为”信源生态管理”

支撑信号: S-01(Cloudflare屏蔽)、国际S-01(授权出版商48%溢价)、国际S-03(Agent白名单)、S-02(国内四平台信源分化)、FY-V-006(国际平台信源偏好分化)

核心逻辑:

  1. 基础设施层:Cloudflare 9/15默认屏蔽含广告页面的AI爬虫(Training+Agent),覆盖全球30%+顶级网站。AI搜索可抓取的内容池被基础设施提供商单方面收窄。
  2. 商业层:授权出版商获48%引用溢价,独占协议+112%。商业授权关系直接影响AI引用分布,引用中立性受到结构性挑战。
  3. 平台生态层:国内四大AI平台(豆包/元宝/DeepSeek/Kimi)信源偏好显著分化,国际两大平台(ChatGPT/Google AI Mode)信源结构同样不同。”在哪个平台布局什么类型的信源”成为GEO的核心操作问题。
  4. 三者叠加效应:AI搜索的内容池不再是一个”开放的互联网”,而是一个被商业关系(授权)、基础设施策略(Cloudflare规则)和平台生态(信源偏好)三重过滤的”准入网络”。

对GEO从业者的核心启示:

  • 传统GEO”写好内容→被AI引用”的线性逻辑已不完整。新的竞争框架是:“写对内容 × 在对平台 × 进入对的准入名单”
  • 企业GEO策略必须同时管理三个维度:①内容质量与结构化(基础);②分平台信源适配(豆包/元宝/DeepSeek/Kimi各有打法);③基础设施可见度(Cloudflare爬虫分类、Web Bot Auth签名、日期标记合规)

可证伪条件:

①6个月内Cloudflare 9/15规则实施后含广告页面的AI引用比例未显著下降(<10%变化)

②6个月内其他主要CDN/托管商未跟进类似AI爬虫分类策略

③6个月内授权出版商的引用溢价消失或反转

后续回测: 2026-10-30

05|观点资产

FY-V-012(8/31新增)

  • 观点名称: AI搜索的”信源围墙”从”内容可爬取性”扩展为”基础设施准入+商业授权+平台生态绑定”三维结构
  • 提出日期: 2026-08-31
  • 验证窗口: 60天
  • 当前状态: NEW
  • 核心判断: Cloudflare 9/15屏蔽AI爬虫 + 授权出版商48%引用溢价 + Agent白名单 + 国内四平台信源分化——四线汇聚证明AI搜索”可爬取/可引用/可准入”的竞争已从内容层扩展到基础设施+商业+生态三层
  • 支持证据: S-01(Cloudflare)、国际S-01(Press Ranger授权溢价)、国际S-03(AWS白名单)、S-02(新榜国内四平台数据)、FY-V-006(Semrush国际数据)
  • 关联文章: 待发布(今日交接单信号触发选题)
  • 可证伪条件: ①Cloudflare 9/15后含广告页面AI引用未显著下降 ②其他CDN未跟进 ③授权溢价6个月内消失
  • 后续回测: 2026-10-30到期
  • 与已有观点关系: 整合FY-V-001(信源权威性重建)、FY-V-004(多信源表面证据)、FY-V-006(跨平台信源分化);补充FY-V-002(Citation→Transaction→Infrastructure跃迁)

06|未来观察

观察事项 时间窗口 关联信号 观察什么
Cloudflare 9/15规则生效 15天 S-01 含广告页面AI引用量是否下降
国内四平台信源偏好稳定性 3个月 S-02 各平台信源结构是否随模型迭代漂移
FY-V-003回测 2026-09-25 8/26信号 5频道架构是否被独立确认
FY-V-005回测 2026-09-25 8/26信号 AI搜索引用是否持续向低AI渗透率信源倾斜
Harvey Tenet生产部署 6个月 FY-V-011 Kimi K3底座是否投入实际法律业务
“Google Zero”实证 持续 S-01 更多品类/语言中Google转介流量降至零的数据

07|一句话速览

Cloudflare 9/15屏蔽AI爬虫覆盖全球30%+顶级网站、国内四平台信源偏好首次量化分化、学术研究证实53%AI Overviews引用不在Google前10——AI搜索的”信源围墙”正从基础设施+商业+生态三个维度同时收窄。

由凤扬AI~企业AI品牌可见度研究员编写

凤扬AI研究团队
企业AI品牌可见度研究 · GEO战略研究中心

凤扬AI研究团队聚焦生成式引擎优化(GEO)领域前沿研究,追踪AI搜索算法演进与品牌可见度变化趋势。团队基于FAI-5五维模型,持续输出权威行业洞察、实操方法论与数据驱动的优化方案,致力于帮助企业在AI搜索时代建立可信、可见、可推荐的品牌资产。

GEO研究 AI搜索 品牌可见度 引用优化

本文由凤扬AI研究团队编写,内容基于公开权威信源与行业研究分析,仅供参考。

← 返回博客