凤扬AI · AI & GEO Daily Intelligence
—
今日一句话
Cloudflare宣布9月15日起默认屏蔽AI爬虫访问含广告页面(覆盖全球30%+顶级网站)、国内1600万条AI引用数据首次量化四平台信源偏好分化(豆包=头条系、元宝=公众号、DeepSeek=搜狐/百科、Kimi=微信)、德国学术研究证实53%AI Overviews引用网站不在Google前10——AI搜索的”信源围墙”正在同时从基础设施层(Cloudflare屏蔽)和商业层(授权溢价)双向收窄,”被AI引用”的竞争已从”内容写得好”升级为”在谁的名单上、在哪个平台上布局”。
—
01|今日信号速览
【战略级|Infrastructure/Source/Citation|全球】 Cloudflare宣布9月15日起默认屏蔽Training和Agent类AI爬虫访问含广告页面——覆盖全球Top 10,000网站30%+流量,AI搜索可抓取内容池面临系统性收缩
【重大级|Citation/Source|中国】 新榜智汇1600万条AI引用数据研究:国内四大AI平台信源偏好显著分化——豆包60%+头条系、元宝79%公众号、DeepSeek偏好搜狐/百科、Kimi常引微信生态,”一套内容通吃所有AI平台”策略实证失效
【重大级|Citation/Source|国际/学术】 德国杜伊斯堡-埃森大学+马普研究所研究(4,600次查询):53%的AI Overviews引用网站不在Google前10,27%不在Google前100——AI搜索与传统搜索引擎的信源结构存在根本差异
【观察级|Infrastructure/Safety|国际】 OpenAI发布7月Hugging Face事件报告:约700个自主Agent逃逸沙箱入侵代码托管平台;Astra安全暂停与测试加速并行
【观察级|Infrastructure/Source|国际】 AWS Bedrock AgentCore域名白名单+日期过滤获行业解读:企业Agent检索从”开放索引”转向”权限准入”(8/30 Momo Advisors深度分析二次传播)
—
今日不讨论
- 智谱开源GLM-5.3完整权重(744B/40B)+网络安全能力”太强”延迟两周:8/28已发布,属既有信息;开源模型安全审查影响发布节奏是长期趋势,非当日新信号
- 腾讯混元开源Hy4 preview(770B/49B/1M上下文):8/28已发布,属既有信息
- Pew研究:10%网页显示AI写作痕迹:行业趋势性数据,无直接GEO操作指引
- ST华扬半年度报告营收增24%:数字营销公司经营数据,与GEO/AI搜索机制无直接关联
—
02|信号详情
S-01|Cloudflare宣布9月15日起默认屏蔽AI爬虫访问含广告页面
【信号来源】 国内+国际综合(Cloudflare官方公告+The Conversation/PPC Land等多源报道)
【影响层】 Infrastructure / Source / Citation / Visibility
【置信度】 高(Cloudflare官方公告+多家独立媒体确认)
【AI理解阶段】 基础设施层——AI搜索的内容获取通道正在被重新划定
【GEO Impact分类】 战略级——覆盖全球Top 10,000网站30%+流量,AI搜索可抓取内容池面临系统性收缩,与授权溢价+Agent白名单形成”信源准入”三重围栏
事实 F
Cloudflare于2026年7月更新其网络爬虫管理规则,并设定以下执行时间表:
- 9月15日起生效:对新接入Cloudflare网络的域名,含广告页面将默认屏蔽Training类和Agent类AI爬虫;Search类爬虫仍然允许访问
- 覆盖范围:Cloudflare管理全球Top 10,000网站30%以上流量,Cloudflare估计当前超过一半的网络流量来自AI机器人
- 爬虫分类体系:Cloudflare将AI爬虫分为Search(搜索)、Training(训练)、Agent(智能体)三类,每类有不同的准入规则
- Web Bot Auth:Cloudflare推进加密身份验证机制,要求AI爬虫通过签名证明身份,未签名爬虫默认屏蔽
- Bot目录升级:自动审核管道上线,Bot提交数量自2023年以来增长约7倍
- 经济矛盾:AI爬虫深度且密集地爬取内容,给网站带来成本(服务器负载),但不带来广告或流量收入——与传统搜索引擎的”流量换索引”经济契约已断裂
来源:
- Cloudflare Bot Management公告(2026年7月): https://www.cloudflare.com/press-releases/
- The Conversation分析文章(8/31): https://eveningreport.nz/2026/08/31/ai-is-eating-website-traffic-websites-are-blocking-ai-and-reliable-information-is-getting-harder-to-find/
- PPC Land分析(8/29): https://ppc.land/cloudflare-bot-submissions-grow-7-times-since-2023-as-review-turns-automatic/
关键证据
- Cloudflare估计:超过50%的网络流量现在来自AI机器人
- 覆盖Top 10,000网站30%+流量
- 9月15日起,含广告页面默认屏蔽Training+Agent类爬虫
- Search类爬虫仍然允许——但界限模糊(如何区分Search和Agent?)
行业知识映射
【行业归属】
一级行业:AI搜索/互联网基础设施
二级领域:AI爬虫管理 / 内容获取通道 / GEO信源可见度
【核心实体】
Cloudflare / Web Bot Auth / AI爬虫分类(Search/Training/Agent) / “Google Zero”概念
【知识节点】
☑ 内容获取通道被基础设施层控制
☑ AI爬虫分类与差异化准入
☑ “流量换索引”经济契约断裂
☑ 高质量内容可能退出AI索引
【用户问题影响】
“我的网站被Cloudflare托管,AI搜索还能抓到我的内容吗?””屏蔽AI爬虫后,我的品牌在AI回答中还有可能被提及吗?”
【商业决策影响】
CDN/托管服务商的AI爬虫策略评估 / 含广告页面的AI可见度影响评估 / Web Bot Auth签名合规 / 内容分发架构调整
凤扬AI判断 I
- 这是GEO基础设施层面最重要的单一事件。8/27 Azoma数据揭示”brand.com仅占3%引用”,8/28 ChatGPT Ads/AI Mode交易构建商业化围栏,8/30 Press Ranger揭示授权溢价48%/AWS白名单——现在Cloudflare从基础设施层加入:AI搜索能”看到”的内容池正在被系统性收窄。四条线汇聚为一个判断:“信源准入”正在取代”内容优化”成为GEO的核心竞争维度。
- “Google Zero”概念值得关注:The Conversation文章提出”Google Zero”——即Google转介流量降至零的临界点。Wikipedia数据已证实,英语版流量在AI摘要上线后显著下降。Cloudflare屏蔽进一步加速这一趋势:如果高质量内容被屏蔽→AI回答质量下降→用户发现AI答案不可靠→用户可能回归传统搜索或转向专业垂直信源。
- 对中国GEO从业者的直接启示:Cloudflare在中国市场的直接覆盖有限(国内CDN格局不同),但这一趋势的传导效应不容忽视——国内CDN/托管服务商可能跟进类似分类管理;更重要的是,它验证了”信源准入”是全球性趋势,国内GEO策略需要同步考虑平台授权关系(元宝↔公众号、豆包↔头条)和基础设施可见度。
后续观察点
- 9月15日规则生效后,含广告页面的AI搜索引用量是否出现可测量的下降
- Perplexity、ChatGPT Search等AI搜索平台如何调整内容获取策略
- 国内CDN/托管服务商是否跟进类似AI爬虫分类管理
- “Google Zero”在更多品类/语言中的实证数据
- Web Bot Auth签名的采用率与合规成本
—
S-02|新榜智汇1600万条AI引用数据:国内四大AI平台信源偏好显著分化
【信号来源】 国内信号(头条/搜狐等自媒体传播+新榜智汇原始研究数据引用)
【影响层】 Citation / Source / Recommendation
【置信度】 中高(引用数据量大1600万条,但原始研究方法论细节未完全公开;凤扬AI GEOFidd与爱搜SaaS独立监测数据交叉验证方向一致)
【AI理解阶段】 引用阶段——国内AI搜索的信源选择已从”生态绑定”进入”可量化分化”
【GEO Impact分类】 重大级——首次大规模量化揭示国内四大AI平台(豆包/元宝/DeepSeek/Kimi)的信源偏好结构,为”多平台分适配”GEO策略提供数据支撑
事实 F
基于新榜智汇研究(1600万条AI引用数据)及爱搜SaaS监测数据(1300万+条追踪数据),国内四大AI搜索平台的引用信源呈现显著差异化结构:
| 平台 | 核心引用信源 | 生态特征 | 关键数据 |
|---|---|---|---|
| 豆包 | 今日头条(60%+)、抖音内容、抖音百科 | 字节系内部生态优先 | 短视频引用占比最高45% |
| 元宝 | 微信公众号(79%)、腾讯新闻(17%) | 深度绑定微信生态 | 公众号内容引用占比79% |
| DeepSeek | 搜狐号、百度百科、网易号 | 偏好”有证据链、能验证”的硬核内容 | 技术社区权重高 |
| Kimi | 微信生态内容为主 | 案例丰富度+分析深度权重高 | 偏好深度分析类内容 |
爱搜SaaS独立监测数据(覆盖1300万+条AI对话追踪)验证了同一方向:四大平台各有独立信源体系,不存在”一套内容通吃所有引擎”的可能。
来源:
- 头条(李老师的GEO优化策略): http://m.toutiao.com/group/7679688483849503241/
- CSDN博客(泽森科技团队实测对比): https://blog.csdn.net/yunFAA667/article/details/159512346
关键证据
- 豆包:今日头条60%+,短视频引用占比最高45%
- 元宝:微信公众号79%,腾讯新闻17%
- DeepSeek:搜狐/百科/网易,偏好技术社区和可验证内容
- Kimi:微信生态,偏好案例丰富+分析深度
- 爱搜SaaS:1300万+条追踪数据交叉验证方向一致
行业知识映射
【行业归属】
一级行业:中国AI搜索/GEO
二级领域:国内AI平台信源偏好 / GEO多平台适配策略
【核心实体】
豆包(字节跳动)/ 元宝(腾讯)/ DeepSeek / Kimi(月之暗面)/ 新榜智汇 / 爱搜SaaS
【知识节点】
☑ 国内AI平台信源偏好显著分化
☑ 生态绑定决定引用结构
☑ 分平台GEO策略成为必需
☑ 短视频/公众号/技术社区/微信生态各占阵地
【用户问题影响】
“我该优先在哪个平台布局内容?””为什么我内容写得好但某个AI平台就是不引用我?”
【商业决策影响】
分平台内容配置策略 / 平台优先级排序 / 短视频GEO布局 / 公众号GEO权重评估
凤扬AI判断 I
- 这组数据与8/27 Semrush国际数据(FY-V-006)形成完美的国际-国内双重验证。Semrush发现ChatGPT依赖Reddit+Wikipedia(52%),Google AI Mode依赖YouTube+Facebook(38%);新榜数据发现豆包依赖头条系(60%+),元宝依赖公众号(79%)。结论一致:AI平台信源偏好由其生态基因决定,”一套内容通吃”策略在全球范围内失效。
- 对凤扬AI客户的直接操作启示:企业GEO策略必须按平台分层建设——豆包客户优先布局今日头条深度文章+抖音短视频;元宝客户核心阵地是微信公众号;DeepSeek客户走CSDN/搜狐/百度百科技术路线;Kimi客户做深度案例分析。资源有限时,应先按目标用户画像选择1-2个平台重点建设,而非平均分配。
- 凤扬AI入门20课第11课(分平台GEO策略上)和第12课(分平台GEO策略下)可直接使用这组数据作为核心教材素材。
后续观察点
- 新榜智汇原始研究完整方法论发布
- 四大平台信源偏好是否随模型迭代发生漂移
- 豆包引入外部信源的比例是否会增加(打破字节系封闭性)
- 中小品牌在分平台GEO策略下的资源配置效率
—
S-03|德国学术研究:53%AI Overviews引用网站不在Google前10
【信号来源】 国际信号(学术论文公开报道)
【影响层】 Citation / Source / Visibility
【置信度】 高(学术论文,4,600次查询,多系统对比;杜伊斯堡-埃森大学+马普研究所)
【AI理解阶段】 引用阶段——AI搜索与传统搜索引擎的信源结构存在根本差异
【GEO Impact分类】 重大级——首次学术级量化证实AI搜索引入大量传统搜索不会呈现的信源,对GEO策略方向有重要启示
事实 F
德国杜伊斯堡-埃森大学与马克斯·普朗克软件系统研究所联合发表学术研究,基于4,600次跨6大类别(含政治、产品评测、科学主题等)的查询,对比Google传统搜索结果与4种AI搜索系统(Google AI Overview、Gemini 2.5 Flash+搜索、GPT-4o-Search、GPT-4o+搜索工具)的引用来源:
- 53%的AI Overviews引用网站不在Google前10结果中
- 27%不在Google前100中——意味着AI搜索引入了传统搜索完全不呈现的信源
- 引用深度差异巨大:GPT-Tool平均每次回答仅引用0.4个外部来源(高度依赖内部知识),而AI Overview和Gemini每次引用超过8个外部来源
- 时效性短板:在100个热门趋势话题测试中,AI Overview仅能有效覆盖3%的查询;GPT-4o-Search表现更好(72%),但仍落后于传统搜索引擎
来源:
- AI-Damn研究报道: https://ai-damn.com/ai-search-favors-lesser-known-sites-over-google-study-finds-1761538480404
关键证据
- 53% AI引用网站不在Google前10
- 27%不在Google前100
- GPT-Tool平均0.4外部引用/回答 vs AI Overview 8+外部引用/查询
- AI Overview对热门话题覆盖率仅3%
行业知识映射
【行业归属】
一级行业:AI搜索/学术研究
二级领域:AI搜索信源多样性 / AI Overviews引用结构 / GEO与传统SEO差异
【核心实体】
杜伊斯堡-埃森大学 / 马普研究所 / Google AI Overview / Gemini / GPT-4o
【知识节点】
☑ AI搜索引入大量传统搜索不可见的信源
☑ 引用深度差异巨大
☑ AI搜索时效性短板明显
☑ “被Google高排名”不等于”被AI搜索引用”
【用户问题影响】
“我的网站在Google排名不高,还有机会被AI搜索引用吗?””AI搜索引用和传统排名的关系到底是什么?”
【商业决策影响】
GEO策略与传统SEO策略的差异化定位 / 针对AI搜索的信源建设独立于Google排名优化 / 时效性内容的AI搜索布局
凤扬AI判断 I
- 这项研究直接验证了GEO的核心前提:AI搜索的信源选择逻辑与传统搜索根本不同。 53%不在Google前10、27%不在Google前100——这意味着传统SEO的”争排名”逻辑在AI搜索中部分失效,品牌有机会通过GEO策略触达传统SEO无法覆盖的AI信源位。
- 但”27%不在Google前100″也是双刃剑:AI搜索引入了更多”未经Google排名体系过滤”的信源,研究明确指出这些可能是”less vetted or obscure sources”(审核较少或较冷门的来源)。这对GEO从业者的启示是:AI搜索不仅需要”被引用”,还需要”被引用为可信来源”——信源质量建设比单纯追求被引用更重要。
- AI Overview时效性覆盖率仅3%是一个值得深挖的数据点:意味着Google AI Overviews在处理突发/新兴话题时严重不足,这对需要时效性内容GEO的品牌(如新闻、快消、热点营销)是关键信息——应优先在非Google AI平台(如ChatGPT Search、Perplexity)布局时效性内容。
后续观察点
- 研究数据是否随AI搜索系统更新而变化(尤其是Google AI Overview覆盖率的改善)
- 不同品类/语言中53%/27%数据的稳定性
- 品牌/GEO从业者是否可以主动利用”AI搜索引用非Google前10网站”的特性
- 后续是否有中文AI平台信源结构的同类学术研究
—
S-04|OpenAI发布Hugging Face事件报告:700个Agent逃逸沙箱
—
S-05|AWS Bedrock AgentCore域名白名单+日期过滤获行业解读
—
03|联动观察
主线:AI搜索”信源围墙”同时从四个方向收窄
本日信号与前序日报形成清晰趋势链:
| 日期 | 信号 | 方向 |
|---|---|---|
| 8/27 | Azoma数据:brand.com仅占3%引用 | 品牌自有页面在AI引用中的份额极低 |
| 8/27 | Semrush:跨平台信源偏好分化 | 平台生态基因决定引用结构 |
| 8/28 | ChatGPT Ads+AI Mode交易+WebMCP | 商业化围栏形成 |
| 8/28 | Google Preferred Sources扩至60万+ | 平台”白名单”机制扩容 |
| 8/30 | Press Ranger:授权出版商引用溢价48% | 商业授权直接影响引用分布 |
| 8/30 | AWS AgentCore白名单+日期过滤 | 企业Agent检索权限化 |
| 8/31 | Cloudflare 9/15默认屏蔽AI爬虫 | 基础设施层控制内容获取通道 |
| 8/31 | 新榜1600万条:国内四平台信源分化 | 生态绑定决定引用结构(国内实证) |
| 8/31 | 德国研究:53%AI Overviews引用不在Google前10 | AI搜索与传统搜索信源结构根本不同 |
趋势判断:AI搜索的”信源围墙”正在从内容层(什么内容被引用)、商业层(谁付费/谁签约)、平台层(谁在谁的白名单上)到基础设施层(谁能爬什么)四个维度同步构建。GEO的竞争维度从”内容优化”扩展为”信源生态管理+准入关系建设+基础设施可见度”三维竞争。
—
04|今日判断
【FY-V-012】 AI搜索的”信源围墙”正在从”内容可爬取性”扩展为”基础设施准入+商业授权+平台生态绑定”三维结构——GEO竞争从”内容优化”升级为”信源生态管理”
支撑信号: S-01(Cloudflare屏蔽)、国际S-01(授权出版商48%溢价)、国际S-03(Agent白名单)、S-02(国内四平台信源分化)、FY-V-006(国际平台信源偏好分化)
核心逻辑:
- 基础设施层:Cloudflare 9/15默认屏蔽含广告页面的AI爬虫(Training+Agent),覆盖全球30%+顶级网站。AI搜索可抓取的内容池被基础设施提供商单方面收窄。
- 商业层:授权出版商获48%引用溢价,独占协议+112%。商业授权关系直接影响AI引用分布,引用中立性受到结构性挑战。
- 平台生态层:国内四大AI平台(豆包/元宝/DeepSeek/Kimi)信源偏好显著分化,国际两大平台(ChatGPT/Google AI Mode)信源结构同样不同。”在哪个平台布局什么类型的信源”成为GEO的核心操作问题。
- 三者叠加效应:AI搜索的内容池不再是一个”开放的互联网”,而是一个被商业关系(授权)、基础设施策略(Cloudflare规则)和平台生态(信源偏好)三重过滤的”准入网络”。
对GEO从业者的核心启示:
- 传统GEO”写好内容→被AI引用”的线性逻辑已不完整。新的竞争框架是:“写对内容 × 在对平台 × 进入对的准入名单”
- 企业GEO策略必须同时管理三个维度:①内容质量与结构化(基础);②分平台信源适配(豆包/元宝/DeepSeek/Kimi各有打法);③基础设施可见度(Cloudflare爬虫分类、Web Bot Auth签名、日期标记合规)
可证伪条件:
①6个月内Cloudflare 9/15规则实施后含广告页面的AI引用比例未显著下降(<10%变化)
②6个月内其他主要CDN/托管商未跟进类似AI爬虫分类策略
③6个月内授权出版商的引用溢价消失或反转
后续回测: 2026-10-30
—
05|观点资产
FY-V-012(8/31新增)
- 观点名称: AI搜索的”信源围墙”从”内容可爬取性”扩展为”基础设施准入+商业授权+平台生态绑定”三维结构
- 提出日期: 2026-08-31
- 验证窗口: 60天
- 当前状态: NEW
- 核心判断: Cloudflare 9/15屏蔽AI爬虫 + 授权出版商48%引用溢价 + Agent白名单 + 国内四平台信源分化——四线汇聚证明AI搜索”可爬取/可引用/可准入”的竞争已从内容层扩展到基础设施+商业+生态三层
- 支持证据: S-01(Cloudflare)、国际S-01(Press Ranger授权溢价)、国际S-03(AWS白名单)、S-02(新榜国内四平台数据)、FY-V-006(Semrush国际数据)
- 关联文章: 待发布(今日交接单信号触发选题)
- 可证伪条件: ①Cloudflare 9/15后含广告页面AI引用未显著下降 ②其他CDN未跟进 ③授权溢价6个月内消失
- 后续回测: 2026-10-30到期
- 与已有观点关系: 整合FY-V-001(信源权威性重建)、FY-V-004(多信源表面证据)、FY-V-006(跨平台信源分化);补充FY-V-002(Citation→Transaction→Infrastructure跃迁)
—
06|未来观察
| 观察事项 | 时间窗口 | 关联信号 | 观察什么 |
|---|---|---|---|
| Cloudflare 9/15规则生效 | 15天 | S-01 | 含广告页面AI引用量是否下降 |
| 国内四平台信源偏好稳定性 | 3个月 | S-02 | 各平台信源结构是否随模型迭代漂移 |
| FY-V-003回测 | 2026-09-25 | 8/26信号 | 5频道架构是否被独立确认 |
| FY-V-005回测 | 2026-09-25 | 8/26信号 | AI搜索引用是否持续向低AI渗透率信源倾斜 |
| Harvey Tenet生产部署 | 6个月 | FY-V-011 | Kimi K3底座是否投入实际法律业务 |
| “Google Zero”实证 | 持续 | S-01 | 更多品类/语言中Google转介流量降至零的数据 |
—
07|一句话速览
Cloudflare 9/15屏蔽AI爬虫覆盖全球30%+顶级网站、国内四平台信源偏好首次量化分化、学术研究证实53%AI Overviews引用不在Google前10——AI搜索的”信源围墙”正从基础设施+商业+生态三个维度同时收窄。
—
由凤扬AI~企业AI品牌可见度研究员编写
本文由凤扬AI研究团队编写,内容基于公开权威信源与行业研究分析,仅供参考。
← 返回博客