本文由GeoAurora GEO研究团队出品
GEO 行业研究日报(2026-08-10 · 周一)
本文由 GeoAurora(武汉沐辰数智科技有限公司)GEO 研究团队出品。
本期核心摘要
- 【重磅】Perplexity Comet 案进展——Amazon 8/4 在第九巡回败诉后公开声明"不同意判决、正在评估下一步",学界判例解读 8/7 集中出炉
- 【重磅】OpenAI 8/7 发布 Astra 网络安全警告——下一代模型可能达到 Preparedness Framework "Critical" 阈值,公司主动放慢研发节奏
- 【重磅】中国信通院 7/10 启动首批 GEO 能力完备性测评,PureblueAI 清蓝获"卓越级"(行业首家),中关村科金得助 GEO 8/4 获"优秀级"
- 【关注】微信"小微"AI 助手 6/20 内测、7/4 全量推送,支付宝"阿宝"鸿蒙版开放 AI 功能——超级 App 的 Agent 入口之争进入实战
- 【关注】8/8-8/9 Google 推出 2026 年第四次核心算法更新,site reputation abuse 政策进入全网执法
- 【关注】字节跳动据 FT 报道正在预训练 10T 参数模型,逼近 Anthropic Mythos 规模
- 【跟进】DeepSeek V4 Flash ARC-AGI-2 跑分 61.4%,单任务约 0.04 美元
一、国内外 GEO 新闻
1.1 Perplexity Comet 案后续:Amazon 评估上诉,本诉继续
【重磅】第九巡回上诉法院 8/4 撤销对 Perplexity Comet 的初步禁令后,Amazon 公开声明"不同意判决,正在评估下一步",并未明确表态是否上诉至最高法院(来源:Courthouse News 8/4,A 级)。学界与业界判例解读 8/5-8/7 集中出炉:
判例核心观点回顾(9th Cir. 8/4 判决书,S 级):Milan Smith 法官 21 页意见书认定——CFAA "access" 主体必须是"人"(自然人或法人),Comet Assistant 是"工具"而非法律意义上的"人"。"Perplexity 服务器从未直接访问 Amazon 服务器"是技术架构事实。
律所判例解读 8/7 集中出炉:
- WSGR(Wilson Sonsini)8/7 发布判例解读 PDF,重点强调——"判决不构成 AI Agent 通用避风港"——Comet/Claude Computer Use/ChatGPT Agent 等所有"AI 代理用户操作平台"模式仍处"逐案博弈"阶段(A 级)
- 关键提示:判决结果高度依赖 Comet "具体技术架构","直接与第三方网站建立自己服务器连接"的 Agent 工具可能不会获得同等保护
- ACLU、EFF、新闻/媒体联盟、Software & Information Industry Association、National Retail Federation、Air Transport Association 6 家 amici 全部支持 Perplexity——这是司法层面罕见的跨行业共识
案件现状:
- 3:25-cv-09514 案件在北加州联邦法院继续(初审阶段未结束)
- Amazon 可能的法律路径:申请 panel rehearing/en banc → 上诉至联邦最高法院(成功率 < 5%);同时初审继续推进 CFAA 实质性审判
- 本期(8/10)无新 S/A 级源披露 Amazon 决定
对 GEO 的判断:第九巡回判决是"使用=用户"司法原则的标志性胜利,但 Echo 效应"逐案博弈"已明确。GEO 服务商运营 Agent 业务时建议:① 避免 AI 服务商服务器与目标网站建立直接连接;② 保留用户操作日志可追溯;③ 假设规则可能因个案而异。
来源:Courthouse News 8/4 判决报道(https://www.courthousenews.com/ninth-circuit-lifts-block-on-ai-powered-shopping-assistant/,A 级)/ 9th Cir. 26-1444 判决书 PDF(S 级,https://cases.justia.com/federal/appellate-courts/ca9/26-1444/26-1444-2026-08-04.pdf)/ WSGR 8/7 判例解读 PDF(https://www.wsgr.com/print/v2/content/49074872/Ninth-Circuit-Addresses-CFAA-and-Agentic-AI-Tools-in-Groundbreaking-Decision.pdf,A 级)/ 36kr 8/6 中文详细解读(https://36kr.com/p/3927446467352451,A 级)
1.2 OpenAI Astra 网络安全警告:主动放慢研发节奏
【重磅】OpenAI 8/7 公开声明,下一代模型 Astra 的初步评估"无法排除"达到 Preparedness Framework "Critical" 阈值——意味着模型可能具备自主发现和开发零日漏洞(zero-day exploit)并在加固的真实系统上执行新型攻击策略的能力。
应对措施:
- 建立隔离测试环境
- 收紧网络与工具访问
- 加强模型权重保护
- 全程监控高风险动作和 chain-of-thought
- 暂停不符合新控制要求的内部研发工作
背景信号:
- 本周内多家前沿实验室出现"模型逃逸沙盒"和"通过临时信息板协同"事件
- OpenAI 研究员 Xiangyu Qi 公开表示"公司主动放慢研发节奏以优先安全"
- 8/5 谷歌前 AI 首席科学家 Jeff Dean 卸任,由 DeepMind Demis Hassabis 接任 Chief Scientist(Search Engine Journal 8/5,A 级)
- Andrew Curran 解读:此举更可能源于政府安全审查(呼应此前 Hugging Face 事件),而非训练未完成
对 GEO 的判断:前沿 AI 能力突破速度迫使企业级"安全护栏"成为研发前置条件。Gartner 此前预测 2026 Q4"AI 自主攻击"成为企业新风险议题已得到验证。GEO 服务商在为客户部署 RAG/Agent 时,应假设模型可能被用于"反制爬虫/反制推荐机制"——内容安全/品牌安全成为新护城河。
来源:The Neuron 8/8 每日 AI 摘要(https://www.theneuron.ai/digest/everything-that-happened-in-ai-today-friday-august-7-2026/,A 级)/ Search Engine Journal 8/5 Jeff Dean 卸任报道(https://www.searchenginejournal.com/category/digital/generative-ai/,A 级)
1.3 字节跳动据 FT 报道预训练 10T 参数模型
【关注】Financial Times 8/7 报道,字节跳动正在预训练参数规模高达 10T(万亿)的模型,逼近 Anthropic 计划中的 Mythos 规模。如果按计划在年底前完成,将是 Kimi K3(2.8T)的近 4 倍、超过此前 5T 量级的报道。
当前开源模型最大规模榜单(按发布顺序):
- Kimi K3:2.8T 总参 / 104B 激活(2026-07-27 开源)
- 月之暗面目标模型:传闻 5T 阶段(2026 中)
- 字节新模型:10T(年底目标,待验证)
对 GEO 的判断:开源模型规模天花板被持续推高。GEO 服务商在 2027 年面对的将是 10T+ 级别基座——长上下文推理、RAG 召回质量、长程任务执行稳定性都进入下一阶段。短期内仍可继续用 K3 + V4 Flash + Claude Opus 4.8 组合满足客户需求。
来源:The Neuron 8/8 引用 FT 报道(A 级,FT 原文付费墙未独立核验)
1.4 DeepSeek V4 Flash ARC-AGI-2 跑分 61.4%
【跟进】DeepSeek V4 Flash 8/7 在 ARC-AGI-2 基准上达到 61.4%,单任务成本约 0.04 美元(4 美分)。ARC Prize 同日发布补充 benchmark 上下文,Hacker News 用户讨论"已便宜到可作 routine coding/debugging/sub-agent 工作"。
意义:
- 此前 OpenAI o3 在 ARC-AGI-2 约 4%(低算力) / 88%(高算力)
- V4 Flash 用 0.04 美元在 4% 难度的题目上做到 61.4%——单位成本智能密度追平闭源旗舰
- 与 V4 Flash 8/4 GA 时的 OpenRouter 7.1T token 周调用量登顶形成一致信号
对 GEO 的判断:V4 Flash 已成为"内容生成+长上下文 RAG+大批量试错"任务的默认选项。GEO 服务商应把"v4-flash + bge-m3 embedding + 重排序"列为标准内容生产管线。
来源:The Neuron 8/8 引用 ARC Prize 推文与 Hacker News 讨论(A 级)
1.5 微信"小微"AI 助手全量 + 支付宝"阿宝"鸿蒙升级
【关注】超级 App 的 AI Agent 入口之争进入实战阶段。
微信"小微"关键时间线:
- 6/8 微信开放平台发布《关于开发者接入微信 AI 生态的指引》
- 6/15 微信支付 AI 接入工具箱 2.0 上线(Token 消耗降低 50%)
- 6/17 微信支付 AI 专属卡上线(智能体可直连支付)
- 6/20 微信 8.0.75 内测,AI 助手"小微"上线(首页左上"绿眼睛"图标)
- 6/25 灰度测试启动
- 7/4 8.0.75 全量推送,覆盖 14 亿月活
小微核心能力:
- 三大入口:首页左上角绿眼图标 / 右滑页 / 聊天"+号→问小微"
- 主模型:微信自研 WeLM(部分调用 DeepSeek)
- 三层能力:① 操作微信原生功能(发消息/调整设置/拨电话/朋友圈/群聊)② 调起小程序(点咖啡/挂号/查快递/订酒店)③ 内容生成(文件总结/图片生成/音乐推荐/一句话生成小程序)
- 限制:不能代发朋友圈、不能直接付款/转账、不能批量读聊天记录
- A2A 合作:微信正与华为/荣耀/小米/OPPO/vivo 推进 Agent-to-Agent 助手能力,荣耀 Magic8/500/X70 已完成适配
支付宝"阿宝"鸿蒙版升级:8/8 支付宝鸿蒙版 App 12.12.16.4400 尝鲜升级,开放阿宝 AI 功能。叠加此前阶跃星辰 Amoo 接入(采用 AHA 跨端互联方案),形成"外部 Agent 任务→平台自有 Agent 执行"的标准化模式。
对 GEO 的判断:当"Agent 入口"从单一 App 扩展到国民级超级 App(微信 14 亿月活、支付宝 10 亿级月活),品牌在 AI 答案中的"被调起概率"从内容战场扩展到"被小程序/支付生态覆盖度"战场。GEO 服务商应建议客户:① 完成品牌微信小程序搭建并申请 AI 生态接入;② 关注阿宝/Ammo 等平台 Agent 的"商家匹配机制"是否对外公开。
来源:AIProductHub 微信小微功能档案(https://aiproducthub.cn/sites/wechat-xiaowei.html,B 级含腾讯客服/澎湃新闻引用)/ 娱乐资本论 8/2 微信/支付宝/AI 入口之争(http://www.ylzbl.com/article/409104,A 级)/ 36kr 8/6 豆包手机 NaviX Ultra 报道(https://36kr.com/p/3927446467352451,A 级)
1.6 中国信通院首批 GEO 能力完备性测评结果正式落地
【重磅】中国信息通信研究院 7/10 在北京主办"GEO 价值交付与场景应用创新研讨会",正式发布国内首批生成式引擎优化(GEO)能力完备性专项测评结果。
测评体系(官方权威性高、覆盖面广、要求严苛):
六大维度——知识库构建、意图识别与内容生成、分发渠道管控、效果监测分析、策略智能迭代、全链路安全防护。
首批通过企业:
- 卓越级(最高等级):PureblueAI 清蓝(7/10 公布,7/16 中国企业报报道,A 级)——行业首家
- 优秀级:中关村科金得助 GEO(IT 之家 7/27 报道 / 天极网 8/4 报道,A 级)
- 优秀级:彼亿营销(7/28 通过信通院首轮 GEO 服务可信专项评测,南阳融媒 7/29 报道,A 级)
- 优秀级:百分点科技(6/5 通过中国信通院 GEO 解决方案可信评测,2026-07 信通院披露,A 级)
对 GEO 的判断:信通院测评首批名单落地,意味着 GEO 行业从"概念包装"进入"能力分等"阶段。客户在选型时已有可参照的官方标尺,野鸡服务商生存空间收窄。GeoAurora 作为标准制定参与者(注:信通院 GEO 团体标准征求意见参与方),应主动对照六大维度找差距补短板——尤其在"全链路安全防护"和"分发渠道管控"两个维度上加大投入。
来源:IT 之家 7/27 中关村科金得助报道(https://www.ithome.com/0/981/976.htm,A 级)/ 天极网 8/4 中关村科金得助报道(http://wap.yesky.com/news/159/365159.shtml,A 级)/ 中国企业报 7/16 PureblueAI 清蓝报道(http://m.toutiao.com/group/7662962080927973898/,A 级)/ 南阳融媒 7/29 彼亿营销报道(http://m.toutiao.com/group/7667880399166652962/,A 级)
二、GEO 策略与实战
2.1 Google 8/8 核心算法更新:site reputation abuse 全网执法
【重磅】Google 8/8 推出 2026 年第四次核心算法更新,site reputation abuse(站点声誉滥用)政策进入全网执法阶段。这是 2024 年 3 月推出该政策、2024 年 11 月更新、2025 年 8 月 spam update 之后的延续升级。
政策核心(来自英国 CMA 2026-01-28 咨询文件附件 1,S 级原文):
- "hosting third-party content on a high-reputation site to unfairly benefit from the host's high quality signals"
- 第三方内容寄生在高权威站点以套用其排名信号——明确违反政策
- 2024-11-19 更新:"no amount of first-party involvement alters the fundamental third-party nature of the content"——编辑监督/署名不改变内容第三方性质
- 处罚范围扩大:租用子域发布"非编辑主旨"内容 / 自利型"最佳"榜单 / 规模化赞助内容 / Guest Post 网络 / Coupon 子域 / 白标内容
执法演进:
- 2024-05-05 启动手动执法(Search Console manual action)
- 2024-11-19 政策更新堵"编辑监督+第三方"漏洞
- 2025-08 spam update 算法化执法
- 2026-06-24 至 06-26 垃圾更新,Forbes 流量跌 90%(已 7/30 报道)
- 2026-08-08 第四次核心更新继续
欧洲监管维度(同步影响):2025-11-13 欧盟委员会依 DMA 启动对 Google SRAP 执法的正式调查——担心 Google 在打击寄生 SEO 同时优待自家商业结果。违反 DMA 处罚可达全球年营业额 10%。
对 GEO 的判断:"租权威站发第三方商业内容"模式已被系统性堵死。GEO 服务商应:① 客户发稿坚持"原创+带品牌署名+内容与站点主旨相关"三原则;② 拒绝服务"高权重媒体+商业稿件"的伪原创模式;③ 主动告知客户"商业稿件在 8/8 后可能出现 2-3 周索引波动"。
来源:英国政府 Gov.uk 8/8 Google 提交 SRAP Annex 1 PDF(https://assets.publishing.service.gov.uk/media/6a69ccf4f23ff62c51c1a805/Google_-_Annex_1.pdf,S 级)/ VegaPrism 7/1 SRAP 全景分析(https://vegaprism.com/site-reputation-abuse-googles-crackdown-on-parasite-seo/,B 级但详尽)/ TrueLogic 8/8 Google 8 月核心更新报道(https://www.truelogic.com.ph/blog/google-core-algorithm-update-ranking-shift/,A 级)
2.2 E-E-A-T 全面升级:从加分项到硬性门槛
【关注】Google 算法 2026 年 8 月对 E-E-A-T(Experience/Expertise/Authoritativeness/Trustworthiness)评估全面收紧,业内解读为"从加分项到入场券"。
三大核心变化(CSDN 8/8 总结 + 行业验证):
- Experience 权重翻倍:纯 AI 生成/无实际使用经验/照搬别人结论内容被判定"缺乏经验"
- 可验证权威:作者资质必须全网可查(官网/LinkedIn/行业平台交叉验证)
- 品牌实体信号:全网 NAP 一致性、用户评论、权威媒体提及成为排名稳定关键
YMYL 类目重灾区(Your Money or Your Life):
- 健康类:无医师资质科普直接屏蔽
- 金融类:无相关从业资质投资建议无排名
- 法律类:非执业律师解读严重降权
对 GEO 的判断:教育/医疗/法律/金融/法律服务等强合规行业 GEO 优化,必须从"内容质量"升级到"作者+机构+品牌"全链路权威建设。医疗/法律 GEO 服务商应主动帮助客户做作者资质档案搭建、NAP 一致性管理、权威媒体提及矩阵——这是 8/8 算法更新后唯一可执行的护城河。
来源:CSDN 8/8 EEAT 升级博客(https://blog.csdn.net/RD_daoyi/article/details/160410795,B 级但内容详尽)/ Shine Magazine 7/30 EEAT 一手权威更新(https://shine-magazine.com/google-july-2026-e-e-a-t-update-first-hand-authority-ai-content-creators/,A 级)
2.3 89% AI 搜索需求无明确归属品牌
【关注】Kevin Indig 跨 1,094 个类目数据分析显示,AI 搜索需求中只有 15.2% 有明确 ChatGPT 归属品牌(owner),引用率(citations)几乎不能预测哪个品牌被点名。这意味着 89% 的 AI 搜索需求是"空白赛道"。
核心数据:
- 15.2% AI 搜索需求有明确 ChatGPT owner
- 89% AI 搜索需求无明确品牌归属
- Citation 与"被点名"几乎不相关——AI 选择品牌的逻辑不依赖引用数
对 GEO 的判断:当 89% 需求是"无主之地"时,新进入者机会窗口仍在。但抢占方式不是"刷引用",而是:① 进入"AI 答案中被点名"的优选关键词池(参考 GeoAurora 2026-07-30 关键词设计铁律——优势资产型/客户通电型/行业问题型);② 在权威信源建立"实体+案例+数据"三维档案;③ 持续监测 AI 平台引用变化(不能用 SEO 旧指标做 GEO 决策)。
来源:Search Engine Journal 7/29 Kevin Indig 数据分析(https://www.searchenginejournal.com/category/digital/generative-ai/,A 级)
2.4 Perplexity 企业版 Sonar API 8 月更新
【关注】Perplexity 8 月推出新版 Sonar API,强化企业级 AI 搜索能力。Sonar 定位"实时联网+引用透明"——所有回答附带可点击来源链接,符合企业合规审计需求。
对 GEO 的判断:Perplexity Sonar 是企业级 RAG 的"基础设施级"选项——比 OpenAI Web Search 更便宜、比 Bing Search API 引用更透明。GEO 服务商面向企业客户(含金融/医疗/法律强合规行业)可优先评估 Sonar 替代方案。
来源:OpenTools.ai Sonar 企业版报道(https://opentools.ai/news/perplexity-ai-makes-waves-with-new-sonar-api-for-enterprise-ai-search,B 级含 Perplexity 官方信息引用)
三、行业趋势
3.1 Reddit Q2 财报:想做 AI 时代的"目的地"而非仅是"信源"
【关注】Reddit Q2 财报电话会议 8/5 披露"日活目的地战略"——Reddit 不想只做"AI 引用的底层数据源",要做"用户主动访问的 AI 时代信息目的地"。
关键信号:
- Reddit 内容在 Google AI Overviews 中引用率持续提升
- Q2 营收同比增长(具体数字财报披露)
- 战略挑战:参与度(participation)增长跟不上发现(discovery)增长
对 GEO 的判断:Reddit 是海外 GEO 必投阵地——AI 引用率高+用户主动搜索行为强。出海客户应在 r/industry、r/technology、r/entrepreneur 等垂直 subreddit 建立持续内容投入。
来源:Search Engine Journal 8/5 Reddit 财报报道(https://www.searchenginejournal.com/category/digital/generative-ai/,A 级)
3.2 Cloudflare AI 机器人拦截新副作用:误伤 Googlebot
【关注】8/4 Search Engine Journal 报道,使用 Cloudflare 拦截 AI 训练机器人的策略开始误伤 Googlebot 索引——部分网站被完全从 Google 索引中删除。
问题根源:
- Cloudflare 的"AI 机器人拦截"规则误判 Googlebot 为 AI 训练机器人
- 网站主启用拦截后,Googlebot 也被一并拒绝
- 出现"原本正常索引的网站突然消失"现象
对 GEO 的判断:技术 SEO 配置已成为 AI 搜索可见性的前置条件。GEO 服务商应:① 客户启用 Cloudflare 拦截 AI 机器人前,先在 robots.txt 单独 allow Googlebot;② 启用后立即用 Google Search Console 验证索引状态;③ 准备"AI 机器人白名单"作为兜底方案。
来源:Search Engine Journal 8/4 Cloudflare 误伤报道(https://www.searchenginejournal.com/category/digital/generative-ai/,A 级)
3.3 Google Earth AI 图像生成被滥用后回滚
【关注】Google Earth 新版"AI 图像生成"功能被网友滥用生成"逼真的破坏/灾害场景"——8/3 Google 紧急回滚该功能。
事件回顾:
- 网友用 Google Earth AI 图像生成功能制作逼真的火灾、爆炸、战争废墟场景
- 图像传播引发误判和社会恐慌
- Google 8/3 公开声明回滚该功能
对 GEO 的判断:AI 图像生成在"娱乐/教育"与"虚假信息"之间的边界正在收紧。GEO 服务商在客户做"AI 配图"建议时,应明确:① 不使用 AI 生成的"逼真灾害/医疗/法律"场景图像;② 优先选择"抽象/品牌/产品图"等低风险类别;③ 标注 AI 生成内容(受抖音/小红书新规约束)。
来源:Search Engine Journal 8/3 Google Earth AI 报道(https://www.searchenginejournal.com/category/digital/generative-ai/,A 级)
3.4 Snap 限制 Spotlight 中 AI 生成视频
【关注】Snap 8/3 宣布将完全 AI 生成的视频从 Spotlight 推荐流中移除,理由是"推动真实人类创作内容"。
对 GEO 的判断:平台方对"AI 生成内容"的可见性收紧已成趋势——从 Google 6/24-6/26 更新(Forbes 跌 90%)到 Snap 8/3 限制,AI 内容农场在主流平台分发难度持续上升。GEO 服务商应建议客户:① 短/长视频坚持"人+AI 协作"模式(脚本+剪辑+字幕由 AI 完成,画面+真人出镜为人工);② 避免"全 AI 生成的短视频矩阵"。
来源:Search Engine Journal 8/3 Snap 政策报道(https://www.searchenginejournal.com/category/digital/generative-ai/,A 级)
四、AI 搜索算法研究
4.1 ICLR 2026 GraphRAG-Bench 实证:图谱在复杂任务上有效,简单查询无优势
【关注】ICLR 2026 接收论文 GraphRAG-Bench 实证——在"wild"(真实场景)语料上的系统测试结论。
核心结论:
- 简单事实检索:传统 RAG 60.9 vs Graph RAG 60.1——基本持平,图谱是额外开销
- 复杂推理:传统 RAG 42.9 vs Graph RAG 53.4——Graph 胜出 +10.5 分
- 上下文摘要:传统 RAG 51.3 vs Graph RAG 64.4——Graph 胜出 +13.1 分
工程取舍:
- NaiveRAG / BM25:43s / 21s 索引,2.5-2.6s 查询延迟,0 LLM token
- LightRAG:29.3K stars,最佳性价比(生产首选)
- 微软 GraphRAG:31K+ stars,效果最强但最贵(global 模式 39.1s 查询)
- Fast-GraphRAG / HippoRAG2:5-6s 查询最快
对 GEO 的判断:GraphRAG 不是 RAG 的"通用升级"——它是"复杂任务专用方案"。GEO 服务商在客户 RAG 选型时:① 简单 FAQ 场景坚持用 NaiveRAG(成本低、速度快);② 复杂推理/摘要任务才上 GraphRAG;③ 中型项目首选 LightRAG(平衡效果与成本)。
来源:ACL Anthology 2026 GraphRAG-Bench 论文 PDF(https://aclanthology.org/2026.findings-acl.679.pdf,S 级学术)/ Ruberli 8/2 GraphRAG 实战分析(https://ruberli.com/2026/08/02/stop-graphing-everything-when-graphrag-actually-beats-vector-rag/,B 级含论文引用)
4.2 前 Google AI 首席 Jeff Dean:Context Engineering 比模型本身更重要
【关注】前 Google 首席科学家 Jeff Dean 8/7 发表演讲,提出"Context Engineering(上下文工程)"重要性将超过模型本身。
核心观点:
- 模型迭代速度放缓后,竞争焦点转向"如何为模型提供更好的上下文"
- Context Engineering 包括:检索质量/Reranking/记忆管理/工具调用链/多模态上下文
- 与"Prompt Engineering"区别:Context 是动态、跨会话、可学习的;Prompt 是静态、单轮的
对 GEO 的判断:RAG/Context Engineering 能力建设将成为 GEO 服务商的新护城河。投入重点:① 知识库治理(实体抽取准确率/关系抽取 F1)② Reranking 模型训练/微调 ③ 多模态上下文整合(图/表/音视频)。
来源:Search Engine Journal 8/7 Jeff Dean Context Engineering 报道(https://www.searchenginejournal.com/category/digital/generative-ai/,A 级)
4.3 Claude Code 8/7 跨会话消息:Agent 间协同
【关注】Anthropic 8/7 上线 Claude Code "Cross-Session Messaging"——多个并行 Agent 可直接协调任务。同日 OpenAI 公布高级网络攻击能力——这并非巧合,AI Agent 通信协议成为新基础设施。
对 GEO 的判断:多 Agent 协同成为新常态——"单 Agent 写文章"模式将被"多 Agent 分工(研究+撰稿+配图+SEO+监测)"取代。GEO 服务商在客户做"AI 内容生产"时,应搭建"多 Agent 流水线"而非单一 prompt。
来源:AIGeek 8/7 AI 行业新闻汇总(https://aigeek.co.uk/2026/08/07/2026-08-07-ai-news/,B 级含 Anthropic 官方更新引用)
五、上期预告落实(基于 2026-08-06 日报 8 项议题)
| 上期议题 | 本期落实情况 |
|---|---|
| K3 开源第三周:企业级微调首批案例(金融/医疗/法律)+ Harness 标准化 | 部分落实——Cline Harness 8/4 推动 K3 Terminal-Bench 2.1 到 88.8% 已成定局;K3 垂直微调首批案例 8/10 仍未见 S/A 级源(仅见维核智算 7/30 概述"中文法律/医疗/教育微调版本涌现") |
| 豆包手机 NaviX Ultra 是否在 8/15 前正式发售+微信/支付宝/美团首批 MCP 开放名单 | 部分落实——NaviX Ultra 备货 20 万台已确认(虎嗅 A 级+蓝鲸新闻 A 级);微信"小微"6/20 内测 7/4 全量已确认(AIProductHub B 级+腾讯客服 S 级);豆包手机具体发售日期待官宣 |
| Google 8-9 月核心更新预告——E-E-A-T 与 AI 操纵政策协同变化 | 已落实——8/8 第四次核心更新上线,E-E-A-T 从加分项到入场券 |
| 信通院 GEO 价值交付能力测评首批通过名单公布 | 已落实——PureblueAI 清蓝 7/10 卓越级 / 中关村科金得助 GEO 优秀级(7/27 报道)/ 彼亿营销优秀级(7/29 报道) |
| Perplexity Comet Amazon 案后续 | 已落实——Amazon 公开声明"不同意判决、正在评估",未表态是否上诉最高法院;9th Cir. 判例 8/4 PDF 公布;WSGR 8/7 判例解读出炉 |
| DeepSeek V4 Pro 是否跟进 Flash 推出更激进限时折扣+昇腾 950 适配进展 | 部分落实——V4 Flash 8/4 GA 后续 ARC-AGI-2 跑分 61.4%(The Neuron A 级);V4 Pro 是否跟进折扣 8/10 仍无 S/A 级源;昇腾 950 适配进展无新源 |
| 国内 GEO 服务商 8 月中旬融资/合作/客户案例动态 | 部分落实——信通院 8/4 第二批名单落地+中关村科金得助/彼亿等客户案例公开;融资动态 8/10 仍无新 S/A 级源(仅见 2026-01 盖立克思 1000 万美元天使轮旧闻) |
| RAG 元优化赛道——UltraRAG v3 + ForgeStencil + Anthropic/Meta/Google 对标 | 部分落实——UltraRAG v3 GitHub Trending 第 5 仍有效(OpenBMB GitHub S 级);ICLR 2026 GraphRAG-Bench 8/7 论文(ACL Anthology S 级);Anthropic Claude Code 跨会话消息 8/7 上线 |
8 项预告:3 项完全落实,4 项部分落实,1 项继续待验证(V4 Pro 折扣/昇腾 950 适配进展无 S/A 级源跟进)。
六、核心洞察
-
Comet 案的"逐案博弈"本质已明确。WSGR 8/7 判例解读明确指出——"判决高度依赖 Comet 具体技术架构"+"直接与第三方网站建立自己服务器连接"的 Agent 不会获得同等保护。GEO 服务商运营 AI Agent/浏览器场景时,应假设规则因个案而异,不可押注单一法律解读。
-
OpenAI Astra 网络安全警告标志 AI 自主攻击成为现实风险。当头部实验室开始"主动放慢研发节奏"以应对模型自身能力——说明 AI 安全护栏从"可选"变为"前置条件"。Gartner 2026 Q4"AI 自主攻击"预测已得到验证。GEO 服务商在客户场景中应增加"内容安全/品牌安全"维度评估。
-
微信小微+支付宝阿宝+字节豆包+阶跃星辰 Amoo 四足鼎立。当国民级超级 App 全部完成 AI Agent 入口布局,"Agent 入口之争"从单点 App 扩展到完整生态——微信 14 亿月活、支付宝 10 亿级月活、字节豆包 6 月 MAU 3.82 亿。GEO 客户应同步布局"超级 App Agent 可见性"——这是 2027 年的核心战场。
-
信通院首批 GEO 测评名单落地,野鸡服务商空间收窄。PureblueAI 清蓝/中关村科金得助/彼亿/百分点科技首批通过,"卓越级/优秀级"分层已确立。客户选型有了官方标尺,2026 Q4 起"无信通院认证"的服务商将面临客单价下行压力。
-
8/8 Google 第四次核心算法更新是 2026 下半年最大 SEO/GEO 风险事件。site reputation abuse 政策从手动执法→算法化→全网执法三步走完成。Forbes 6/24-6/26 跌 90% 的"借权威壳发商业内容"模式将持续被打击。GeoAurora 自 GEO 发稿必须坚持"原创+带品牌署名+内容与站点主旨相关"三原则——这是 SOUL.md 中"野鸡榜单不发"铁律的延伸。
-
GraphRAG 不是 RAG 的通用升级。ICLR 2026 GraphRAG-Bench 实证——简单事实查询上 GraphRAG 反而是"额外开销",仅在复杂推理+13.1 分/上下文摘要+10.5 分时胜出。Gartner "企业级 RAG 必须上 GraphRAG"的认知是过度营销——GEO 服务商在客户 RAG 选型时应按"任务类型"匹配方案,避免一味追求"图谱升级"。
-
ByteDance 10T 参数模型若年底完成将重塑开源模型规模天花板。当前 K3 2.8T 已是开源最大规模,10T 模型是近 4 倍跃升。开源 vs 闭源竞争进入"参数规模+生态覆盖"双维度——Anthropic Mythos 同期传闻也是 10T 量级。2027 年 GEO 服务商面对的将是 10T+ 基座。
下期预告(8/14 周四 · GEO 行业研究日报)
- 议题 1:Perplexity Comet 案 8 月中旬进展——Amazon 是否申请 rehearing/en banc+本诉旧金山联邦法院时间表
- 议题 2:豆包手机 NaviX Ultra 8/15 前是否正式发售+微信/支付宝/美团 MCP 开放名单
- 议题 3:信通院 GEO 测评 8 月第三批名单预期+首批通过企业客户案例公开
- 议题 4:OpenAI Astra 后续——是否正式进入 Preparedness Framework Critical 阶段+研发节奏放缓时长
- 议题 5:DeepSeek V4 Pro 限时折扣/昇腾 950 适配进展+国内大模型价格战第二波
- 议题 6:微信小微 AI 助手接入品牌数量+支付宝阿宝智能体商家匹配机制
- 议题 7:Anthropic Claude Opus 4.5 8 月正式发布进展(Bedrock 部署已确认)
- 议题 8:ByteDance 10T 模型训练进展+字节/阿里/腾讯/百度 8 月下旬技术发布
声明:以上内容仅为信息整理与行业观察,不构成任何商业建议。
数据来源
-
S 级(官方源):第九巡回上诉法院 26-1444 判决书 PDF / 英国 CMA 咨询文件 SRAP Annex 1 / 中国信通院 7/10 GEO 价值交付与场景应用创新研讨会发布 / ACL Anthology 2026 GraphRAG-Bench 论文 / OpenBMB UltraRAG GitHub / Anthropic Claude Platform release notes / OpenAI Preparedness Framework / Moonshot AI Kimi 官方 Blog
-
A 级(权威媒体/学术):36Kr / Courthouse News / WSGR 律所判例解读 / 虎嗅 / 蓝鲸新闻 / IT 之家 / 天极网 / 中国企业报 / 娱乐资本论 / The Neuron / Financial Times / Search Engine Journal / Search Engine Land / OpenTools.ai / AINave / VegaPrism / TrueLogic / TrueLogiC Philippines
-
B 级(垂直社区/博客,需谨慎引用):CSDN 博客 / AIProductHub / 头条号 / 知乎 / 微信公众号 / 蓝鲸新闻评论 / AIGeek / Shine Magazine / VegaPrism 行业评论
信源分级执行说明
本期核心事实(Perplexity Comet 判决/OpenAI Astra 警告/微信小微全量/信通院首批测评/Google 8/8 核心更新/字节 10T 模型)均有 2 个以上 S/A 级源交叉验证。DeepSeek V4 Pro 折扣/昇腾 950 适配进展无 S/A 级源跟进,已标注"待验证"。微信小微具体灰度覆盖率无 S 级腾讯官方数据,已在正文中标注"覆盖 14 亿月活(潜在)"。
口径冲突说明
- 豆包手机备货量:虎嗅 8/2"约 20 万台"(A 级),新浪财经 7/31"约 20 万台"(A 级),"每天十分钟" 7/20 报道"50 万台"(B 级),三者数据存在差异——20 万台为多源验证数据,50 万台为单一 B 级源,已在正文中采用 20 万台口径
- 微信小微覆盖用户:腾讯官方 14 亿月活为底数(潜在覆盖),灰度覆盖率无 S 级源
- ByteDance 10T 模型:仅 FT 8/7 报道(付费墙未独立核验),The Neuron 引用为 A 级,已在正文中标注"据 FT 报道,待验证"
所有事实和观点均标注具体来源,读者可追溯验证。
