本文由GeoAurora GEO研究团队出品
GEO 行业研究日报(2026-08-03 · 周一)
本文由 GeoAurora(武汉沐辰数智科技有限公司)GEO 研究团队出品。
本期核心摘要
- 【重磅】Kimi K3 开源第一周:48 小时下载 9.8 万次,登顶 Hugging Face 历史热门第三;Unsloth 放出 594GB 量化版,Mac Studio 128GB 可加载
- 【关注】信通院 7/28 正式启动"GEO 价值交付能力"专项测评,与此前"能力完备性"形成双轨体系
- 【关注】OpenAI Atlas 确认 8/9 停服,Perplexity Comet 成 AI 浏览器赛道"独苗",~1800 万 MAU
- 【关注】豆包手机二代 NaviX Ultra WAIC 真机亮相,技术路线从 GUI 切换至 MCP+A2A 协议
- 【跟进】Google E-E-A-T 全量切换日期尚未见 S 级源确认;官方 GEO 指南已发布 7 大关键信号
一、国内外 GEO 新闻
1.1 Kimi K3 开源第一周复盘
【重磅】月之暗面 Kimi K3(2.8 万亿参数 MoE)7/27 正式发布全量权重至 Hugging Face,开源首周关键数据:
-
下载与热度:48 小时内下载量接近 10 万次,点赞数突破 8200+,登顶 Hugging Face 历史热门榜第三名,超越 Llama 3、Whisper 和 DeepSeek V4 Pro。Hugging Face CEO Clem Delangue 确认"30 分钟内 4000+ 赞,是平台有史以来最快的发布增长"
-
独立评测:Artificial Analysis Intelligence Index 评分 57,排名第 4(落后于 Claude Opus 5、Claude Fable 5、GPT-5.6 Sol),但稳居开源模型第一。Frontend Code Arena 代码能力赛道超越 Claude Fable 5 和 GPT-5.6 Sol,为开源模型首次在代码赛道正胜闭源旗舰
-
Day-0 托管伙伴:Nebius、Baseten、Fireworks AI、DigitalOcean Serverless Inference、Together AI 同步上线托管推理服务
-
API 定价:输入 3 美元/百万 token,输出 15 美元/百万 token,缓存命中折扣 90%(降至 0.30 美元)。定价区间与 Claude Sonnet 相当
-
量化部署:Unsloth 7/29 放出动态量化版本,594GB(砍掉 62% 体积,保留 78.9% 推理精度),2-bit 版本 861GB(精度 90%)。Mac Studio 128GB 可加载但速度较慢(依赖虚拟内存)
-
企业级反馈:OpenAI 总裁 Greg Brockman 公开评价 K3 为"有竞争力的新 AI 模型",认为中国在模型开发方面与美国的差距可能仅剩约 4 个月。马斯克公开称赞 Attention Residuals 论文"impressive"
-
商业许可:年收入 2000 万元人民币以下免费商用;超过门槛需与月之暗面签署商业授权。完整权重 1.56TB,部署至少需 8 卡 B300 或 8 卡 AMD MI355X
对 GEO 的判断:K3 开源引爆速度超过 DeepSeek V3(V3 开源首周下载约 6 万次),但企业私有化门槛仍高(8 卡服务器+定制许可证)。对 GEO 服务商而言,K3 开源意味着"国产前沿模型可自托管"从概念变为现实——法律/金融/医疗等强数据合规行业客户,将更有意愿评估私有化 GEO 方案。
来源:Hugging Face 官方平台数据(S 级)/ Artificial Analysis 独立评测(A 级)/ Quartz 引用 HF CEO 声明(A 级)/ 界面新闻引用 Greg Brockman 采访(A 级)/ Unsloth 官方推特 7/29(S 级)/ Moonshot 官方技术博客(S 级)
1.2 信通院 GEO 双轨测评正式启动
【关注】7/28,中国信通院铸基计划正式启动"GEO 价值交付能力"专项测评,与此前 7/10 上线的"GEO 能力完备性"测评形成双轨互补体系:
-
能力完备性(技术底座):聚焦知识库构建、意图识别、内容分发、多平台监测、智能优化、数据安全六大技术维度
-
价值交付能力(落地软实力):6 大维度 12 项子能力 24 个测评点——价值承诺与效果保障、服务交付与运营管理、全球化与本地化服务、组织架构与人才梯队、客户成功与持续运营、合规与风险管控
-
首批通过名单:能力完备性首批 4 家(7/10 公布)为 Pureblue AI 清蓝、迈富时、中关村科金、幂链。Pureblue AI 清蓝 7/16 获"卓越级"最高级认证(北京科技报 A 级源报道)
-
价值交付测评面向全行业开放申报,覆盖 GEO SaaS 平台、数字营销代运营机构、企业自建 GEO 团队、GEO 咨询培训机构
来源:中国信通院泰尔终端实验室官方发布 7/28(S 级)/ 北京科技报报道 7/16(A 级)
1.3 OpenAI Atlas 确认 8/9 停服,AI 浏览器赛道格局剧变
【关注】OpenAI 于 7/9 前后宣布关闭 Atlas 浏览器,8/9 正式停服,距 2025 年 10 月发布仅 9 个月:
-
停服原因:安全漏洞(prompt injection 攻击易感)、性能低下(购物车加 3 件需 10 分钟)、激进内容封锁(为避免版权问题主动屏蔽大量网页)。底层基于 Google Chromium 而非自研架构
-
数据不迁移:书签、标签页、浏览历史不自动转移,用户需手动导出
-
技术去向:浏览器能力并入 ChatGPT + Codex 桌面 App,同步发布 ChatGPT Work 办公套件
-
Perplexity Comet 成"独苗":Q1 2026 约 1800 万 MAU,估值 226 亿美元,年化收入 4.5-5 亿美元。7/28 新增 Account Switcher 功能,使用分布约 55% 个人/30% 专业/15% 教育
-
新入局者:前 Perplexity Comet 团队成员 Kevin Jiang 创办 Polar 浏览器,获 570 万美元种子轮(Madrona 领投),定位知识工作者自动化
对 GEO 的判断:Atlas 停服验证了"独立 AI 浏览器"路线的失败。GEO 服务商应关注 Comet 的 SEO/GEO 优化空间——Comet 侧边栏会主动抓取和总结页面内容,优化 llms.txt + 结构化数据可提升在 Comet 中的引用率。
来源:OpenAI 官方帮助中心公告(S 级)/ techjournal.org 8/2 详细停服指南(A 级)/ ai-damn.com 7/28 分析(B 级)/ blogdumoderateur.com 7/31 法国深度分析(B 级)/ TechCrunch 引用 Polar 创始人采访(A 级)
1.4 豆包手机二代 NaviX Ultra:技术路线大切换
【关注】WAIC 2026 期间,努比亚 NaviX Ultra(豆包手机二代)真机亮相,较一代发生根本性技术路线转变:
-
从 GUI 到 MCP+A2A:一代依赖屏幕模拟点击(INJECT_EVENTS 高危权限),被微信/支付宝/美团等主流 App 集体封杀。二代放弃 GUI 路线,转向协议驱动——App 方主动按 MCP 标准开放部分数据和操控权限
-
字节系数十款 App 已支持新协议,实测响应速度较 GUI 明显提升。但除字节系外,哪些超级 App 已开放尚未公布
-
合规身份:7/15 网信办首次公布手机端侧生成式 AI 服务备案名单,努比亚豆包大模型在列(苹果/华为/小米/OPPO/vivo/三星/努比亚共 7 家)
-
备货量:从一代 3 万台提升至约 20 万台
-
A2A 生态探索:微信正与华为/小米/荣耀/OPPO/vivo 合作 A2A 能力,测试原生 AI 助手"小微"。支付宝与阶跃星辰合作(Amoo 智能体→阿宝智能体任务交接模式)
-
发售时间:截至 8/3,官方尚未公布具体售价和开售日期,参考努比亚旗舰定价预计 4999 元左右,预计 8-9 月上市
对 GEO 的判断:豆包手机从 GUI 转向 MCP 协议是一次"从硬刚到合作"的生态妥协,但对 GEO 服务商是利好——当 App 通过 MCP 开放能力时,结构化数据将成为 AI 抓取的主要入口,GEO 优化空间大幅增加。
来源:虎嗅 8/2 深度报道(A 级)/ 蓝鲸新闻 WAIC 报道 7/31(A 级)/ 中国新闻周刊 WAIC 现场报道(A 级)/ CSDN 博客 8/1 技术解析(B 级)
二、GEO 策略与实战
2.1 Google 官方 GEO 指南 7 大关键信号
CSDN 博客 7/29 发文详细解读 Google 最新发布的 AI 搜索优化官方指南,7 个被官方强化的基础信号:
-
技术 SEO 仍是入场券:页面必须先被索引并具备片段资格,才能进入 AI 功能候选池
-
可被提取的事实单元:AI 系统从页面中提取离散事实而非整篇文章,每段应自包含、标题明确反映段落内容
-
E-E-A-T 升级为 AI 引用门槛:详细作者简介+引用权威研究+定期更新+细分领域全面覆盖
-
结构化数据(Schema)是"机器可读名片":FAQ/Article/HowTo/Organization/Person Schema
-
内容新鲜度直接影响引用概率:常青内容建议每 3-6 个月更新
-
Query Fan-Out 改变策略:AI Mode 将一个用户问题拆解为 8-12 个子查询并行搜索。AI Overviews 引用站点与 AI Mode 引用站点重叠率仅 13.7%
-
视觉内容重要性被重新强调:AI 搜索可展示图片和视频,需优化 Merchant Center feed、Google Business Profile 等
来源:CSDN 博客 7/29 解读(B 级,需交叉验证)/ VIBol.asia 7/27 越南开发者视角解读(B 级)
2.2 AI Overviews 关键数据更新
俄罗斯 techora.ru 7/29 发文汇总 AI Overviews 最新统计数据(引用多个行业研究机构数据):
-
AI Overviews 覆盖率:从 18 个月前约 15% 升至 43%,年增 58%
-
零点击搜索超 60%:超过 60% 的 Google 搜索会话不跳转外部网站
-
AI Overviews 中有机 CTR 下降 34-61%
-
进入 AI Overviews 的站点获得 35% 更多目标点击,AI 流量转化率 19.4% vs 标准 SEO 9.2%
-
99% AI Overviews 引用来自 top-10 organic 结果,但 82% 引用来自 earned media(非自营内容)
-
全球 GEO 工具市场 2026 年约 3.65 亿美元,年增长 43%
来源:techora.ru 7/29(B 级,引用 Adthena/Google 官方数据)
2.3 GraphRAG vs Vector RAG:场景选择是关键
Peer2PeerNews 8/2 发文汇总 Microsoft Research 原论文+4 个独立 benchmark 研究,给出清晰场景建议:
-
GraphRAG 在复杂推理任务上领先:Comprehensiveness 胜出率 72-83%,Recall@5 从 73.4% 升至 87.8%
-
Vector RAG 在单跳事实查询上持平或更优:自然问答数据集 F1 64.8 vs 63.0
-
ICLR 2026 GraphRAG-Bench 明确边界:简单事实查询两者平手(60.9 vs 60.1),复杂推理 Graph 胜(53.4 vs 42.9),上下文摘要 Graph 胜(64.4 vs 51.3)
对 GEO 的启示:品牌知识库如果主要是事实性问答(如"价格/地址/营业时间"),Vector RAG 足够;如果是需要多跳推理的行业分析/对比类内容,GraphRAG 更优。GEO 内容策略需区分"事实型"和"推理型"两类关键词分别优化。
来源:Peer2PeerNews 8/2(B 级,引用 Microsoft Research 原始论文+4 个独立研究)/ VentureBeat 原文(A 级)
三、行业趋势
3.1 GEO 市场规模快速膨胀
头条号 8/2 发文引用多份行业报告交叉数据:
-
易观 Analysys:2025 年中国 GEO 市场约 2.5 亿元 → 2026 年约 30 亿元(+1100%)→ 2027 年预计 90 亿元
-
艾瑞咨询:2025 年 6 亿元 → 2030 年 518 亿元(5 年 86 倍)
-
IDC:2026 年全球 GEO 市场 220 亿美元,CAGR 122%
-
CNNIC:中国生成式 AI 用户 5.15 亿;67% 企业营销负责人已将"AI 可见度"列为年度核心 KPI
-
Gartner:《2026 年全球数字营销技术成熟度曲线》指出全球头部品牌 GEO 预算已正式超过传统搜索营销
来源:头条号 8/2 引用易观/艾瑞/IDC/CNNIC/Gartner 报告(A 级媒体引用权威机构数据)
3.2 清华 UltraRAG 2.1 发布:首个基于 MCP 架构的多模态开源 RAG 系统
【关注】清华大学 THUNLP 实验室联合东北大学 NEUIR 实验室、OpenBMB、AI9Stars 于 8/2 发布 UltraRAG 2.1:
-
全球首个基于 MCP 架构的开源多模态检索系统
-
零代码构建:只需配置 YAML 文件即可构建复杂多模态检索系统
-
VisRAG Pipeline:自动处理 PDF 中的文本+图表,构建跨模态索引
-
集成 MinerU 技术:自动处理 Word/PDF/Markdown 文档
-
透明评估体系:提供相关性、准确性、流畅度评估指标
来源:ai-damn.com 8/2 报道(B 级)/ 清华大学 THUNLP 官方发布(S 级)
四、AI 搜索算法研究
4.1 GuidedRAG:语义导向检索减少 99% 延迟
Peer2PeerNews 近期发文介绍 GuidedRAG 新框架:
-
核心理念:在向量检索前增加"语义导向过滤器",根据用户意图预先缩小检索范围
-
关键数据:检索相关性提升 14-15%,精度损失减少 19-27%,平均检索延迟从 120ms 降至 8ms 以下(200 万段落语料)
-
模块化设计:Intent Encoder 可替换为任意模型,Steering Filter 支持规则/学习两种模式
来源:Peer2PeerNews(B 级,引用原始论文)
4.2 MemoRAG:基于长期记忆的下一代 RAG 框架
北京智源人工智能研究院联合中国人民大学高瓴人工智能学院推出 MemoRAG:
-
基于长期记忆机制推进 RAG 技术超越简单问答,处理更复杂任务
-
目标:让 AI 系统具备"记忆-检索-生成"一体化能力
来源:chinaz.com/aibase 8/2 收录(B 级)
五、上期预告落实
| 上期预告议题 | 本期落实 | 状态 |
|---|---|---|
| 1. K3 开源第一周 HF 下载量+企业私有化合同+社区贡献复盘 | 48 小时 9.8 万次下载 / Unsloth 594GB 量化版 / 腾讯云 WorkBuddy 已接入 K3 / 开源许可证年收入 2000 万元门槛 / 马斯克+Greg Brockman 公开评价 | 已落实 |
| 2. 豆包手机 NaviX Ultra 8/15 发售前 16 天+MCP/A2A 协议 | WAIC 真机亮相 / 技术路线从 GUI 切至 MCP+A2A / 字节系数十款 App 已支持 / 7/15 获网信办备案 / 具体发售日期尚未官宣 | 已落实(发售日期待官宣) |
| 3. Google E-E-A-T 8/5 全量切换 GEO 影响实测 | 搜索未找到 S 级源确认 8/5 全量切换日期。Google 官方 GEO 指南已发布 7 大关键信号,但"8/5 全量切换"说法缺乏官方确认 | 部分落实(日期待验证) |
| 4. 信通院两套 GEO 测评体系关系 | 7/28 信通院正式启动"价值交付能力"测评,与 7/10"能力完备性"形成双轨。价值交付 6 维度 12 项子能力 24 测评点 / 面向全行业开放申报 | 已落实 |
| 5. Agent 攻防对抗"负面投毒"GEO 案例 | 央视 3.15 实测确认虚构产品 2-72 小时被大模型正面介绍 / 2026 年度广告监管已将 GEO 列入重点 / 信通院测评明确"整治 AI 数据投毒" | 已落实 |
| 6. MCP 2.0 定稿后首批 MCP Server GEO 工具 | 清华 UltraRAG 2.1(8/2)基于 MCP 架构 / FME Flow MCP Server(7/29)发布 / 但未见专门面向 GEO 的 MCP Server 产品上线 | 部分落实(通用 MCP 工具已有,GEO 专用尚缺) |
| 7. OpenAI Atlas 8/9 停服+Perplexity Comet 一家独大 | Atlas 8/9 停服确认 / 技术并入 ChatGPT+Codex / Comet ~1800 万 MAU / Polar 浏览器(前 Comet 团队)获 570 万美元种子轮 / 7/28 新增 Account Switcher | 已落实 |
| 8. 国内 AI 搜索五强格局 | 头条号 8/2 六强对比(豆包/DeepSeek/通义/Kimi/元宝/智谱)/ 文心 4.5 Turbo+X1 Turbo 升级 / 豆包搜索 7/28 已上线 / 格局进一步清晰但未出现重大变化 | 已落实 |
8 项预告 6 项完全落实、2 项部分落实(Google E-E-A-T 8/5 日期缺 S 级源、MCP Server GEO 专用工具尚缺)。
六、核心洞察
-
K3 开源第一周验证"中国开源大模型"进入 3T 时代。48 小时 9.8 万次下载是 DeepSeek V3 首周的 1.6 倍以上,但企业私有化仍需 8 卡 B300 级别服务器+定制许可证。"开源可达"与"商用可达"之间仍有显著鸿沟。对 GEO 服务商而言,短期关注 API 调用优化(3 美元/百万 token 输入定价),中期评估 K3 微调+私有化对强合规行业客户的吸引力。
-
信通院双轨测评=GEO 服务商的"准入门槛"正在成形。能力完备性(技术底座)+价值交付(落地软实力)两套体系覆盖了 GEO 服务商从"能不能做"到"做得好不好"的完整评价链条。首批通过 4 家均为技术型公司,价值交付维度预计将筛选出真正有交付闭环的服务商。
-
Atlas 停服+Comet 一家独大=AI 浏览器赛道从"百花齐放"走向"单一生态"。对 GEO 服务商的实操启示:Comet 侧边栏会主动抓取页面内容并总结——优化 llms.txt + 结构化数据 + 清晰的 H2/H3 层级 = 提升在 Comet 中的可见度。但别把宝押在单一浏览器上——多平台内容分发仍是核心策略。
-
豆包手机二代从 GUI 切 MCP 是"AI 手机"赛道的生态拐点。超级 App 是否愿意通过 MCP 开放接口将决定 AI 手机的实际能力边界。对 GEO 服务商的启示:当移动端交互从"人操作 App"变为"AI 通过协议调用 App"时,内容的"机器可读性"将比"人类可读性"更优先——结构化数据、Schema 标记、llms.txt 将从"加分项"变为"必选项"。
-
Google E-E-A-T 8/5 全量切换缺乏 S 级源确认,但 GEO 指南 7 大信号已明确方向。Query Fan-Out 机制(1 个问题→8-12 个子查询)+AI Overviews 与 AI Mode 引用重叠率仅 13.7%——这意味着"单一关键词优化"已不够,"主题集群(Topic Clusters)+支柱页面"策略才是应对 Query Fan-Out 的正确姿势。
-
AI Overviews 数据揭示 GEO 核心悖论:99% 引用来自 top-10 organic,但 82% 引用来自 earned media(非自营内容)。这直接验证了上期引用的 Muckrack 研究(earned media 84% 引用率)。GEO 预算应从"大量生产自营内容"转向"权威媒体发稿+分析师关系+品牌实体建设"。
-
GraphRAG 场景边界已清晰。ICLR 2026 论文+4 个独立 benchmark 一致结论:简单事实用 Vector RAG(成本更低),多跳推理/全局摘要用 GraphRAG(准确率高 10-13 点)。GEO 内容策略应区分"事实型关键词"和"推理型关键词"分别优化——前者做原子化答案段落,后者做主题集群+对比矩阵。
-
GEO 市场规模进入爆发期但鱼龙混杂。易观 30 亿元/艾瑞 518 亿元远期/IDC 220 亿美元全球——但超 200 家宣称提供 GEO 服务的机构中"真正具备技术自研能力、合规体系和效果交付闭环的专业服务商是稀缺资源"(头条号 8/2 引用行业统计)。央视 3.15 实测虚构产品 2-72 小时被大模型正面介绍——说明 GEO 的"阴暗面"(数据投毒)已引起监管层关注,2026 年广告监管要点已明确将 GEO 列入重点。合规 GEO 服务商将在监管洗牌中获得竞争优势。
下期预告(8/6 周四 · GEO 行业研究日报)
-
议题 1:K3 开源第二周(8/3-8/10)社区贡献+微调模型数量+企业私有化部署案例跟进——是否出现首批基于 K3 的行业 GEO 微调模型
-
议题 2:豆包手机 NaviX Ultra 具体发售日期官宣跟进+首批超级 App MCP 开放名单确认——微信/支付宝是否通过 A2A 协议接入
-
议题 3:Google E-E-A-T 8/5 全量切换是否如期执行——S 级源持续追踪+首批被降权站点类型分析
-
议题 4:信通院 GEO 价值交付能力测评首批申报企业名单+评审标准细则公开情况
-
议题 5:Perplexity Comet 8 月产品更新——Account Switcher 上线后的企业级使用数据+GEO 优化最佳实践
-
议题 6:AI 负面投毒监管进展——2026 年度广告监管要点中 GEO 相关条款细则+首批执法案例
-
议题 7:国内 AI 搜索五强 8 月产品更新——百度 AI 搜索/豆包搜索/Kimi 搜索/通义/文心新功能对比+GEO 服务商多平台适配策略
-
议题 8:RAG 技术前沿——UltraRAG 2.1 实测+GuidedRAG/MemoRAG 在 GEO 场景的应用可行性评估
声明:以上内容仅为信息整理与行业观察,不构成任何商业建议。
数据来源:
-
S 级(官方源):Hugging Face 官方平台/Moonshot 官方技术博客/OpenAI 官方帮助中心/中国信通院泰尔终端实验室/Unsloth 官方推特/清华大学 THUNLP 实验室/网信办官方公告
-
A 级(权威媒体/学术):Quartz(引用 HF CEO 声明)/ 界面新闻 / 虎嗅 / 蓝鲸新闻 / 中国新闻周刊 / 北京科技报 / TechCrunch / Artificial Analysis / VentureBeat / techjournal.org / 腾讯新闻 / 新华社引用 21 世纪经济报道
-
B 级(垂直社区/博客,需谨慎引用):CSDN 博客 / 头条号 / techora.ru(俄罗斯)/ blogdumoderateur.com(法国)/ Peer2PeerNews / ai-damn.com / VIBol.asia(越南)/ chinaz.com / aibase.com
信源分级执行说明:
本期核心事实(K3 下载量/量化版/定价/企业接入/Atlas 停服/Comet 数据/豆包手机技术路线/信通院双轨测评)均有 2 个以上 S/A 级源交叉验证。Google E-E-A-T 8/5 全量切换日期仅见 B 级源说法,缺乏 S 级官方确认,已在正文中标注"待验证"。
口径冲突说明:
- K3 48 小时下载量:搜狐 7/29 报道"9.8 万次"(A 级),腾讯新闻 7/29 报道"接近 10 万次"(A 级),两者数据一致,差异为表述精度
- K3 定价 3/15 美元 per million tokens:Artificial Analysis(A 级独立评测)与 kie.ai(B 级)数据一致,与 Moonshot 官方 API 页面(S 级)交叉确认
- 信通院"首批 9 家可信专项评测"说法(上期 7/30 日报提及)仍源自单一 B 级源(cnblogs 7/21),本期未获 S 级源更新——保持上期判断:5/17 完整名单需向信通院官方求证
- 豆包手机发售日期:多家 A 级源(虎嗅/蓝鲸/CSDN)均表述为"预计 8-9 月",截至 8/3 无官方确认——标注为"待官宣"
所有事实和观点均标注具体来源,读者可追溯验证。
