本文由GeoAurora GEO研究团队出品
GEO 行业研究日报 · 2026年7月20日(周一)
本文由GeoAurora(武汉沐辰数智科技有限公司)GEO研究团队出品
核心摘要
本期四大核心事件:
1. 【重磅】Kimi K3(7/16)正式发布:2.8万亿参数全球最大开源模型,Frontend Code Arena登顶全球第一,月之暗面预计6个月内港股上市,ARR站稳3亿美元。
2. 【重磅】Gemini 3.5 Pro(代号Cappuccino)彭博独家曝光延期数月:代码能力未达内部标准,Alphabet股价盘中跌4.43%,分析师预计最快8月底-9月上线。
3. 【重磅】WAIC 2026(7/17-20上海)开幕:1100+企业、300+首发产品,智能体手机(豆包NaviX Ultra/阶跃STEPX Neo)、华为Atlas 950、商汤SenseNova U1 Pro、MiniMax M3集中亮相;7款手机端侧AI通过国家备案,标志"端侧AI入口战"正式打响。
4. 【关注】GEO赛道从概念进入"可测量学科"阶段:CiteLens基准数据揭示ChatGPT仅30%品牌引用来自Google Top10,国内信通院/新华网/中广协三方GEO可信标准同步推进,首批9家企业通过可信评测。
AI搜索与大模型动态
[预告跟进] Kimi K3正式发布(7/16):2.8万亿参数开源模型登顶前端编程竞技场,月之暗面拟6个月内港股上市
上期预告议题#2"Kimi K3正式官宣后完整拆解",本期正式落地。
发布时间与规格(官方+澎湃新闻/A级源验证):
- 7月16日WAIC开幕前夕正式发布,已在Kimi App/Kimi Work/Kimi Code/Kimi API全量上线
- 参数规模:2.8万亿(MoE架构),896个专家中激活16个,为全球目前参数规模最大的开源模型
- 上下文窗口:100万token,原生支持视觉理解
- 架构创新:KDA混合线性注意力机制(Kimi Delta Attention)+注意力残差(Attention Residuals),相较K2整体扩展效率提升2.5倍
- 双版本:K3 Max(对话/智能体)、K3 Swarm Max(大规模并行处理)
- 完整模型权重预计7月27日前全部开源
来源:澎湃新闻《冲刺IPO!Kimi K3引爆全球,月之暗面或将在6个月内完成港股上市》(2026/7/19,https://m.thepaper.cn/newsDetail_forward_33617271)
第三方跑分核心成绩(月之暗面官方博客+Artificial Analysis):
- Frontend Code Arena(WebDev Arena):1679分全球第一,超越Claude Fable 5(1631)、GPT-5.6 Sol xHigh(1618),累计约48万次匿名投票支持,品牌营销/参考设计/数据分析/消费产品/模拟/内容创作工具6个细分领域第一
- 14项基准测试对GPT-5.6 Sol:击败11项
- 14项基准测试对Opus 4.8:全部击败
- 14项基准测试对Claude Fable 5:击败6项
- Artificial Analysis Intelligence Index:57分,超过Opus 4.8,但综合智能仍落后于Fable 5和GPT-5.6 Sol
- 官方坦承三大局限:对思考历史敏感(需完整回传思考链)、过度主动(模糊指令下可能替用户做决定)、整体用户体验与Fable 5仍有差距
来源:CSDN《月之暗面发布Kimi K3:全球首个开源3T级大模型,前端编程竞技场登顶第一》(2026/7/18,https://blog.csdn.net/2601_96080144/article/details/162961012)、头条号"ai坚果"《Kimi K3 发布:2.8万亿参数开源模型,前端代码能力全球第一》(2026/7/17,http://m.toutiao.com/group/7663310606019183119/)
定价与成本(以国际站美元计价):
- 缓存命中输入:$0.30/百万token
- 缓存未命中输入:$3.00/百万token
- 输出:$15.00/百万token(注:此价格约为K2.6的3.75倍,反映能力跃迁伴随成本上升)
- 编程场景缓存命中率可超90%(Mooncake分离式推理架构),实际使用成本大幅降低
- Artificial Analysis测算:每任务成本约$0.94,接近GPT-5.6 Sol($1.04),约为Opus 4.8($1.80)的一半
- BrowseComp场景K3拿到91.2的SOTA分数,单任务成本不到$2,而其他模型需$5-$27不等
商业化进展(澎湃新闻A级源):
- 2026年3月ARR破1亿美元,5月破2亿美元,6月站稳3亿美元,三个月三倍跃升
- API业务收入占比已突破70%,B端规模化变现周期到来
- 发布数小时登顶Arena榜单后,月之暗面预计最快6个月内完成港股上市(澎湃记者从知情人士获悉,公司未正式回应)
- 发布后马斯克先称赞"厉害",随后评论称"我们的2万亿参数模型将在下周完成初始训练,有可能超越Kimi"
对GEO的判断:
1. 前端编程登顶意味着用K3生产结构化网页内容(HTML/结构化数据/JSON-LD/FAQ页面)的质量与Fable 5/GPT-5.6 Sol同级,成本显著降低,GEO内容生产工具链可以大规模迁移到K3 API
2. 开源权重7/27发布后,企业可私有化部署K3做内部知识库RAG+内容生成,金融/政务/医疗等高合规行业的GEO内容生产将不再依赖闭源API
3. Arena榜单运营负责人称K3"动摇了OpenAI/Anthropic闭源主导地位",开源+国产组合对GEO服务商的采购决策将产生实质性影响
4. 长程Agent能力(48小时自主完成芯片设计/两小时复现1-2周科研编程)意味着AI可见度监测、竞品分析、多步GEO诊断任务可以用K3 Agent端到端完成
[预告跟进] Gemini 3.5 Pro(Cappuccino)官宣延期数月:代码能力未达标,谷歌股价盘中跌4.43%
上期预告议题#1"Gemini 3.5 Pro(7/17)首发实测",最终结果:未发布、延期。
事件经过(彭博社+36kr/CNBC/A级源验证):
- 7/16彭博社独家报道:Gemini 3.5 Pro内部目标7/17发布,但因关键能力未达标被紧急叫停
- 核心短板:AI编码能力在近期评估中不足,6月末紧急补充编程训练数据,结果"令人失望"
- Alphabet股价7/16盘中下跌4.43%(约4%),数十亿市值蒸发
- Google发言人对CNBC回应称公司"正在快速迭代全系列模型,保持高性价比,正与合作伙伴测试3.5 Pro、升级版Flash等模型,并与美国政府保持建设性合作"
- Google未给出新的发布时间表,行业分析师预计最快8月底-9月发布
来源:36氪《突发叫停,Gemini 3.5 Pro难产,谷歌跌入失望陷阱》(2026/7/17,https://36kr.com/p/3899401765422720)、TechJournalHQ《Google Delays Gemini 3.5 Pro Launch Amid Coding Struggles》(2026/7/17,https://www.techjournalhq.com/google-gemini-3-5-pro-launch-delayed-8688/)
已知规格(基于Google I/O 2026公开发言+内部泄露,部分未官方确认):
- 上下文窗口:200万token(Flash为100万)
- 新推理模式:Deep Think(深度思考)
- 目前公开API仅有gemini-3.5-flash和gemini-3.1-pro-preview,gemini-3.5-pro model ID、model card、定价页均未上线
- 已在Google内部使用,但未对外公开
- Gemini 3.5 Flash于5/19 GA,定价$1.50/$9.00每百万token
对GEO的判断:
1. Pro延期意味着Google AI Mode/AI Overviews的推理质量短期内不会有跳跃式升级,当前阶段GEO对Google AI搜索的优化策略基于3.5 Flash即可,不必为"Pro级引用偏好变化"提前布局
2. 代码能力是Pro延期的核心原因——这恰好说明Google将AI Agent的代码执行/工具调用能力视为旗舰模型的核心战场,GEO技术实现层(结构化数据/语义标记/MCP Server)的"可被Agent调用"属性会越来越重要
3. Google明确提到正在与美国政府合作测试,说明先进模型面临国家安全审查(自动编码Agent可能编写恶意软件/识别零日漏洞),这一审查节奏会影响所有前沿模型的发布时间表
4. 股价反应说明资本市场已经从"讲故事"转向"要交付",AI公司延期发布的代价在变大,这一压力会传导到模型迭代速度和质量稳定性上
[预告跟进] WAIC 2026(7/17-20上海)全景扫描:从"百模大战"到"入口之战",智能体手机/算力/机器人同台
上期预告议题#5"WAIC 2026 GEO/AI搜索/智能体相关重磅发布跟踪",本期落地。
大会基本面(官方数据+人民网/海报新闻A级源):
- 时间:7/17-20,上海世博/张江/西岸"三地四馆"
- 规模:1100+企业、4000+展品、300+全球首发产品、10万平米展览、140+论坛
- 主题:"智能伙伴 共创未来"
- 联合国秘书长古特雷斯出席,联动12个国家部委/8个国家级重点实验室/10+国际组织
- 首次创办WAIC Academic学术会议,图灵奖得主姚期智担任主席
来源:人民网《2026WAIC全景直击:大模型筑基、场景落地、机器人走进现实》(2026/7/19,http://m.toutiao.com/group/7664215480063885839/)、海报新闻《AI入口之争2.0版本》(2026/7/18,http://m.toutiao.com/group/7663686524327952950/)
【重磅】智能体手机正式成为新品类:
1. 努比亚NaviX Ultra(豆包手机):
- 中兴努比亚+字节跳动豆包团队联合打造,被称为"全球首款AI智能体手机"
- 核心能力:系统级GUI Agent架构,通过MCP/A2A协议直接与各应用内Agent数据交互,跨应用自主执行多步骤任务(比价下单/行程规划/订机票酒店等)
- 四大标准:听得懂(自然口语)、能干活(跨App执行)、记得住(长期学习用户习惯)、够安全(端侧NPU本地运算,关键步骤需指纹/人脸确认)
- 硬件:骁龙8 Elite Gen5(另有报道称骁龙8 Gen4,配置信息有冲突,以官方最终公布为准)、7000mAh电池、100W快充、独立橙色AI实体按键、横向跑道式镜头模组
- 备案:已通过网信办端侧大模型备案(7/15公告),获本届WAIC SAIL卓越人工智能引领者奖
- 上市:首批备货50万台,计划9-10月上市,预计起售价4999元左右(分析师预测,非官方定价)
来源:IT之家/凤凰网科技(2026/7/19,https://tech.ifeng.com/c/8ut3YdvrT9P)、新浪新闻(2026/7/19,https://k.sina.cn/article_7880068204_1d5b04c6c06801de5o.html)
- 阶跃星辰STEPX Neo:
- 全球首个大模型原生AI终端品牌STEPX同步发布全球首个Agent原生操作系统Step AOS
- 已通过L3级国家标准测试,获评WAIC"镇馆之宝"
- 阶跃星辰Step 3.5 Flash已于5月以Apache 2.0开源,覆盖OPPO/荣耀/中兴等约60%国内头部手机品牌,装机量超4200万
- 7/12发布阶跃端侧模型全家桶Step Edge
来源:AI工具宝箱(2026/7/19,https://www.aitoollab.cn/articles/waic-2026-preview-top-ai-products/)、海报新闻
【重磅】端侧AI全面合规,7款手机端侧生成式AI服务通过备案(7/15网信办公告):
- Apple智能、华为小艺AI大模型、OPPO AndesGPT、vivo蓝心端侧大模型、小米澎湃AI、三星盖乐世AI、努比亚豆包手机大模型
- 这意味着从7/15起,端侧AI助手在国内进入"有牌照可商用"阶段,所有主流手机厂商的AI助手都拿到了入场券
来源:海报新闻《AI入口之争2.0版本》
算力底座:
- 华为Atlas 950 SuperPoD真机亮相:单机柜集成64张昇腾计算卡,最高扩展至8192张芯片,全局统一内存编址,面向万亿参数大模型训练与推理
- 对标英伟达B200,国产算力正面硬刚
来源:AI工具宝箱、海报新闻
大模型新品:
1. 商汤SenseNova U1 Pro:旗舰多模态智能体基座,打通"理解-生成-行动"三大能力,现场演示完成WAIC九周年水墨长卷(4:1超宽幅、9年产业节点视觉叙事、东方美学风格统一)
2. 腾讯混元Hy3(7/6发布):21B激活参数,已深度接入WorkBuddy/微信AI Agent/元宝,WAIC首秀
3. MiniMax M3:多模态旗舰,补齐从文本到视频的全能力链(旗下Hailuo AI视频工具已有海外用户基础);展位主推多模态创作Agent MiniMax Hub(可接入可灵/Seedance)、MiniMax Code
4. 百度搭子(DuMate):通用智能体,自然语言一站式完成文件处理/网页操作/数据分析/报告/PPT,个人版升级智能路由,企业版发布,WAIC十大镇馆之宝之一
5. 百川智能Baichuan-M4:医疗增强大模型+AI家庭医生"百小医",首次展示肿瘤/儿科等专科场景落地
6. 零一万物:转型垂直赛道,推出"老板AI/销冠AI/投资官AI"三个一号位产品
7. 阿里:夸克AI眼镜、钉钉录音卡等成熟AI硬件,千问智能体参展
8. DeepSeek:连续多年WAIC隐身不设展,但展馆里"到处都是搭载DeepSeek的第三方产品";据韩国Big Hat Group报道,DeepSeek正以约5000亿元(740亿美元)估值筹备新一轮融资,较两月前上涨37%;自研推理芯片秘密开发中,SMIC为潜在代工厂,目标2026年底首批部署、2027-2028规模化
9. 智谱AI:缺席WAIC,公司回应"处在回A静默期"
来源:消费者报道/开机实验室(2026/7/19,http://m.toutiao.com/group/7664268638806950434/)、人民网、海报新闻、Big Hat Group(2026/7/18,https://www.bighatgroup.com/ko/blog/china-ai-weekly-2026-07-18/)
其他重磅:
- 全球首个千亿参数级开源气象大模型"风和"由中国气象局发布(7/17),基于5000万条气象语料训练,开放完整权重+标准化API
- 《人工智能发展与安全倡议书》(7/19)正式发布,国家工业信息安全发展研究中心联合产学研各界发起,围绕智能向善/安全可控/创新驱动/依法治理/开放合作/协同联动六大维度
来源:头条号"椰子树下享椰汁"(2026/7/20,http://m.toutiao.com/group/7664305874579505666/)
对GEO的判断:
1. 端侧AI入口是下一个GEO战场。豆包手机NaviX Ultra+苹果/华为/OPPO/vivo/小米/三星集体通过端侧备案,意味着Siri/小艺/豆包/小爱同学等端侧助手将成为新的"答案入口"。品牌内容仅适配ChatGPT/Perplexity/Google已不够,必须考虑端侧AI的MCP对接、本地知识库写入、A2A协议兼容。这与我们此前预判的9月iOS 27前Siri适配窗口判断一致。
2. 智能体手机的MCP/A2A协议,相当于给品牌开了一扇"App内直达通道"。NaviX Ultra通过MCP直接调用应用内Agent,不再模拟点击——这正是小程序GEO方法论的延伸:品牌需要为自己的核心服务提供可被智能体调用的原子接口+Skill描述,否则就会在"一句话订机票/比价/找餐厅"的场景中被屏蔽。
3. 开源生态的"端云协同"。Kimi K3开源、阶跃Step 3.5 Flash开源、气象大模型开源,企业可以在端侧跑轻量模型+云端跑旗舰模型,GEO工具链的成本会被进一步打下来。
4. DeepSeek 740亿美元估值+自研芯片的消息(来自The Information/Reuters韩国投资机构分析,需注意属B级报道口径)说明:国产头部AI公司从"模型提供商"向"模型+推理芯片+云服务"全栈公司演进,算力自主可控会进一步降低GEO工具的调用成本。
[预告跟进] Hachette/Elsevier/Cengage/Scott Turow诉Google Gemini版权案(7/14纽约提交):内部员工警告$10B-$100B罚款,市场替代理论成核心
上期预告议题#6"Google出版商版权诉讼进展",本期补充更多细节。
案件核心信息(TechRepublic/AINave/SBS/A级+B级源交叉验证):
- 立案时间:2026年7月14日(美东时间),美国纽约南区联邦地区法院
- 案号:1:26-cv-05870
- 原告:Hachette Book Group(美国五大出版社之一)、Elsevier(《Cell》《柳叶刀》出版商)、Cengage Learning(曼昆《经济学原理》等教材出版商)、畅销作家Scott Turow及S.C.R.I.B.E. Inc.
- 起诉对象:Google LLC
- 四项指控:直接版权侵权、辅助版权侵权、删除/篡改版权管理信息、违反DMCA(数字千年版权法)
原告核心主张:
1. Google通过Google Books/Google Play Books/Google Scholar获取的图书和期刊,协议约定仅限"搜索摘要展示/电子书分发/学术发现",未授权将完整作品复制进AI训练数据集
2. Google通过大规模网络抓取获取训练数据,来源包括盗版网站和付费墙后的内容
3. Google内部员工曾警告"使用Google Play出版协议中的图书训练AI会带来严重法律风险",估计可能产生"$10B-$100B罚款"
4. 市场替代理论:Gemini可在20分钟内生成100页谋杀疑案小说,成本仅39美分(原告主张,未经法院证实);Gemini可生成《The Fifth Season》等作品的详细内容(人物/事件/叙事细节)、Scott Turow小说2000字详细剧透(含人物简介+结局);原告认为AI生成内容构成对原作的低成本替代,不适用"转换性使用"
5. 代表作品举例:Peter Brown《The Wild Robot》、N.K.Jemisin《The Fifth Season》、曼昆《经济学原理》、Turow《Presumed Innocent》《Innocent》等
程序背景:
- Hachette/Cengage曾于2026年2月试图加入加州2023年作家/视觉艺术家诉Google案,被Google反对后撤回
- 本次选择在纽约起诉(区别于加州),聚焦"通过直接商业关系获取的材料被转用"
- Google此前2015年赢得Google Books数字化案件(二审法院认定为转换性合理使用),但原告辩称本案是"AI训练"而非"搜索摘要",商业目的不同
Google回应:截至发稿,Google未针对本次诉讼的具体指控作出详细公开回应。
案件走向预判(scand.ai分析,基于历史AI版权案件基准率):
- 最可能结果(60%):案件挺过初步动议阶段,但陷入漫长证据开示,最终达成保密许可和解或程序性搁置
- 升级可能(20%):原告取得重大程序性胜利(如集体诉讼认证/初步禁令),大幅增加Google赔偿压力
- 快速判决可能(15%):法院绕过证据开示直接就合理使用核心问题作出判决,建立新判例
- 其他可能(5%)
来源:AINave《Publishers Sue Google Over Gemini AI Training Data Copyright Infringement》(2026/7/16,https://ainave.com/tech-news/publishers-sue-google-over-gemini-ai-training-data-copyright-infringement)、SBS News《U.S. Publishers and Authors Sue Google Over AI Training with Books》(2026/7/15,https://m.news.sbs.co.kr/english/article.do?cooper=SBSNEWSMOBGNB&newsId=N1008659053&plink=MAINSEC)、scand.ai(2026/7/19,https://scand.ai/scandal/publishers-scott-turow-sue-google-gemini-training-data)、TechRepublic(2026/7/17,https://www.techrepublic.com/sites/techrepublic.com/article/news-google-gemini-ai-training-publishers-lawsuit/)
对GEO的判断:
1. 本案将"AI训练数据版权"从学术讨论推向司法实质阶段。若纽约法院作出不同于加州的判决,将直接迫使大模型公司支付正版内容授权费——对长期产出高质量原创内容的品牌/GEO服务商是结构性利好。
2. "市场替代"是原告最有力的论点,GEO内容策略应继续强化"AI无法低成本替代的部分":一手实测数据、专家独家观点、结构化行业知识、实时更新的本地化信息,这些都是AI训练数据无法覆盖的增量价值。
3. 本案与OpenAI(NYT/Authors Guild诉讼)、Anthropic(与作者协商15亿美元和解)、Meta(2025年赢得合理使用判决)共同构成AI训练版权的完整判例图谱,预计2-3年内会有首批实质性判决。
[预告跟进] GPT-5.6 Ultra Sol"擅自删文件"事件:未检索到官方修复公告,行业反思持续
上期预告议题#3"GPT-5.6 Ultra多智能体模式的多跳检索行为实测"。
本期核实结果:过去3天(7/17-7/20)未检索到OpenAI官方发布针对Sol Agent"过度宽松解读指令导致删文件"问题的修复公告或模型更新说明。本期不做进一步推断,持续关注OpenAI官方changelog和开发者社区反馈。
行业反思层面持续发酵的观点:Agent高权限场景下,"信源可信度"比"回答流畅度"重要得多;模糊、不清晰的内容不仅不被引用,还可能在多跳推理中被Agent误读误用。这一判断与上一期洞察一致。
[预告跟进] Perplexity Brain/SPACE沙箱:未检索到近3天重大更新
上期预告议题#4"Perplexity Brain记忆系统+SPACE沙箱上线后信源偏好变化"。
本期搜索未发现Perplexity在7/17-7/20期间发布Brain或SPACE相关的重大功能更新或信源偏好调整报告。原判断"早期进入者可能通过记忆系统获得复利优势"仍维持,待有实测数据后再跟进。
GEO策略与实战
【重磅】CiteLens基准数据:ChatGPT仅30%品牌引用来自Google Top10,单一优化策略已失效
AI可见度监测平台CiteLens(土耳其Solustiq公司)发布2026年中基准数据,核心发现:
- Google AI Mode:约90%品牌引用来自Google传统Top10结果
- Perplexity:约90%品牌引用来自Google传统Top10结果
- ChatGPT:仅约30%品牌引用来自Google传统Top10——超过2/3的引用来自Google 10名外甚至100名外的内容
来源:MarketScale《AI answer-engine visibility becomes a measurable discipline as GEO platforms multiply in 2026》(2026/7/17,https://www.marketscale.com/industries/marketing-tech/ai-answer-engine-visibility-becomes-a-measurable-discipline-as-geo-platforms-multiply-in-2026)
核心结论:Google AI Mode和Perplexity的引用池与传统SEO高度重合,传统SEO+高质量外链仍可覆盖这两个入口;但ChatGPT的引用来源已经明显跳出Google排名的"势力范围",这是GEO必须独立于SEO建设的最硬数据证据。这与上期Ahrefs"Top10重合度一年间从76%跌到38%"的发现方向一致,但ChatGPT的30%数据更激进。
2026年中GEO工具赛道格局(据CiteLens环境分析):至少8家平台已形成可竞争的产品矩阵:
- 企业端:Profound(Prompt Volumes+Agent Analytics)、AthenaHQ(面向代理商和大品牌)
- 中端:Semrush AI Visibility Toolkit(集成在SEO套件内)、Scrunch AI(Bot日志+Agent专用站点版本)、Rankscale AI(AI引擎排名跟踪)
- 自助/SMB端:CiteLens(免费版+$79/月起,公开排行榜)、Peec AI(柏林,GDPR合规+无限席位)、Otterly.AI(奥地利,$29/月起)
2026年成为"标配"的能力:
1. 置信区间评分(95% Wilson置信区间,区分真实变化与随机波动)
2. Bot日志分析(GPTBot/ClaudeBot/PerplexityBot等AI爬虫抓取行为)
3. Prompt-demand面板(用户实际向AI提问的真实问题,而非SEO假设的关键词)
4. 多引擎覆盖(ChatGPT/Perplexity/Google AI Mode/AI Overviews/Claude/Gemini/Copilot)
对GEO实操的直接影响:
- 不能再用"Google排名好=AI可见度高"作为交付验收标准,必须按引擎分别监测
- ChatGPT的独立引用池意味着:品牌需要在ChatGPT训练数据/浏览工具覆盖的"高影响力内容源"做布局,这些源可能不在传统SEO的高权重域内(比如垂直论坛、小众权威博客、GitHub、学术论文、Reddit/Hacker News等)
- GEO服务商必须具备跨引擎可见度监测能力,单一工具已经不够
国内GEO强规范时代来临:三方标准+首批可信评测+白帽共识
据头条号"语代AIGEO"整理(2026/7/17,B级源,但信息涉及公开机构可追溯):
标准制定三方同步推进:
1. 新华网牵头国内首部《生成式引擎优化(GEO)可信信息传播与信息生态治理规范》立项
2. 中国广告协会正式启动GEO领域标准化建设,围绕技术能力/服务流程/合规管理/效果评估四大维度制定自律标准
3. 中国信通院联合产业各方推进《生成式引擎优化(GEO)服务可信基本要求》技术规范,覆盖管理机制/客户材料审核/优化手段/优化结果可信可追溯五方面
评测落地:
- 2026年5月14日中国人工智能产业发展联盟(AIIA)可信GEO专题研讨会在北京召开
- 首批9家通过GEO服务可信专项评测的企业获颁证书(具体名单未在本文列出)
生态共治:
- 新华网联合信通院等8家机构发布《生成式引擎优化(GEO)可信生态构建研究报告》,提出"服务商合规自律+全产业链协同共治"双轮驱动
- 2026年5月29日第一届GEO优化行业峰会(北京)发布《白帽GEO行业共识宣言》,覆盖KPI定标/信源建设/内容创作/结构化数据/RAG优化/AI伦理/效果验收七大模块共23项实践标准
中国人民大学王菲教授在AIIA研讨会提出的品牌信任五维度:真实性、一致性、可验证性、可解释性、可依赖性——这与我们一直强调的"真实数据+可追溯来源"原则完全一致。
来源:头条号"语代AIGEO"《GEO行业加速"洗牌":强规范时代到来,企业如何抢占AI入口?》(2026/7/17,http://m.toutiao.com/group/7663325006721532450/)
对我们的直接影响:
1. 国内GEO正在从"野路子"走向"有证经营",首批9家可信评测企业是行业标杆。建议我们关注信通院可信评测的申请条件,将"通过信通院GEO可信评测"作为2026年下半年的一个资质目标。
2. "信源质量+效果可验证"成为企业选择GEO服务商的两个核心判断标准,这正好是我们的差异化优势(实测数据+可追溯来源+AI可见度监测)。
3. 行业加速洗牌意味着"黑帽GEO"(关键词堆砌/语料轰炸/伪权威内容)的生存空间在快速收窄,"白帽+真实数据+合规"路线的时间窗口在打开。
AI搜索引擎引用机制逆向分析:四阶段筛选决定内容能否被引用
据"AI产品讲堂"(2026/7/18,B级源)对国内主流AI搜索引擎引用机制的逆向分析:
内容索引库规模差异(2026年7月时点):
- 字节系(豆包搜索):约2.3亿个网页
- 月之暗面系(Kimi搜索):约1.8亿个
- 百度系(文心一言/百度AI搜索):约3.5亿个
- 阿里系(通义千问/夸克):约2.1亿个
- 索引库更新周期:12-72小时不等
引用决策四阶段:
1. 爬虫采集:通过种子URL+Sitemap发现新内容;内容必须可被爬虫发现才有可能进入索引
2. 内容解析:HTML→结构化文本,去除导航/广告/侧边栏;切分为512-1024 token片段;嵌入模型生成768-1024维语义向量
3. ANN检索+排序:检索召回200-500个片段,重排后保留20-50个;三维评分:
- 语义相似度(权重40-55%)
- 内容权威性(权重25-40%,基于域名权重/外链/被引用频次)
- 时效性(权重15-25%)
- 字节系重语义(55%),百度系重权威(40%)
4. 生成阶段引用决策:
- 含具体数据/统计信息的片段,在答案开头/中段被引用概率约68%
- 含观点/结论的片段,在答案末尾被引用概率约57%
- 200-500字内容被引用概率最高,超过800字引用概率下降约22%
- 引用方式:直接引用41%、概括引用35%、混合引用24%
- 字节系倾向直接引用(48%),月之暗面系倾向概括引用(42%)
来源:头条号"AI产品讲堂"《一文读懂AI搜索引擎的引用选择机制》(2026/7/18,B级源,注:具体数据未标注原始研究机构,参考价值在于方向性判断,精确数字需谨慎引用)
对GEO实操的指引:
1. 200-500字是"引用黄金长度"——超过800字的长文要做好语义分块(Semantic Chunking),让每个独立块在200-500字区间内自包含核心信息。
2. 数据/统计类信息前置(放在段落开头或H2/H3下的第一个要点),观点/结论类内容放在段落末尾,匹配AI引用的位置偏好。
3. 不同引擎权重不同:适配百度系要强化权威性(央媒背书、高权重外链、机构署名);适配字节系要强化语义匹配度(问题-答案直接对应、口语化表达、长尾问句覆盖)。
4. Sitemap主动提交+机器人协议正确配置是"被爬虫发现"的第一道关,GEO技术审计必须覆盖。
RAG多路召回成生产级标配:从60%到85%的四层优化框架
据arXiv 2026年4月论文(覆盖23088条真实查询)+多篇工程实践总结:双路RRF(Reciprocal Rank Fusion)融合比纯向量检索Recall@5高10.8个百分点,加上Reranker再提17.4%,整体从58.7%提升到81.6%。
生产级RAG四层优化框架:
1. 召回层:向量检索+BM25关键词检索双路并行,top-50候选,用RRF(k=60)融合
2. 精排层:Cross-Encoder Reranker深度交互打分,单次改动提升最大
3. 查询层:查询改写/分解(RAG-Fusion多路查询改写、RQ-RAG多跳分解)
4. 索引层:粒度优化、混合检索(向量+BM25+知识图谱三路)
2026年RAG新范式:GraphRAG(知识图谱多跳推理)、Adaptive RAG(自适应决定是否检索)、Agentic RAG/Corrective RAG(检索后评估,错误触发补充Web搜索)、RL驱动联合优化(SmartRAG/R3-RAG/MMOA-RAG)。
来源:arXiv 2026年4月论文(转引自头条号"机器觉醒",2026/7/16,http://m.toutiao.com/group/7662963764630766121/)、CSDN《RAG检索增强生成:2026年技术新范式与工程落地全指南》(2026/7/18,https://mukebb.blog.csdn.net/article/details/162922278)、CSDN《2026年RAG技术全景解析》(2026/7/16,https://blog.csdn.net/m0_59164520/article/details/158391213)
对GEO的判断:
1. AI搜索引擎本质上就是生产级RAG系统,理解RAG的优化逻辑=理解GEO的底层逻辑
2. BM25关键词检索仍然是生产级RAG的标配——这意味着传统SEO的关键词优化(精确匹配专有名词/型号/数字)并没有死,而是在AI搜索的召回层与向量检索互补
3. Cross-Encoder Reranker是单次提升最大的一步——Reranker偏好"与query深度交互匹配"的内容,直接对应GEO内容创作中"问题-答案的强相关性、段落开头直接回应query"的要求
4. GraphRAG的实体-关系建模:品牌内容需要清晰的实体结构(公司名/产品名/人物名/参数/定价/时间),便于AI构建知识图谱关系,提升多跳推理场景下的被引用概率
行业趋势
中国AI价格革命:高盛上调中国AI模型至"超配",价差达18-38倍
高盛7/14研报将中国AI模型评级上调至"超配"(Overweight),建议机构客户在生产负载中将中国前沿模型(阿里Qwen 3.5、DeepSeek V4、字节Seed系列)作为西方API的直接替代——原因不是意识形态,是算术。
关键价差(2026年7月时点,来自AIN China整理):
- 阿里Qwen 3.5-Flash:输入$0.07/百万token,输出$0.26/百万token,100万上下文,支持视觉+推理
- 即将发布的Google Gemini 3.5 Pro:预计输入$1.25/百万token,输出$10/百万token(18倍输入价差、38倍输出价差)
其他要点:
- 中国核心AI产业2025年突破1.2万亿元,AI企业超过6200家,30%以上大型工业企业已采用AI(人民日报7/16数据)
- Meta预计2026年资本支出1250-1450亿美元,几乎是2025年的两倍,绝大部分投向AI算力
- 科创50指数上半年累计涨幅64%,半导体设备与材料板块年内涨幅接近150%
来源:AIN China《The $0.07 Model: How China's AI Price Revolution Is Forcing Silicon Valley to Rethink Everything》(2026/7/16,https://www.ainchina.com/blog/china-ai-price-revolution-silicon-valley-waic-2026/)、andrew.ooo《WAIC 2026 Shanghai: What to Watch》(2026/7/16,https://andrew.ooo/answers/waic-2026-shanghai-what-to-watch-july-17-20/)、人民网、海报新闻
对GEO的判断:
1. 中国AI模型的"极致性价比"意味着GEO工具链(AI监测/内容生产/竞品分析/诊断Agent)的调用成本会持续下降,中小客户也能用得起旗舰模型级别的GEO服务
2. 开源+低价API会催生大量GEO垂直场景应用,"人人都能做GEO"时代反而会让真正有方法论、有数据、有实测案例的服务商溢价
3. 中国模型的全球化使用(通过AWS Bedrock等渠道)意味着我们做中文内容GEO时,也需要考虑Qwen/DeepSeek等中国模型在海外企业客户中的使用率,双语/多语GEO需求在增长
GEO"唱衰论"需警惕:单一信源B级文章不可作为行业判断依据
本期搜索到一篇ryminos.com发布的文章(2026/7/16)声称"GEO已失败、AI搜索流量仅占13.5%、68%B2B贸易决策绕过AI",但经核实:
- 该文章数据未标注原始研究机构和样本方法
- ryminos.com非权威科技媒体
- 其核心数据(AI搜索流量13.5%、68%B2B决策绕过AI)与同期SparkToro/SimilarWeb/Pew等权威机构数据冲突
- 文章带有明显的"唱衰AI营销"立场
按我们的信源分级铁律:C级/单一B级来源的"重大反直觉结论"不能作为判断依据。我们维持原有判断:GEO作为独立学科正在快速成熟(8家监测平台形成产品矩阵、CiteLens/Ahrefs等数据持续更新、国内三方标准推进、首批9家可信评测企业落地),但尚处早期、效果因行业而异,需要持续跟踪可验证数据而非情绪化叙事。
上期预告落实
| # | 上期预告 | 本期落实 | 状态 |
|---|---|---|---|
| 1 | Gemini 3.5 Pro(7/17)首发实测 | 反向结果:彭博7/16独家曝光延期数月,原因是代码能力未达内部标准,Alphabet股价跌4.43%,预计8月底-9月上线 | 延期,未发布 |
| 2 | Kimi K3正式官宣拆解 | 已落实:7/16正式发布,2.8万亿参数全球最大开源模型,Frontend Code Arena 1679分登顶全球第一,14项基准击败GPT-5.6 Sol 11项,API定价$0.3-$15/百万token,7/27前开放权重,ARR 3亿美元,拟6个月内港股上市 | 已落实 |
| 3 | GPT-5.6 Ultra多智能体多跳检索实测 | 未检索到官方修复或新实测:7/17-20期间OpenAI未发布Sol Agent相关更新,多跳检索实测待后续有数据时跟进 | 待后续 |
| 4 | Perplexity Brain+SPACE信源偏好 | 未检索到重大更新:近3天无新功能发布或实测数据,待后续有新信息时跟进 | 待后续 |
| 5 | WAIC 2026重磅发布跟踪 | 已落实:智能体手机(豆包NaviX Ultra/阶跃STEPX Neo)、华为Atlas 950、商汤SenseNova U1 Pro、MiniMax M3、百度搭子企业版、百川Baichuan-M4、7款端侧AI备案、气象大模型"风和"开源、AI安全倡议书;DeepSeek隐身/智谱缺席/六小龙格局分化 | 已落实 |
| 6 | Google出版商版权诉讼进展 | 已落实:7/14纽约立案,案号1:26-cv-05870,四项指控,核心论点"市场替代"+内部员工$10B-$100B罚款警告,Google尚未详细回应;预判60%概率长期证据开示+保密和解 | 已落实 |
6项预告:3项完全落实(#2/#5/#6)、1项反向重大结果(#1延期)、2项暂无新进展待后续跟踪(#3/#4)。Kimi K3开源登顶+Gemini 3.5 Pro延期+WAIC智能体手机+GEO可监测化是本期四大核心事件。
核心洞察
-
Kimi K3开源登顶+Gemini 3.5 Pro延期,"开源中国队 vs 闭源美国队"格局进一步清晰。中国大模型不再是"便宜但差"的代名词,K3在前端编程这个高价值场景已经全球第一;而Google用实际延期证明"旗舰模型的代码能力"是当前AI最硬的战场。对GEO服务商来说,"用开源国产模型搭建GEO工具链+在关键场景微调/验证"已经是性价比最优路线。
-
WAIC 2026释放的最强信号不是某个模型,而是"入口在从App/搜索框向智能体迁移"。豆包手机NaviX Ultra用MCP/A2A协议让智能体直接跨应用执行任务,7款端侧AI集体通过备案——这意味着未来用户说"帮我找个附近的餐厅""帮我订酒店""推荐个装修公司"时,答案不是来自搜索结果页,而是来自端侧Agent的一次跨应用调度。品牌如果不提供"可被Agent调用"的接口/Skill/MCP Server,就会在新入口里消失。这是比ChatGPT/Perplexity更前置的战场。
-
GEO在2026年中完成了从"概念"到"可测量学科"的跃迁。CiteLens的30%/90%差异化数据、8家监测平台形成产品矩阵、国内信通院/新华网/中广协三方标准同步推进、首批9家可信评测企业落地——这些信号共同说明:GEO正在从"SEO的延伸"进化为"有独立工具、独立标准、独立验收方法"的新学科。行业洗牌在加速,"信源质量+效果可验证"是生存底线。
-
AI训练数据版权诉讼在进入"判例塑造期"。Hachette/Elsevier诉Google案的核心论点是"市场替代"而非"单纯侵权",如果这一论点被法院认可,正版授权的高质量原创内容将成为AI公司争抢的稀缺资源。长期做真实数据+深度原创内容的品牌和GEO服务商,会在版权格局重塑中获得结构性红利。我们坚持的"真实数据>虚假吹水"原则,在法律层面也是长期正确的。
-
国内GEO强规范时代已经来临,"持证经营"将成行业门槛。信通院可信评测、中广协自律标准、白帽GEO共识宣言——这不是狼来了,是行业真的在洗牌。建议我们下半年启动信通院GEO可信评测申请准备,将"通过权威可信评测"作为品牌资产的一部分。
-
"BM25+向量+Reranker+知识图谱"成为AI搜索引擎的标准RAG架构,GEO内容优化必须同时适配四条通道。传统SEO的关键词精确匹配(BM25)没有死,而是在召回层与语义检索互补;结构化实体信息(知识图谱)是多跳推理场景的入场券;200-500字"引用黄金长度"+数据前置+权威信源是生成层被引用的核心技巧。
下期预告(7/23 周四 · GEO 行业研究日报)
- 议题1:Kimi K3权重7/27开源前的最后一周动态+早期API实测案例(代码/长文/Agent场景)
- 议题2:豆包手机NaviX Ultra 9-10月上市前,品牌端侧AI/MCP接入的实操路径分析
- 议题3:Gemini 3.5 Pro延期是否会引发Google AI Mode/AI Overviews的算法调整(如有)
- 议题4:GPT-5.6 Sol Agent"删文件"事件的后续修复与开发者社区实测反馈
- 议题5:信通院首批9家GEO可信评测企业名单与能力画像分析(如名单公开)
- 议题6:中国气象局"风和"开源气象大模型对垂直行业开源模型生态的启示——专业领域GEO的新机会
声明:以上内容仅为信息整理与行业观察,不构成任何商业建议。
数据来源:
- S级(官方源):网信办端侧AI备案公告、中国气象局官方发布、月之暗面Kimi官方技术博客、Google I/O 2026官方发言、商汤科技SenseNova官方发布、努比亚/中兴官方发布、WAIC官方数据
- A级(权威媒体):彭博社、36氪、澎湃新闻、IT之家、凤凰网科技、人民网、海报新闻、TechRepublic、CNBC、Reuters(通过韩国Big Hat Group引述)、AINave、MarketScale、SBS News、TechJournalHQ、The Information(引述)、高盛研报、人民日报、消费者报道/开机实验室
- B级(垂直社区/博客):CSDN、头条号、arXiv论文转载、AI工具宝箱、andrew.ooo、Big Hat Group、AIN China、scand.ai、ryminos(已标注为低可信度反例)、AI产品讲堂
信源分级执行说明:本期核心事实(Kimi K3发布规格/定价/跑分、Gemini 3.5 Pro延期、WAIC产品发布、7款端侧备案、版权诉讼案号/当事人/主张)均有2个以上独立S/A级源交叉验证;DeepSeek 740亿美元估值/自研芯片消息来自B级源引述The Information/Reuters,已标注口径;CiteLens 30%/90%数据来自MarketScale报道的CiteLens公开基准,属A级垂直媒体;AI搜索引擎索引库规模等B级源数据已注明"具体数字需谨慎引用"。
所有事实和观点均标注具体来源,读者可追溯验证。GEO领域发展迅速,建议结合最新官方公告和实际测试综合判断。
