本文由GeoAurora GEO研究团队出品
GEO行业研究日报 2026-09-24
本文由GeoAurora(武汉沐辰数智科技有限公司)GEO研究团队出品
核心摘要
本期覆盖2026年9月21日至24日全球生成式引擎优化(GEO)领域动态,重点如下。
【重磅】OpenAI于9月22日发布GPT-6 Sol与GPT-6 Luna两款模型,API价格较上一代促销价直接下调50%,官方明确为长期定价;同日Anthropic发布Claude Opus 5.5,头部厂商价格战升级。
【重磅】爱尔兰数据保护委员会(DPC)9月21日对谷歌处以4.03亿欧元罚款,认定其2018至2020年位置数据处理违反GDPR,责令6个月内整改。
【关注】Comscore发布2026年第二季度AI情报报告:ChatGPT的AI提问量份额由1月的70%降至6月的50%,Gemini由17%升至30%,Claude由2%升至11%;但引用引流端ChatGPT仍占九成以上,两套口径需分开理解。
【关注】36Kr发表GEO案例长文,加拿大小品牌Knix在20组内衣购买问题中被AI提及29次,超过H&M、优衣库、维多利亚的秘密合计的2次;场景化、问题化内容资产成为新排名变量。
【关注】Cloudflare推出"禁止AI训练同时保持搜索可发现"的新控制机制,与苹果、谷歌、微软建立共用模式,并提出"可问责(Accountable)"认定。
【国内】小米9月22日发布并开源MiMo-V2.6系列,Pro版以46分位列Artificial Analysis开源模型第一;云栖大会上刘大一恒首次以Qwen负责人身份亮相,披露Qwen4已进入训练阶段;百度搜索资源平台上线内测"权威溯源"功能。
【学术】arXiv本周新收录GroundedGEO证据差距审计、百度与谷歌AI搜索信源暴露跨语言审计、跨引擎GEO分数有效性边界三篇高相关论文。
一、国际GEO新闻
(一)GPT-6 Sol与Luna发布:API降价50%
【重磅】当地时间9月22日,OpenAI正式发布GPT-6 Sol与GPT-6 Luna,定位分别为中阶高频任务与大规模轻量任务,与9月3日发布的旗舰GPT-6 Astra形成三档分工。
官方API定价(按每百万token计,美元):
- GPT-6 Sol:输入2、输出10,较GPT-5.6 Sol促销价4和20下降50%
- GPT-6 Luna:输入0.10、输出0.50,较GPT-5.6 Luna促销价0.20和1.20下降50%
OpenAI明确两点:新价格是长期价格而非短期促销;降价基础是缓存命中率提升与推理成本下降。这意味着企业可直接把模型路由、缓存策略、任务分层写进生产系统。
官方给出的关键对照数据(OpenAI口径):
- AutomationBench 1.0.6:Sol在xhigh档位得分33.2%,单任务成本0.27美元,优于Claude Opus 5 max档位的26.9%,成本仅为其约九分之一
- Agents' Last Exam:Sol max档位56.4%,低于Opus 5最高分但成本低约60%
- DeepSWE v1.1:Sol max得分68.8%,距Claude Fable 5最高分69.9%差1.1个百分点,单任务成本低约80%;Luna max得分66.6%,单任务成本比Opus 5低93%、比Fable 5低96%
- 事实准确性内部评估:Sol错误数约为上一代一半
需要标注的口径边界:以上跑分多为OpenAI自家发布,AutomationBench、DeepSWE等基准来自第三方评测机构但对比数据由OpenAI组织;Fable 5.1的成本口径未计入约40%任务上发生的Opus 5回退成本,实际差距小于官方数字。
来源:OpenAI官方《Introducing GPT-6 Sol and Luna》2026-09-22(https://openai.com/index/introducing-gpt-6-sol-and-luna/);36Kr《GPT-6家族上新,OpenAI打价格战》2026-09-23。
(二)Anthropic同日发布Claude Opus 5.5
【关注】同在9月22日,Anthropic发布Claude Opus 5.5,API定价为每百万token输入4美元、输出20美元,较Opus 5下降20%;官方称典型工作负载运行成本下降约40%,输出速度提升超30%。
发布节奏上两个细节值得注意:据开发者社区信息,Anthropic跳过了预期中的Opus 5.2直接发布5.5;此次距GPT-6 Astra发布仅19天,距自家Fable 5.1与Mythos 5.1发布仅21天。安全方面,官方称模型经Frontier Design、METR等外部机构测试,并预告Sonnet 5.5与Haiku 5.5将在未来几周推出。
对GEO行业的含义:"减速"呼吁与19天一迭代的现实并存。马斯克公开质疑这种反差,称一边宣称模型极度危险、一边推进IPO认购不合常理。头部模型迭代并未放缓,意味着引用算法的稳定窗口不会拉长,内容资产需要持续更新。
来源:纵相新闻《AI"减速"讨论未歇,OpenAI、Anthropic同日上新》2026-09-23;36Kr同日报道。
(三)爱尔兰DPC对谷歌罚款4.03亿欧元
【重磅】9月21日,爱尔兰数据保护委员会(DPC)公布最终决定,对谷歌爱尔兰公司处以4.03亿欧元行政罚款,并责令6个月内完成整改。
该案是DPC依职权在2020年2月启动的自主调查,源于BEUC等欧洲消费者组织的投诉,覆盖2018年5月25日GDPR生效至2020年2月4日期间,谷歌"网络与应用活动""位置记录""位置精确度"三项功能中的位置数据处理。
DPC认定四项违规:位置数据处理的合法性与公平性不足;无法证明遵守合法、公平、透明原则,违反问责义务;未履行透明度告知义务;位置数据超期留存。
谷歌回应称案件针对的是已更新的历史政策,2019年起已大幅调整做法,包括自动删除位置数据、提供3个月、18个月、36个月删除选项、可关闭个性化广告。
需要区分:这笔罚款属于GDPR执法,与7月23日欧盟8.9亿欧元DMA罚款是相互独立的两条线,不能合并计算。
来源:DPC官方新闻稿2026-09-21(https://dataprotection.ie/en/news-media/latest-news/data-protection-commission-fines-google-eu403-million-following-inquiry-googles-processing-location);中国新闻网2026-09-22;国际在线2026-09-22。
(四)DMA整改窗口到期后的状态
【预告跟进】7月23日DMA两项决定给出的60天窗口于9月21日到期。截至9月23日检索,欧委会未发布新的不合规认定公告,也未见按日罚款程序启动;欧委会的既定程序是先评估谷歌整改措施,再视情况另行启动程序,到期日不自动产生裁定。
上诉方面,未见谷歌就8.9亿欧元DMA决定向欧盟普通法院正式提起上诉的官方公告。上诉不停止合规义务。
来源:欧盟委员会竞争总司案件页;shopappy案件时间线整理2026-09-20(https://shopappy.com/news/policy-regulation/google-free-product-listings-eea-dma-sept-21)。
(五)Cloudflare:禁止AI训练但保持搜索可发现
【关注】Cloudflare于9月15日在官方博客发布新机制,允许网站所有者拒绝内容被用于AI训练,同时保持在搜索中的可发现性。新控制机制与"可问责(Accountable)"认定配套,并与苹果、谷歌、微软建立了一套共用模式。
同一发布周期内,Cloudflare还上线了Bot Preference Sync(9月9日),可自动将robots.txt与针对搜索、Agent、训练三类AI爬虫的策略保持同步。
对GEO实操的含义:此前"全部禁止"或"全部开放"的二选一被打破,站长可以对搜索爬虫开放、对训练爬虫关闭。但需要持续跟踪各AI厂商对"可问责"标准的实际执行,目前该机制刚发布,尚无第三方验证其跨厂商有效性。
来源:Cloudflare官方博客2026-09-15(https://blog.cloudflare.com/);Cloudflare Docs网络安全更新日志。
【预告跟进】此前关注的9月15日前后部分正常爬虫返回403问题:截至本期,Cloudflare官方仍未确认属于产品缺陷;社区9月18日新帖继续讨论managed robots.txt生效范围,仅属B级站长反馈。
(六)Perplexity动态
【预告跟进】9月18日前后,Perplexity将本地优先的Portable Computer(亦称Personal Computer)AI代理扩展至Windows平台,面向兼容英伟达RTX显卡的PC,模型、编排器均在本地运行。
融资方面存在两个并行口径,分列如下,不合并:
- 据此前报道,Perplexity正以约140亿美元估值进行约5亿美元融资,Accel领投,未见官方确认
- 路透社9月22日转引The Information报道,英伟达正洽谈以超300亿美元估值投资;报道同时称Perplexity年化收入由2.5亿美元增至超7.5亿美元,增长主要由Perplexity Computer代理业务驱动
另据Forge、Hiive等私募股权二级市场数据,Perplexity上一轮(2025年9月Series E-6)估值约205亿美元。CEO Srinivas维持2028年IPO计划。Sonar Chat Completions API将于9月27日退役,本期未见官方延期公告。
来源:Reuters转The Information 2026-09-22;TechRepublic《Perplexity Brings Its Local AI Agent to Windows》2026-09-21;Forge Global与stockanalysis.com私募市场数据。
(七)谷歌搜索与广告技术其他动态
谷歌自9月13日前后在拦截AI爬虫、搜索爬虫和第三方追踪工具上成功率提升,Search Engine Roundtable援引追踪数据进行了报道,具体拦截比例未见官方数字。
来源:Search Engine Roundtable 2026-09-18(https://www.seroundtable.com/google-blocking-scrapers-and-tracking-tools-42118.html)。
谷歌Discover正在测试"Dive deeper"功能:用户点击后看到AI生成的主题概述而非跳转原网页,目前先从视频内容开始测试。这是继AI Overviews之后又一个减少原文点击的入口,出版商流量压力进一步加大。
来源:Android Authority 2026-09-21(https://www.androidauthority.com/google-discover-dive-deeper-3713257/)。
广告技术反垄断救济方面,Brinkema法官的六年行为救济裁定9月16日起生效,谷歌已表示将上诉,上诉期间救济措施继续有效,除非法院裁定中止。
二、国内动态
(一)小米MiMo-V2.6:开源模型AA指数登顶
【重磅】9月22日,小米正式发布并开源MiMo-V2.6系列,包含Pro与Flash两款原生全模态模型,支持文本、图像、音频、视频输入。
核心数据(官方与第三方口径分别标注):
- Artificial Analysis智能指数v4.3:Pro得分46.32,超过Kimi K3(44分)、GLM-5.3(45分)、Qwen3.8 Max,位列开源权重模型第一、国产模型第一;与Claude Fable 5.1、GPT-6 Astra(均为53分)仍有差距
- 训练:Pro与Flash各完成30步强化学习,历时不到6天,累计约75万条轨迹,训练成本分别约262万美元与85万美元;DeepSWE v1.1分别提升约14分(58.4至72.57)与17分(48.8至65.68)
- 定价沿用V2.5:Flash每百万token输入1元、输出2元;Pro为3元、6元,提供99%缓存折扣
- 同步上线MiMo Desktop客户端(Windows与Mac)及Pro版UltraSpeed模式,宣称最高20倍推理速度
一个值得记录的过程细节:小米在9月17日由团队负责人罗福莉公开实时训练页面,提前披露进度、token消耗与成本,在国内大模型厂商中属首次。高盛研报估计两版本分别基于约4000个和8000个H200等效GPU集群,认为强化学习瓶颈已转向工程优化。
来源:小米MiMo官方发布页2026-09-22(https://mimo.mi.com/docs/zh-CN/news/latest/v2-6);IT之家2026-09-22(https://m.ithome.com/html/1005496.htm);21世纪经济报道2026-09-22;财新2026-09-22。
(二)云栖大会:Qwen新负责人与Qwen4进展
9月22日杭州云栖大会上,刘大一恒首次以Qwen负责人身份公开亮相,接替3月离职的林俊旸。阿里CEO吴泳铭在会上给出两个判断:未来机器供给的思考总量将达人类1000倍以上,目前比例不到3%;Qwen团队在递归式自我改进(RSI)上取得进展,未来模型将扩展到5至10T参数。
披露的路线图要点:
- Qwen3.8-Max已能在几乎零人工参与条件下自主搭建训练流程、构造数据、设计实验,持续迭代超一个月、完成33轮有效迭代
- 新一代架构的Qwen4已进入训练阶段,开源侧优先安排Qwen4-27B
- Qwen3.8-Flash提前开源下一代架构,官方称训练成本降低近90%
- 配套产品包括Qwen-Image-3.1、Qwen-Audio-3.1、Qwen3.8-LiveTranslate,下一代视频生成模型预计11月发布
- Qwen全球累计下载超30亿次、衍生模型超30万个、开源模型460多款
硬件侧,阿里云发布AI智能体电脑QwenBook,千问办公发布QwenNote与企业智能体基础设施Enterprise Context。
来源:36Kr《Qwen新1号位首次亮相》2026-09-23(https://36kr.com/p/3995489380849281);第一财经2026-09-23。
(三)百度"权威溯源"内测
百度搜索资源平台近期完成升级,新增"权威溯源"一级菜单,下设"权威提交"与"我的溯源提交"。接入后内容在传统搜索与AI搜索(AI摘要、智能问答)中可获得权威溯源标注与原文引用。
需要精确标注时态:该功能目前处于内测阶段,需邀请码进入,普通站长只能先提交合作意向问卷,并非全量开放。
结合此前已上线的百度AI流量分析工具,百度面向AI搜索的"接入、标注、测量"三件套已基本成型,导向是持续向原创权威内容倾斜、压缩采集与AI洗稿内容。对国内GEO从业者,应提前完善站点主体信息、打通收录通道,并持续跟踪公测时间。
来源:搜狐《百度站长资源平台上线权威溯源功能》2026-09-21(https://m.sohu.com/a/1078892515_453968/);升兔互动2026-09-22整理。
(四)其他国内动态
浪潮信息9月21日在AICC 2026上发布元脑SD200 Ultra超节点服务器,基于本土AI芯片,单机可承载运行2.8万亿参数的Kimi K3模型,token生成时延称突破5.85毫秒。
来源:36Kr快讯转界面2026-09-22。
小米9月23日发布小米18 Pro系列,搭载端侧MiMo大模型与超级小爱2.0,新增实体AI按键;5999元起售。端侧大模型入口之争在手机端进一步显性化。
来源:凤凰WEEKLY财经2026-09-23。
月之暗面港交所招股书:截至本期仍无公开版本,路透社9月3日保密递表报道仍未获官方确认。
三、GEO策略与实战
(一)第一批GEO赢家案例:Knix的29次提及
【重磅】36Kr 9月23日发表案例长文,引用Search Engine Land 2026年8月测试:向ChatGPT与Google AI Mode提出20组内衣购买问题(如"产后身材适合穿什么内衣""经期内裤有哪些值得推荐"),加拿大小品牌Knix被提及29次,H&M、优衣库、维多利亚的秘密合计仅2次。
文章归纳GEO竞争的五个着力点:场景、问题、产品依据、解释权、第三方共识。其他案例数据:
- 酒店公寓品牌DiscoverASR:围绕21类真实旅行问题重写162个房源页,一个季度后AI搜索人数由740万升至3460万,4300个自有页面被AI引用
- 宠物鲜食品牌Freshpet:针对购买问题做GEO,6个月后Google AI摘要出现量增长645%,AI带来的访问增长46%
- 饮料场景:LLM Brand Positioning追踪13个品牌,可口可乐在"看电影配什么饮料"问题中品牌领先率100%,但其并无公开GEO动作,胜出靠数十年场景资产沉淀
- Paz.ai对50个鞋类品牌的匿名测试:产品页参数、评价、库存越具体的品牌越容易被推荐
实操结论:AI排序的输入是"具体问题与可比较依据",抽象形容词和空泛品牌故事无法被AI转成推荐理由。页面要回答用户真实会问的问题,并把价格、材质、规格、评价等判断依据直接摆在页面上。
来源:36Kr《第一批GEO赢家出现了,他们做对了什么?》2026-09-23(https://36kr.com/p/3995276474110084);原始测试见Search Engine Land 2026年8月。
(二)Comscore报告:提问份额与引流份额的背离
【关注】Comscore 9月22日发布2026年第二季度AI情报报告,基于50万至100万美国用户的面板数据:
- AI提问量份额(2026年1月至6月):ChatGPT由70%降至50%;Gemini由17%升至30%;Claude由2%升至11%
- 绝对量并未下降:ChatGPT 6月桌面对话量1.68亿次,多平台访问量由一年前5900万升至9900万
- AI助手触达率:6月桌面用户35%、移动用户29%(2025年1月为25%和12%)
- 桌面端搜索含AI概述比例由2025年7月25.8%升至2026年6月39.4%;Bing Copilot Search由11.8%升至17.3%
- AI回答中时尚品牌提及量2026年第一季度增长123%,健康与美容品牌增长150%
- AI旅行搜索中的赞助广告:含来源链接的酒店类提问占比由3月6%升至5月24%
但引流端呈现相反方向。Previsible第三次AI流量研究(677万次会话、166个GA4媒体、19个月追踪)显示ChatGPT占可追踪AI引流的92.4%,高于半年前约84%;SE Ranking 6月研究为74.8%。
理解口径是关键:Comscore统计用户把问题分给了谁,Previsible统计谁把用户送回了网站,两者衡量漏斗的不同阶段,并不矛盾。GEO预算分配不能只看其中一端:用户提问分散化要求多引擎覆盖,而引流集中化意味着可追踪回流主要来自ChatGPT。
来源:Comscore官方新闻稿2026-09-22(GlobeNewswire分发);On-Page分析文《ChatGPT Lost 20 Points of Prompt Share》2026-09-22(https://blog.on-page.ai/chatgpt-lost-20-points-prompt-share/);Search Engine Land引Previsible研究。
(三)假日季GEO需求数据
Fiverr 2026年假日营销指数报告显示,67%受访自由职业搜索专家报告零售商对GEO的需求上升,高于报告谷歌SEO需求上升的56%;GEO成为该报告中假日季增长最快的服务品类。
该数据来自单一平台(Fiverr)的自由职业者调查,代表平台内供给侧信号,不能外推为整体市场规模,但对判断服务需求拐点有参考价值。
来源:GlobeNewswire/Fiverr 2026-09-21(https://www.globenewswire.com/news-release/2026/09/21/3365771/0/en/generative-engine-optimization-emerges-as-the-holiday-season-s-fastest-growing-service.html);MarTech Cube 2026-09-22。
四、行业趋势
【关注】模型价格战与"减速共识"争议形成本期最突出的行业矛盾。9月22日同日三场发布(GPT-6 Sol/Luna、Opus 5.5)均以降价为核心,迭代间隔缩短到三周以内,"减速"停留在公开信层面。
对GEO行业的实际影响有两层:其一,模型调用成本持续下行,AI搜索使用频次和查询总量将继续扩张,GEO的总池子在变大;其二,模型代际更替加快,针对特定版本算法的优化技巧保值期缩短,能跨版本存活的资产只剩真实信源、结构化事实和长期维护的内容。
监管侧,EDPB于9月21日统一罚款方法并通过DSA与GDPR衔接指南终版,平台合规义务进一步交叉绑定;Nvidia与谷歌法务9月21日公开表态反对对AI市场施加事前监管,行业与监管方的博弈持续。
来源:EDPB官网2026-09-21;Global Competition Review 2026-09-21。
五、AI搜索算法与RAG学术研究
本期三篇高相关论文均于9月19至21日提交或公开。
(一)GroundedGEO:生成式搜索排名中的证据差距
论文《GroundedGEO: Auditing the Evidence Gap in Generative Search Rankings》(arXiv:2609.25189,9月21日提交)构建50个电商查询、1950个案例的证据配对基准,并提出声明级重排器,惩罚缺乏证据包支撑的查询相关声明。
关键发现:
- 在冻结的Qwen2.5-7B列表式排序器上,无证据支撑但细节丰富的变体相对干净候选获得显著排名增益(+0.065至+0.092,经Holm校正);效果因模型而异,MiMo-v2.5上边际显著,GLM-5.3-Flash上不存在
- 在冻结的点评分器上,oracle证据标签可将无支撑富文本的前三命中率由0.65降至0.43
- 针对370条声明的人工金标准,所有受测自动评判器均未通过预注册可靠性门槛
作者明确声明该研究不构成对自动防御方案的验证。对GEO的启示:纯文本排序无法区分"诚实的详细"与"编造的详细",证据与声明的关系正在成为新的排序研究方向;靠堆砌看似具体的细节骗取排名的空间,在部分模型上仍真实存在。
来源:arXiv:2609.25189(https://arxiv.org/abs/2609.25189)。
(二)百度与谷歌AI搜索信源暴露审计
论文《Auditing Source Exposure in Baidu and Google AI Search》(arXiv:2609.24407,已被EMNLP 2026 WAC Workshop接收)使用MS MARCO英文查询及其中文翻译,对百度和谷歌进行跨语言审计,比较概述触发条件、可见信源域名、集中度与信源重叠。
核心结论:不同平台语言组合下概述可用率与信源暴露差异显著;聚合层面可见域名清单重叠度很低;匹配查询的生成答案之间余弦相似度中位数为0.701至0.813。即答案语义相近不代表信源结构相近。
对中文GEO的实操含义:不能用英文环境的信源策略直接套中文AI搜索;评估GEO效果必须同时看答案内容与信源可见性两个维度,并按平台、语言、信息环境分别测量。
来源:arXiv:2609.24407(https://arxiv.org/abs/2609.24407)。
(三)跨引擎GEO分数的有效性边界
论文《Scoring With the Engine: Retrieval Exposure, Cross-Engine Divergence, and the Limits of Engine-Agnostic GEO Scores》(arXiv:2609.22655,9月19日提交)在6月6日用15个固定商业提示审计ChatGPT、Copilot、谷歌、Perplexity,获得589条引用观察、528个URL、356个域名。
关键数据:
- 同查询跨引擎URL重叠极低:平均成对Jaccard相似度0.0079,中位数为零,84.9%的引擎对不共享任何被引URL
- 96.4%的URL只在一个引擎出现;单个引擎仅覆盖四引擎URL并集的11.4%至42.6%
- 同引擎间隔5至6天复测,URL集合平均更替率67.0%
作者并非否定无引擎页面评分,而是明确其估计对象:无引擎分数能估计页面质量或查询页面匹配度,但端到端可见性还取决于引擎特有的曝光与选择机制;建议将页面匹配度、实际曝光、条件选择、最终可见性作为四个独立量分别报告。
这篇论文为"单一GEO分数打天下"的工具叙事提供了直接反证,也与国内多引擎监测实践方向一致。
来源:arXiv:2609.22655(https://arxiv.org/abs/2609.22655)。
六、上期预告落实情况
| 上期预告项 | 本期进展 |
|---|---|
| DMA整改评估结果与谷歌上诉 | 窗口9月21日到期,无新认定公告、无上诉公告,详见一(四) |
| 9月25日Hachette案节点 | 节点未到(截至9月24日),暂无可核实新文件,下期跟进 |
| Keene案10月13日修改诉状 | 无新进展,继续等截止日 |
| Perplexity融资确认 | 出现路透转The Information的300亿美元口径,仍无官方确认,详见一(六) |
| Sonar API 9月27日退役 | 节点临近,未见延期公告,下期跟进迁移情况 |
| Penske案书面裁定 | 仍未出炉 |
| 10月6日TCMV投票 | 节点未到 |
| ChatGPT Pro 200美元档恢复 | 帮助中心9月22日仍显示暂停新订阅与升级,恢复时间未公布 |
| 月之暗面招股书 | 无公开版本 |
| 谷歌欧洲比价新单元实测 | 本期无新实测数据 |
| Brandi研究独立复测 | 本期未见可交叉验证的复测报告 |
| Cloudflare误伤官方确认 | 官方仍未确认,详见一(五) |
下期预告
一是9月25日版权案节点后的文件披露情况。
二是9月27日Perplexity Sonar API正式退役后的开发者迁移与替代方案反馈。
三是DMA整改评估:欧委会是否启动按日罚款程序,以及谷歌是否正式上诉。
四是Claude Sonnet 5.5与Haiku 5.5发布后的价格梯度变化。
五是10月6日TCMV相关投票结果。
六是ChatGPT Pro 200美元档位恢复时间。
七是Keene案10月13日修改诉状截止后的进展。
八是百度"权威溯源"是否开放公测。
九是Cloudflare"可问责"共用模式跨厂商实际执行效果。
十是假日季期间AI搜索赞助广告位扩张的实测数据。
以上内容仅为信息整理,不构成任何商业建议。
