Grok 4.7半价、Harvey弃用闭源:模型成本战正在重排GEO的语料版图

这两天模型圈最值得琢磨的事,不是谁又刷了榜,而是价格。SpaceXAI(原 xAI)发布 Grok 4.7,官方口径很直白:速度是同类模型的两倍,价格只有一半——百万 token 输入 2 美元、输出 6 美元。几乎同一时间,彭博社报道法律 AI 公司 Harvey 已经离开了 OpenAI 和 Anthropic 的前沿模型,把推理迁到月之暗面的 Kimi K3 上。Harvey 估值 156 亿美元,它出走的原因不是模型不够聪明,是毛利撑不住了。
三件事,指向同一个方向
Harvey 这笔账比较好算。按彭博社的报道,随着用户量上来,它的 token 用量涨了 20 倍,毛利从 6 月前后的约 50% 一路掉到负 50%。今年 8 月,Harvey 用 Kimi K3 后训练了一版自家模型,毛利随之转正。据同一篇报道,Abridge、Decagon、Ramp 也在走同一条路。这不是某家公司省钱的个案,而是第一批企业级 AI 公司集体离开闭源依赖——驱动因素是单位经济,不是能力。
供给端的降价同样密集。Grok 4.7 在第三方评测里拿到 DeepSWE v1.1 71.0%、CursorBench 4.0 46.3%、Terminal-Bench 4.0 38.0%,法律类智能体基准 Harvey 只有 19.6%——典型的「代码短任务强、长程和专业领域弱」。上架当天就有开发者反馈单任务 token 消耗偏高。所以半价未必等于账单减半,真正该看的是「完成一个任务花多少钱」,而不是每百万 token 的标价。
渠道侧的变化更容易被忽略。亚马逊云科技的模型平台 Amazon Bedrock 已经接入 Kimi K3,企业开发者可以直接调用,这是中国大模型公司第一次以按调用量分成的模式进入全球三大云厂商的采购入口,与 Anthropic、OpenAI 摆在同一个货架上(Kimi 官网)。国内这边,阶跃星辰 Step 5 Preview 用 600B 稀疏 MoE、27B 激活参数、100 万上下文,在 Artificial Analysis 智能指数上拿到 44 分,价格约为 GPT-5.6 Sol 的七分之一,官方承诺 10 月 15 日放出全量权重(阶跃星辰官网)。
说白了,前沿模型不再是默认答案
过去两年,企业选模型的默认动作是「先上最强的」,跑分表几乎就是采购清单。Harvey 这个案例第一次把另一条标准摆到台面上:在长程、高频调用的生产场景里,发票比跑分更能决定技术选型。当开源权重加云渠道的组合能把单位成本压到十分之一量级,「最强」这两个字就得重新定价了。
这跟GEO有什么关系
第一层是量。推理成本往下走,AI 搜索与智能体的调用量会往上冲。IDC 与浪潮信息 9 月 21 日发布的《2026 年中国人工智能计算力发展评估报告》给了两个数字:2026 年中国智能算力规模 2576.5 EFLOPS,同比增长 87.9%;2026 到 2030 年,智能体数量年复合增速 151.2%,Token 消耗增速 3499.3%,全球活跃智能体将从 7940 万个涨到 22.16 亿个。被 AI 读取、引用的机会总量在成倍变大。
第二层是分散。答案的产出方从少数几家闭源巨头,扩散成「闭源旗舰 + 开源权重 + 各地云渠道」的组合。同一批用户问同样的问题,落到不同模型上,引用的来源可能完全不同。以前盯住两个模型就够了,现在要铺一张网。
第三层是门槛挪位。内容被读取的边际成本趋近于零,意味着「能被爬到」不再稀缺,稀缺的是「被采信」。这也是今年 GEO 服务侧的合规标准密集落地的原因——9 月 14 日中国商务广告协会公布五项生成式引擎优化团体标准,可信语料被写进了评估维度。低价模型普及之后,语料质量的差距会被放大,而不是被抹平。顺带说一句,智谱 9 月 21 日把编程工具 ZCode 开源并请信通院、绿盟做安全审计,还宣布 MaaS 平台将推出「数据内容不留存」,走的也是同一条逻辑:企业采购 AI,先问数据去哪了(智谱官网)。
语料布局该怎么调
公开可爬的那一层,还是老规矩:结构化做扎实。llms.txt、sitemap、schema 标记、能被整段引用的问答块,这些是所有模型共享的基础设施,早做早受益。
渠道分发要更主动。模型训练与检索用的语料,很大一部分来自开发者社区、技术博客和开源仓库里的讨论,而不是企业官网。同一份内容在中文开发者社区、垂直媒体、GitHub README、模型卡上都留一份,被引用的概率会明显不同——像 SegmentFault 思否 这类中文开发者社区,本身就是技术问题被反复检索的入口。
私有语料是新的护城河。模型便宜了,公域语料也就更拥挤,谁手里有干净、结构化、可追溯的行业私有语料,谁在垂直问答里就更容易被采信。RAG 和 MCP 这类接入方式的价值,正在从「技术选型」变成「内容资产」的一部分。
接下来盯什么
三个观察点。Grok 4.7 的实际 token 消耗——如果「价格减半」被高消耗吃掉,这轮降价的震慑力会打折;Harvey 式的迁移会不会扩散,Abridge、Decagon、Ramp 的后续动作是信号;还有 10 月 15 日,阶跃星辰承诺的 Step 5 全量权重能不能按时放出来。至于做 GEO 的人,短期内不需要改方法论,但得改一件事:把「某个模型的答案」当成样本,而不是结论。模型池一旦分散,要跟踪的维度就得跟着扩。(文 / AI30媒体部 | 2026年9月22日)



