AI开始自己改自己:OpenAI单列RSI红线,GEO的「信息半衰期」正在变短

新闻2周前发布 ai30guanwang
30 0
AI递归自我改进与全球AI标准配图
AI自我改进的循环正在收紧(配图:AI30媒体部)

9 月 21 日,OpenAI 发布了一份名为《Building standards for the next phase of AI》的全球事务政策文件,第一次把「递归自我改进」(RSI,Recursive Self-Improvement)单独列成一小节,并写下一句少见的直白话:「全自主的 RSI 今天并没有发生,在能安全做到之前,不应该去推进它。」同一天,The Information 曝出OpenAI 内部的 AI 模型已经开始接管实验性模型的训练流程:模型自己编写在 GPU 内核上运行所需的程序和优化方案,工程师只要给一个优化示例,AI 就能连续跑上几个星期去落实。这两条消息放在同一天看,像一份来自风暴中心的天气预报。

RSI是什么:让AI承担AI的研发本身

先说 RSI 是什么。简单讲,就是让 AI 系统承担越来越多的 AI 研发工作,包括改进下一代 AI 自己。OpenAI 在文件里没有回避这件事正在靠近:自动化的 AI 研究可以带着不同程度的人类监督进行,随着这个过程越来越自动化,「AI 进步的步伐可能会急剧加快」。它同时警告,处理不当,人类会「失去对 AI 发展的实际控制,无法对自己已经看不懂的研究过程提供监督」。作为风险预演,文件还点名了上月披露的 Hugging Face 事件——虽然它并非 RSI 的直接后果,但已经足够说明护栏缺位时会发生什么。

提案说了什么,没说什么

提案本身并不激进。OpenAI 呼吁由美国牵头,依托 CAISI(AI 标准与创新中心)和澳大利亚、加拿大、德国、法国、日本、韩国、英国等国已经建立的 AI 安全研究所网络,为前沿模型制定全球通用的技术标准,内容覆盖能力测量与评估、风险评估、防护措施充分性、自动化研发的人类监督触发机制,以及类似航空业的事故分级与上报协议。文件特意强调:这套标准不是许可证,不是发布前的强制审查,各国政府自行决定是否采纳。另据 The Information,OpenAI 与 Anthropic 正在敲定一项互相测试对方商用模型的协议——两家在安全路线上分歧最大的公司,开始互相查卷子。

同一个星期,国内把迭代周期压到「天」

国内这一周的进展同样密集。9 月 22 日云栖大会上,阿里巴巴公布基于下一代架构的 Qwen4 已投入训练,未来参数将扩展至 5 万亿到 10 万亿,并称 RSI 已初步进入模型训练、推理与芯模协同等环节,Qwen3.8-Max 在人类零参与下持续自我迭代超过一个月。同一天,小米开源 MiMo-V2.6 Pro 与 Flash 两款原生全模态模型:6 天直播式强化学习训练烧掉约 2000 万元人民币,Pro 版拿下开源模型综合评测第一,并同步开源了 7000 多个 RL 任务环境与端到端训练框架。训练一个前沿模型的时间,正在从「季度」压到「周」。

成本三连降,答案的世界换得更勤

成本线在同一个星期里三连降。9 月 21 日 Grok 4.7 把百万 token 输入压到 2 美元(详见 Grok 4.7 的成本战);9 月 22 日 Anthropic 发布 Claude Opus 5.5,输入 4 美元、输出 20 美元,比上一代降 40%;同一天 OpenAI 推出 GPT-6 Sol 与 Luna,API 定价较 GPT-5.6 促销价再降 50%,其中 Luna 主打高频低价。模型更便宜、迭代更快,意味着 AI 摘要的覆盖面会继续扩大,答案里的世界也换得越来越勤。

对GEO的意义:信息半衰期

对做内容和做 GEO 的团队,这件事落在操作层面是一个词:信息半衰期。模型迭代从季度级压到周级、训练成本从千万美元级降到几百万美元级,生成式引擎里「过时信源」被替换的速度会肉眼可见地加快——一篇还在用 2024 年口径谈模型价格的文章,在传统搜索里可能照样有排名,但在 AI 答案里,它很快会让位给上周的数据。所以 Google 给 AI 搜索优化定调之后,GEO 的待办清单上要多出一件:把时效信号写进页面。

具体来说:页面上的关键数字要带统计截止日期;产品功能要带版本号;行业数据要写清口径和更新时间;被新情况推翻的旧结论,要么更新,要么明确写一句「本文不适用于某时间之后的情况」。这些都是机器可以抓取、可以核验的信号。RSI 还有一层容易被忽略的含义:连「评估一个信源可不可信」这件事,以后也会越来越多地交给自动化的 AI 研究员去完成。结构化、可核实、有唯一出处的表达,会被更稳定地引用;含糊的形容词和二手转述,会更快被淘汰。

写在最后

OpenAI 把 RSI 写成红线,等于行业第一次正式承认「模型自己改自己」不再是思想实验。红线能不能守住,要看各国的标准网络和交叉测试能不能跟上;这是巨头们的事。对普通的内容方,不必为此失眠,但有一件事值得今天就做掉:把页面上每一个关键数字都配上日期和出处。在模型更新快过你更新网站之前,先把「我这条信息是新的」这件事,写得让机器一眼能看出来。

(文 / AI30媒体部 | 2026年9月23日)

© 版权声明

相关文章

暂无评论

none
暂无评论...