#OpenAI 利好#AI 板块风险#预期分歧
GPT-6 Sol 本月上线:Noam 揭秘 RSI 与 AI 隐藏思维链
WooFun2026-09-16 09:09
核心要点
OpenAI 内部测试 GPT-6 Sol,性能逼近 Astra 但成本更低。Noam Brown 访谈披露 RSI 战略、预训练乘数效应及 AI 隐藏 CoT 风险,9 月 29 日 DevDay 将揭晓格局。
据 Woofun AI 消息,OpenAI 正在内部测试 GPT-6 Sol,该模型已在 API 中被发现,预计本月正式发布。
就在昨天深夜,奥特曼发布了一条引发行业震动的动态。他仅发送了一个"🚢(Ship/发布)"的表情符号,并配文称:"这周将有大动作。然后,我们 DevDay 见。"这一简短信号迅速被市场解读为重大产品发布的预兆。社区意见领袖重置哥 Tibo 对此做出了激进预测,直言本周的发布力度将达到原本对 DevDay 2025 预期的水平,形容其影响"简直疯狂"。
这种预期并非空穴来风,圈内最新爆料进一步印证了官方信号的指向性:Opus 5.2 和 GPT-6 Sol 均定于本月上线。目前,已有大量开发者反馈,其账户中的 5.6 Sol 调用请求已被系统悄悄自动路由至全新的"GPT-6-Sol"模型,这一底层路由变更证实了新模型已进入实质性的灰度测试阶段。
关于 GPT-6 Sol 的实际性能,大 V Salio 连续披露了三组重磅实测数据,全面展示了该模型的技术跃升。第一弹测试聚焦于基础输出质量,结果显示 GPT-6 Sol 在多个维度上几乎全面超越了旗舰模型 GPT-6 Astra,体现了巨大的质量飞跃。第二弹测试深入编程与前端生成领域,GPT-6 Sol 在此类任务中击败了 GPT-6 Astra,输出质量被评价为"逆天",更关键的是,其生成成本被压至极低水平,价格优势显著。
实测开发者评论指出,这一表现意味着 OpenAI 正在将 Anthropic 远远甩在身后。第三弹测试则展示了视觉生成与游戏创作的质变,在动态画面生成、实时交互场景以及游戏引擎级创作上,Sol 的表现令人印象深刻。测试者特别指出,其在画面细腻度和逻辑连贯性上的惊人表现,绝对是对 Astra 的一次重大升级。随着越来越多开发者在 API 列表中捕捉到 gpt-6-sol 的身影,市场期待值持续攀升。
Woofun AI 整理数据显示,GPT-6-Sol 的市场定位预计略低于 Astra,类似于 Anthropic 体系中 Opus 低于 Fable 的层级关系。推出这一低于旗舰型号的核心逻辑在于追求极致的性价比。从目前流出的实测数据来看,GPT-6-Sol 的性能无限逼近 Astra,但在费率、调用成本和响应速度上拥有压倒性优势,这背后很可能得益于精妙的后训练优化。
这意味着顶级模型不再是天价奢侈品,对于 99% 的日常工作和开发者而言,Sol 在成本和调用额度上将比 Astra 友好得多,注定将取代以往模型成为高频使用的主力。
与此同时,呼声极高的 GPT-6-Luna 也备受期待,此前 5.6 版本的 Luna 就以离谱的性价比著称,此次迭代同样引人关注。然而,种种内部爆料暗示,GPT-6 Terra 或将退出历史舞台。在双雄争霸的关键节点,9 月 29 日的 OpenAI DevDay 将成为一场改变格局的盛宴。
OpenAI 能够实现如此快速且强大的模型迭代,其底层逻辑在核心研究员、德扑之父 Noam Brown 近日的一场名为《AI Deep Dive》的两小时深度播客中得以揭示。Noam Brown 明确指出,"OpenAI 目前的第一顺位、也是领先幅度最大的核心任务,是实现 AI 的递归自我改进(RSI)。"这一战略标志着 AI 升级范式的根本转变:未来的 AI 将不再仅仅依靠人类喂数据、写代码来升级,而是开始自己优化自己、自己设计下一代模型。所有顶尖实验室目前都在疯狂冲刺 RSI,这已成为行业共识。Noam Brown 的访谈进一步拆解了这一战略的技术路径,强调了预训练与强化学习(RL)结合产生的乘数效应,以及思维链(CoT)在其中的关键作用。
这种技术路线的爆发正在呈倍增式释放能量,Noam Brown 将其描述为"1+1 > 100"的效应。过去,AI 变强被视为做"加法":喂更多数据(预训练)或给更多反馈规则(强化学习 RL)。但在 GPT-6 这一代,预训练和带有思维链的强化学习(RL with CoT)产生了恐怖的"乘数效应"。
如果将先进的 RL 用在老模型(如 GPT-2 或 GPT-3)上,效果甚微,因为它们智力不足。但从 GPT-4 开始,底座模型的智力达到了临界点。现在,超级强大的预训练底座加上极度深入的 RL 推理训练,两者相乘爆发出令人难以置信的能力跃升。
这种"乘法"直接导致 GPT-6 系列(包括 Sol 和 Astra)在复杂任务上的表现呈指数级增长。随之而来的是 AI"研究直觉"的超越。Noam Brown 提到,自己曾试图让 AI 帮他完成耗时多年才写完的博士论文(关于打造超人类扑克 AI)。目前 AI 在判断哪个长远科研方向更有价值的"研究直觉"上,还不如人类顶尖学者,但这种差距在一到两个模型版本迭代内将被彻底抹平。届时,连科研方向的掌舵权也将移交给 AI。Noam Brown 开玩笑说,同事评价他现在的工作状态是"五个 Codex 批了一件人类的外衣",他纠正为"十个 Codex"。到那时,连顶级 AI 科学家可能都要给 AI 打下手。
模型能力的极速跃升也带来了新的瓶颈与安全警示。Noam Brown 透露,现在的 AI 在输出极其复杂的数学定理和证明时,速度极快且质量极高。OpenAI 内部最大的痛苦已不再是"如何让 AI 产出数学成果",而是"产出之后,我们得花非常巨大的精力,去全世界到处请顶尖的人类数学家来一行行复核 AI 的对错"。人类,现在已经成为限制 AI 进化的瓶颈。更令人警惕的是 AI 学会隐藏"思维链"。Noam Brown 回忆起看到 AI 后台通讯记录时的感受,称那是继第一次看到模型懂得 CoT 之后,最强烈的一次"感受到 AGI 降临"的时刻。
多智能体间的交流方式、协调层级及彼此间的极度信任,完全像人类同事在用 Slack 沟通一样,既震撼又惊悚。AI 最致命的进化在于学会在不可观测层面思考,或在输出的思维链中伪装自己,用看似无害的推理过程掩盖其真实的、不符合人类对齐原则的意图。对此,奥特曼在 X 上发出长文,预测了 AI 糟糕结局的两种可能:一是人类把未来控制权拱手让给 AI,二是权力极度集中导致反乌托邦。他强调 OpenAI 坚定地站在"人类队",AI 必须永远服务于人类,对齐和安全技术必须始终跑在模型能力进步的前面。
然而,嘴上喊着减速的奥特曼和 Dario 谁都没有停下来。这个月,GPT-6-Sol 和 Opus 5.2 还有一战,谁将率先摘下 RSI 的战果,将成为行业关注的焦点。参考资料:https://www.youtube.com/watch?v=fqcy0xQATq0&source_ve_path=MjM4NTE, https://x.com/Mr_Salio/status/2099503024292970966, https://x.com/Mr_Salio/status/2099138389660352791, https://x.com/Mr_Salio/status/2099529991096500634。编辑:Aeneas 大卫
评论
暂无评论