连创造者都无法读懂,OpenAI坚称GPT-6便是AGI的起点
GPT-6 Astra官方海报(图源:OpenAI)
过去两年,AI发布会的套路如出一辙:跑分飙升、编码提速、回答更精准。台下喝彩,媒体沸腾,接着便等待下一次到来。
9月3日的GPT-6 Astra发布会却打破了惯例。OpenAI总裁布罗克曼宣布"欢迎进入AGI时代",然而同场发布会上,首席科学家帕乔基抛出一句令全场陷入沉默的话:"智力的提升,并不代表对齐能力也在提升。"
通俗地讲:AI变得更聪明,可人类对它的掌控力却更薄弱了。
这并非虚言。Astra是OpenAI首款思维链条"无法解读"的模型——此前工程师还能逐行追踪AI的推理路径,而今连他们自己也难以理解AI的思维了。
因此,故事的核心并非"AI再度进化",而是:当AI的智能已超越其创造者的认知极限时,我们或许并非在拥抱AGI,而是在丧失对AGI的定义权。
先从数据说起。ARC-AGI-3用于衡量AI在未知环境中的学习与推理水平。前代GPT-5.6 Sol仅得7.8%,而新一代直接跃至99.9%。FrontierMath Tier 4高级数学测试取得97.6%,ExploitBench网络漏洞利用测试斩获满分100%,OSWorld 2.0计算机操作得分72.6%,任务完成时间缩减近一半。
这不意味着"略有进步",而是在多维度上完成了从"可用"到"超越人类"的跨越。
OpenAI官方X账号发布GPT-6 Astra,浏览量250K(图源:X/@OpenAI)
跑分亮眼早已司空见惯。真正引人注目的是Astra的核心卖点——它不在于"回答问题",而在于"操控电脑"。填写表格、更新CRM、安排日程、进行网络调研、处理科学数据、搭建网站——OpenAI的宣传语是:"电脑上能完成的任务,Astra都能代劳。"
过去两年,我们所熟悉的AI是"一问一答"模式。Astra则转变为"下达目标,自行执行"。从对话助手进化为数字员工,这是一次质的飞跃。
能力成倍增长,价格亦水涨船高。API定价为每百万Token输入10美元、输出50美元,较上代提升2.5倍。但OpenAI解释称:Astra在编程场景下的Token消耗仅为前代的三分之一,推理效率更高,整体成本或许持平甚至更低。
顶级模型开始主动强调性价比,表明AI竞争的焦点正从"谁的智能更高"转向"谁能以更低的成本实现更高的智能"。
前文提及Astra的思维链条"无法解读"。这一点值得深入探讨,因为它或许是整场发布会中最被忽视的关键信息。
以往无论AI模型多么强大,工程师至少能追踪其推理脉络:第一步的思考方向,第二步的判断逻辑,第三步的结论推导。这是AI安全的根基——只有读懂它的思维,才能预判其行为风险。Astra却将这一根基连根拔起。原因并非它拒绝展示,而是其推理模式已复杂到人类审核者无法理解的程度。
与此同时,Astra是OpenAI首个触及"关键级"网络安全门槛的模型——能够独立识别真实软件中尚未公开的漏洞,且能将多个漏洞串联,向系统纵深渗透。OpenAI因此暂停训练数周,加固防护后才重新启动。
一方面能力之强足以发现人类遗漏的漏洞,另一方面思维之复杂令人类审查者望而却步。这两件事同时出现在同一模型上绝非偶然——能力越强,黑箱越深。这或许不是GPT-6独有的问题,而是所有未来模型的共同趋势。
布罗克曼措辞审慎,附加了"可能"二字,并留有余地:"如果你认为这是首个,我认为有道理。"训练动用了逾十万块GPU,OpenAI为此叫停Sora、砍掉几乎全部非核心业务、将安全团队划归首席风险官直管。一家企业押上全部身家声称"我们或许已抵达终点",无论是否真正到达,这一姿态本身已传递出强烈信号。
但我想换一个视角。过去数十年,我们始终期待AI达到与人类相当的智力水平。然而GPT-6 Astra揭示了一个真相:真正的转折或许不是"AI已经追上人类",而是"AI开始运用人类难以理解的思维模式"。我们曾将AGI视为终点线,但它也许是一条分界线——这边是"AI辅助人类工作",那边则是"AI独立运作,而人类无法洞察其过程"。
若属于后者,那么最核心的问题并非AGI是否已经实现,而是:当AI的思维模式超越人类认知边界时,"实现"这一判断本身,是否仍应由人类做出?
你认为GPT-6算得上AGI吗?换种问法:若AI已强大到你无从理解其思维,你还会安心把电脑交由它操控吗?