标签

GPT-6 Astra震撼亮相 OpenAI宣告AGI新纪元正式来临

发布时间:2026-09-04 19:55阅读:1

2026年9月3日,OpenAI重磅推出GPT-6 Astra,公司总裁格雷格·布罗克曼在发布会开场便宣布:"我们已迈入AGI时代。"

Astra在衡量抽象推理能力的ARC-AGI-3基准测试中,成绩从GPT-5.6 Sol的7.8%飞跃至99.9%,提升幅度超过十倍,几乎达到满分级。

人工智能在未知环境中自主学习与逻辑推断的能力,已逼近人类极限水平。

核心要点:关键能力与测试成绩

Astra最显著的进化,是从"被动响应指令"迈向"主动完成任务",如今用户只需设定高层次目标。

模型自行分解任务、调用各类工具、跨平台协同操作,并最终交付完整的工作成果。

在多个权威评测基准上,Astra的成绩全面超越上一代GPT-5.6 Sol:

抽象推理与泛化能力:99.9% 对比 7.8%,完成跨代际飞跃;

OSWorld 2.0:72.6% 对比 65.7%,单任务耗时由75分钟压缩至40分钟,效率提升约47%;

Automation Bench:41.4% 对比 18.1%,增长超过两倍;

ExploitBench:100% 对比 78.5%,同时成为OpenAI首款达到内部"关键"级安全标准的模型。

另外,在FrontierMath Tier 4数学评测基准中,Astra亦拿下97.6%的高分。

最大转变:从工具进化为智能体

Astra无需用户再将复杂任务拆分成逐项指令,它能够自主规划、执行、检验并修正错误,从而完成跨系统、长周期的实际业务。

这种"目标驱动型自主智能"的成熟,使AI从辅助工具升级为可独立承担任务的协作伙伴。

训练规模与技术参数

GPT-6 Astra借助超过10万块GPU,在得州Stargate基地完成模型训练。

最大输出长度达12.8万词元,可处理文本与图像输入并生成文本输出,同时支持网页检索、文件搜索、代码编写与运行等能力。

知识截止日期为2026年4月30日。该模型提供五档推理强度调节,范围从low到max,用户可按任务复杂度灵活平衡成本与推理深度。

当AI能够自主"做事"而不仅仅是"回应",世界的运转逻辑正被重新书写。