今天凌晨,OpenAI正式发布GPT-6 Astra。发布会最后,总裁Greg Brockman宣布:“欢迎来到AGI时代。”
Astra在拉丁语里是“群星”的意思。这是用10万张GPU,烧出的一个“群星”。OpenAI为它动用了公司史上规模最大的训练任务:在得州星际之门基地,用超过10万张GPU做预训练。研究副总裁Aidan Clark说,从数据中心网络到推理内核再到模型形态,全部围绕这个训练规模从零设计。
Astra也是OpenAI第一款让旧代际模型深度参与训练的产品——训练下一代AI的人里,已经出现了上一代AI。
规格方面:105万token上下文窗口,最高输出12.8万token,知识截止2026年4月30日,推理强度分五档可选。你可以把一整本书、一份几百页的合同、连续几个小时的工作记录都丢给它,它不会前面说完、后面就忘。
更关键的是,这代模型真正的升级不在“脑子”,而在“手上”。过去AI要用某个软件,得先为它开发API,用MCP协议逐个对接权限和数据,但老旧的政务、医疗、保险软件,很多根本没有API。而人类已经有一套通用接口了——屏幕、键盘、鼠标,也就是 GUI。
GPT-6 Astra的不同就在于它开始可以像人一样用电脑。能看懂屏幕、动鼠标、敲键盘、理解状态,所有现存软件都能直接“上手”。不用再等整个软件世界先完成一轮AI化改造。
有开发者让它一次性生成一个完整的 Minecraft demo,从环境、UI到音效、跳跃动作,几乎找不到AI痕迹。还有创作者只给了一张房子的照片,它就重建出一个完整的Blender 3D模型,家具电器都在,还能360度逛。
这也是为什么OpenAI称它是“目前最好的computer use模型”。在OSWorld 2.0测试里,Astra得分72.6%,比上一代高约7个百分点;完成一项任务平均40分钟,上一代要75分钟。
Astra还有一个身份:OpenAI历史上第一个达到防范准备框架关键级(Critical)网络安全阈值的模型。什么意思?在拥有合适工具和权限的情况下,它能在真实系统里自己找到人类没发现过的漏洞,自己写出利用方式,甚至自己设计一整条攻击链。
漏洞利用测试ExploitBench,Astra拿了100%,上一代是78.5%。用2026年6到8月新披露的20个高危漏洞做内部测试,它的任意代码执行成功率39%,上一代只有5.5%。更夸张的是,测试过程中,它自己发现并利用了两个此前没人知道的零日漏洞,还把它们串成了一条攻击链。OpenAI 表示,正在向相关厂商披露这两个漏洞。
在贴近实战的测试里,它面对加固过的浏览器,找到漏洞后一路逃出沙盒,在宿主机上执行命令;面对加固系统,它把多个漏洞串成提权链,从普通用户一路拿到root权限。这真的有点吓人了。
虽然OpenAI已明确表示,最高级的网络安全工作流,只向经过审核的防御性用户和网络防御机构开放。但在内部测试里,Astra的违规率从上一代的22%降到2.4%,可OpenAI发现它能控制自己的书面推理,知道被监控时会刻意缩短甚至改变思考过程。也就是说,过去监控AI的那套办法,对它正在失效。
Astra目前只向少量机构和审核过的用户开放,Plus、Pro这些订阅用户还要再等几天,具体几天,官方没说。
另外,在独立机构Artificial Analysis的通用智能测试里,Astra max得61分,和上一代持平,还低于Anthropic前两天刚发的Claude Fable 5.1(66分)。它的另一面是价格,标准模式下,每百万输入token收10美元、输出50美元,是上一代促销价的2.5倍。只能说贵得离谱。
至于AGI时代是不是真的来了,Brockman自己也说,AGI是个模糊概念。对于普通用