OpenAI发布GPT-6 Astra:布罗克曼宣称「AGI时代到来」
当地时间9月3日,OpenAI在旧金山正式发布新一代旗舰模型GPT-6 Astra。官方称其为「全球最智能且对齐程度最高的模型」,总裁格雷格·布罗克曼(Greg Brockman)更直称「欢迎来到AGI时代」。这是继GPT-5.6系列之后,OpenAI时隔数月推出的又一次代际升级,也是大模型行业「周抛时代」里分量最重的一颗炸弹。
核心亮点:ARC-AGI-3逼近满分
据OpenAI披露,GPT-6 Astra在ARC-AGI-3抽象推理基准上的得分从上一代的7.8%跃升至99.9%,几乎触及满分。模型动用了超过10万块GPU进行训练,并在软件工程、长链推理与自主任务执行上实现大幅跃升。官方将其定位为「迄今为止最强的软件工程模型」。
价格与能力边界
能力跃升的同时,定价也水涨船高。GPT-6 Astra的API价格为上一代的2.5倍,输入与输出分别约为每百万Token 10美元与50美元。更受关注的是,该模型首次达到「关键级(Critical)」网络安全能力,可自主发现零日漏洞,但这项能力被严格门控在Daybreak Blue特定项目中,仅向可信防御者开放。
| 维度 | GPT-5.6 Sol(上代) | GPT-6 Astra(新版) |
|---|---|---|
| ARC-AGI-3得分 | 约7.8% | 99.9% |
| 训练规模 | — | 超10万块GPU |
| API定价(输入/输出) | 约4/20美元每百万Token | 约10/50美元每百万Token |
| 网络安全评级 | 未达关键级 | 关键级(零日漏洞发现,门控) |
RSI:模型开始参与自身进化
本轮发布另一个被反复强调的变化是RSI(Recursive Self-Improvement,递归式自我改进)。OpenAI指出,Astra是第一款由前代模型深度参与训练监督的旗舰产品——AI正在参与并改进自身的研发流程。谷歌DeepMind相关研究人员也强调,RSI正在成为模型迭代加速的核心推手,未来模型「周抛」都可能成为过去式。
对开发者意味着什么
更强的推理与编程能力,意味着更复杂的自动化智能体将成为可能;但2.5倍的定价与受限的关键级安全能力,也提醒企业用户需要重新评估成本与合规边界。短期看,高频运行的coding agent将更依赖模型选型与缓存策略来压低成本。
FAQ
Q1:GPT-6 Astra和此前的GPT-5.6有什么本质区别?
A:核心区别在推理上限与安全评级。ARC-AGI-3得分从约7.8%跃升至99.9%,并首次具备关键级网络安全能力,可自主发现零日漏洞,但该能力被门控在可信防御项目中。
Q2:API价格涨了多少?
A:约为上一代的2.5倍,输入与输出分别约每百万Token 10美元与50美元,对高并发场景成本影响显著。
Q3:什么是RSI递归式自我改进?
A:指AI参与乃至改进自身研发流程,由前代模型深度参与训练监督,从而持续缩短模型迭代周期,是本轮模型发版加速的重要推手。
Q4:关键级网络安全能力普通用户能用吗?
A:不能。该能力被严格门控在Daybreak Blue项目中,仅向通过审核的可信防御者开放,普通API用户无法调用。
本网站的文章部分内容来源于网络,仅供大家学习与参考,如有侵权,请联系站长 QQ:24844 进行删除处理。本站一切资源不代表本站立场,不代表本站赞同其观点和对其真实性负责。本站一律禁止以任何方式发布或转载任何违法的相关信息,访客发现请向站长举报。本站资源大多存储在云盘,如发现链接失效,请联系我们我们会第一时间更新。














![修愚分享推广计划正式上线,推广可获高额奖励[限时推广]-修愚](https://xiuyu.com/wp-content/uploads/2025/05/愚你同乐-1024x410.jpg)


暂无评论内容