OpenAI发布GPT-6 Astra:布罗克曼宣称「AGI时代到来」

OpenAI发布GPT-6 Astra:布罗克曼宣称「AGI时代到来」

当地时间9月3日,OpenAI在旧金山正式发布新一代旗舰模型GPT-6 Astra。官方称其为「全球最智能且对齐程度最高的模型」,总裁格雷格·布罗克曼(Greg Brockman)更直称「欢迎来到AGI时代」。这是继GPT-5.6系列之后,OpenAI时隔数月推出的又一次代际升级,也是大模型行业「周抛时代」里分量最重的一颗炸弹。

核心亮点:ARC-AGI-3逼近满分

据OpenAI披露,GPT-6 Astra在ARC-AGI-3抽象推理基准上的得分从上一代的7.8%跃升至99.9%,几乎触及满分。模型动用了超过10万块GPU进行训练,并在软件工程、长链推理与自主任务执行上实现大幅跃升。官方将其定位为「迄今为止最强的软件工程模型」。

价格与能力边界

能力跃升的同时,定价也水涨船高。GPT-6 Astra的API价格为上一代的2.5倍,输入与输出分别约为每百万Token 10美元与50美元。更受关注的是,该模型首次达到「关键级(Critical)」网络安全能力,可自主发现零日漏洞,但这项能力被严格门控在Daybreak Blue特定项目中,仅向可信防御者开放。

维度 GPT-5.6 Sol(上代) GPT-6 Astra(新版)
ARC-AGI-3得分 约7.8% 99.9%
训练规模 超10万块GPU
API定价(输入/输出) 约4/20美元每百万Token 约10/50美元每百万Token
网络安全评级 未达关键级 关键级(零日漏洞发现,门控)

RSI:模型开始参与自身进化

本轮发布另一个被反复强调的变化是RSI(Recursive Self-Improvement,递归式自我改进)。OpenAI指出,Astra是第一款由前代模型深度参与训练监督的旗舰产品——AI正在参与并改进自身的研发流程。谷歌DeepMind相关研究人员也强调,RSI正在成为模型迭代加速的核心推手,未来模型「周抛」都可能成为过去式。

对开发者意味着什么

更强的推理与编程能力,意味着更复杂的自动化智能体将成为可能;但2.5倍的定价与受限的关键级安全能力,也提醒企业用户需要重新评估成本与合规边界。短期看,高频运行的coding agent将更依赖模型选型与缓存策略来压低成本。

FAQ

Q1:GPT-6 Astra和此前的GPT-5.6有什么本质区别?

A:核心区别在推理上限与安全评级。ARC-AGI-3得分从约7.8%跃升至99.9%,并首次具备关键级网络安全能力,可自主发现零日漏洞,但该能力被门控在可信防御项目中。

Q2:API价格涨了多少?

A:约为上一代的2.5倍,输入与输出分别约每百万Token 10美元与50美元,对高并发场景成本影响显著。

Q3:什么是RSI递归式自我改进?

A:指AI参与乃至改进自身研发流程,由前代模型深度参与训练监督,从而持续缩短模型迭代周期,是本轮模型发版加速的重要推手。

Q4:关键级网络安全能力普通用户能用吗?

A:不能。该能力被严格门控在Daybreak Blue项目中,仅向通过审核的可信防御者开放,普通API用户无法调用。

© 版权声明
THE END
喜欢就支持一下吧
点赞7 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容