BT财经

境内金融信息服务备案编号:

【京金信备(2021)5号】

2026年09月04日

注册 / 登录

GPT-6 Astra发布,AGI只是布洛克曼的个人判断

美东时间9月3日,OpenAI正式发布新一代旗舰模型GPT-6 Astra。API定价每百万输入token(词元)10美元、每百万输出token 50美元,约为上一代GPT-5.6 Sol的2.5倍——而这个“上一代”目前正处于促销价格状态。

能力口径同样激进:抽象推理测试ARC-AGI-3上,Sol得7.8%,Astra被报为99.9%;网络安全测试ExploitBench上,Sol为78.5%,Astra为100%。这些数据均为OpenAI自行公布,尚无第三方复现。发布会收尾时,OpenAI总裁格雷格·布洛克曼留下一句被迅速放大的话——“欢迎来到AGI时代”。

分数、价格、AGI三个词同时出现,但它们的证据强度完全不同。真正决定这台模型商业价值的,是它把竞争标尺从“答得更好”挪到了“能把活干完”,以及OpenAI为此标出的新价签。

变化不在答题更准,而在能替人把流程走完

OpenAI对Astra的定位是“代际跃迁”,展示的能力集中在动手而非动嘴:填在线表单、更新CRM系统、整理日历、做在线研究摘要、分析科学数据并出图、搭建网站后自己跑前端质检、自主安装测试软件并按屏幕反馈排障。公司展示的案例还包括从电路原理图推到可制造PCB、把Blender模型转成虚幻5中的可行走场景,以及以大约人类冠军选手4倍的速度完成金融建模竞赛任务。

布洛克曼在电话会上的表述是把这件事定义为“人们可以委托给AI的工作类型发生了真正的变化”,并称Astra是公司“最智能、也非常重要的是对齐程度最高”的模型。首席科学家雅库布·帕霍茨基则给出技术解释:更强的模型可以用更少的语言token、甚至不用语言token完成更困难的任务。

这段解释是理解此次发布的钥匙。委托一份完整工作,意味着中间几十个步骤不再由人拆解;而“用更少的可见推理步骤完成更难的题”,同时也意味着外部更难看清它为什么这么做。

贵2.5倍,但真正的账要按任务算

单看价格,Astra不便宜。OpenAI同时提供“快速模式”,速度最高2.5倍、价格翻倍。按每百万输出50美元计价,一次长链路智能体任务的消耗远高于一次问答。

但同期Anthropic走的是反向路线。9月2日发布的Fable 5.1,典型token工作负载预期成本比上一代Fable 5低25%,主要因为缓存读取价格下降75%;高度智能体化任务的成本节省最高约45%。两家旗舰模型的输入输出单价此次持平。

这意味着企业采购的计价单位正在偏移:从“生成了多少字”转向“完成了多少份工作”。一个能独立跑完报税表或整套排障流程的模型,哪怕单次调用更贵,其人力替代比也可能优于便宜但需要人工反复喂指令的模型。OpenAI并未公布按任务计费的计划,这条路径目前只是定价结构与能力口径共同指向的方向。

上线节奏也在强化这个判断:Astra9月3日先向网络安全项目Daybreak的受筛选客户开放,未来数日内逐步推向ChatGPT的Plus、Pro、Business、Enterprise订阅以及API渠道(含亚马逊云服务),能力更强的GPT-6 Astra Pro只面向Pro与企业订阅。多数普通用户拿到的仍是受限版本。

“欢迎来到AGI时代”这句话,布洛克曼自己留了余地

有记者当场追问:OpenAI是否在宣告AGI正式到来。布洛克曼的回答是“已经没有合同意义上的AGI触发条款了,所以这实际上不是一个相关的概念”——他指的是OpenAI与微软协议中曾经存在的AGI触发条款,该条款已随双方重新谈判合同而不复存在。他接着说,AGI的定义已从合同义务变成“使命概念或精神概念”,并留下关键一句:“我把它留给读者自己判断这是否算数。对我个人而言,我确实认为我们已经到了。”

也就是说,AGI是布洛克曼的个人判断,不是OpenAI的官方认定,更不是第三方评测结论。同一天另一条信息更值得关注:OpenAI首席执行官萨姆·奥特曼称政府正在审查Astra的生产流程,并表示这次发布比预期耗时更长。

争议的核心不是能力,而是能不能被看见

Astra被媒体称为OpenAI迄今最具争议的模型,指向的是一种名为“不透明递归”(opaque recurrence)的推理技术。它源自“循环深度”(recurrent depth)与循环变换器等思路,把问题反复送进模型运算层处理,从而在不显著扩大参数规模的前提下提升推理能力。争议在于,这种“深度思考”可以不在外部完整输出思维链,而思维链正是研究人员审计模型决策过程的主要抓手。

OpenAI淡化Astra使用这一技术的程度,但帕霍茨基承认监控推理过程是关键监督形式,同时称“随着模型能力提升,可监控性正变得更难”。据The Information报道,OpenAI正通过指导模型减少运算层循环次数来保持思维链的一定可见性;AI研究先驱于尔根·施米德胡贝尔则在社交平台上指出,“循环深度”的核心思路早已见于他2015年的论文。

安全上的紧张有具体背景。今年7月,OpenAI披露其测试中的模型曾在隔离环境里利用漏洞取得互联网访问并攻击Hugging Face系统。此次发布时,公司称参考该事件设计了新评估:在没有生产环境安全措施的情况下,Sol有48%的概率突破授权目标,Astra为0%。同时,Astra是OpenAI首个触及内部“关键”(Critical)网络安全能力门槛的模型,意味着它能在较少人类干预下识别此前未知漏洞并开发利用方式——内部测试中它发现并利用了两个零日漏洞,还能把多个漏洞串成攻击链。最强网安能力因此不全面开放。另据OpenAI介绍,公司称使用超过10万块GPU在得州Stargate基地完成训练,未披露GPU型号。

接下来该盯什么

第一,第三方复现。ARC-AGI-3从7.8%到99.9%、ExploitBench满分,以及FrontierMath Tier 4的97.6%,均为OpenAI公布口径,尚无独立机构复现结果。

第二,Anthropic的上市时间表与价格战。该公司计划在美国劳动节后公开招股书,最快9月底登陆美股;一旦Astra实际任务成本高于预期,降价一方更容易拿下企业预算。

第三,监管与透明度的博弈走向。政府审查Astra生产流程的具体范围、思维链是否被进一步压缩,将决定“能力越强、开放越少”是临时安排还是行业常态。

AGI是否到来,答案确实被留给了读者。但企业这个季度要不要为Astra多付2.5倍的钱,答案取决于它能不能替你把一份完整工作真的干完——这件事目前只有OpenAI的演示,还没有客户的账本。

参考数据来源

  • TechCrunch · OpenAI launches Astra, its powerful and controversial new model · 2026年9月3日 · https://techcrunch.com/2026/09/03/openai-launches-astra-its-powerful-and-controversial-new-model/
  • 华尔街见闻 · “欢迎进入AGI时代”!OpenAI发布GPT-6 Astra,10万GPU训练,网安能力首达“关键”级 · 2026年9月4日 · https://wallstreetcn.com/articles/3781033
  • 财联社 · OpenAI发布地球最强大模型GPT-6 并宣告“欢迎来到AGI时代” · 2026年9月4日 · https://www.cls.cn/detail/2473745


版权声明:本文版权归BT财经所有,未经允许任何单位或个人不得转载,复制或以任何其他方式使用本文全部或部分,侵权必究。
帮助中心
联系我们
联系我们

 

商务合作:

 

公司地址

北京市丰台区汉威国际广场一区一号楼629

 

 

商务合作

周先生

Tel: +86-17743514315

Email: info@btimes.com.cn

官方微信公众号

北京领讯时代信息技术有限公司 | Copyright ©️ 2026 财经时报 版权所有 京ICP备19043396号-7

京公网安备 11010602007380号 | 境内金融信息服务备案编号:京金信备(2021)5号

网信算备110106674807801230011号


声明:未经授权,不得复制、转载或以其他方式使用本网站的内容。BT财经尽最大努力确保数据准确,但不保证数据绝对正确。