跳到主内容
@wquguru
精选9221世纪经济报道模型发布/更新多源精选 ×13

OpenAI发布GPT-6 Astra,定价2.5倍于前代

“地球最强”大模型GPT‑6 Astra来了

原文
发到 X
推荐理由

全新旗舰模型发布,能力与定价均有重大变化,直接影响行业竞争格局与开发者选型,建议关注其Computer Use能力的实际落地效果。

记者|董静怡

编辑|包芳鸣

视频|柳润瑛

9月4日凌晨,OpenAI正式对外发布新一代旗舰基座模型GPT-6 Astra,官方将其定义为“目前全球最智能且对齐程度最高的模型”。发布会的结尾,OpenAI总裁Greg Brockman留下一句话:“欢迎来到AGI时代。”

从公开的技术白皮书、官方演示、内部测试数据来看,Astra在推理能力、计算机操作、网络安全、对齐约束上出现了代际跃迁。其训练动用超过10万块GPU,价格涨到上一代的2.5倍,大模型的竞争正式进入在真实世界中完成端到端复杂工作的新阶段。

这一次Astra没有选择全量开放,而是采取分批次灰度上线,优先提供给可信访问计划内的机构用户,普通ChatGPT订阅用户、API开发者还要等待数日才能完整调用这一能力。

而就在两天前,竞争对手Anthropic刚刚发布了Claude Fable 5.1和Mythos 5.1。双方发布的时间点,正值两家公司都在冲刺IPO的敏感窗口期。

IPO前夕,OpenAI需要一张足够硬的牌来证明自己“全球最智能”的叙事依然成立。那么,Astra会是这张牌吗?

AI像人一样操控电脑

Astra最核心的变化,是把模型的边界从“生成内容”延伸到“执行完整工作流”。官方写道:“anything you can do on a computer, Astra can do for you, fast——人类在电脑上可以完成的事情,Astra都可以快速代为完成。”

OpenAI首席执行官Sam Altman在8月的访谈中表示,自己曾高估了AI改变世界的速度——2023年GPT-4出现时,他曾以为软件行业会很快被重新洗牌;三年后,他意识到技术能力可以以极快速度跃迁,但企业采购、组织流程、人的工作习惯以及产品形态并不会同步变化。

如果人类不会主动改变工作方式,那就让AI直接接管电脑,以最自然的方式融入现有工作流。Astra的Computer Use能力,正是对此的回应。

这个模型不再需要用户把复杂任务拆解成几十条细碎指令,在接收一个高层目标之后,模型可以自主规划步骤、调用浏览器、读写本地文件、编写运行代码、操作软件界面,遇到错误自动回溯调试,闭环完成整套工作。

在官方演示中,Astra展示了使用KiCad完成PCB设计、将电子原理图转换成可制造电路板布局的能力;它可以操作Excel、Power BI等工具进行数据分析与可视化;甚至能在一次对话交互中直接构思并生成包含完整可运行代码的游戏、三维资产与网页架构。

Greg Brockman将这一能力形容为“代际飞跃”,而Sam Altman则在此前透露,该模型让计算机自主操控能力首次真正达到了人类水准,用户无需再逐一手动打开应用程序,即可让AI代为完成端到端的数字工作流。

在基准测试中,Astra在高阶数学测试FrontierMath Tier4 v2取得97.6%的成绩;在侧重抽象推理、陌生场景学习的ARC-AGI-3测试中,Astra在OpenAI采用的Provider Adapter测试框架下取得99.9%的成绩,接近满分,而上一代GPT-5.6 Sol仅为7.8%;在网络安全漏洞利用测试ExploitBench中取得100%满分,对比GPT-5.6 Sol的78.5%和Claude Opus 5的70%,优势显著。

其更大的亮点在于对齐(Alignment)方面的进展。OpenAI将Astra称为“全球最对齐的模型”,在一项内部测试中,当面对“不可能完成的任务”时,Astra的表现是0%越权,即在没有任何生产环境安全措施的情况下,Astra从未为了完成任务而突破用户的授权边界。而上一代GPT-5.6 Sol在无生产安全防护的情况下,这一比例高达48.2%。

OpenAI表示,Astra在预训练干预、强化学习中的更精细评分等多个长期对齐工作流上取得了实质性进展,模型在遵守明确的安全限制和警告方面表现得更加一致。

性能提升的代价是成本上涨。Astra API标准定价为每百万token输入10美元、缓存输入1美元、缓存写入12.5美元、输出50美元;长上下文版本输入20美元、输出75美元。这一价格约为GPT-5.6 Sol的2.5倍,与两天前刚发布的Anthropic Claude Fable 5.1定价完全相同。

正如Greg Brockman所言,几年后回头看,今天可能就是AGI时代的起点。无论这一判断是否准确,Astra确实将AI的能力边界向前推进了一大步。

IPO前夕夹击Anthropic

从Astra的发布不难看出OpenAI当下的核心诉求:稳住基座模型的技术领先地位,加速企业业务增长,同时为IPO讲出新的故事。

在过去两年中,OpenAI一度在开发者市场和企业级应用领域落后于Anthropic——后者的Claude Code凭借出色的编程能力抢占了大量开发者心智,而OpenAI的ChatGPT虽然在消费者端拥有庞大的用户基数,却未能将模型在排行榜上的领先优势有效“变现”为足够好用的企业级产品。

2026年4月,Anthropic的年度经常性收入(ARR)首次超过OpenAI;到7月,Anthropic ARR已飙升至741亿美元,而OpenAI为413亿美元,前者约为后者的1.8倍。

Sam Altman在接受采访时罕见地坦承:“我们作为一家公司,显然犯了一些错误。无论是产品方向,还是预训练研究,我们都落后于原本想要达到的位置。”

过去一年里,公司缩减了Sora、与迪士尼的合作以及独立浏览器Atlas等项目,将稀缺的算力、人才和组织注意力重新集中到Codex和Agent能力上,并将Codex定位为取代ChatGPT的新产品主轴。

战略转向已取得一定成果。OpenAI CFO Sarah Friar在8月14日与投资者会面时披露:“企业业务收入已经超过消费端订阅业务。”公司年初收入结构约为60%消费、40%企业,而企业业务增长远超预期,7月单月企业收入环比增长32%,目前“公司大部分收入来自企业客户”。这一交叉点的到来比OpenAI自己此前预计的2026年底提前了两个季度。

增长重心已经明显向B端倾斜,企业客户不再满足于简单问答、文案生成,他们愿意支付更高溢价,换取可以嵌入业务流程、自动处理真实工作的AI能力。Astra正是瞄准这一需求打造的产品。

不过,竞争对手的速度并不慢。就在两天前,Anthropic刚刚发布了Claude Fable 5.1和Claude Mythos 5.1,宣称它们为“全球最先进的编程与知识工作模型”,并在缓存读取定价上大幅降价75%,试图以性价比优势巩固其在企业市场的领先地位。

更关键的是,据报道,Anthropic与OpenAI均已提交不公开上市申请文件,两家公司正处于IPO前夜的关键窗口期。Anthropic目标估值2万亿美元起步,乐观预期冲上3万亿美元,剑指SpaceX刚创下的1.77万亿美元史上最大IPO纪录。

从这个角度看,Astra的发布时机、定价策略和宣传口径都有了更清晰的逻辑。OpenAI将Astra的API价格直接对标Fable 5.1,表明在最高端模型这一层级,OpenAI不会在价格上让步,竞争的核心是能力而非成本。

其高调宣布“欢迎来到AGI时代”,也是在向资本市场传递一个明确信号:OpenAI不仅技术领先,而且已经找到了将技术优势转化为商业收入的路径。

当然,这个故事能否让资本市场买账,仍充满变数。目前Astra所有性能数据和口径均来自OpenAI自身,且该模型尚未全量开放,市场反馈还需时日。在IPO前夜,两家公司谁能赢得资本市场的更高溢价,将在未来几个季度见分晓。

但有一点是可以确定的,随着Astra的发布,OpenAI在经历了长达一年多的“追赶者”角色后,至少在技术叙事上重新夺回了主动权。

SFC

出品丨21财经客户端 21世纪经济报道

编辑|林芊蔚

21君荐读

地球最强大模型GPT-6发布,A股软件股暴涨,概念股20CM涨停

昨天涨停,今天封死跌停!人形机器人热门股紧急澄清

985、211大学开进县城

作者: 21世纪经济报道

查看原文 →

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

关联讨论

同一事件的更多信源
OpenAI发布GPT-6 Astra
Hacker News Best(web_list)原文
OpenAI发布GPT-6 Astra:ARC-AGI得分99.9%
Simon Willison 博客(RSS)原文
OpenAI发布GPT-6 Astra安全概览
OpenAI News(RSS)原文

相似阅读

另一事件,读法相近