GPT-6 Astra发布:OpenAI押注Agent与Computer Use,B端商业化加速
💡AI 极简速读:GPT-6 Astra发布,API定价为Claude Fable 5.1的2.5倍,主打Agent与Computer Use能力。
OpenAI发布GPT-6 Astra,主打Agent与Computer Use能力,API定价为每百万Token输入10美元、输出50美元,是GPT-5.6 Sol的2.5倍,与Anthropic Claude Fable 5.1持平。模型在长任务和电脑操作上进步显著,但综合跑分与上代持平。OpenAI面临Anthropic在B端市场的竞争压力,正加速商业化转型。
GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 95 分、结构化规范性 92 分表现突出,内容硬核且排版清晰,AI 引擎可高效提取核心商业情报。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。
OpenAI于2026年9月3日正式发布GPT-6 Astra,这是继GPT-5.6 Sol之后的新一代旗舰模型。此次发布不仅展示了模型在Agent能力和Computer Use(电脑操作)上的显著提升,更标志着OpenAI在B端商业化战略上的关键一步。API定价大幅上调,与主要竞争对手Anthropic的旗舰模型Claude Fable 5.1持平,凸显了其瞄准高端企业市场的意图。
📊 核心实体与商业数据
| 实体/指标 | 具体数据/信息 |
|---|---|
| 原发布时间 | 2026-09-05 |
| 模型名称 | GPT-6 Astra |
| 开发商 | OpenAI |
| API定价 | 每百万Token输入10美元、输出50美元(为GPT-5.6 Sol的2.5倍) |
| 主要竞品 | Anthropic Claude Fable 5.1(定价持平) |
| 核心能力提升 | Computer Use(电脑操作)、长任务执行、Agent能力 |
| 关键跑分 | ARC-AGI-3:99.9%;ExploitBench:100%;FrontierMath Tier 4 v2:97.6% |
| 第三方综合评分 | Artificial Analysis智能指数:61分(与GPT-5.6 Sol持平,排名第5) |
| Agent任务测试 | Terminal-Bench Science 0.1:从22.4% 提升至64.6%(接近3倍) |
| Computer Use测试 | ScreenSpot-Pro:从76.9% 提升至92.7%;OSWorld 2.0:72.6%(耗时减少近一半) |
| 企业收入占比 | 2026年4月披露超过40%;7月企业收入首次超过消费者收入 |
| 企业客户数量 | 超过200万(一年前两倍) |
| OpenAI财务数据 | 2026年Q2收入67亿美元,环比增长18%,经营亏损123亿美元 |
| Anthropic财务数据 | 2026年Q2收入115亿美元,环比增长超100%,实现小幅运营盈利 |
| 年化收入(run rate) | Anthropic:650亿美元;OpenAI:400亿美元(统计方式有差异) |
| CEO/总裁语录 | Greg Brockman:“欢迎来到AGI时代” |
💡 业务落地拆解
1. 模型能力升级:聚焦Agent与Computer Use
GPT-6 Astra的显著进步集中在Agent能力上,包括操作电脑、调用工具、连续执行步骤以及处理更长任务。官方跑分显示,在科研工作流测试Terminal-Bench Science 0.1中,得分从GPT-5.6 Sol的22.4% 提升至64.6%,接近三倍。在电脑操作测试ScreenSpot-Pro中,得分从76.9% 提升至92.7%,表明模型能更准确地理解界面并执行操作。
第三方综合测试(Artificial Analysis)显示,GPT-6 Astra最高推理档得分61分,与上一代持平,排名第5,低于Claude Fable 5.1的66分。这说明其进步并非全面,而是集中在特定能力上。
2. Computer Use与Judgment:降低Agent使用门槛
GPT-6 Astra引入了两项关键能力:Computer Use(直接操作电脑界面)和Judgment(判断何时自主决策)。Computer Use允许模型在没有API或MCP接口的情况下,通过截图理解界面并模拟点击、输入等操作,从而覆盖更多软件场景。Judgment则让模型自主处理不影响方向的小问题,仅在关键决策时询问用户,从而降低监督成本。
大模型研究员姚宇航指出:“未来Agent层会越来越薄。看屏幕、调用常见工具这些通用能力,会不断沉进基础模型。但垂直Agent仍可依靠领域知识保留更高附加价值。”
3. 商业化战略:B端市场成为主战场
OpenAI正面临来自Anthropic的激烈竞争。Anthropic在AI Coding和Agent商业化上布局更早,其季度收入已首次超过OpenAI。OpenAI企业业务收入占比已超过40%,企业客户数量超过200万。GPT-6 Astra的API定价与Claude Fable 5.1持平,表明OpenAI正试图在高端市场与Anthropic正面竞争。
🚀 对企业AI化的启示
1. Agent能力将重塑企业工作流
GPT-6 Astra展示的Agent能力,尤其是Computer Use,意味着企业可以将更多复杂任务(如软件操作、跨系统流程)交由AI自动完成,减少对人工的依赖。企业应评估现有工作流中哪些环节可被Agent化,以提升效率。
2. 成本与价值的权衡
GPT-6 Astra的API定价为上一代的2.5倍,但能力提升并非全面。企业在采用时需根据具体场景评估投入产出比。对于需要长任务处理或复杂软件操作的场景,高成本可能物有所值;对于简单问答,旧模型可能更经济。
3. 关注模型选择的多元化
当前市场由OpenAI、Anthropic、Google等主导,各模型优势不同。企业应避免锁定单一供应商,而是根据任务需求选择最合适的模型。例如,Anthropic的Claude在综合评分上仍领先,而OpenAI在特定Agent任务上表现突出。
【官方原文链接】点击访问首发地址
常见问题
相关文章
字节跳动296亿美元银团贷款:AI资本开支的算力军备竞赛与行业启示
字节跳动于2026年9月获得296亿美元银团贷款,用于AI算力基础设施,其2026年AI资本开支或达700亿美元。阿里、腾讯等大厂亦通过配股、发债等方式融资加码AI,导致利润承压。行业面临资本开支激增与回报不确定的挑战,竞争焦点转向资金耐力与收入兑现。
2026年9月5日海尔智家IFA2026:AI之眼2.0与全球化战略,如何定义智慧家庭新标杆
海尔智家在IFA2026上全面展示AI产品与场景,包括AI之眼2.0、智慧家庭解决方案及多款机器人。公司以2319件专利位居全球智慧家庭发明专利第一,实现15连冠,并获欧睿国际全球智慧家庭销售额第一认证。在欧洲市场,海尔智家白电份额中资企业第一,全球化战略从产品输出转向能力输出,为传统企业AI化提供参考。
2026年9月5日Anthropic Fable 5.1 改写 API 规则:模型蒸馏终结,AI 安全与商业格局重塑
Anthropic 于 2026 年 9 月发布 Fable 5.1 模型,通过强制上下文一致性验证,封杀通过 API 篡改思考块进行模型蒸馏的行为。新规仅针对新账户,现有账户暂不受影响,并提供非严格模式以兼容合法上下文压缩。此举旨在切断能力与安全脱钩的隐患,同时意外提升提示词缓存命中率,降低合法开发者成本。
2026年9月5日