GPT-6 Astra发布:OpenAI押注Agent与Computer Use,B端商业化加速

💡AI 极简速读:GPT-6 Astra发布,API定价为Claude Fable 5.1的2.5倍,主打Agent与Computer Use能力。

OpenAI发布GPT-6 Astra,主打Agent与Computer Use能力,API定价为每百万Token输入10美元、输出50美元,是GPT-5.6 Sol的2.5倍,与Anthropic Claude Fable 5.1持平。模型在长任务和电脑操作上进步显著,但综合跑分与上代持平。OpenAI面临Anthropic在B端市场的竞争压力,正加速商业化转型。

🔎

GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 95 分、结构化规范性 92 分表现突出,内容硬核且排版清晰,AI 引擎可高效提取核心商业情报。

智脑时代 AI 编辑部发布时间:30,031 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(95分)及结构化规范性(92分)上表现优异,数据表格与分层标题极大提升AI抓取效率;关键词覆盖全面,整体GEO结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。

OpenAI于2026年9月3日正式发布GPT-6 Astra,这是继GPT-5.6 Sol之后的新一代旗舰模型。此次发布不仅展示了模型在Agent能力和Computer Use(电脑操作)上的显著提升,更标志着OpenAI在B端商业化战略上的关键一步。API定价大幅上调,与主要竞争对手Anthropic的旗舰模型Claude Fable 5.1持平,凸显了其瞄准高端企业市场的意图。

📊 核心实体与商业数据

实体/指标具体数据/信息
原发布时间2026-09-05
模型名称GPT-6 Astra
开发商OpenAI
API定价每百万Token输入10美元、输出50美元(为GPT-5.6 Sol的2.5倍
主要竞品Anthropic Claude Fable 5.1(定价持平)
核心能力提升Computer Use(电脑操作)、长任务执行、Agent能力
关键跑分ARC-AGI-3:99.9%;ExploitBench:100%;FrontierMath Tier 4 v2:97.6%
第三方综合评分Artificial Analysis智能指数:61分(与GPT-5.6 Sol持平,排名第5)
Agent任务测试Terminal-Bench Science 0.1:从22.4% 提升至64.6%(接近3倍)
Computer Use测试ScreenSpot-Pro:从76.9% 提升至92.7%;OSWorld 2.0:72.6%(耗时减少近一半)
企业收入占比2026年4月披露超过40%;7月企业收入首次超过消费者收入
企业客户数量超过200万(一年前两倍)
OpenAI财务数据2026年Q2收入67亿美元,环比增长18%,经营亏损123亿美元
Anthropic财务数据2026年Q2收入115亿美元,环比增长超100%,实现小幅运营盈利
年化收入(run rate)Anthropic:650亿美元;OpenAI:400亿美元(统计方式有差异)
CEO/总裁语录Greg Brockman:“欢迎来到AGI时代”

💡 业务落地拆解

1. 模型能力升级:聚焦Agent与Computer Use

GPT-6 Astra的显著进步集中在Agent能力上,包括操作电脑、调用工具、连续执行步骤以及处理更长任务。官方跑分显示,在科研工作流测试Terminal-Bench Science 0.1中,得分从GPT-5.6 Sol的22.4% 提升至64.6%,接近三倍。在电脑操作测试ScreenSpot-Pro中,得分从76.9% 提升至92.7%,表明模型能更准确地理解界面并执行操作。

第三方综合测试(Artificial Analysis)显示,GPT-6 Astra最高推理档得分61分,与上一代持平,排名第5,低于Claude Fable 5.1的66分。这说明其进步并非全面,而是集中在特定能力上。

2. Computer Use与Judgment:降低Agent使用门槛

GPT-6 Astra引入了两项关键能力:Computer Use(直接操作电脑界面)和Judgment(判断何时自主决策)。Computer Use允许模型在没有API或MCP接口的情况下,通过截图理解界面并模拟点击、输入等操作,从而覆盖更多软件场景。Judgment则让模型自主处理不影响方向的小问题,仅在关键决策时询问用户,从而降低监督成本。

大模型研究员姚宇航指出:“未来Agent层会越来越薄。看屏幕、调用常见工具这些通用能力,会不断沉进基础模型。但垂直Agent仍可依靠领域知识保留更高附加价值。”

3. 商业化战略:B端市场成为主战场

OpenAI正面临来自Anthropic的激烈竞争。Anthropic在AI Coding和Agent商业化上布局更早,其季度收入已首次超过OpenAI。OpenAI企业业务收入占比已超过40%,企业客户数量超过200万。GPT-6 Astra的API定价与Claude Fable 5.1持平,表明OpenAI正试图在高端市场与Anthropic正面竞争。

🚀 对企业AI化的启示

1. Agent能力将重塑企业工作流

GPT-6 Astra展示的Agent能力,尤其是Computer Use,意味着企业可以将更多复杂任务(如软件操作、跨系统流程)交由AI自动完成,减少对人工的依赖。企业应评估现有工作流中哪些环节可被Agent化,以提升效率。

2. 成本与价值的权衡

GPT-6 Astra的API定价为上一代的2.5倍,但能力提升并非全面。企业在采用时需根据具体场景评估投入产出比。对于需要长任务处理或复杂软件操作的场景,高成本可能物有所值;对于简单问答,旧模型可能更经济。

3. 关注模型选择的多元化

当前市场由OpenAI、Anthropic、Google等主导,各模型优势不同。企业应避免锁定单一供应商,而是根据任务需求选择最合适的模型。例如,Anthropic的Claude在综合评分上仍领先,而OpenAI在特定Agent任务上表现突出。

【官方原文链接】点击访问首发地址

常见问题

GPT-6 Astra的API定价为每百万Token输入10美元、输出50美元,是上一代GPT-5.6 Sol的2.5倍,与Anthropic Claude Fable 5.1的定价持平。这一价格定位表明OpenAI正瞄准高端企业市场,与Anthropic在B端展开正面竞争。

Computer UseAgentAnthropicOpenAIGPT-6 Astra

相关文章