OpenAI宣告AGI时代:GPT-6 Astra 正式发布,AI 第一次能替你干活了

2026 年 9 月 3 日(美东),一个值得 AI 行业记住的日子。

#GPT-6 Astra#OpenAI#Computer Use#自主智能体#AGI#大模型#人工智能更新于 2026-09-06
📑 本页目录

OpenAI宣告“AGI时代”:GPT-6 Astra 正式发布,AI 第一次能替你干活了

本文核心参数(上下文 105 万 / 输出 12.8 万 / 定价 $10+$50 / 五档推理 / 多模态 / 不支持自定义 temperature)已对照 models.dev 官方模型数据核验(2026-09-04 更新,多个平台条目一致);基准跑分、知识截止、训练规模等为 OpenAI 官方发布口径,尚未经第三方独立复测

2026 年 9 月 3 日(美东),一个值得 AI 行业记住的日子。

ChatGPT 时代,AI 只是个“答题机器”:你问,它答,然后你复制粘贴,回到自己电脑前接着干活——AI 从来没碰过你的电脑

GPT-6 Astra 发布,这个边界被打破了:它能像人一样看到你的屏幕、移动你的鼠标、敲击你的键盘,从“回答一个问题”变成“完成一整件事”。

如果把 ChatGPT 比作 AI 的“智能手机时刻”,GPT-6 Astra 就是 AI 的“应用商店时刻”:AI 第一次真正“上手干活”,而不只是“陪你聊天”。发布会现场,OpenAI 联合创始人 Greg Brockman 直接宣布:欢迎来到 AGI 时代

为什么敢喊这么大声?往下看它的实操能力,你就明白“AGI 时代”不是空话——因为:

不用手动操作电脑、不用写代码、不用反复指令微调,GPT-6 Astra 真正实现:你只说目标,AI 全程自主干完所有工作。

这不是普通大模型迭代,是 AI 行业颠覆性的范式革命。

过往所有 AI,本质都是「工具」:你问一句、它答一句,只能输出文字、代码、图片,不能触碰你的电脑系统、不能操作软件、不能完成完整闭环工作。

而全新 GPT-6 Astra,是第一个能完全替代人类电脑操作的数字劳动力。

它能干所有你日常用电脑能做的事,且全程自主、全自动、零人工干预,看完这些实操能力,你就懂它为什么被称为「准 AGI」:

办公党直接解放双手

自动打开浏览器、批量查资料、整理数据、填充表格;自主登录 CRM 系统,更新客户信息、分类线索、一键生成个性化跟进邮件;整理周报月报、排版公众号、校对文档、批量处理文件,繁琐重复工作全部包办。

设计/工程行业直接提效 10 倍

无需手动建模、调参数,一句话指令就能操作 Blender、Unreal 引擎,从零搭建可交互 3D 场景、复原建筑模型、生成影视级渲染成片;操控 KiCad 自动绘制 PCB 电路板、完成布线设计,输出可直接投产的工业图纸。

开发者全能代工

自主写代码、搭项目、排查报错、部署上线,自动做前端页面、跑功能质检、修复 BUG;能独立完成完整软件开发、运维、排错全链路,解决复杂工程难题。

科研/数据分析全程自动化

自主抓取全网研究数据、清洗整理、建模分析、生成可视化图表,撰写完整研究报告,搞定高难度数理推导与学术难题。

简单一句话总结:凡是你电脑能手动完成的工作,GPT-6 Astra 都能替你更快、更精准、不间断做完。


美东时间 2026-09-03,OpenAI 正式发布新一代旗舰大模型 GPT-6 Astra,命名源自拉丁语“Astra(星辰)“。整场发布会的定调口号,就是开场那句:欢迎来到 AGI 时代

它彻底跳出了传统 AI“一问一答”的局限,核心定位升级为端到端完成完整工作任务的自主 AI 智能体,独家王牌能力 Computer Use(全域计算机操控),可以像人一样看懂电脑屏幕、识别所有软件界面、模拟键鼠操作,兼容 Windows、Linux 全平台、新旧所有软件,无需 API 接口、无需适配开发,直接操控任意系统干活。

但“AGI”只是 OpenAI 的官方叙事,关于这款模型的真实实力、行业争议、短板与机遇,我们一次性讲透。

一、GPT-6 Astra 基础规格参数

API 模型 ID: gpt-6-astra

  • 上下文窗口: 105 万 Token(约 1500 页 A4 文档)
  • 最大单次输出: 12.8 万 Token
  • 知识截止: 2026-04-30(官方口径)
  • 推理档位: low / medium / high / xhigh / max,五档推理强度可调
  • 输入: 文本 + 图像(官方模型数据另含 PDF);输出: 文本
  • 内置工具: 网页搜索、文件解析、代码解释器、Shell 执行、Computer Use 电脑操控、MCP 协议支持
  • 训练基础设施: 得州 Stargate 超算基地,超过 10 万张 GPU 参与预训练(官方口径)
  • API 定价: 输入 $10 / 百万 Token,输出 $50 / 百万 Token,约为 GPT-5.6 Sol 的 5 倍(官方价实锤:Sol 为 $2/$10);智能体场景 Token 消耗下降,实际账单不一定暴涨

开放节奏: 灰度分批上线,优先 Pro / Enterprise / Business 高级订阅用户;Plus 普通用户延迟数天开放;同步上线 API 与 Azure(官方模型数据已实锤 Azure 条目);AWS Bedrock 上线为官方发布口径。

二、核心能力:三大颠覆性突破

1、Computer Use:AI 直接操控真实电脑,本次最大王牌

官方称 Astra 是全世界最好的计算机使用模型。不需要软件提供 API 接口,AI 读取屏幕画面,识别按钮、输入框、菜单,模拟鼠标点击、键盘输入,直接操作 Windows、Linux 各类软件。

官方发布口径关键数据:

  • OSWorld 2.0 真实电脑任务完成率 72.6%,上一代 GPT-5.6 Sol 为 65.7%
  • 同等任务平均耗时从 75 分钟缩短至 40 分钟,效率提升约 47%
  • ScreenSpot-Pro 屏幕 UI 定位准确率 92.7%,大幅领先前代 76.9%

GPT-6 Astra Computer Use 自主操控电脑

实际能干什么:填表单、维护 CRM、整理表格、浏览器批量调研;CAD 建模、电路板布线、Unity 场景搭建;Jupyter 完整数据分析流水线;操作各类老旧无 API 的内部业务系统。

过去 AI 要依赖开发者写接口,现在屏幕本身就是通用 API。

2、推理、数学、编程能力大幅跃升

官方发布口径关键得分:

  • ARC-AGI-3: 99.9%(衡量通用抽象推理,GPT-5.6 Sol 仅 7.8%)
  • FrontierMath Tier 4: 97.6%,解决高难度数学开放问题
  • Terminal-Bench 4.0(终端复杂工程任务):57.9%,可以独立完成完整项目开发、部署、排错
  • ExploitBench 网络安全测试满分 100%,是 OpenAI 首个达到内部安全框架 Critical 关键级的模型,具备挖掘漏洞能力,该能力仅对高审核门槛项目开放

演示案例:独立完成 KiCad 电路板布线、FreeCAD 机械建模、Blender 动画渲染,完整走完工程全链路。

3、复杂多步骤智能体工作流

不再是一问一答。你给一个大目标,Astra 会自己拆解子任务、调用工具、迭代修正、中间自我校验,直到输出完整成品。

可以依据模板批量生成 Word、Excel、PPT,中途变更需求,模型自动回溯修改前面的产出。

同时新增智能体安全监控:当模型预判可能越权执行危险行为,会话会自动暂停,交由人工确认后继续执行。

把这一切串起来:AGI 时代的一天

上面讲的都是能力清单,把它们放进一天里,画风是这样的(基于官方展示能力的场景推演,不是演示回放):

早上 8:30 你跟 Astra 说一句:“把昨晚的客户线索按价值排个序,高潜客户写好跟进邮件。“它自动打开 CRM、登录系统、筛选更新、起草几十封个性化邮件,你只需要点”发送“。

上午 10:00 行政同事丢过来 200 份报销单:“整理成表格,该驳回的标出来。“几分钟后表格完成,异常项自动标注,不用加班。

下午 2:00 设计团队说“把这份建筑图在 Unreal 里复原成可交互场景”,硬件工程师说“帮我把这块 PCB 布线布完”。它打开软件、建模、渲染、布线——过去要熬到深夜的活,它在旁边自己干。

晚上 9:00 开发者说“项目有个 BUG,查日志修掉,顺便部署到测试环境”。它写代码、跑测试、修 BUG、部署上线,一气呵成。

这一天没有魔法,核心只有 Computer Use:屏幕就是它的眼睛,鼠标键盘就是它的手。真实体验当然会打折扣,但它代表的范式切换——AI 从“回答问题”到“亲手做完一件事”——是实打实的。

三、理性看待:是 AGI 吗?争议与短板

OpenAI 喊出“AGI 时代到来”,但行业并没有达成共识。

  1. 基准跑分很强,但部分第三方综合评测并未碾压竞品

    部分独立评测显示,Astra 综合得分与 Claude 系列互有胜负,并非全方位无敌;高跑分来自专项基准,真实复杂现实任务依然会犯错、幻觉依旧存在。

  2. 推理增强,可观测性下降

    OpenAI 官方文档明确提到:随着推理能力变强,模型内部思考过程的可监控性降低。更聪明,但黑盒程度更高,行为更难预判。

  3. 成本高昂

    Token 单价显著上涨(对比前代 Sol 为 5 倍),Computer Use 电脑操作会产生大量额外工具调用计费,大规模企业使用算力成本压力巨大;OpenAI 暗示未来部分场景会转向按任务收费,而不是单纯按 Token 计费。

  4. 安全风险抬升

    Critical 网络安全等级是双刃剑:强大漏洞挖掘能力,如果管控不当会带来现实风险,因此高危能力严格限制访问。

一句话总结:GPT-6 Astra 是目前最强的 AI 智能体模型,但不等于通用人工智能 AGI。 它实现了极强的“代理执行”,依然没有自我意识、主观欲望。

四、对个人、开发者、企业意味着什么

普通用户

Pro 订阅用户可以体验电脑操控能力,大量重复性电脑工作可以交给 AI 完成;普通 Plus 用户等待灰度推送。日常办公、资料整理、简单设计、内容创作,均可实现 AI 全自主代劳,大幅压缩无效工作时间。

开发者

gpt-6-astra API 已上线,支持 responses 接口;注意:不再支持自定义 temperature、top_p(官方模型数据已实锤),推理强度改用 reasoning.effort 参数控制。智能体、Agent 应用迎来新底座,但预算需要重新评估,适配全新电脑操控开发场景。

企业

内部老旧系统不用改造 API,借助 Computer Use 实现自动化办公,低成本完成数字化升级;同时要重视安全隔离,严禁直接把高危系统完全交给 AI 自主操作,平衡效率与风险。

五、结尾|未来展望

GPT-6 Astra 代表 AI 范式彻底切换:从“回答我问题”→“帮我做完整件事”。

过去大模型只是“纸上谈兵”的问答工具,现在 Astra 真正落地为可实操、可执行、可闭环的数字员工,直接介入人类工作流程,颠覆办公、设计、开发、科研全行业工作模式。

但距离真正拥有自我意识、通用思维的终极 AGI,仍有巨大鸿沟。跑分亮眼不代表现实世界万无一失,幻觉、成本、安全、黑盒问题仍是悬在头顶的核心命题。

这就是 OpenAI 口中的“AGI 时代”——一个由 AI 亲手干活开启的新时代,也是一个更需要人类保持清醒的时代。

星辰已经升起,AI 自主工作的新时代已然到来,但属于人类与 AI 共生的全新征途,才刚刚开始。


互动: 你觉得 AI 自主操控电脑,会彻底改变未来办公模式吗?欢迎评论区留言讨论。