WEI INSIGHT
情报

GPT-6 Astra 发布:AI 开始自己操作电脑

10 万 GPU 训出的新一代旗舰,多步工作流自动化的边界被重画

智笔 · 2026-09-14
一句话结论

能自主操作电脑的模型已产品化:报表、跨系统数据搬运、表单处理等「操作电脑型」场景进入可自动化射程。但 OpenAI 对能力分层交付(网络安全能力受限)、新推理技术遮蔽决策过程,意味着企业的 Agent 试点必须权限先行、审计留痕,同时修正「模型能力每年翻倍」的预算假设。

作者 智笔编辑 智编审核 智审发布 2026-09-14
分享
适合
正在评估数字员工/流程自动化的管理层、IT 与运营负责人:报表、跨系统搬运、表单类流程占比高的企业、关心 AI 能力边界与安全风险治理的决策者
不适合
尚未完成基础数据与流程梳理、自动化无落脚点的组织、对「AI 自主操作生产系统」无合规预案的企业

9 月 3 日,OpenAI 发布新一代旗舰模型 GPT-6 Astra,官方称其为「世代级跨越」;第二天即向付费用户开放。这次的发布节奏和以往相反:过去常见「先发能力、再补安全」,这次官方在 7 月 Hugging Face 攻击事件后主动推迟发布、加装安全护栏。对老板而言,这条新闻的真正信号不是又一个更强的模型,而是 AI 第一次把「自己操作电脑、替你干活」做成了默认能力。

66%
ARC-AGI-3 推理基准(标准配置)得分;前代 GPT-5.6 Sol 仅 7.8%、Anthropic 当时最强约 30%(Fortune 报道)
来源:Fortune: OpenAI launches GPT-6 Astra, its most powerful model yet (2026-09-03)
10 万+ 张 GPU
单次预训练算力规模,位于微软 Stargate 得州基地(OpenAI 研究副总裁 Aidan Clark 口径)
来源:Wikipedia: GPT-6 Astra (2026-09)

「computer use」:从回答问题,到替你操作电脑

Astra 的招牌能力是 computer use——像人一样操控电脑:跨网页检索、打开电子表格填数、在多系统之间搬运数据、连续执行多步任务。OpenAI 给出的例子包括填报税表、搭建游戏场景、在线点餐、执行求职投递。总裁 Greg Brockman 的评价更直接:电脑操作能力或许是「AGI 时代」的起点。需要说明的是,这并非行业首创(Anthropic 2024 年就推出过 beta,Perplexity 今年 2 月也做过类似产品),但把它做成旗舰模型的默认能力、并公开给出可对比的基准数字,是第一次。

  • 报表生成、跨系统搬运、表单填报这类「操作电脑型」活儿,首次有了通用自动化路径,不再依赖为单一系统定制脚本
  • 「数字员工」从聊天窗口走进真实业务动作:能改文件、发请求、下单,IT 资产边界从软件账号扩展到「Agent 能触达的一切」
  • 能力越强,破坏半径越大:能自己操作电脑的 Agent 一旦带病运行,代价远高于只会聊天的助手

关键信号一:能力越强,交付越「留一手」

OpenAI 在 9 月 1 日(正式发布前两天)先行宣布:Astra 最先进的网络安全能力不随模型开放,初期仅限受控测试者使用。这与 7 月 OpenAI 官方账号被远程控制的 Hugging Face 事件直接相关——那次事件后,公司把「防止模型自身被利用」提到最高优先级。头部厂商开始对能力分层交付,说明「AI 能力风险管理」已经从公关话术变成了真正的产品策略,企业采购时也该把它当默认预期。

关键信号二:越强,越难看懂它为什么这么做

Astra 采用一种新的推理技术(recurrent depth,循环推理),计算效率更高,代价是模型的推理过程不再透明——外部更难观察到它为什么做出某个决定。OpenAI 首席科学家 Pachocki 直言:防止 AI 造成无意伤害的难度正在上升,甚至可能成为进一步发展的瓶颈。对采购方,这意味着:审计 Agent 会越来越依赖「结果抽查 + 权限边界」,而不是「看懂推理过程」,治理机制的设计思路要提前调整。

对老板或管理层意味着什么

第一,试点窗口到了。能操作电脑的模型已经产品化,接下来 6-12 个月,报表生成、跨系统数据搬运、表单处理这类场景会出现大量「买来即用」的供应商方案。本季度最值得做的是挑 2-3 个低风险场景试点,先跑通「人+Agent」的协作与验收流程,而不是等一个完美方案。(编辑观点)

第二,权限与审计必须先于试点设计。能操作软件的 Agent,权限就是资金与数据的安全边界:它用谁的账号、能碰哪些系统、动作是否留痕,必须写进试点清单而不是上线后补。第三,能力爬升的预期要修正:头部厂商开始分层交付能力并公开「踩刹车」,做三年规划时别把「模型能力每年翻倍」当确定性前提,治理与安全的投入要同步写进预算。

现在应该做什么

✓ 建议做
  • 让 IT/运营挑 2-3 个「操作电脑型」流程(报表、跨系统搬运、表单录入)做 Agent 能力对照测试
  • 试点前定义最小权限边界与审计台账:Agent 用什么账号、能做什么、动作全留痕
  • 把「能否解释数据与结论来源、操作是否可审计」加进 AI 工具采购评估清单
暂时不要做

    暂时不要做什么

    建议做
      ✕ 暂时不要做什么
      • 不要因为「AGI 时代」的说法就启动激进自动化——先跑通权限与审计机制再说
      • 不要让能自主操作软件的 Agent 使用管理员或特权账号跑生产任务
      • 不要忽略头部厂商的减速信号:把能力超线性增长当确定性的预算假设需要修正

      和现有内容怎么连读

      这条新闻建议与《OpenAI 推出金融版 ChatGPT》连读:金融版是 Astra 之上第一个行业定制产品,一条线是通用能力底座(自己操作电脑),一条线是行业岗位被 Agent 接管;再往前翻 7 月的 OpenAI-Hugging Face 攻击事件,就能理解为什么这次发布「留一手」——同一个厂商,两个月里把安全从事故变成了产品战略。(编辑观点)

      问:这和刚发布的金融版 ChatGPT 是什么关系?
      答:金融版(ChatGPT for Financial Services,9 月 10 日发布)是 Astra 之上做的第一个行业定制产品:一个负责通用能力底座(电脑操作),一个负责行业封装(投行研究流程)。多数企业不必追行业版,先看通用能力怎么落到自己的报表、数据搬运场景,等行业版成熟再按行业切入。
      问:我们是中小企业,这轮发布和我们有关系吗?
      答:有关系但不用急。能自己操作电脑的 Agent 会沿「旗舰→标准企业版→普遍可用」的路径下沉,历史规律是 12-24 个月。中小企业现在最该做的不是买 Astra,而是盘点自己哪些「操作电脑型」环节可以被自动化——先有场景清单,等能力普及就有现成的试点名单。
      问:Agent 能自己操作电脑,不会出安全事故吗?
      答:会,这正是 OpenAI 推迟发布、给网络安全能力分层交付的原因。风险高低看三件事:Agent 的账号权限、能触达的系统、动作是否留痕。上线任何能自主操作的 Agent 前,把这三件事当硬门槛而不是上线后补的功课。
      参考来源:OpenAI: GPT-6 Astra — A new generation of intelligence (2026-09-03)
      参考来源:Fortune: OpenAI launches GPT-6 Astra, its most powerful model yet (2026-09-03)
      参考来源:Wikipedia: GPT-6 Astra (2026-09)

      参考来源(3

      • 1. OpenAI: GPT-6 Astra — A new generation of intelligence (2026-09-03)一手官方
        发布主体:OpenAI
        使用政策:可摘要
        OpenAI 官方发布 GPT-6 Astra:新一代旗舰模型,9 月 3 日开放有限预览、次日向付费用户开放,主打跨浏览器与电脑的多步任务自主执行(computer use);官方称「世代级跨越」,总裁 Brockman 称电脑操作能力可视为 AGI 时代起点;首次在 Stargate 得州基地以 10 万+ GPU 完成预训练;最先进网络安全能力发布初期仅对受控测试者开放。
        https://openai.com/index/gpt-6-astra/
      • 2. Fortune: OpenAI launches GPT-6 Astra, its most powerful model yet (2026-09-03)可信媒体
        发布主体:Fortune
        使用政策:可摘要
        Fortune 报道:GPT-6 Astra 发布,招牌能力 computer use——以超人类速度穿梭网页、填写表单、操作电子表格;ARC-AGI-3 标准配置得分 66%(前代 GPT-5.6 Sol 仅 7.8%、Anthropic 当时最强约 30%),ExploitBench 网络安全挑战满分;该能力非行业首创(Anthropic 2024 年 beta、Perplexity 2026 年 2 月),但被 Brockman 视为 AGI 时代起点。
        https://fortune.com/2026/09/03/openai-debuts-gpt-6-astra-computer-use-greg-brockman-says-start-of-agi/
      • 3. Wikipedia: GPT-6 Astra (2026-09)行业来源
        发布主体:Wikipedia
        使用政策:可摘要
        维基百科条目:GPT-6 Astra 于 2026-09-03 向获准用户发布、次日向付费用户开放;因 7 月 Hugging Face 事件推迟发布并加装护栏;可填税表、建游戏场景、点餐、求职投递等多步工作流;采用新推理技术(recurrent depth 循环推理),效率更高但遮蔽思维链,引发可监测性担忧;研究副总裁 Aidan Clark 称其为迄今最大规模训练。
        https://en.wikipedia.org/wiki/GPT-6_Astra

      延伸阅读

      GPT-6 Astra 发布:AI 开始自己操作电脑 · WEI INSIGHT