美东时间 9 月 3 日,OpenAI 正式推出新一代旗舰大模型 GPT‑6 Astra,同步发布更强性能版本 GPT‑6 Astra Pro。这次更新不再局限于文字问答,重点强化自主操作电脑、跨软件完成完整工作流程的能力,被行业视作 AI 从聊天助手向专业智能工作体转型的重要节点。两款模型采用分阶段灰度上线策略,初期仅向部分合作企业开放,后续几天逐步向 ChatGPT 订阅用户、企业客户开放使用权限。

和前代产品相比,GPT‑6 Astra 最核心的突破是计算机使用能力。过往大模型只能接收文字指令,输出文本、代码或者方案,无法直接在电脑系统里执行操作。Astra 能够识别屏幕界面,自主打开浏览器、办公软件、设计工具,根据最终目标分步规划操作,自动检索资料、整理表格、生成文档,全程不需要用户持续下达细碎指令。例如开展市场调研时,模型可以自主查找行业数据,整理信息制作图表,最后生成完整 PPT,串联起多软件协同工作。在设计领域,它还能完成三维建模,把模型文件导入游戏引擎生成可交互场景,降低专业创作的技术门槛。
硬件与底层训练规模也提升到新的级别。GPT‑6 Astra 在美国德州 Stargate 超算中心完成训练,投入超过 10 万张 GPU 参与预训练。模型上下文窗口达到 105 万 token,单次最大输出 128000token,能够一次性读取并处理数十万字的长篇资料,长时间开展连续性工作,减少长任务里信息丢失、逻辑断裂的问题。知识截止时间更新至 2026 年 4 月 30 日,掌握更多最新行业信息。官方测试数据显示,该模型在数学推理、前沿科研、代码开发、网络安全多项基准测试中取得亮眼成绩,复杂推理与解决陌生难题的能力明显提升。

本次推出两个版本,定位存在清晰区分。GPT‑6 Astra 面向普通付费订阅用户与中小型企业,兼顾性能与使用成本,适合日常办公、内容创作、基础数据分析、代码编写等场景。GPT‑6 Astra Pro 属于高阶版本,仅对 ChatGPT Pro、商业及企业客户开放,推理深度更强,能够应对超大规模科研项目、复杂系统开发、高精度金融建模等难度更高的专业任务。在 API 收费标准上,GPT‑6 Astra 每百万输入 token 定价 10 美元,每百万输出 token 定价 50 美元,价格相比上一代旗舰有所上涨,OpenAI 解释,模型单次任务完成效率显著提高,完成同等工作量的总开销并不会持续增加。
值得关注的一点,GPT‑6 Astra 是 OpenAI 首款达到网络安全 Critical 等级的模型。强大的安全相关能力也带来潜在风险,出于安全管控考虑,高危网络安全功能没有向全部用户开放,单独纳入 Daybreak 可信访问项目,仅经过严格审核的机构才能够调用。OpenAI 表示,模型早在夏季就完成训练,为了完善安全对齐、搭建风险防护机制,推迟发布时间,组织大量研究人员开展长期测试,确认风险可控之后才启动上线流程。

市场层面,各大科技企业的大模型竞争已经从简单对话能力比拼,转向智能体落地应用。GPT‑6 Astra 系列的发布,意味着竞争焦点转移到自动执行、多工具联动、长流程自主作业。但我们需要理性看待模型能力边界,它目前依然存在短板。面对高度非标、变数极多的现实工作场景,自主操作依然容易出现失误,复杂专业项目仍然离不开人工校验。模型的高分只是实验室基准测试结果,不能等同于现实环境下稳定可靠的表现。
从 GPT 系列迭代路径来看,早期产品以问答、文案生成为主,之后逐步增加绘图、联网、代码功能,而 GPT‑6 Astra 把自主执行作为核心方向。AI 不再只提供建议,而是尝试直接落地完成任务。随着后续持续迭代优化,智能体有望深度融入办公、研发、设计等工作场景,改变很多行业的工作模式。不过安全监管、隐私保护、使用成本、可靠性短板依旧是落地路上的难题,AI 真正大规模替代复杂人工工作,还有很长的探索周期。