据腾讯科技报道,美国当地时间 9 月 3 日,OpenAI 正式推出 GPT-6 Astra。不同于过往以问答、内容生成、工具调用为主的大模型,Astra 可以完整执行一整套连续任务:接收指令、操作软件、依据运行结果迭代后续动作。

让 AI 直接上手“使用电脑”
Astra 最核心的革新,是原生的计算机操作能力。以往想要让 AI 完成业务工作,企业需要搭建插件、API、检索组件等各类连接器,才能让模型调用内部工具。Astra 试图降低这一部分接入成本,它可以识别电脑屏幕界面,通过模拟、、浏览器完成操作。
OpenAI 将 Astra 定义为“全球最强的计算机使用模型”,其能力不再局限浏览器、邮件、表格等简单工作,而是已经拓展至 Power BI、KiCad、FreeCAD 等专业软件,可落地数据分析、工程设计、软件测试、故障排查等复杂业务流程。
从公布的基准测试结果来看,该模型的提升集中体现在计算机操控、长链路编码、工程设计、科研类连续任务。ExploitBench 测试拿到 100% 得分,计算机操作、CAD 相关测试成绩显著优于前代模型。
不止写代码,可独立推进完整复杂任务
依托强大的计算机操作能力,Astra 的业务覆盖范围进一步拓宽,OpenAI 将其定位面向软件工程、专业办公、科学研究的大模型,能够承接长周期任务,并根据现实情况动态调整执行思路。
针对长 Codex 编码任务,Astra 做出专项优化。传统大模型遇到上下文窗口限制时,会压缩历史工作内容生成摘要,很容易丢失细节,例如失败的修复记录、组件历史故障信息。Astra 可以留存任务过程中的关键信息,支持回溯检索历史消息与工具输出记录,便于调取过往需求、测试结果与操作记录。
该模型也具备生成演示文稿、电子表格、文档的能力。输入参考幻灯片模板,Astra 可以复刻原有排版、行文风格产出全新 PPT;同时会自主甄别信息,保留关键上下文,减少无效重复工作。
面对信息残缺的指令,Astra 拥有判断能力:缺失关键信息会主动向用户提问,次要信息缺失则合理假设继续推进任务。编码场景下,用户未及时回复时可先处理其他模块,遇到重大决策点则等待用户确认。
能力升级背后,网络安全风险同步抬升
OpenAI 表示,Astra 已经达到内部网络安全准备框架关键阈值,有能力挖掘未知软件漏洞,甚至构建漏洞利用链。因此当前版本会拒绝执行高危网络安全任务。另外,模型在识别任务边界、理解模糊指令、能力自我说明方面有所优化,幻觉发生概率约为 GPT-5.6 Sol 的三分之一。
现阶段 Astra 优先向部分机构开放,未来数日将逐步面向 ChatGPT Plus、Pro、Business、Enterprise 用户推送,同时支持 OpenAI API 以及 Amazon Bedrock 调用。API 标准定价为每百万输入 10 美元、每百万输出 Token 50 美元,相当于是 GPT-5.6 Sol 的 2.5 倍,跟刚刚发布的 Fable 5.1 持平。
OpenAI 称 GPT-6 Astra 为“目前全球最智能、且对齐程度最高的模型”。在发布会最后,OpenAI 联合创始人兼总裁 Greg Brockman 表示,“ Welcome to the AGI era ( 欢迎来到 AGI 时代 ) ”,对 Astra 的意义给出了更具象征性的判断。OpenAI CEO 山姆・奥特曼 ( Sam Altman ) 也评价,Astra 有望开启新一轮创业浪潮与科研创新。
丁丁打折网©版权所有,未经许可严禁复制或镜像 ICP证: 湘ICP备2023003002号-11
Powered by 丁丁打折网本站为非营利性网站,本站内容均来自网络转载或网友提供,如有侵权或夸大不实请及时联系我们删除!本站不承担任何争议和法律责任!
技术支持:丁丁网 dddazhe@hotmail.com & 2010-2020 All
rights reserved