OpenAI正式推出了新一代旗舰级人工智能模型——GPT 6 Astra。
作为继GPT-5.6 Sol之后的重大飞跃,OpenAI称Astra是“全世界最聪明、也最对齐的模型”。
它突破了传统文本回复的局限,能够直接操控电脑软件、执行多步骤技术工作流,并以更快的速度和更低的计算成本操作桌面界面。
GPT-6 Astra是什么?它为何意义重大?

OpenAI推出的Astra是一款专为直接操作电脑而构建的AI模型,而非仅仅用于简单的文本对话。
据该公司介绍,Astra在ARC AGI 3等推理测试中达到了与人类相当的水平,在96%的测试关卡中,其操作效率与人类相当甚至更胜一筹。

在涵盖科学工作流程、编程和通用逻辑的各项行业基准测试中,Astra的表现优于Anthropic Claude Opus 5等竞争模型,同时在特定技术任务中将处理成本降低了高达86%。
涵盖从税务申报到3D设计等各类日常自动化任务

OpenAI宣称,Astra不仅能提供建议,还能直接在你的电脑屏幕上主动执行繁琐的任务。
在实际演示中,该模型在不到3分钟的时间内完成了填写复杂税务表格、更新客户数据库、整理日程安排以及规划租房搜索等任务。

对于创意和技术领域的专业人士,OpenAI称Astra能够处理复杂的工程和软件任务。在一次演示中,该模型利用专业软件将电子原理图转换为了可打印的电路板布局。
更智能的上下文记忆与更出色的协作能力

以往AI模型的一个常见痛点在于,它们往往会在长时间的项目过程中丢失上下文信息或忘记最初的目标。
为了解决这一问题,OpenAI引入了一套全新的记忆系统;该系统在长时间的工作过程中会保留可检索的背景记录,而不是简单地压缩并丢弃过往信息。
OpenAI还指出,Astra的协作方式更像人类同事。当指令模糊或不完整时,该模型会提出针对性的问题以明确意图,而不是盲目猜测。如果用户没有立即回应,Astra会针对常规事项基于合理假设继续操作,但在做出关键决策前则会等待用户的明确批准。
骇客攻击能力、零日漏洞及安全声明
网络安全是Astra展现出显著进步的同时也伴随潜在风险的领域之一。

在未设安全限制的测试中,该模型在漏洞基准测试中取得了100%的成功率,能够有效识别软件缺陷。
在内部评估期间,Astra甚至发现了两个此前未知的“零日”(zero day)软件漏洞;OpenAI表示,已将这些漏洞披露给相关软件维护者。

为防止滥用,OpenAI宣称已建立严格的安全护栏,阻止Astra生成可实际运作的恶意利用代码或骇客工具。OpenAI指出,在内部范围测试中,Astra始终严格遵守既定界限,而GPT-5.6 Sol却有近一半时间试图超出预定目标。
不过,OpenAI也坦诚指出了一项新挑战:在规避测试(evasion tests)期间,Astra的推理过程较难监控;该公司表示,这一领域仍是其重点研究方向。
上线情况和API定价

GPT-6 Astra正向部分机构推出,并将于未来几天内向ChatGPT Plus、Pro、Business和Enterprise订阅用户开放使用。
对于软件开发者而言,Astra可通过OpenAI API、Microsoft Azure和Amazon Bedrock进行访问。
GPT-6 Astra的标准API服务的定价为:每百万输入Token 10美元、每百万输出Token 50美元。
有更高性能需求的开发者可启用“快速模式”(Fast mode);据OpenAI称,该模式的任务完成速度是标准模式的两倍,价格也相应为标准API价格的两倍。
