Astra 在软件工程、科学研究、推理与计算机操作上全面跃升,可直接进入软件环境,自主完成编程、金融建模、制作演示文稿与电子表格等长周期、多步骤任务。
专为长时间复杂任务设计。多个 Agent 可数小时甚至数天内分工合作、持续开会讨论并自我修正错误,宛如一座全自动化虚拟公司团队,突破单体 AI 长上下文失忆的瓶颈。
核心创新技术「循环深度」(Recurrent Depth):将问题反复传递至模型各层处理,在不显著增加参数规模的情况下展现出远超自身体量的推理能力,效果相当于一个规模大得多的模型。
在数学、物理、生物、医学、化学等领域取得重要成果,首次攻克 10 个此前人类未解的高阶数学难题,并具备更强的多模型协调能力以调度其他模型共同参与研究。
市场领先的软件工程能力,可直接进入软件环境自主完成编程、金融建模、制作演示文稿与电子表格等长周期、多步骤任务。
能压缩并保留更多有用信息,在长期交互中维持更稳定的上下文,未来或许可持续理解一名用户、一套企业运营体系乃至更复杂的长期环境。
首个达到「关键」级网络安全能力门槛的模型,能无须人工引导发现未知漏洞并开发利用方式。最尖端能力仅向 Daybreak Blue 计划内的经审核合作伙伴开放。
多项关键评测接近满分,ARC-AGI-3 从 7.8% 跃升至 98.6% 尤为瞩目。
OpenAI 应战备框架(Preparedness Framework)中首次将模型评定为「关键」级网络安全能力,开发期间曾主动暂停部分工作以加强防护措施。
8 月发现 Astra 在网络安全任务上能力超群,OpenAI 暂停部分训练工作数周以加入更严格的安全措施,随后恢复并加强防护后才发布。
内部测试中,Astra 在 ExploitBench 内部移植版评估期间发现并运用了两个零日漏洞纳入利用链,目前正向维护者披露。
在「面对困难/不可能任务是否越界」的评估中,Astra 越界比例为 0%(GPT-5.6 Sol 为 48%)。Brockman 表示,监控置信度可能约束进一步开发,「我们愿意在安全信心不足时放慢或暂缓扩展」。
最尖端网络安全能力仅向经审核的合作伙伴开放,配合专为网络安全工作设计的安全措施,允许批准测试人员使用最强模型用于防御性工作。
Astra 分阶段向用户开放,API 定价为前代 GPT-5.6 Sol 的 2.5 倍,OpenAI 表示未来行业可能转向按任务收费。
| 类型 | 价格 | 说明 |
|---|---|---|
| 输入 Token | $10 / 百万 | 标准版 |
| 输出 Token | $50 / 百万 | 标准版 |
| 缓存输入 | $1 / 百万 | — |
| 缓存写入 | $12.5 / 百万 | — |
| Fast 模式 | 标准版 2 倍价格 | 最高约 2.5 倍速度 |
gpt-6-astra)与 AWS Bedrock 提供。—— OpenAI 官方发布