OpenAI Astra 是什么?
2026 年 8 月,OpenAI 公开披露了其下一代旗舰模型 Astra 的初步评估结果。与以往模型发布不同,这次 OpenAI 是因为 Astra 的网络安全能力评估达到了内部 Preparedness Framework 的"Critical"阈值,才主动向公众披露——这本身就说明了这个模型能力之强。
核心能力突破
Agentic 编程
根据 OpenAI 的评估报告,Astra 在代码能力上超越了 GPT-5:
- SWE-bench 成绩:超越 GPT-5,成为公开评测中代码修复能力最强的模型
- 跨文件重构:能够理解大型代码库结构,执行跨多个文件的重构
- 测试生成:自动生成有意义的单元测试,覆盖边界条件
- 调试策略:不仅找到 Bug,还能分析根因并提出系统性修复方案
网络安全能力
这是 Astra 最具争议也最令人关注的能力:
根据 OpenAI Preparedness Framework 的定义,Critical 级网络安全能力意味着:
- 能在无人类干预下识别并开发对真实系统的零日漏洞利用
- 能构建针对加固目标的端到端网络攻击策略
OpenAI 的初步评估显示,Astra 的表现"无法排除"达到 Critical 阈值的可能性。
OpenAI 的安全应对措施
面对这一评估结果,OpenAI 采取了一系列严格措施:
1. 隔离测试环境:所有 Astra 的高风险评估在隔离环境中进行
2. 链式思维监控:对 Astra 的推理过程实施全程监控
3. 限制网络访问:测试期间限制模型的外部工具访问
4. 暂停高风险活动:不满足强化安全控制要求的内部活动已暂停
5. 政府合作:将与相关政府机构和 AI 安全组织合作进行测试
这种透明度是 OpenAI 负责任 AI 发布承诺的体现。
性能对比
| 维度 | Astra | GPT-5 | GPT-4o |
|---|---|---|---|
| 代码能力 | 5星+ | 5星 | 4星 |
| 推理深度 | 5星+ | 5星 | 4星 |
| 安全评级 | Critical 级 | High 级 | Medium 级 |
| 公开状态 | 受限内测 | 公开可用 | 公开可用 |
访问方式
目前 Astra 处于受限研究预览阶段:
- ChatGPT Plus/Pro 用户将优先获得访问权限
- API 访问需申请加入等待列表
- 完整公开发布时间待定
对开发者意味着什么?
Astra 的能力演示意味着:
1. AI 结对编程将质变:不再是"补全代码",而是真正的"完成任务"
2. 代码审查将 AI 化:Astra 能发现人类难以察觉的安全漏洞
3. 软件工程流程重塑:从写代码到审核 AI 生成的代码
总结
OpenAI Astra 代表了大语言模型发展的新里程碑,其 Agentic 编程能力将重新定义软件工程师的工作方式。安全性与能力的平衡是 Astra 最值得关注的议题——它既令人兴奋,也需要审慎对待。
> 本文为整理搬运文章,参考来源:OpenAI 官方公告(https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/)及公开技术报道,内容经 AI大广场 编辑整理。
