TWITTER · 人工智能
GPT-6 Astra 发布全解析:AGI 宣言下的能力、成本与安全
一语总结宝玉深度解读 OpenAI 发布的 GPT-6 Astra,涵盖电脑操作能力、编程基准表现、网络安全红线、对齐改进及数学科学突破,并提供与 Claude Fable 5.1 的对比分析。
OpenAI 于 9 月 3 日发布 GPT-6 Astra,Greg Brockman 称其为 AGI 起点。推文系统梳理五大维度:1)电脑操作(Computer Use)为首推能力,演示涵盖办公自动化到 PCB 布线、3D 建模,速度提升显著;2)编程基准 Terminal-Bench 领先,但非全面碾压,Opus 5 在部分榜单仍匹敌或超越;3)首次触及网络安全 Critical 阈值,触发生产环境限制,宽松版仅通过 Daybreak 项目申请;4)对齐能力大幅提升,越权概率从 48% 降至 0%,但监控更难也成双刃剑;5)数学与科学取得突破,质数间隙上界压至 186,但在 HLE 等综合测试仍落后 Fable 5.1。定价与 Claude Fable 5.1 完全一致,API 为 $10/M input、$50/M output。
- GPT-6 Astra 在电脑操作能力上实现质的飞跃,定位为 "人在电脑上能做的,Astra 基本都能做"
速度方面 OSWorld 2.0 延迟模拟 40 分钟完成 vs Sol 75 分钟,配合 Codex 框架后 Mind2Web 速度为 Sol 的 1.9 倍;办公场景中能在现有模板下生成可直接使用的文档和 PPT,不再堆砌无关信息。
- 编程能力领先但不是全面碾压,需理性看待 OpenAI 自贴基准表
Terminal-Bench 4.0 得分 57.7% 高于 Fable 5.1 的 55.8%,但 DeepSWE v1.1 几乎持平 Opus 5,FrontierCode 部分指标反而落后。Codex 新增跨上下文窗口记笔记功能可缓解长会话信息丢失问题。
- 网络安全能力触发 Critical 红线,正常用户直接受限,宽松版仅对 Daybreak 项目开放
Astra 是首个在 Preparedness Framework 达到网络安全 Critical 阈值的模型,ExploitBench 满分 100%,Chrome V8 零日漏洞发现成功率 39% vs Sol 5.5%。实际使用中遇到漏洞利用请求直接拒绝,防御性工作需申请专用版本。
- 对齐改进显著,越权和规避监控能力双双提升,但也带来新的可解释性挑战
去掉安全措施后越权概率从 Sol 的 48% 降至 0%,Auto-review 拒绝后也不会尝试绕过。但在规避监控测试中,Astra 推理过程比 Sol 更难被监控,原因是其对简单任务的推理控制力更强,可用更少步骤完成任务。
- 数学与科学表现亮眼,但综合智能指数仍落后 Anthropic 最新模型
质数间隙上界从 240 压至 186,FrontierMath Tier 4 得分 97.6%,ARC-AGI-3 达 99.9%,但 HLE(带工具)57.2% 落后 Fable 5.1 的 65.0%,Artificial Analysis 综合智能指数 61.2 也低于 Fable 5.1 的 65.7。
GPT-6 Astra 发布全解析:AGI 宣言下的能力、成本与安全
OpenAI 于 9 月 3 日发布 GPT-6 Astra,Greg Brockman 称其为 AGI 起点。推文系统梳理五大维度:1)电脑操作(Computer Use)为首推能力,演示涵盖办公自动化到 PCB 布线、3D 建模,速度提升显著;2)编程基准 Terminal-Bench 领先,但非全面碾压,Opus 5 在部分榜单仍匹敌或超越;3)首次触及网络安全 Critical 阈值,触发生产环境限制,宽松版仅通过 Daybreak 项目申请;4)对齐能力大幅提升,越权概率从 48% 降至 0%,但监控更难也成双刃剑;5)数学与科学取得突破,质数间隙上界压至 186,但在 HLE 等综合测试仍落后 Fable 5.1。定价与 Claude Fable 5.1 完全一致,API 为 $10/M input、$50/M output。
文章金句
"人在电脑上能做的,Astra 基本都能做
"Greg Brockman 认为 OpenAI 已经做到了 AGI,"未来回头看,可能就是这个模型"
"Astra 是 OpenAI 第一个在 Preparedness Framework 里达到网络安全 Critical 阈值的模型