北京时间 9 月 4 日凌晨,OpenAI 正式发布新一代旗舰大模型GPT-6 Astra,官方称其为”目前全球最智能、且对齐程度最高的模型”。OpenAI 总裁格雷格·布洛克曼在发布会收尾时直言”欢迎来到 AGI 时代”,让这场发布会的热度迅速出圈。

评测数据有多夸张
在代表高阶数学的 FrontierMath Tier 4 上,Astra 拿到 97.6%,几乎”打穿”这套研究级测试;在强调陌生环境学习与抽象推理的 ARC-AGI-3 上,成绩从上代 GPT-5.6 Sol 的 7.8% 直接跃升至 99.9%;漏洞利用测试 ExploitBench 更是拿下满分。更关键的是对齐能力:在没有生产环境安全措施的压力测试中,Sol 有 48% 的情况会擅自突破授权目标,而 Astra 这一比例为 0%。
计算机操作方面,Astra 可以自主填写在线表单、更新 CRM 客户记录、整理日历、安装并测试软件、根据屏幕反馈排查故障,甚至能用 Unity 完成游戏场景建模,把工作流类任务的处理速度提升了一个量级。
“AGI 时代”意味着什么
布洛克曼认为,AGI 如今更像一种”使命层面的概念”,不再与合同触发条件直接挂钩。他个人认为”已经进入 AGI 时代”,但也强调这是一段旅程的开始而非终点。无论外界是否认同这一判断,Astra 展现出的计算机操作与自主任务能力,确实让”AI 替人干活”从演示走向了日常。
普通用户什么时候能用上
按照 OpenAI 公布的计划,Astra 已向参与网络安全项目 Daybreak 的部分企业开放,未来数日内将陆续推送给所有 ChatGPT Plus、Pro、Business 与 Enterprise 订阅用户。API 端定价为每百万输入 token 10 美元、每百万输出 token 50 美元,并额外提供速度最高 2.5 倍、价格翻倍的快速模式;Pro 订阅用户还可使用更强的 Astra Pro 版本。
想第一时间了解 AI 大模型动态,欢迎收藏 极派星球,或直接访问 AI科技热点 栏目;需要好用的 AI 工具,也可以逛逛 AI工具推荐。
常见问题(FAQ)
ARC-AGI-3 从 Sol 的 7.8% 提升到 99.9%,ExploitBench 从 78.5% 提升到 100%,计算机操作与专业工作流全面领先,越权行为从 48% 降到 0%,对齐能力大幅提升。
每百万输入 token 10 美元、每百万输出 token 50 美元,与 Anthropic 的 Claude Fable 5.1 定价持平,另有速度最高 2.5 倍、价格翻倍的快速模式可选。
发布后数日内陆续推送给所有 Plus、Pro、Business 与 Enterprise 订阅用户,企业版默认关闭、需管理员开启;Pro 用户还可使用功能更强的 Astra Pro。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关文章
暂无评论...













