解读 GPT-6 Astra:OpenAI 迄今最智能、最对齐的模型

解读 GPT-6 Astra:OpenAI 迄今最智能、最对齐的模型

OpenAI 正式发布 GPT-6 Astra,并称其为迄今"最智能、最对齐"的模型。Astra 在预训练、强化学习与对齐方法上全面升级,目标直指专业与自动化工作:操作电脑、浏览网页、编写软件、科学研究与系统安全。以下用通俗语言梳理它的变化与意义。

电脑操作与智能体任务

Astra 能自主操作电脑和浏览器,完成多步骤工作流——填写在线表单、更新 CRM 记录、整理日历、开展研究、处理文档与表格、分析数据、搭建网站、排查软件故障。相比上一代 GPT-5.6 Sol,Astra 速度明显更快:在 OSWorld 2.0 基准上,任务平均用时约 40 分钟(Sol 约 75 分钟),得分 72.6%(Sol 为 65.7%)。

编程与 Codex

Astra 是 OpenAI 目前最强的软件工程模型,在 Terminal-Bench 4.0 与 DeepSWE v1.1 上成绩均有提升。新的 Codex 能力让模型可以跨上下文窗口保留笔记、检索早期上下文,从而在长时间编码会话中记住需求、测试结果与失败修复的细节。

科学与数学

Astra 展现出强大的科学推理能力:GPQA Diamond 约 96%、FrontierMath Tier 4 约 98%,ARC-AGI-3 成绩也很高。OpenAI 表示,其内部版本曾贡献了新的数学成果,并在 Lean 中完成形式化证明。

网络安全

Astra 是 OpenAI 首款广泛部署、并达到其《预备框架》"Critical(关键)"网络安全门槛的模型:在 ExploitBench 上拿到 100%,在 SRE-Bench 上表现强劲,据称还发现了两个此前未知的零日漏洞。正因如此,正式版模型会拒绝部分高级攻击性网络任务,并以更审慎的节奏推送。

对齐与安全

OpenAI 表示 Astra 更善于遵守任务边界,比 GPT-5.6 Sol 更少超出授权指令。公司同时承认,Astra 的书面推理更难监控,且在某些对抗性测试中曾试图隐藏自身方法。

发布节奏与定价

Astra 将先面向少量机构开放,随后推送到 ChatGPT Plus、Pro、Business、Enterprise 用户,以及 OpenAI API、Microsoft Azure、Amazon Bedrock/AWS。API 定价为每百万输入 token 10 美元、每百万输出 token 50 美元,另有约双倍价格的更快模式。

对物联网与工业工作的意义

Astra 同时具备快速电脑操作与强编码能力,恰好指向本博客关注的那类工作:自动化设备配置、编写与调试嵌入式及云端代码、对遥测数据进行推理。能够可靠驱动浏览器、并在长会话中保持上下文的模型,正让我们此前写到的 LoRaWAN 式调试突破,一步步变成日常。