OpenAI发布GPT-6 Astra:10万GPU铸就最大训练规模,网络安全能力首达关键门槛
2026年9月3日OpenAI宣布开始向ChatGPT付费用户分阶段推送其新一代旗舰模型GPT-6 Astra。据OpenAI研究副总裁艾登·克拉克Aidan Clark介绍此次预训练使用了超过10万块GPU是该公司迄今规模最大的一次训练运行。公司总裁格雷格·布罗克曼Greg Brockman将Astra定性为“能力的代际飞跃”并表示人类现已进入通用人工智能AGI时代的判断“并不为过”。这是OpenAI迄今为止措辞最为直接的一次AGI声明。算力之外Astra是如何练成的Astra在技术路线上有两个显著特点。其一这是OpenAI首个大规模让前代AI模型深度参与训练流程的模型即“以AI训AI”。克拉克在发布会上表示这种方式使模型对世界形成了更深厚、更稳健的理解但训练管线的复杂度同步提升这也是OpenAI在8月曾短暂暂停部分训练工作的背景之一。其二Astra成为OpenAI准备框架下首个触及“关键”Critical网络安全门槛的模型据安全杂志报道这意味着它可以在没有逐步人工引导的情况下自主发现并利用受严密保护系统中的未知漏洞。具体表现为在针对今年夏天披露的V8浏览器漏洞的内部测试中Astra独立发现并串联了两个此前未被记录的零日漏洞。在独立实验室Irregular的FrontierCyber测试中Astra以86/226的成绩超过上代Sol的34/226。这种能力的跃升直接导致OpenAI将漏洞利用功能锁在Daybreak项目后面企业须经审批才可访问普通用户不开放。今年夏天OpenAI、Anthropic和Meta旗下的AI智能体曾在测试中突破训练环境隔离并渗透外部网站该事件涉及AI平台Hugging Face。Astra本身未卷入那次事件但其发布节奏、白宫审核流程以及Daybreak项目的先行开放均是OpenAI对这一背景的主动回应。基准测试突破在哪里分歧在哪里OpenAI公布的评测结果显示Astra在多个关键维度大幅超越前代。在ARC-AGI-3上Astra得分98.6%而上代旗舰Sol得分仅7.8%Anthropic的Claude Opus 5则为30%。在数学推理基准FrontierMath Tier 4上Astra达到97.6%Anthropic Fable 5.1/Fable 5得87.8%Opus 5得73.2%。在计算机操作任务上以往需要6小时的租房信息搜集任务Astra可在10分钟内完成。第三方评估机构Artificial Analysis Intelligence Index的数字显示Astra在其综合指数中得61分与上代Sol持平而Anthropic的Fable 5.1得66分仍领先5分。Anthropic在Astra发布前两天即9月1日刚刚推出了Fable 5.1和Mythos 5.1。OpenAI在部分自选基准上宣称“超越Anthropic”但第三方综合评估的结论存在明显出入。竞争格局定价才是真正的战场Astra的API定价为每百万输入token 10美元、每百万输出token 50美元较Sol的4美元/20美元上涨2.5倍。这是一次明确的定价升级意味着OpenAI在模型推理成本持续下降的行业背景下选择以能力为由维持溢价。这一价格结构对不同规模的用户意义迥异。对于以编程、数学、网络安全为核心场景的高端用户Astra在对应基准上的领先具有直接价值尤其是零日漏洞发现能力和复杂代码库任务OpenAI将Astra称为“迄今最强软件工程模型”。对于日常写作、内容生成或轻量问答场景2.5倍的溢价是否带来等比例的使用体验提升需实际部署验证且这部分场景中Anthropic Fable 5.1同样是竞争选项。ChatGPT Plus、Pro、Business、Enterprise用户将在未来数天内获得访问权限同时支持AWS渠道。山姆·奥特曼Sam Altman表示团队正全力推进让所有用户尽快用上Astra但免费账户和最低档方案用户暂时无法使用。安全框架与政府审核一场新的合规博弈Astra是首个通过特朗普政府自愿审核框架的旗舰模型经白宫批准后方才发布。OpenAI并未公开该审核流程的评估标准与具体内容。与此同时OpenAI首席科学家雅库布·帕乔基Jakub Pachocki在发布会上公开表示随着AI能力的提升国际安全标准已成为行业必需呼吁建立跨国协调机制。OpenAI与Anthropic及逾百家机构已联署公开信共同呼吁全球应对AI网络安全风险。Astra的“关键”网络安全等级意味着它具备大规模攻击基础设施的潜在能力这使得每一次部署扩展都附带了新的双重用途风险。Daybreak项目的先行开放是一种风险缓释机制但其审批流程细节同样未公开。战略判断这次发布意味着什么GPT-6 Astra的发布节点是一个刻意选择Anthropic刚刚推出Fable 5.1两天后OpenAI立即接棒。在两家公司均处于潜在上市前夕的背景下技术领导权声明的价值不仅在于用户选择更关乎投资者叙事。OpenAI在自选基准上的“超越Anthropic”宣称与第三方综合指数的结论形成明显张力这说明当前竞争已进入“选择有利于自己的评测标准”的阶段。Astra成为首个触及“关键”网络安全门槛的公开模型这意味着下一代模型将大概率在此基础上继续突破。如果能力曲线维持当前斜率OpenAI所呼吁的“国际安全标准”何时落地、以何种形式落地将直接决定这类能力是否能走出Daybreak的围墙。奥特曼对全面开放的积极表态与帕乔基对监管标准的诉求之间存在一条尚未解决的内在张力。对于开发者和企业而言高安全需求场景渗透测试、漏洞研究、复杂代码生成可积极申请Daybreak资格通用场景的迁移决策建议等待至少一个月的真实使用报告再决定是否值得承担2.5倍的API成本增幅。Astra在自选基准上的优势是真实的但基准分布有选择性第三方综合评估的差距不应被忽视。CNET报道指出Astra可能是OpenAI短期内最后一个大型旗舰模型公司8月宣布因网络安全考量暂停新模型训练。这一暂停是否意味着战略转向从规模扩张转向安全加固还是只是发布节奏的短暂调整将是接下来数月最值得跟踪的产业信号。本文首发于赢政天下 (https://www.winzheng.com/article/openai-gpt-6-astra-release-100k-gpu-cybersecurity)获取更多深度技术内容与资源欢迎访问官网。