Astra正式推送Codex与ChatGPT Work:首个"关键级"网络安全大模型进入日常工作流
结论:2026年9月,OpenAI的Astra已全面推送给Codex和ChatGPT Work的Plus、Pro、Business、Enterprise用户,这是OpenAI首个被自家"准备框架"评定为"关键级"网络安全能力的模型,意味着AI不再只是帮你写代码,而是能在防护严密的系统里自己找漏洞、自己设计利用路径。Astra到底是什么?为什么说它和安全有关?
9月初,OpenAI发布《迈向Astra:关键能力与前沿防护机制》一文,明确说明Astra已跨过"关键级"网络安全能力阈值。通俗讲:给它配上合适的工具和权限,它不需要人一步步指导,就能在许多防护严密的系统中发现此前未知的安全漏洞,并制定漏洞利用策略。
这在OpenAI内部是第一次。该公司坦言,过去几周他们主动推迟了Astra的部分开发和发布工作,用于加强并测试"网络滥用"和"模型未经授权行动"两类防护措施。最终结论是防护机制足以将严重危害风险降到最低,才按准备框架放行。
一个模型同时干两件事:造漏洞和补漏洞
Astra的能力是双刃的。同一条推理链路,可以用于安全测试和漏洞研究,也可以被滥用。OpenAI的对策是把能力分级开放,通过Daybreak项目扩展网络安全服务,其中包含Blue与Red两个等级:Blue提供事件响应、恶意软件分析等常规服务;Red则包含专为安全测试与漏洞研究训练的新模型GPT-5.6-Cyber,目前只向埃森哲、IBM、CrowdStrike等可信合作伙伴开放。
普通人会感受到什么变化?
最直接的变化是入口。Astra已向Codex和ChatGPT Work的Plus、Pro、Business和Enterprise用户全面推送,用户可直接使用,官方还在openai.com/gpt-tv/放出了实机演示。也就是说,一个被内部定级为"关键"的安全能力模型,已经出现在普通付费用户的日常工作窗口里。
另一个变化是调用方式。OpenAI在文档里提到"对齐监控器":当监控器判断任务存在风险会暂停执行,ChatGPT或Codex用户可能需要先审核相关操作才能继续,而通过API等其他界面调用时,任务会被直接停止。官方表示会继续校准这些防护,减少不必要的打断。
数据说话:能力提升背后的代价
第一,Astra是OpenAI首个被评定为"关键级"网络安全能力的模型,此前无先例。
第二,OpenAI为强化防护,主动推迟了该模型部分开发与发布工作,这在产品迭代以周为单位的当下并不常见。
第三,截至2026年8月月中,OpenAI内部Agent运行时长已达到人力的3.1倍,说明这类长周期自主任务已经不是实验室演示,而是在真实生产环境里跑数据。
行业意义:安全不再是"附加项"
把"关键级"标签挂在旗舰模型上,等于承认一件事:前沿模型的能力增长已经超出了"聊天助手"的范畴。当模型能自主发现零日漏洞,厂商就必须在发布前完成防护设计,而不是先上线再补丁。
这也解释了为什么2026年多份行业报告都把"智能体行为的可审计与可回滚机制"列为关键突破方向。能力越强,责任边界越需要在代码和流程里被写清楚。
总结
Astra的全面推送,标志着AI从"辅助写代码"走向"自主做安全评估"的分水岭。对普通用户来说,变化是功能更多、偶尔会被安全校验打断;对企业来说,变化是必须重新想清楚:哪些权限能给AI,哪些任务必须留人在环。2026年下半场,比拼的不只是模型有多强,而是谁能把强模型管得住、用得好。
页:
[1]