日期:2026-08-22 更新 | 分类:AI动态 / 知识库 | 来源:SiliconANGLE
核心要点
OpenAI 于 2026 年 4 月正式发布 GPT-5.4-Cyber——一个基于 GPT-5.4 微调、专为防御性网络安全工作设计的专用模型,同时将其 Trusted Access for Cyber(网络可信访问)项目大幅扩展至数千名经认证的安全专家。
![]()
模型能力
GPT-5.4-Cyber 被 OpenAI 称为”cyber-permissive”(网络宽容型)模型,核心设计目标是降低合法网络安全任务的拒答边界,提供标准版 GPT-5.4 不具备的能力。其中最具代表性的是:
- 二进制逆向工程:安全人员无需源代码即可分析编译后的软件,用于检测恶意软件、漏洞和安全弱点。
鉴于模型权限较高,OpenAI 将初期访问范围严格限制在经过认证的安全厂商、组织和研究人员,全部通过 Trusted Access for Cyber 项目分发。
![]()
Trusted Access for Cyber 项目
该项目于 2026 年 2 月推出,配套 1000 万美元网络安全资助计划。本次更新增加了分级验证体系,最高等级可解锁 GPT-5.4-Cyber:
- 个人用户:可在 chatgpt.com/cyber 验证身份
- 企业用户:通过 OpenAI 客户代表申请接入
- 已入册用户:可另行申请更高验证等级
生态进展与背景
- Codex Security:私测启动六个月后已累计为生态系统修复 3000+ 个关键和高危漏洞。
- CTF 基准提升:OpenAI 模型在夺旗(Capture-the-Flag)基准上的表现,从 2025 年 8 月 GPT-5 的 27% 提升至 2025 年 11 月 GPT-5.1-Codex-Max 的 76%。
- 行业对标:发布前一周,Anthropic 推出网络安全能力同样突出的模型 Mythos(仅向约 40 个组织限量开放);OpenAI 的覆盖范围更广,目标触达数千名防御者与数百个安全团队。
- 开源贡献:通过 Codex for Open Source 为开源项目提供免费安全扫描,目前已覆盖 1000+ 个项目。
值得关注的是,本次发布距离 Anthropic 推出网络安全模型 Mythos 仅一周。Mythos 最初仅向约 40 个组织限量开放,而 OpenAI 的 GPT-5.4-Cyber 覆盖规模更大,目标触达数千名防御者和数百个安全团队,两家公司在网络安全 AI 赛道的竞争态势已然明朗。OpenAI 同时披露,其夺旗(Capture-the-Flag)基准成绩已从 2025 年 8 月 GPT-5 的 27% 提升至 2025 年 11 月 GPT-5.1-Codex-Max 的 76%,为后续更强模型的发布埋下伏笔。
意义与趋势
这一发布反映了 AI 安全治理思路的重要转变:从一刀切的能力限制,转向基于身份验证的访问控制。OpenAI 表示,目标是”在防止滥用的前提下,让先进防御工具尽可能广泛可用”,通过自动化验证系统而非人工把关来实现。
![]()
同时,OpenAI 明确将此次发布定位为”今年晚些时候更强大模型”的铺垫,并承诺按照 Preparedness Framework,以”每个新模型都可能达到高等级网络安全能力”的标准进行安全评估。
OpenClaw—AI研究