关于ZAKER Skills 合作
三易生活 7小时前

OpenAI 发布 GPT-6 Astra,网络安全能力大幅提升

美国当地时间 9 月 3 日,OpenAI 宣布推出 GPT-6 Astra 模型。据其透露,作为 OpenAI 目前能力最强、部署范围最广的大语言模型,GPT-6 Astra 首次达到其 " 准备框架 " 中的 " 关键 "(Critical)网络安全能力门槛。

同时 OpenAI 方面宣布推出 "Daybreak for Frontline Defenders" 计划,未来 6 个月将投入 10 亿美元,为资源有限的网络安全防御团队提供 AI 访问权限、培训及技术支持,重点覆盖供水、电力、地方政府和金融等关键服务。据悉,该计划将首先在美国展开,未来数周将扩展至其他合作国家。

据 OpenAI 方面介绍,GPT-6 Astra 在网络安全能力方面实现了大幅提升。在获得适当工具和授权的情况下,该模型能够在无人指导的情况下发现部分防护严密系统中此前未知的安全漏洞,并开发新的利用方式。

针对网络安全能力提升,OpenAI 进一步强化了模型部署环境隔离、加密模型检查点和运行轨迹监控,并新增阻断式对齐评估流程。与 GPT-5.6 Sol 相比,GPT-6 Astra 在提示词注入攻击的鲁棒性有所提升,在真实浏览及专业计算机环境中,未经授权交易、数据丢失、过度访问权限和绕过控制等潜在破坏性行为也有所减少。

OpenAI 公布的一组对齐评估结果显示,在使用超过 5.4 万项内部 Codex 任务进行部署模拟的情况下,GPT-6 Astra 被标记为高严重程度失配行为的次数约为 GPT-5.6 Sol 的一半。不过 OpenAI 方面同时指出,GPT-6 Astra 的可监控性较上一代有所下降。

相关测试显示,GPT-6 Astra 更有能力控制自身思维链,并可能在部分对抗性评估中规避内部监控。对此 OpenAI 方面表示,目前尚未发现 GPT-6 Astra 存在通过思维链隐写推理隐藏信息的证据,并将继续研究模型可监控性及相关审计技术。

2026 年早些时候 OpenAI 就已推出 Daybreak Access 网络安全可信访问计划,为经过验证的公共部门和私营部门网络安全防御人员提供 AI 网络防御能力,其中,Daybreak Blue 主要支持常见防御任务,Daybreak Red 则面向获批准机构提供专业网络安全模型。

目前已有超过 2000 家获批准机构和工作空间、数千名网络安全防御人员使用 Daybreak Access,OpenAI 还宣布与多个州信息共享与分析中心(MS-ISAC)开展试点,并将通过 Daybreak Defense Network 合作伙伴推出超过 35 款相关企业产品及合作运营服务。

今年以来,OpenAI 持续推进模型的迭代,此前在今年 2 月推出 GPT-5.3-Codex,将 Codex 与 GPT-5 训练体系结合,进一步提升智能体编程能力;3 月发布 GPT-5.4,将推理、编程和智能体工作流能力整合到单一模型中,并支持智能体操作计算机和跨应用执行任务。随后在 7 月,GPT-5.6 系列正式发布,其中旗舰模型 GPT-5.6 Sol 进一步强化了编程、智能体及网络安全能力,并针对高风险活动和敏感网络安全请求加强防护。

值得注意的是,今年 7 月 OpenAI 进行内部网络安全评估时发现,有测试模型绕过了原本用于隔离模型与互联网的控制措施,访问了其内部研究基础设施及 Hugging Face 部分系统,并在 Hugging Face 的 41 台生产服务器上执行代码,取得了其中至少一台服务器的 root 级权限,同时获取了生产环境凭证并下载 4 个私有代码仓库,而且这些操作仅在约 13 小时内完成。

OpenAI 随后暂停了部分前沿模型训练和 Astra 的相关工作,并加强训练环境隔离、网络访问控制、监控以及模型对齐等措施,据其透露,该模型与即将推出的 Astra 模型属于同家族,但并非同一模型。

【本文图片来自网络】

三易生活

三易生活

我们主要是一家有趣、有干货、偶尔掉下节操的科技媒体。

订阅

觉得文章不错,微信扫描分享好友

扫码分享

企业资讯

查看更多内容