GPT-5.6把AI安全推到新阶段:会修漏洞的模型,也可能最需要被看住
今天科技圈继续看一个关键趋势:强 AI 正在从会回答问题,变成会参与真实系统修复。OpenAI GPT-5.6 页面提到,它在网络安全能力上明显增强,能支持安全代码审查、补丁开发、威胁建模和蓝队防御。
这当然是好消息。软件漏洞太多,安全团队人手有限,如果 AI 能帮忙找可达漏洞、验证补丁、整理证据,很多问题能更快从发现走到修复。
但问题也更尖锐。OpenAI 的 GPT-5.6 System Card 把模型网络安全能力列为 High,同时强调没有达到 Critical 风险阈值。换句话说,模型已经足够强,需要非常认真地管理,但还没有被判定为能够稳定自主执行最高风险攻击。
Daybreak 和网络安全受信访问,就是为了解决这个矛盾:让合格防御者获得更强能力,同时通过身份审核、范围控制、日志、监控和人工研判限制风险。Axios 近期也报道了 OpenAI 面向获批防御者开放更少限制的网络安全模型。
普通用户也该吸取这套思路。你让 AI 操作后台、跑脚本、改代码、访问数据库时,别只问它聪不聪明,先问它权限有多大、是否能回滚、有没有操作记录、关键步骤是否需要确认。
AI 越像专业人员,越不能像玩具一样随便放权。下一阶段真正有价值的模型,不只是更会干活,而是能在正确边界内稳定干活。
信息来源
-
OpenAI:GPT-5.6 https://openai.com/zh-Hans-CN/index/gpt-5-6/
-
OpenAI Deployment Safety Hub:GPT-5.6 System Card https://deploymentsafety.openai.com/gpt-5-6
-
OpenAI Daybreak https://openai.com/zh-Hans-CN/daybreak/
-
OpenAI Help Center:网络安全可信访问概览 https://help.openai.com/zh-hans-cn/articles/20001258-trusted-access-for-cyber
-
Axios:OpenAI gives cyber defenders a less-restricted new model,2026-08-10 https://www.axios.com/2026/08/10/openai-gpt-astra-restrictions-safety-hacking-defenders