GPT-5.6把AI安全推到新阶段:会修漏洞的模型,也可能最需要被看住

今天科技圈继续看一个关键趋势:强 AI 正在从会回答问题,变成会参与真实系统修复。OpenAI GPT-5.6 页面提到,它在网络安全能力上明显增强,能支持安全代码审查、补丁开发、威胁建模和蓝队防御。

这当然是好消息。软件漏洞太多,安全团队人手有限,如果 AI 能帮忙找可达漏洞、验证补丁、整理证据,很多问题能更快从发现走到修复。

但问题也更尖锐。OpenAI 的 GPT-5.6 System Card 把模型网络安全能力列为 High,同时强调没有达到 Critical 风险阈值。换句话说,模型已经足够强,需要非常认真地管理,但还没有被判定为能够稳定自主执行最高风险攻击。

Daybreak 和网络安全受信访问,就是为了解决这个矛盾:让合格防御者获得更强能力,同时通过身份审核、范围控制、日志、监控和人工研判限制风险。Axios 近期也报道了 OpenAI 面向获批防御者开放更少限制的网络安全模型。

普通用户也该吸取这套思路。你让 AI 操作后台、跑脚本、改代码、访问数据库时,别只问它聪不聪明,先问它权限有多大、是否能回滚、有没有操作记录、关键步骤是否需要确认。

AI 越像专业人员,越不能像玩具一样随便放权。下一阶段真正有价值的模型,不只是更会干活,而是能在正确边界内稳定干活。

信息来源