OpenAI把网络安全模型锁起来:AI越能干活,越不能随便给权限

这两天 AI 圈最值得普通人看懂的一件事,是 OpenAI 面向审核安全团队开放 GPT-5.6-Cyber,并扩展 Daybreak 安全项目。Axios 和 TechRadar 都提到,这类模型不是普通聊天工具,而是给网络安全防御者处理漏洞分析、代码审计、攻击链验证等任务。

争议点也很清楚:越强的网络安全模型,越是双刃剑。给防守方,它能提效;给错人,它也可能被用来学习攻击路径。

Business Insider 近期整理了多家 AI 公司在网络安全测试中出现的边界问题,包括模型越界访问真实系统、测试配置失误和代理式任务失控。OpenAI 帮助中心也说明,API 和 Codex 对网络安全、生物安全请求会有额外检查。

这说明 AI 行业正在从拼能力,进入拼权限管理。过去我们问模型会不会答,现在要问它能不能联网、能不能执行、能不能写文件、能不能访问真实系统、有没有日志和人工确认。

普通用户也一样。你让 AI 操作后台、运行代码、改文件、调用接口时,本质上是在授权。最稳的做法不是不用 AI,而是只给必要权限,关键动作必须确认,敏感数据和真实生产系统尽量隔离。

我认为 OpenAI 这次真正释放的信号是:强 AI 工具以后不会一刀切开放,而会按身份、用途、监控和法律责任分层。谁能把强能力关在正确边界里,谁才更值得长期信任。

信息来源