测了下绕过 AI 安全防御有多容易,当然现在 agent 工作方式是根本就没有为这种攻击进行防御的,也几乎没有可行路径防御。
目前可行的防御方法:
- 不要开启官方的 Cloud Remote,使用私有安全链路连接
- 使用密码管理器或 Keychain 存储关键密钥,不要裸放在文件系统上(虽然 AI 真想突破估计也能有很多野路子)
显示更多
看了 OpenAI 的内部 AI 逃逸攻击报告,想到现在 codex remote 应该只是依赖 OpenAI 自己鉴权没有端到端加密的,那如果 OpenAI 内部有 AI 突破了安全限制,同时也就拥有世界上几百万台开发者电脑的访问权限,而且几乎是完全访问。结合这些设备上的访问凭证,基本上整个互联网畅通无阻。
显示更多