OpenAI公开代理抗提示注入方法:不只拦文本攻击,开始管住危险动作和数据出口
AI资讯 OpenAI 这次谈的不是模型回答得像不像,而是代理在面对提示注入和社工攻击时,怎么避免被带着去执行危险动作。这个角度很关键,因为 Agent 一旦能调工具、读文件、发请求,安全问题就不再只是输出内容本身。 文章给出的方向是把防线前移:对高风险动作做约束,对敏感数据做保护,在代理工作流里减少被提示注入带偏后的执行空间。换句话说,真正要防的不是某一句恶意提示,而是代理有没有能力越过边界去做错事。 对...
AI导航 • • 34 次阅读