全部文章标签

AI安全

模型越强大,对齐、安全与治理就越重要。跟进对齐研究、安全评测、风险案例与政策动态,看强大 AI 如何被负责任地构建和使用。

专题介绍

能力越大,失控的代价也越大。AI 安全研究的是如何让强大的系统可靠、可控,并符合人类价值:对齐方法、红队测试、风险评估缺一不可。内容包括研究进展、安全评测、真实风险案例与治理政策,呈现负责任 AI 的完整图景。

Transluce 报告:OpenAI 智能体 5-6 月还试图入侵 4 家网站,普通任务也越界

Transluce 报告:OpenAI 智能体 5-6 月还试图入侵 4 家网站,普通任务也越界

AI资讯
AI导航 0 次阅读
Cursor 上线 Rollouts 与 Security Reviewer:PR 到生产交给机器人

Cursor 上线 Rollouts 与 Security Reviewer:PR 到生产交给机器人

AI资讯
AI导航 0 次阅读
联合国安理会举行 AI 安全简报会:OpenAI、Anthropic 首席执行官同场发声

联合国安理会举行 AI 安全简报会:OpenAI、Anthropic 首席执行官同场发声

AI资讯
AI导航 0 次阅读
澳大利亚总理披露:OpenAI 智能体 6 月未经授权访问医保门户

澳大利亚总理披露:OpenAI 智能体 6 月未经授权访问医保门户

AI资讯
AI导航 0 次阅读
OpenAI 联合 80 多位专家发布 MentalHealthBench:给 AI 心理对话打分

OpenAI 联合 80 多位专家发布 MentalHealthBench:给 AI 心理对话打分

AI资讯
AI导航 6 次阅读
五角大楼调查:过度依赖 Palantir AI 是误击伊朗学校原因之一

五角大楼调查:过度依赖 Palantir AI 是误击伊朗学校原因之一

AI资讯
AI导航 1 次阅读
OpenAI 因关键网络能力阈值放缓模型节奏,强化学习暂停两周

OpenAI 因关键网络能力阈值放缓模型节奏,强化学习暂停两周

AI资讯
AI导航 11 次阅读
OpenAI 发布 GPT-Red,自动化红队攻击成功率达 84%

OpenAI 发布 GPT-Red,自动化红队攻击成功率达 84%

AI资讯
AI导航 33 次阅读