全部文章标签

AI安全

模型越强大,对齐、安全与治理就越重要。跟进对齐研究、安全评测、风险案例与政策动态,看强大 AI 如何被负责任地构建和使用。

专题介绍

能力越大,失控的代价也越大。AI 安全研究的是如何让强大的系统可靠、可控,并符合人类价值:对齐方法、红队测试、风险评估缺一不可。内容包括研究进展、安全评测、真实风险案例与治理政策,呈现负责任 AI 的完整图景。

OpenAI 联合 80 多位专家发布 MentalHealthBench:给 AI 心理对话打分

OpenAI 联合 80 多位专家发布 MentalHealthBench:给 AI 心理对话打分

AI资讯
AI导航 7 次阅读
五角大楼调查:过度依赖 Palantir AI 是误击伊朗学校原因之一

五角大楼调查:过度依赖 Palantir AI 是误击伊朗学校原因之一

AI资讯
AI导航 1 次阅读
OpenAI 因关键网络能力阈值放缓模型节奏,强化学习暂停两周

OpenAI 因关键网络能力阈值放缓模型节奏,强化学习暂停两周

AI资讯
AI导航 11 次阅读
OpenAI 发布 GPT-Red,自动化红队攻击成功率达 84%

OpenAI 发布 GPT-Red,自动化红队攻击成功率达 84%

AI资讯
AI导航 33 次阅读
Grok Build CLI 被曝上传完整代码库,数据边界引发争议

Grok Build CLI 被曝上传完整代码库,数据边界引发争议

AI资讯
AI导航 29 次阅读
Anthropic 暂停 Fable 5 和 Mythos 5,前沿模型监管进入实操阶段

Anthropic 暂停 Fable 5 和 Mythos 5,前沿模型监管进入实操阶段

AI资讯
AI导航 16 次阅读
纽约时报更正 AI 生成引文,新闻编辑流程再次拉响警报

纽约时报更正 AI 生成引文,新闻编辑流程再次拉响警报

AI资讯
AI导航 23 次阅读
OpenAI公开代理抗提示注入方法:不只拦文本攻击,开始管住危险动作和数据出口

OpenAI公开代理抗提示注入方法:不只拦文本攻击,开始管住危险动作和数据出口

AI资讯
AI导航 36 次阅读