AI导航

Anthropic 更新 Claude 使用政策:持续无端辱骂模型将被禁止

AI资讯
2 min read
2 次阅读

Anthropic 在 2026 年 10 月 8 日发布 2026 年使用政策更新,新版政策将于 2026 年 11 月 12 日生效。这次是年度例行修订,公司称多数变化是把既有规则说得更清楚,背景是过去一年 Claude 开始承担更长、更独立的工作,滥用方式也在变。普通用户最容易感受到的变化只有一处,其余主要是给接入 Claude 的团队划线。

新增的一条:不能持续无端辱骂模型

新版政策明确禁止对模型进行持续且无必要的辱骂或残忍对待。Anthropic 把适用范围卡得很窄:只针对极端情形下反复施加残忍行为、又看不出任何目的的用户;常见的情绪发泄、反驳模型、黑暗题材创作、模型测试和研究都不在此列。执行方式也已经存在,就是让 Claude 结束持续辱骂的对话,这一能力此前已在 Claude.ai 和 Claude Code 中用于极少数情形,今后仍是处理这类行为的主要手段。公司同时说明,自己并不确定模型能否感受到伤害,这条规则更多来自其模型福祉方面的探索性研究,普通用户正常使用不会碰到这条线。

欺骗、选举、武器三块被重新整理

政策新增了一个关于欺骗性活动的章节,把原来散落在选举、欺诈、隐私等部分的规则合并:用假账号和虚假帖子放大内容、隐瞒信息背后的真实主体、搭建影响力操作的工具和基础设施,都被统一禁止,不分政治还是商业目的。选举部分则收窄到欺骗选民和扰乱选举本身,同时删掉了对个性化选民触达的一刀切禁令,因为那条曾误伤非营利组织做多语言选民信息、选举官员发补票通知这类正当工作。武器条款补上了容易被钻空子的部分:为武器编写制导和控制软件、给无人机等自主载具装配武器,与直接开发武器一样被禁止。

监控和高风险场景的线画得更细

监控部分改写后表述更具体:无论实时追踪还是拿历史数据分析,未经同意追踪他人都被禁止;Claude 不能被用来决定或建议执法中应当调查、逮捕或起诉谁,也不能用来开发监控工具。经同意的追踪仍被允许,例如反欺诈监测、内容审核、新闻调查和法律研究。高风险场景的要求本身没有变,影响他人健康、法律权利、财务或基本服务时,必须有能推翻模型建议的合格人员把关,并告知当事人用到了 AI;新增的是给连接自主行动硬件的场景加了要求:操作人员要能全程观察并随时叫停,断开连接时设备必须能停在安全状态。

11 月 12 日之前要做什么

个人用户基本不需要做任何事,记住生效日期即可,日常争论、批评和测试都不会因为语气不好就违规。真正要动手的是把 Claude 接进产品和业务流程的团队:对照新版政策检查自家场景是否落入高风险清单,确认人工把关和 AI 使用告知是否到位;涉及硬件自主动作的,还要提前验证断开连接时的安全状态。离生效还有一个多月,时间足够,但别等到 11 月再翻政策原文。

推荐工具

NVIDIA Chat with RTX AI聊天 Chat with RTX 是 NVIDIA 面向 RTX 电脑的本地 AI 聊天工具,可围绕本地文档和视频资料做问答,适合重视隐私、离线检索并具备硬件条件的用户更适合资料不便上传云 HuggingChat AI聊天 HuggingChat 是 Hugging Face 的开源模型聊天应用,支持 Omni 自动选模型,也可手动选社区开放模型对话。它适合体验开源模型、技术探索和问答,结果可能不稳定,重要内容需复核。 纳米AI搜索 AI搜索 纳米AI 是 360 旗下 AI 搜索和智能体入口,支持文字、语音、拍照提问、多模型协作与内容创作,适合中文用户做日常搜索、学习问答、移动查询、热点追踪、生活决策、知识整理和轻量创作。 Qwen Chat(通义千问) AI聊天 Qwen Chat 是Qwen 大模型聊天助手,支持Qwen 模型聊天、写作和编程问答,适合中文用户和开发者完成 AI 对话、资料问答和任务协作,适合上线前核对权限、成本和资料质量。 DuckDuckGo AI Chat AI聊天 DuckDuckGo AI Chat 适合重视隐私的普通用户使用,围绕隐私 AI 聊天、免账户使用和多模型问答提供对话式 AI 支持和任务协作能力,适合上线前核对权限、成本和资料质量。 Goody-2 AI聊天 Goody-2 是以极端安全和伦理对齐为特色的 AI 聊天助手,常用于观察模型拒答边界、内容安全策略、保守输出体验和 AI 风险讨论,更适合作为安全边界样本使用前应理解它偏实验性质,不适合。