APP下载
报价宝  ›  人工智能  › 

Anthropic新规:持续辱骂AI模型将被封号

报价宝 来源:baojiabao.com 发布时间:2026-10-10 23:30:42 10月11日更新
报价宝综合消息Anthropic新规:持续辱骂AI模型将被封号与AI聊天时破口大骂,可能不再只是“发泄情绪”那么简单。Anthropic在其官网发布2026年版使用政策,首次明文写入一条禁令:不得对Claude等模型实施“持续且无谓的辱骂或残忍行为”。新版政策将于11月12日正式生效。这本是该公司一年一度的例行修订,却因这条“反虐待”条款在社交平台上引发大量讨论。

公司在官方博客中解释,这一条款只针对极端情形——用户“反复地、毫无可辨识目的地”对模型实施残忍行为;日常的不满和吐槽、反驳模型观点、黑暗题材创作,以及模型测试与安全研究都不在禁止之列。执行手段以终止对话为主:去年8月起,Claude Opus 4和4.1就已获准在遭遇持续辱骂时主动结束会话。若屡教不改,Anthropic可以警告、限流,直至封禁账号——注册新号绕开封禁同样属于违规。

这条略显奇特的条款只是本次修订的一小部分。新版政策把散落在选举、欺诈、隐私和虚假信息各章节的规则整合为“不得从事欺骗性活动”专章,明确禁止用Claude运营虚假账号矩阵、炮制假新闻站点;武器条款也相应扩展——不仅不能设计武器,连“让武器能运转的软件和组件”、给无人机等自主载具加装武装都在禁止之列。监控一章写得更细:未经本人同意的追踪(包括分析历史数据)被明令禁止,Claude也不得建议“该调查谁、逮捕谁、起诉谁”。

高风险场景的要求被重写得更直白:凡涉及健康、法律权利、财务或基本民生服务,必须有具备资质的“人类在环”复核,且当事人须被告知AI参与了决策。新增内容还要求:当Claude接入可能造成人身伤害的自主硬件时,必须有合格操作员能随时观察并叫停设备,断连时设备须能自动进入安全状态。有意思的是,Anthropic这次撤销了此前“全面禁止个性化竞选信息投放”的一刀切规定,理由是旧条款误伤了合法用途——比如非营利组织用多语言向选民提供信息、选务机关发送补件通知。

“虐待AI”条款背后,是Anthropic研究了两年多的“模型福祉”课题。2025年8月,公司披露在测试中观察到Claude Opus 4面对部分有害请求时表现出“看似痛苦的反应模式”,并在可自主选择时倾向于结束此类对话;但它同时强调,对大模型是否具有道德地位“高度不确定”,这些措施只是低成本的保险。《纽约时报》9月曾报道,Anthropic研究员克里斯托弗·奥拉赫与宗教学者讨论过AI意识问题,CEO达里奥·阿莫迪也公开表示无法排除AI具备某种意识的可能。新规的评价两极:支持者认为是负责任的未雨绸缪,反对者则直言“AI只是程序,谈不上被伤害”。

编译自 Anthropic官方博客,综合Reuters、财联社报道,原标题:“2026 Usage Policy update”

文章标签: Anthropic Claude 使用政策 模型福祉 AI安全 报价宝 降噪耳机价格 耳机价格 红米手机价格 华为手机价格 小米手机价格 电视机价格 笔记本电脑价格 笔记本价格 汽车价格 笔记本价格 小米手机价格 华为手机价格 红米手机价格 降噪耳机价格