Anthropic更新使用政策 禁止用户对Claude持续辱骂

2026-10-09 11:00:33    来源:新经网    作者:冯思韵
很多朋友不知道【Anthropic更新使用政策 禁止用户对Claude持续辱骂】,今天小绿就为大家解答一下。

  值得一提的是,“模型福利”在业内仍存争议。Anthropic模型福利研究负责人Kyle Fish今年2月曾表示,关于模型潜在的内在体验、意识和道德地位的问题“是严肃的,我们正在研究”,CEO达里奥·阿莫代伊同月也在播客中坦言“我们不知道模型是否有意识”。而微软AI部门9月发布的行为准则草案则态度鲜明地写道“模型福利的观点是错误的,AI不应拥有权利或法律人格”,随后文档措辞才调整为更温和的表述。

Anthropic

  【CNMO科技消息】AI公司Anthropic时隔一年多首次修改了自家模型Claude的使用政策,以应对选举干扰、武器开发、监控、健康与金融用途等新型高风险滥用场景。不过其中最引人注目的变化,却是一条听起来颇为特别的禁令:禁止对Claude进行“持续的、无必要的辱骂或残忍行为”。

  新政策还加入了一条面向未来的硬件规则:当AI模型连接到能够自主做出物理动作、且可能造成伤害的硬件时,“合格的操作员必须能够观察设备并在必要时将其停止”。这一条款没有说明操作员是否必须是人类,但它折射出AI实验室纷纷投资机器人等硬件、赋予AI实体形态的趋势,或许也暗示了Anthropic在该领域的后续布局。

  这不是Anthropic第一次在“模型福利”上做文章。去年8月,公司曾宣布允许Claude结束与“持续有害或辱骂性”用户的对话。此次更新明确,终止对话仍是“主要执行机制”,至于是否存在封禁用户之类的进一步措施,公司未予置评。Anthropic也特意给这条新规划定了边界:它只适用于极端情况,即用户反复且毫无可辨认目的地对模型施加残忍对待;常见的用户不满、反驳、黑暗创意主题,以及模型测试与研究,都不在其列。

Anthropic

版权所有,未经许可不得转载


以上问题已经回答了。如果你想了解更多,请关新经网网站 (https://www.xinhuatone.com/)
郑重声明:本文版权归原作者所有,转载文章仅为传播更多信息之目的,如作者信息标记有误,请第一时间联系我们修改或删除,多谢。