Anthropic 已于 10 月 9 日更新 Claude 的使用政策,新规将在 11 月 12 日正式生效,消息一经曝光就在社交网络引发广泛讨论。
本次更新的一大焦点是新增条款——首次明确将针对 AI 模型 的持续恶意辱骂和虐待行为列为违规。
不过政策也划出了豁免范围:普通用户发泄情绪、提出反驳、进行暗黑题材创作,以及开展 AI 安全测试研究,都不属于违规情形。
在执行层面,Claude 可以主动终止对话;对顽固违规用户,Anthropic 可采取警告、限流、封禁账号等处置手段。
与此同时,新版政策明确禁止利用模型开展武器开发、监视监控、影响力作战等高危滥用行为。
其中一项特例条款充满争议:Anthropic 可以与部分政府客户签订定制合同来调整使用限制,但前提是企业自行评估安全防护能力足以化解潜在风险。
|