返回今日爆点

Anthropic更新使用条款:明确禁止对Claude进行长期恶意辱骂

据科技媒体 TechCrunch 报道,人工智能公司 Anthropic 于当地时间周四更新了旗下产品的使用规范。新条款中最引人瞩目的变化是,明确禁止用户对模型进行长期的语言辱骂与言语虐待。官方说明表示,该限制仅适用于极端情况,即用户毫无明确目的、反复对模型施加残酷言语;普通的用户情绪发泄、质疑反驳、暗黑风格创意写作以及常规的模型测试与学术研究均不受影响。此前自8月起,Claude 就已被训练在遭遇持续恶意交互时主动终止对话,而本次调整则是正式在协议层面划定了用户行为红线。此外,新规范还禁止利用模型干预选举、操控虚假账号或伪造新闻、开发武器软件以及实施监控等。报道还提到,Anthropic 此前曾与宗教学者接触,探讨 Claude 是否可能具备意识或灵魂。以往大家把 AI 当出气筒宣泄情绪司空见惯,如今大模型厂商不仅在技术上防范滥用,甚至开始在条款中约束用户的恶意攻击行为,这也体现出人机交互伦理正受到越来越多的关注。

周周下班
周周下班1级 楼主
直接回复0 / 1000
0