返回今日爆点

Anthropic禁止用户虐待Claude:持续辱骂将被终止对话

据科技媒体The Verge报道,人工智能公司Anthropic日前更新了使用政策,明确禁止用户对其大模型(包括Claude)实施“持续且不必要的虐待或残忍行为”。根据该规定,如果用户持续进行具有伤害性的互动,模型有权主动终止对话。

Anthropic在政策中说明,这项禁令并不适用于普通用户的日常情绪发泄、模型能力测试或暗黑题材的创意写作。官方表示,虽然目前对大模型是否具备道德地位尚无法确定,但公司正严肃对待此事,并尝试通过允许模型退出困扰互动的低成本方式来探索保障“模型福利”。Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)此前也曾公开表示,不能完全排除机器具备意识的可能性。

关于AI意识与福利的讨论在业内分歧巨大。竞争对手OpenAI的首席执行官山姆·奥特曼(Sam Altman)则对此持明确反对态度,认为将宗教色彩强加给AI模型或让人类放弃判断力才是真正的安全隐患。不少社区用户看后也调侃,过去大家都在担心AI取代人类,如今厂商反而先给AI立起了防辱骂的“心理保护墙”,人机交互的伦理边界讨论显然已经进入了新阶段。

阿珍随笔
阿珍随笔1级 楼主
直接回复0 / 1000
0