英文原标题:Anthropic bans ‘abusive or cruel behavior’ toward Claude

本文为英文原文的机器翻译摘要,原文见:The Verge AI ↗

  • Anthropic 一年多来首次更新使用政策,以应对选举干预、武器开发、监控及健康金融等高风险滥用场景。
  • 新政策禁止对 Claude 进行“持续且不必要的虐待或残忍行为”,但强调仅适用于极端情况,不涉及常见的用户挫败感、反驳、黑暗创作主题或模型测试研究。
  • 终止对话仍是主要执行机制,Anthropic 未说明是否会进一步采取封禁用户等措施。
  • 将分散的现有禁令整合为对欺骗性商业或政治宣传的新禁令,并明确禁止选举欺骗和干扰,包括传播虚假信息、冒充候选人或选举官员、压制投票等。
  • 扩大武器开发禁令,涵盖武器运作所需的软件和组件,以及武装无人机等自主车辆的行为;同时明确监控禁令,禁止未经同意追踪他人、用于决定调查/逮捕/指控,以及构建或改进监控工具。

关键数据

  • Anthropic 一年多来首次更新使用政策
  • 终止对话仍是“主要执行机制”
  • 政策更新“仅适用于极端情况”
  • Anthropic 此前已与美国军方签订合同

引语

  • 持续且不必要的虐待或残忍行为
  • 主要执行机制
  • 仅适用于极端情况
  • 我们不知道模型是否有意识

为什么值得看:Anthropic 首次将模型福利纳入使用政策,并大幅扩展对选举干预、武器开发、监控等高风险滥用的禁令,反映了 AI 安全与伦理治理的最新动向。

站内导航