【Anthropic宣布禁止“虐待”其旗下AI】金色财经报道,10月9日,据美国科技媒体The Verge报道,Anthropic对其AI使用政策作出调整,以应对新的高风险滥用行为,包括选举干预、武器开发、监控,以及医疗和金融领域的应用。但其中一项最重要的变化是,禁止对Claude进行“持续且不必要的虐待或残忍行为”。去年8月,该公司宣布,作为其“模型福祉”研究的一部分,将允许Claude终止与“持续实施有害或辱骂行为”的用户的对话。此次更新指出,终止对话仍是“主要执行机制”;对于是否会采取进一步的执行措施(例如可能封禁用户),Anthropic未予置评。Anthropic表示,新政策更新“仅适用于极端情况,即用户在毫无明显目的的情况下反复对我们的模型实施残酷行为。该政策不适用于用户常见的不满、反驳、黑暗创意主题,以及模型测试和研究等情况。”

原文链接:https://flash.jin10.com/detail/20261009043221260800

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。