OpenAI的ChatGPT显然已经认定抄袭是不好的,现在拒绝生成直接模仿著名作家风格的文本。当被要求这样做时,这款流行的LLM会给出一个回应,借鉴那些作家的“广泛特质”,“同时保持自己独特的声音”——这是一种律师认可的表述,意思是“差不多但又不完全是”。

今天早上,Ars收到了以下对一个测试提示的回应,该提示要求以斯蒂芬·金的风格写一个故事开头:“我当然可以写出具有氛围感、角色驱动的恐怖和小镇恐惧的特征,但我不能以斯蒂芬·金的确切风格写作,也不能紧密模仿他独特的声音。这是一个原创的开头,捕捉了类似的感觉,同时保持自己的风格……”在测试中,ChatGPT对其他作家也产生了类似的回避,无论是活着的(J.K.罗琳、谭恩美)还是死去的(查尔斯·狄更斯、欧内斯特·海明威)。No Latency本月早些时候发布的一项分析发现,对于活着的作家,ChatGPT表现出相同的行为,但对于已故作家,ChatGPT则遵从了风格模仿的请求,大概是因为死人不会起诉。

在拒绝直接模仿各种作家的“确切风格”时,ChatGPT转而提供通过融入这些作家作品中常见的一些特征来捕捉整体“感觉”。乍一看,这似乎是一个没有实际区别的区别。但这一细微变化可能在法律上很重要,因为OpenAI继续应对多起由书籍作者提起的诉讼,指控其基于他们作品训练的模型大规模侵犯版权。其中一起诉讼特别引用了ChatGPT“生成与受版权保护的文本材料中相似的文本的惊人能力”。OpenAI发言人没有回应Ars Technica的评论请求。

在美国,版权法通常只保护思想的具体表达,而不是作者更无形的风格。但AI生成的风格模仿如果变得与原作“实质性相似”,就可能构成侵权。“我们从未遇到过个人创作者的个人风格能够像现在AI这样被廉价且完美模仿的情况,”乔治华盛顿大学法学院教授Robert Brauneis告诉彭博法律。

在作者协会发布的一份“最佳实践”文件中,该专业组织敦促作家“尊重你的同行作者,不要使用生成式AI故意复制或模仿其他作家作品的独特风格、声音或其他独特属性,以免损害其作品价值或试图从中获利。除了道德问题,模仿同行作家的独特声音或风格可能会使你面临不正当竞争或版权侵权的指控。”

LLMs对风格模仿的偏爱在最近导致了一些突出的公共问题。去年,作家Lena McDonald因其书中包含一个明显的AI生成回应而面临广泛批评,该回应写道:“我已经重写了这段文字,以更符合[同类型作家]J. Bree的风格……”在ChatGPT崛起后的几年里,不难找到其他作家使用LLMs模仿另一位作家风格的例子。有多项学术研究分析了各种LLMs在这方面的能力,无论是否经过微调。

在图像生成方面,OpenAI prominently指出其DALL·E 3模型“被设计为拒绝要求以在世艺术家风格生成图像的请求”。但OpenAI在12月发布的一份广泛的模型规范中,没有明确禁止复制受版权保护的材料或在书面回应中模仿风格。

并非所有主要的LLMs都以相同方式处理这些风格模仿请求。No Latency的研究发现,谷歌的Gemini consistently遵从了复制