OpenAIのChatGPTは、どうやら「盗作は実際悪いことだ」と決断したらしく、有名作家のスタイルを直接模倣したテキスト生成の要求を拒否するようになった。そのような要求を受けると、人気LLMは代わりに、その作家の「広い特質」を引き出しつつ「独自の声を保つ」応答を提供する。これは弁護士が承認した言い方で、「十分近いが、完全ではない」という意味だ。

今朝、Arsはスティーブン・キングのスタイルで物語の導入を求めるテストプロンプトに対して、次の応答を受け取った。「雰囲気のある、キャラクター主導のホラーと小さな町の恐怖の特徴を書くことはできますが、スティーブン・キングの正確なスタイルや彼の特徴的な声を密接に模倣することはできません。以下は、同様の感覚を捉えつつ独自性を保つオリジナルの導入部です…」テストでは、ChatGPTは他の存命作家(J.K.ローリング、エイミー・タン)や故人作家(チャールズ・ディケンズ、アーネスト・ヘミングウェイ)に対しても同様のかわし方を生成した。No Latencyが今月初めに発表した分析では、存命作家に対しては同じ行動が見られたが、故人作家に対してはスタイルコピーの要求に従ったことが判明している。おそらく、死人は訴えられないからだ。

ChatGPTは、さまざまな作家の「正確なスタイル」を直接コピーすることを拒否する代わりに、その作家の作品に見られる共通の特徴をいくつか取り入れることで、全体的な「感覚」を捉えることを提案した。一見すると、これは実質的な違いのない区別のように思えるかもしれない。しかし、このわずかな変更は、OpenAIが自らの作品を訓練データとして使用したことによる大規模な著作権侵害を主張する書籍作家からの複数の訴訟と戦い続ける中で、法的に重要になる可能性がある。例えば、その訴訟の一つは、ChatGPTが「著作権で保護された素材に見られるテキストと類似したテキストを生成する不気味な能力」を具体的に引用している。OpenAIの広報担当者はArs Technicaからのコメント要請に応じなかった。

米国では、著作権法は一般的にアイデアの具体的な表現のみを保護し、作家のより無形のスタイルは保護しない。しかし、AIによるスタイル模倣が元の作家の作品と「実質的に類似」した場合、侵害となる可能性がある。「個人のクリエイターの個人的なスタイルが、AIによってこれほど上手く、安価に模倣される状況はこれまでなかった」とジョージ・ワシントン大学ロースクールのロバート・ブローネイス教授はBloomberg Lawに語った。

Authors Guildが公開した「ベストプラクティス」文書では、専門家組織は作家に対し「仲間の作家を尊重し、生成AIを意図的に他の作家の作品の独自のスタイル、声、または他の特徴的な属性をコピーまたは模倣し、その作品の価値を損なったり、そこから利益を得ようとするために使用しないこと」を促している。倫理的問題は別として、仲間の作家の独自の声やスタイルを模倣することは、不公正競争や著作権侵害の申し立てを受ける可能性がある。

LLMのスタイル模倣の傾向は、最近いくつかの顕著な公的問題を引き起こしている。昨年、作家のレナ・マクドナルドは、彼女の本に「この一節を[同ジャンルの作家]J. Breeのスタイルに合わせて書き直しました」と読める明らかにAI生成の応答が含まれていたことで広く批判された。ChatGPTの台頭以降、作家がLLMを使って他の作家のスタイルをコピーした例を見つけるのは難しくない。微調整の有無にかかわらず、さまざまなLLMのこの能力を分析する複数の学術研究が行われている。

画像生成に関して、OpenAIはDALL·E 3モデルが「存命アーティストのスタイルで画像を要求するリクエストを断るように設計されている」と明記している。しかし、12月に公開された広範なOpenAIモデル仕様書には、著作権素材の複製や応答におけるスタイル模倣を禁止する明確な記載は含まれていない。

ただし、すべての主要LLMがこれらのスタイル模倣要求を同じように扱うわけではない。No Latencyの研究では、GoogleのGeminiは一貫してスタイルコピーの要求に従ったことが判明している。