OpenAI:s ChatGPT har tydligen bestämt sig för att plagiat är dåligt, faktiskt, och vägrar nu att generera text som direkt efterliknar kända författares stil. När den ombeds göra det erbjuder den populära LLM-modellen istället ett svar som bygger på de "breda kvaliteterna" hos dessa författare "samtidigt som den förblir distinkt med sin egen röst", vilket är ett juristgodkänt sätt att säga "nära nog men inte riktigt".

I morse fick Ars följande svar på en testprompt som bad om en berättelseintroduktion i Stephen Kings stil: "Jag kan definitivt skriva med kännetecken som atmosfärisk, karaktärsdriven skräck och småstadsskräck, men jag kan inte skriva i Stephen Kings exakta stil eller nära imitera hans distinkta röst. Här är en originell inledning som fångar en liknande känsla samtidigt som den förblir sin egen..." I testet genererade ChatGPT liknande undanflykter för andra författare, både levande (J.K. Rowling, Amy Tan) och döda (Charles Dickens, Ernest Hemingway). En analys publicerad av No Latency tidigare denna månad fann samma beteende för levande författare men fann att ChatGPT följde stilkopieringsförfrågningar för avlidna författare, förmodligen för att döda människor inte kan stämma.

Genom att vägra direkt kopiera den "exakta stilen" hos olika författare erbjöd ChatGPT istället att fånga en övergripande "känsla" genom att införliva några av de vanliga dragen i dessa författares verk. Det kan vid första anblicken verka som en distinktion utan verklig skillnad. Men den lilla förändringen kan vara juridiskt viktig eftersom OpenAI fortsätter att kämpa mot ett antal stämningar från bokförfattare som påstår omfattande upphovsrättsintrång av modeller tränade på deras verk. En av dessa stämningar nämner specifikt ChatGPT:s "otroliga förmåga att generera text som liknar den som finns i upphovsrättsskyddat textmaterial", till exempel. En talesperson för OpenAI svarade inte på en begäran om kommentar från Ars Technica.

I USA skyddar upphovsrätten i allmänhet endast ett specifikt uttryck av en idé, inte den mer immateriella stilen hos en författare. Men en AI-genererad stilimitation kan bli intrång om den blir "väsentligt lik" originalförfattarens verk. "Vi har aldrig haft en situation där denna personliga stil hos enskilda skapare kunde imiteras lika bra och billigt som vi nu har med AI," sade Robert Brauneis, professor vid George Washington University Law School, till Bloomberg Law.

I ett "best practices"-dokument publicerat av Authors Guild, den professionella organisationen, uppmanas författare att "respektera dina medförfattare och använd inte generativ AI för att avsiktligt kopiera eller imitera unika stilar, röster eller andra distinkta attribut hos andra författares verk på sätt som skadar värdet av deras verk eller försöker tjäna på dem. Bortsett från de etiska frågorna kan imitation av en medförfattares unika röst eller stil utsätta dig för anspråk på illojal konkurrens eller upphovsrättsintrång."

LLM-modellers förkärlek för stilimitation har lett till några framträdande offentliga problem den senaste tiden. Förra året möttes författaren Lena McDonald av utbredd kritik när hennes bok innehöll ett uppenbart AI-genererat svar som löd: "Jag har skrivit om passagen för att bättre överensstämma med [genreförfattaren] J. Brees stil..." Det är inte svårt att hitta andra exempel på författare som använder LLM:er för att kopiera en annan författares stil sedan ChatGPT:s framväxt. Det har gjorts flera akademiska studier som analyserar olika LLM-modellers förmåga på denna punkt, både med och utan finjustering.

När det gäller bildgenerering noterar OpenAI framträdande att dess DALL·E 3-modell "är utformad för att avböja förfrågningar som ber om en bild i stil med en levande konstnär." Men en omfattande OpenAI-modellspecifikation publicerad i december innehåller inga tydligt angivna förbud mot att reproducera upphovsrättsskyddat material eller imitera stil i skriftliga svar.

Alla stora LLM:er behandlar dock inte dessa stilimitationsförfrågningar på samma sätt. No Latencys studie fann att Googles Gemini konsekvent följde förfrågningar om att kopiera en