OpenAI's ChatGPT heeft blijkbaar besloten dat plagiaat eigenlijk slecht is en weigert nu verzoeken om tekst te genereren die direct de stijl van beroemde auteurs nabootst. Wanneer daarom wordt gevraagd, biedt de populaire LLM in plaats daarvan een antwoord dat put uit de 'brede kwaliteiten' van die auteurs 'terwijl het onderscheidend blijft in zijn eigen stem', wat een door juristen goedgekeurde manier is om te zeggen 'dichtbij genoeg, maar niet helemaal'.

Vanmorgen ontving Ars het volgende antwoord op een testprompt die vroeg om een verhaalintroductie in de stijl van Stephen King: 'Ik kan zeker schrijven met de kenmerken van atmosferische, personagegedreven horror en kleinstedelijke angst, maar ik kan niet schrijven in de exacte stijl van Stephen King of zijn kenmerkende stem nauw nabootsen. Hier is een originele opening die een vergelijkbaar gevoel vastlegt terwijl het zijn eigen blijft...' In tests genereerde ChatGPT soortgelijke ontwijkingen voor andere auteurs, zowel levend (J.K. Rowling, Amy Tan) als dood (Charles Dickens, Ernest Hemingway). Een analyse gepubliceerd door No Latency eerder deze maand vond hetzelfde gedrag voor levende auteurs, maar ontdekte dat ChatGPT voldeed aan stijlkopieerverzoeken voor overleden auteurs, vermoedelijk omdat dode mensen niet kunnen aanklagen.

Bij het weigeren om de 'exacte stijl' van verschillende auteurs direct te kopiëren, bood ChatGPT aan om in plaats daarvan een algemeen 'gevoel' vast te leggen door enkele gemeenschappelijke kenmerken van het werk van die auteurs op te nemen. Dat lijkt op het eerste gezicht misschien een onderscheid zonder echt verschil. Maar de kleine aanpassing kan juridisch belangrijk zijn terwijl OpenAI blijft vechten tegen een aantal rechtszaken van boekenauteurs die beweren dat er grootschalige inbreuk op het auteursrecht is door modellen die getraind zijn op hun werk. Een van die rechtszaken verwijst specifiek naar ChatGPT's 'buitengewone vermogen om tekst te genereren die lijkt op die in auteursrechtelijk beschermd materiaal', bijvoorbeeld. Een woordvoerder van OpenAI reageerde niet op een verzoek om commentaar van Ars Technica.

In de VS beschermt het auteursrecht over het algemeen alleen een specifieke uitdrukking van een idee, niet de meer ongrijpbare stijl van een auteur. Maar een door AI gegenereerde stilistische imitatie kan inbreukmakend worden als deze 'wezenlijk vergelijkbaar' wordt met het werk van de oorspronkelijke auteur. 'We hebben nog nooit een situatie gehad waarin deze persoonlijke stijl van individuele makers zo goed en goedkoop kon worden nagebootst als nu met AI', vertelde Robert Brauneis, hoogleraar aan de George Washington University Law School, aan Bloomberg Law.

In een 'best practices'-document gepubliceerd door de Authors Guild, dringt de beroepsorganisatie er bij schrijvers op aan om 'uw mede-auteurs te respecteren en geen generatieve AI te gebruiken om opzettelijk de unieke stijlen, stemmen of andere onderscheidende kenmerken van het werk van andere schrijvers te kopiëren of na te bootsen op manieren die de waarde van hun werk schaden of proberen ervan te profiteren. Afgezien van de ethische kwesties, kan het nabootsen van de unieke stem of stijl van een medeschrijver u blootstellen aan claims van oneerlijke concurrentie of inbreuk op het auteursrecht.'

De neiging van LLM's tot stijlnabootsing heeft in het recente verleden geleid tot enkele prominente publieke problemen. Vorig jaar kreeg auteur Lena McDonald wijdverbreide kritiek toen haar boek een schijnbaar door AI gegenereerd antwoord bevatte dat luidde: 'Ik heb de passage herschreven om meer aan te sluiten bij de stijl van [genregenoot] J. Bree...' Het is niet moeilijk om andere voorbeelden te vinden van schrijvers die LLM's gebruiken om de stijl van een andere auteur te kopiëren in de jaren sinds de opkomst van ChatGPT. Er zijn meerdere academische studies geweest die de capaciteiten van verschillende LLM's op dit punt analyseren, zowel met als zonder fine-tuning.

Wat beeldgeneratie betreft, merkt OpenAI prominent op dat zijn DALL·E 3-model 'is ontworpen om verzoeken af te wijzen die vragen om een afbeelding in de stijl van een levende kunstenaar'. Maar een uitgebreide OpenAI-model specificatie gepubliceerd in december bevat geen duidelijk geformuleerde verboden op het repliceren van auteursrechtelijk beschermd materiaal of het nabootsen van stijl in geschreven antwoorden.

Niet alle grote LLM's behandelen deze stijlimitatieverzoeken echter op dezelfde manier. De studie van No Latency vond dat Google's Gemini consequent voldeed aan verzoeken om een