Teknik

ChatGPT får osynlig vattenstämpel i EU, verktyget OpenAI höll inne 2024

Adrian Kessler
Lägg till oss på Google

OpenAI har länge offentligt förklarat varför företaget inte tänkte vattenmärka ChatGPT:s texter. Nu gör det ändå just det. Det är inte tekniken som har fått företaget att ändra sig. Det är en lag med en tidsfrist och en tillhörande sanktionsavgift.

Företaget uppger att texter som ChatGPT och Codex skapar åt användare i EU kommer att förses med en osynlig statistisk signatur. Införandet sker stegvis under de kommande veckorna och omfattar alla abonnemang. På andra håll finns samma märkning bara som ett reglage i utvecklar-API:t, där den är avstängd från början. Gränsen OpenAI har dragit går längs gränsen för den jurisdiktion som kan utdöma böter.

Så fungerar ChatGPT:s vattenstämpel

Metoden, som kallas textGrain, lämnar inga synliga spår i texten. När flera möjliga nästa ord passar ungefär lika bra i en mening styr en hemlig nyckel valet mot ett av dem. En sådan liten knuff betyder ingenting i sig. Men hundratals knuffar i en text bildar ett mönster som en detektor med tillgång till nyckeln kan söka efter. Eftersom signalen finns i själva orden överlever den kopiering och inklistring. OpenAI har skrivit den tekniska rapporten tillsammans med forskare från University of Pennsylvania och Yale. Enligt rapporten påverkas kvaliteten inte nämnvärt: på Artificial Analysis Intelligence Index fick vattenmärkta texter 49,76 poäng, jämfört med 49,57 utan märkning.

Verktyget OpenAI redan hade

Inget av det här är nytt för OpenAI. Sommaren 2024 rapporterade Wall Street Journal att företaget hade en fungerande vattenstämpel för text, som i interna dokument bedömdes vara 99,9 procent effektiv, men att man höll tillbaka den. OpenAI svarade att företaget intog ”ett medvetet förhållningssätt”. De angivna skälen var både tekniska och sociala: metoden var ”enkel att kringgå för illasinnade aktörer” genom översättning eller omformulering med en annan modell, och den kunde stigmatisera AI som skrivhjälp för personer som inte har engelska som modersmål. TechCrunch, som rapporterar om veckans besked, påminner om ett tredje skäl från den perioden: oron för att användare skulle gå över till konkurrenter som inte vattenmärkte sina texter.

Sett mot den bakgrunden visar den nya lanseringen vilka av de farhågorna OpenAI faktiskt har hanterat. Problemet med att kringgå märkningen finns fortfarande kvar, enligt företagets egna siffror. Den kommersiella risken har i stället stängslats in på en enda marknad.

OpenAI:s siffror, inte kritikernas

Under gynnsamma förhållanden, med en andel falska positiva på 1 procent, hittar detektorn ungefär 80 procent av de vattenmärkta textstycken som omfattar 200 token och omkring 95 procent av dem på 400 token. Om 10 procent av orden byts ut mot synonymer sjunker träffsäkerheten från 92 till 66 procent. Byts en fjärdedel ut faller den till 17 procent. Korta svar, matematik och översatt text är svåra att upptäcka över huvud taget. OpenAI varnar självt för att goda resultat under idealiska förhållanden ”inte garanterar tillförlitlig detektion i vardaglig användning” och att avsaknad av en vattenstämpel inte bevisar att en människa har skrivit texten. Företaget säger också att märkningen inte identifierar användaren.

Det gör textGrain till en användbar signal mot den som slentrianmässigt kopierar och klistrar in text, men en svag sådan mot den som är beredd att lägga en minut på att redigera. I en union där människor läser och skriver på många språk är översättningsluckan ingen bisak.

Varför EU – och varför nu?

Den rättsliga drivkraften är artikel 50 i AI-förordningen, vars transparensregler började gälla den 2 augusti. Den kräver att leverantörer av generativa system märker syntetisk text, ljud, bilder och video på ett maskinläsbart sätt och tillhandahåller en metod för att upptäcka dem. System som redan fanns på marknaden före det datumet, däribland ChatGPT, har till den 2 december på sig att följa reglerna. Överträdelser kan enligt en analys från advokatbyrån Cooley leda till böter på upp till 15 miljoner euro eller 3 procent av den globala årsomsättningen, beroende på vilket belopp som är högst.

Två detaljer visar hur nära lanseringen följer regelkravet snarare än någon princip. Den första gäller detektorn. Lagen kräver en metod för att upptäcka märkningen; OpenAI har byggt en sådan och gett tillgång till den enbart till godkända forskare och expertorganisationer, som måste ansöka. Företaget säger att det ska bredda tillgången ”när vi anser att resultaten kan tolkas på ett ansvarsfullt sätt”, rapporterar The Decoder, men har inte angett någon tidsplan. En lärare eller redaktör i Lissabon eller Warszawa som har en misstänkt text kan inte kontrollera den i dag.

Den andra detaljen är kartan. Anthropic, som började vattenmärka Claudes texter i augusti, använder märkningen globalt oavsett hur människor får tillgång till modellerna och fick kritik från vissa användare för det. OpenAI valde motsatsen: på som standard där en tillsynsmyndighet kan utfärda böter, valbart för utvecklare på andra håll och inget globalt standardläge vid lanseringen. Om den gamla oron för att användare skulle gå över till konkurrenter utan märkning hade försvunnit, vore det svårt att se varför företaget skulle dra gränsen så här.

Vad händer härnäst?

OpenAI säger att textGrain ska släppas som öppen källkod och att metoden matchar eller överträffar lösningar som Googles SynthID. Båda påståendena går att pröva när koden blir offentlig. Frågan för Bryssel är snävare: om en märkning som försvagas av lättare redigering, och som läses av en detektor nästan ingen kan använda, uppfyller en regel som utformats för att andra system ska kunna känna igen AI-text.

Efter den 2 december är det bara ChatGPT-användarna vars tillsynsmyndighet kan skicka räkningen som får texter med OpenAI:s signatur som standard.

Taggar: , , , ,

Lägg till oss på Google

Diskussion

Det finns 0 kommentarer.