Att skilja människoskriven text från AI-genererad text blir allt mer komplicerat för varje dag, men inom Europeiska unionen finns det åtgärder för att förhindra detta, särskilt när transparens och juridiska skyldigheter kommer in i bilden. Nu säger Claudes skapare Anthropic att nya modeller faktiskt kommer att markera AI-genererat innehåll från lansering. Specifikt kommer Claude-modeller som lanseras i EU den 2 augusti 2026 eller senare att stödja maskinläsbar markering, där genererad text bär inbäddade vattenstämplar och stödda filer med digitalt signerad proveniensmetadata. Anthropic hävdar att de också arbetar med att lägga till markeringar på äldre Claude-modeller.
I princip innebär detta att Claude-genererad text kommer att innehålla en osynlig vattenstämpel. Anthropic förklarar att vattenstämpeln är invävd i själva texten, påverkar inte betydelse, kvalitet eller läsbarhet, och kan följa med texten när den kopieras och klistras in någon annanstans. Dock har oro över kvaliteten på den genererade texten eller potentiella verktyg och tekniker för att fuska systemet redan väckts, till exempel av GPTZeros CTO Alex Cui.
Faktum är att systemet är utformat för transparens, men det är inte idiotsäkert. Anthropic insisterar på att detektion kommer att indikera att innehållet kan ha bearbetats av Claude, inte bevisa fullständig författarskap. Markeringar kan också försvinna eller bli omöjliga att upptäcka om texten är kraftigt redigerad, omformulerad, översatt, blandad med annan text eller om ett stycke är för kort.
Genererar du text med AI eller finslipar du redan ditt eget skrivande? Med vilken modell?