A mesterséges intelligencia egyre ügyesebb, olyannyira, hogy szinte lehetetlenné válik megkülönböztetni az általa létrehozott tartalmakat (szövegeket, képeket, videókat) az emberek által készítettektől, ami átláthatósági és biztonsági aggályokat vet fel. Fokozódik emiatt az AI cégekre gyakorolt nyomás, hogy jelezzék a mesterséges intelligencia ténykedését.Ahogy erről mi is beszámoltunk, az Európai Unió frissen hatályba lépett rendelkezéseinek értelmében a generatív AI-rendszerek szolgáltatóinak minden létrehozott tartalmat mesterségesen létrehozottként vagy manipuláltként kell felismerhetővé tenniük. A Claude mögött álló Anthropic most azt tervezi, hogy vízjelezni fog mindent, amit a chatbotja készít. A szövegek egy láthatatlan statisztikai vízjelet fognak kapni, míg a (támogatott) vizuális formátumokon (például PNG, JPG vagy SVG) aláírt metaadatok jelzik majd, hogy a Claude virtuális keze is benne van a műben. https://hvg.hu/tudomany/20260731_vasarnap-megkezdodik-az-unios-ai-rendelet-vegrehajtasaAz augusztus 2-án vagy azt követően piacra dobott Anthropic-modellek támogatják a bevezetéskor történő jelölést, miközben a vállalat azon dolgozik, hogy az elkövetkező hónapokban, az EU-s jogszabályok által megengedett átmeneti időszak keretében, a régebbi modellekhez is hozzáadja ezt a funkciót. Bár a követelmény európai, az Anthropic a kezdetektől fogva világszerte alkalmazza a vízjelzést, mondván, hogy még nincs megoldva a régiónkénti korlátozás.A szövegek vízjelzéséhez az Anthropic a Google DeepMind SynthID-Text módszerének egy verzióját használja. Ez egy igazán trükkös eljárás, ugyanis nincsenek benne rejtett karakterek, hanem a vízjelet a szöveg generálása során kiválasztott szavak alapján hozza létre. https://hvg.hu/tudomany/20260807_programozas-anthropic-claude-opus-5Amikor szöveget írnak a nagy nyelvi modellek, akkor számos lehetőségből választják ki a következő szót, miután az esetek döntő hányadában ugyanolyan jól folytatódik a mondat. A választható szavaknak van egy előfordulási valószínűsége, viszont a rendszer ezeknél a döntéseknél nagyon apró mértékben megváltoztatja ezt. Ez egyetlen mondatban természetesen nem tűnik fel, azonban több ezer vagy tízezer szó után az apró változtatások összeadódhatnak, és egy statisztikailag felismerhető mintázatot alkothatnak. Viszont – jegyzi meg az Anthropic – a vízjelzett és a vízjel nélküli szöveg megkülönböztethetetlen lesz az olvasók számára. Másképp fogalmazva: a vízjel nem változtatja meg a jelentést vagy az olvasó élményét, de ha utólag ellenőrizné valaki, hogy a szöveget Claude generálta-e, a vízjel lehetővé teszi ezt.Az Anthropic egyébként külön vízjel-detektáló API-t is tervez, amellyel ellenőrizhető lesz a Claude-szöveg, bár ennek a működéséről egyelőre még nem osztott meg részleteket.Az azért az Anthropic is elismeri, hogy ezek a jelzések csak jelek, nem pedig a mesterséges intelligencia általi generálás végleges bizonyítékai. Az észlelt vízjel csak azt mutatja, hogy Claude valószínűleg részt vett valamikor a szöveg készítésében, nem pedig azt, hogy nem ember írta. Mivel a vízjel Claude által választott szavakhoz kapcsolódik, nem tudja különválasztani a szerzőséget a szerkesztéstől.A képeknél más a helyzet. Ha például a Claude létrehoz egy PNG-t, JPG-t vagy SVG-t, akkor egy kriptográfiailag aláírt megjegyzést csatol a fájl metaadataihoz a nyílt C2PA szabvány szerint. Ez persze nem egy látható „made by AI” felirat, a képen semmi sem változik. A hitelesítő adat rögzíti, hogy Claude készítette vagy dolgozta fel a fájlt, viszont nem tartalmaz személyes adatokat. Mivel az információ kriptográfiailag alá van írva, segíthet felfedni azt is, hogy a hitelesítő adatot vagy a fájlt később manipulálták-e.A vízjelzés bejelentésekor az Anthropic azt is közölte, hogy ez elhanyagolható hatással lesz a modellek sebességére, és mivel nem termel extra tokeneket, a modell kiszolgálása és használata is ugyanannyiba fog kerülni.Ha máskor is tudni szeretne hasonló dolgokról, lájkolja a HVG Tech rovatának Facebook-oldalát.
Szavakba rejtett rafinált trükkel fog vízjelezni a Claude
Különleges vízjelet, láthatatlan nyomot fog elhelyezni a Claude (az Anthropic chatbotja) az általa generált szövegekbe, hogy egyértelműsítse, AI áll a háttérben. Nem valami titkos karakterről vagy furcsa jelről van szó, ennél sokkal rafináltabb a módszer.







