AI & Content

Čo vodoznačenie obrázkov generovaných AI v skutočnosti prináša

Vodoznaky môžu pomôcť s pôvodom, presadzovaním pravidiel a zverejňovaním informácií. Nedokážu však zázračne urobiť syntetické médiá dôveryhodnými.

The Wux Webtools Team The Wux Webtools Team 12 min čítania Pomocou AI, kontrolované človekom
Illustration of an image file being inspected for watermark and provenance signals
Obsah
  1. Sľub znie jednoduchšie než realita
  2. Najprv si definujme typ vodoznaku
  3. Viditeľné vodoznaky
  4. Neviditeľné vodoznaky
  5. Metadáta a záznamy o pôvode
  6. Čo vodoznačenie v skutočnosti prináša
  7. 1. Podporuje poctivé zverejňovanie informácií
  8. 2. Platformám dáva signál na moderovanie
  9. 3. Pomáha zachovať reťazec správy
  10. 4. Zvyšuje náklady na klamanie
  11. Čo nedokáže
  12. Nedokazuje, že obrázok je pravdivý
  13. Nerieši atribúciu ani autorské práva
  14. Neprežije každú transformáciu
  15. Nefunguje bez prijatia
  16. Praktická politika pre tímy používajúce obrázky AI
  17. Detekcia má byť pravdepodobnostná, nie moralizujúca
  18. Najlepší prípad použitia: dôveryhodné pracovné postupy, nie dokonalé stráženie
  19. Záver

Sľub znie jednoduchšie než realita

Vodoznačenie obrázkov AI sa často prezentuje ako praktická oprava syntetických médií: označiť vygenerované obrázky, neskôr značku rozpoznať a dať divákom istotu v tom, na čo sa pozerajú.

Čiastočne je to pravda. Vodoznačenie môže platformám pomôcť označovať obrázky generované AI, vydavateľom dokumentovať pracovný postup a vyšetrovateľom rozlišovať medzi niektorými dielami vytvorenými človekom a strojom. Je to užitočná vrstva.

Nie je to však univerzálny stroj na pravdu. Vodoznak možno odstrániť, prehliadnuť, sfalšovať, znehodnotiť, vymazať z metadát alebo urobiť nepodstatným snímkou obrazovky. Aj keď funguje, zvyčajne odpovedá na úzku otázku: prešiel tento súbor, alebo niečo jemu podobné, systémom, ktorý použil túto značku?

To je niečo iné než odpovedať na otázky, na ktorých ľuďom naozaj záleží: Je tento obrázok skutočný? Kto ho vytvoril? Bol upravený? Je zavádzajúci? Mám povolenie ho použiť?

Vodoznačenie s týmito otázkami pomáha iba vtedy, keď je súčasťou širšieho systému pôvodu a zverejňovania informácií.

Najprv si definujme typ vodoznaku

Ľudia používajú slovo vodoznak na označenie viacerých rôznych vecí.

Viditeľné vodoznaky

Sú to zjavné značky umiestnené navrchu obrázka: logo, štítok, diagonálny vzor alebo popis hovoriaci, že obrázok bol vygenerovaný AI.

Viditeľné vodoznaky sú pre ľudí ľahko pochopiteľné. Zároveň sa dajú ľahko orezať, prekryť, rozmazať alebo odstrániť nástrojmi na úpravu obrázkov. Ich hlavnou hodnotou je zverejnenie informácie v momente publikovania, nie forenzná spoľahlivosť.

Najlepšie fungujú vtedy, keď chce byť vydavateľ úprimný. Slabo fungujú vtedy, keď chce vydavateľ klamať.

Neviditeľné vodoznaky

Neviditeľné vodoznaky sú signály vložené do pixelov obrázka. Detekčný nástroj môže neskôr otestovať, či je signál prítomný.

Tento model používajú systémy ako SynthID a ďalšie prístupy vodoznačenia na úrovni generátora. Jeho príťažlivosť je zrejmá: obrázok môže vyzerať normálne a zároveň niesť strojovo detegovateľný signál.

Kompromisom je krehkosť. Niektoré neviditeľné vodoznaky prežijú kompresiu, zmenu veľkosti, úpravu farieb alebo mierne orezanie. Iné nie. Silnejšie značky môžu byť odolnejšie, ale môžu ovplyvniť kvalitu alebo byť zraniteľné voči adversariálnym útokom. Na detailoch veľmi záleží a verejnosť ich málokedy vidí dosť na to, aby ich vedela nezávisle vyhodnotiť.

Metadáta a záznamy o pôvode

Tretí prístup nie je vodoznakom v zmysle úrovne pixelov. Pripája k súboru informácie: kto ho vytvoril, aký nástroj bol použitý, aké úpravy boli vykonané a či boli poverenia podpísané dôveryhodnou stranou.

Tu prichádza na scénu C2PA, Coalition for Content Provenance and Authenticity. C2PA sa usiluje štandardizovať obsahové poverenia, aby obrázky a ďalšie médiá mohli niesť podpísané údaje o pôvode naprieč nástrojmi a platformami.

Tento prístup je výpovednejší než vodoznak. Dokáže povedať viac než len AI alebo nie AI. Môže opísať úpravy, zdroje a reťazec správy. Závisí však od podpory softvéru, dôvery v podpisujúce strany a od toho, či metadáta zostanú pripojené. Každý, kto riešil nahrávanie obrázkov, vie, že metadáta sa často automaticky odstraňujú. Ten istý inštinkt ochrany súkromia, ktorý stojí za odstraňovaním EXIF metadát pred zdieľaním fotografií, zároveň komplikuje systémy pôvodu.

Čo vodoznačenie v skutočnosti prináša

Vodoznačenie je užitočné vtedy, keď od neho žiadate správnu úlohu.

1. Podporuje poctivé zverejňovanie informácií

Pre tímy publikujúce vizuály s pomocou AI môže vodoznačenie zabezpečiť konzistentnejšie zverejňovanie informácií. Redakcia, trhovisko, škola alebo dizajnérsky tím môže vyžadovať, aby vygenerované obrázky niesli viditeľné štítky, neviditeľné značky, podpísané poverenia alebo ich kombináciu.

To nezabráni zlým aktérom v odstraňovaní značiek. Znižuje to však nejednoznačnosť v organizáciách, ktoré sa chcú správať zodpovedne.

Je to podobné ako redakčné zverejňovanie pri texte AI. Užitočným štandardom nie je performatívna vina, ale praktická jasnosť. Ak váš tím používa syntetické materiály, malá zásada vysvetľujúca, kedy a ako ich zverejňujete, je užitočnejšia než neurčité lomcovanie rukami. Rovnaký princíp platí pre poctivé zverejňovanie používania AI na malej webovej stránke: povedzte používateľom to, čo podstatne ovplyvňuje ich porozumenie.

2. Platformám dáva signál na moderovanie

Platformy potrebujú signály vo veľkom rozsahu. Spoľahlivý vodoznak im môže pomôcť smerovať nahrané súbory na kontrolu, pridávať štítky, presadzovať pravidlá reklamy alebo obmedzovať určité použitia.

Nevyžaduje si to dokonalú presnosť. Moderovací systém môže detekciu vodoznaku použiť ako jeden zo signálov: popri správaní účtu, histórii nahrávania, vizuálnej podobnosti, hláseniach používateľov a kontexte obsahu.

Nebezpečenstvo spočíva v tom, že sa signál považuje za rozhodujúci. Detegovaný vodoznak môže naznačovať, že obrázok pochádza z konkrétneho generátora. Chýbajúci vodoznak nedokazuje, že obrázok je skutočný.

3. Pomáha zachovať reťazec správy

Pre vydavateľov, archívy, právne tímy a výskumníkov môže mať pôvod skutočnú hodnotu. Ak súbor nesie podpísané poverenia od vytvorenia cez úpravy až po publikovanie, neskorší posudzovatelia môžu pochopiť, ako sa menil.

Ide menej o chytanie každého falošného obrázka na otvorenom webe a viac o budovanie dôveryhodných pracovných postupov. Fotoeditor môže overiť, že obrázok pochádza zo známeho fotoaparátu, prešiel schváleným softvérom na úpravu a exportoval ho konkrétny editor. Dizajnérsky tím môže sledovať, či bola ilustrácia vygenerovaná, upravená, licencovaná a schválená.

Poverenia v štýle C2PA sú najsilnejšie v týchto kontrolovaných prostrediach. Slabšie sú vtedy, keď sa obrázok kopíruje cez neznáme systémy, zachytí snímkou obrazovky alebo opakovane preposiela.

4. Zvyšuje náklady na klamanie

Vodoznačenie klamanie nezastaví. Môže ho však urobiť o niečo pracnejším.

Ak generátor predvolene používa odolné neviditeľné značky, niekto, kto sa snaží vydávať syntetické obrázky za originály z fotoaparátu, môže potrebovať dodatočné kroky „prania“: úpravu, opätovné kódovanie, snímku obrazovky alebo použitie modelov bez značiek. Tieto kroky môžu zhoršiť kvalitu, zanechať iné stopy alebo zvýšiť prevádzkové trenie.

Nie je to očarujúce, ale bezpečnosť tak často funguje. Zneužívanie zriedka úplne odstránite. Urobíte bežné zneužívanie pomalším, menej spoľahlivým a ľahšie vyšetrovaným.

Čo nedokáže

Práve pri obmedzeniach sa tímy zvyčajne dostávajú do problémov.

Nedokazuje, že obrázok je pravdivý

Skutočná fotografia môže byť zavádzajúca. Syntetický obrázok môže byť jasne označený a napriek tomu komunikovať niečo nepravdivé. Vodoznačenie vám hovorí o pôvode alebo spracovaní, nie o pravde.

Označený obrázok AI politika, ktorý robí niečo fiktívne, je stále potenciálnym problémom dezinformácií. Skutočná fotografia s klamlivým popisom je tiež problémom dezinformácií. Pôvod pomáha, ale interpretácia je stále dôležitá.

Nerieši atribúciu ani autorské práva

Vodoznak hovoriaci, že niečo bolo vygenerované AI, vám nepovie, či výstup porušuje niečiu prácu, či prompt použil meno žijúceho umelca alebo či boli tréningové dáta získané eticky.

To sú samostatné právne a etické otázky. Sú dôležité, ale nemožno ich zredukovať na binárny vodoznak.

Ak váš tím používa generované obrázky vo verejne viditeľnej práci, vodoznačenie by malo stáť popri kontrole licencií, dokumentácii zdrojov a základnom úsudku o nevyhnutnosti. Syntetické obrázky majú náklady aj mimo detekcie, ako sa rozoberá v článku skryté náklady obrázkov generovaných AI na otvorenom webe.

Neprežije každú transformáciu

Obrázky sa bežne komprimujú, menia veľkosť, transkódujú, snímajú z obrazovky, filtrujú a znovu zverejňujú. Niektoré systémy sú navrhnuté tak, aby znášali bežné transformácie. Pri žiadnom by sa však nemalo predpokladať, že prežije všetky transformácie.

Metadáta sú obzvlášť krehké. Mnohé sociálne platformy, systémy na správu obsahu, aplikácie na posielanie správ a optimalizačné pipeline odstraňujú metadáta, aby zmenšili veľkosť súboru alebo chránili súkromie. Vodoznaky na úrovni pixelov môžu prežiť viac transformácií, ale stále môžu byť napadnuté.

Nefunguje bez prijatia

Štandard pôvodu je užitočný iba vtedy, ak ho podporujú nástroje na tvorbu, nástroje na úpravu, publikačné systémy, platformy a prehliadači.

Toto je nudný problém nasadenia. Ak jeden generátor označuje výstupy a iný nie, pokrytie detekcie je čiastočné. Ak softvér na úpravu zahodí poverenia, reťazec sa preruší. Ak prehliadače a platformy nezobrazujú poverenia jasne, bežní používatelia ich nikdy neuvidia.

Vodoznačenie nie je len technická funkcia. Je to dohoda ekosystému.

Praktická politika pre tímy používajúce obrázky AI

Väčšina organizácií sa nemusí stať forenznými mediálnymi laboratóriami. Potrebujú použiteľný súbor pravidiel.

Rozumná politika vyzerá takto:

  • Označujte syntetické obrázky, keď by ich syntetická povaha mohla ovplyvniť interpretáciu.
  • Uchovávajte zdrojové súbory, prompty, licencie a schválenia pre publikované vizuály AI.
  • Uprednostňujte nástroje, ktoré podporujú poverenia pôvodu alebo odolné vodoznačenie.
  • Nepovažujte chýbajúce vodoznaky za dôkaz autenticity.
  • Vyhýbajte sa obrázkom generovaným AI v dokumentárnych, dôkazných, medicínskych, právnych alebo spravodajsky citlivých kontextoch, pokiaľ neexistuje veľmi jasný proces zverejnenia a kontroly.

Pre marketingové a produktové tímy najčastejšou chybou nie je zlomyseľné klamanie. Je to ležérna nejednoznačnosť. Hero image, ktorý je zjavne ilustračný, potrebuje menej zverejnenia než falošná produktová fotografia, falošný portrét zákazníka alebo syntetický obrázok udalosti. Čím viac obrázok žiada od diváka, aby uveril, že zobrazuje skutočnú osobu, miesto, produkt alebo udalosť, tým silnejšie by malo byť vaše zverejnenie.

Dizajnérske tímy by sa tiež mali rozhodnúť, kam zverejnenie patrí. Niekedy sú vhodné viditeľné štítky. Niekedy stačia metadáta a obrazový kredit. Niekedy je správnou odpoveďou vygenerovaný obrázok nepoužiť.

Detekcia má byť pravdepodobnostná, nie moralizujúca

Detekcia vodoznaku je signál, nie verdikt. Záleží na tom, pretože falošná istota môže ľuďom ublížiť.

Detektor môže po výrazných úpravách prehliadnuť označený obrázok. Môže obrázok označiť nesprávne. Môže fungovať dobre pri jednom generátore a slabo pri inom. Môže byť vyladený na laboratórne podmienky, nie na chaotickú distribúciu v reálnom svete.

Prevádzková otázka by teda nemala znieť: Je toto AI? Mala by znieť: Aké dôkazy máme, aké sú spoľahlivé a aké rozhodnutie z nich robíme?

Platforma rozhodujúca o pridaní jemného štítku môže tolerovať viac neistoty než škola obviňujúca študenta z priestupku alebo vydavateľ tvrdiaci, že došlo k podvodu. Čím vyšší je dôsledok, tým viac potvrdení potrebujete.

Je to rovnaká opatrnosť, ktorá platí pri detekcii obsahu AI všeobecne: detektory sú užitočné na triedenie, nie ako sudcovia.

Najlepší prípad použitia: dôveryhodné pracovné postupy, nie dokonalé stráženie

Najsilnejší argument pre vodoznačenie nie je chytiť každý syntetický obrázok po tom, čo unikne na internet. To je príliš ambiciózne.

Silnejším argumentom je budovanie dôveryhodných pracovných postupov pred publikovaním:

  • Generátor označí výstupy.
  • Softvér na úpravu zachová poverenia.
  • Systém na správu obsahu ich uloží.
  • Vydavateľ ich zobrazí, keď je to relevantné.
  • Kontrolóri môžu reťazec neskôr preskúmať.

Tento pracovný postup nezastaví každého zlého aktéra. Zodpovedných aktérov však urobí čitateľnejšími.

Na tomto rozlíšení záleží. Vodoznačenie sa často predáva ako obranný múr proti dezinformáciám. V praxi má bližšie k papierovej stope. Papierové stopy sú cenné. Sú však aj neúplné, stratové a iba také dôveryhodné ako inštitúcie, ktoré ich udržiavajú.

<!-- tool-cta:start -->

💡 Vyskúšajte toto: Ak chcete vidieť, aké krehké môžu byť vložené podpisy AI, vyskúšajte AI Metadata Masker, ktorý ukazuje, ako ľahko možno takéto značky zmeniť alebo odstrániť.

<!-- tool-cta:end -->

Záver

Vodoznačenie obrázkov generovaných AI prináša tri užitočné veci: podporuje zverejňovanie informácií, dáva platformám a vydavateľom signál na moderovanie a pomáha zachovať pôvod v kontrolovaných pracovných postupoch.

Nedokazuje pravdu, nerieši autorské práva, nezaručuje atribúciu a spoľahlivo neidentifikuje každý syntetický obrázok v divočine.

Praktický postoj nie je ani cynizmus, ani slepá dôvera. Používajte vodoznačenie tam, kde znižuje nejednoznačnosť. Uprednostňujte pôvod založený na štandardoch tam, kde záleží na reťazci správy. Pri použití s vysokými stávkami ponechajte ľudskú kontrolu. A nedovoľte, aby technický marker nahradil redakčný úsudok.

Často kladené otázky

Dá sa vodoznak obrázka AI odstrániť?
Často áno. Viditeľné značky možno orezať alebo upraviť preč. Metadáta možno odstrániť. Neviditeľné značky na úrovni pixelov môžu prežiť bežné úpravy, ale odhodlaní útočníci sa ich môžu pokúsiť znehodnotiť alebo odstrániť.
Dokazuje chýbajúci vodoznak, že obrázok je skutočný?
Nie. Chýbajúci vodoznak znamená iba to, že nebola zistená žiadna podporovaná značka. Obrázok môže byť skutočný, vygenerovaný neoznačeným modelom, upravený tak, že značka zmizla, alebo skopírovaný cez systém, ktorý odstránil metadáta.
Je C2PA to isté ako vodoznačenie?
Nie celkom. C2PA je štandard proveniencie na pripájanie podpísaných obsahových poverení k médiám. Dokáže zaznamenať históriu vytvorenia a úprav. Môže dopĺňať vodoznačenie, ale nie je to jednoducho skrytá značka v pixeloch.
Mali by webové stránky viditeľne označovať obrázky generované AI?
Mali by vtedy, keď by syntetická povaha mohla zmeniť spôsob, akým divák obrázok interpretuje. Dekoratívne abstraktné umenie môže potrebovať málo zverejnenia. Syntetickí ľudia, produkty, udalosti alebo dokumentárne pôsobiace scény zvyčajne potrebujú jasnejšie označenie.
Sú detektory vodoznakov AI dostatočne spoľahlivé na presadzovanie pravidiel?
Môžu podporiť moderovanie s nízkymi stávkami a kontrolné pracovné postupy, ale nemali by byť jediným dôkazom pri rozhodnutiach s vážnymi dôsledkami. Berte detekciu ako pravdepodobnostnú a potvrďte ju ďalšími dôkazmi.

Zdroje a ďalšie čítanie

  1. C2PA Technical Specification
  2. Google DeepMind: Identifying AI-generated images with SynthID
  3. NIST AI 100-4: Reducing Risks Posed by Synthetic Content
  4. Partnership on AI: Responsible Practices for Synthetic Media
O autorovi
The Wux Webtools Team

Posledná aktualizácia:

Pokračujte v čítaní