AI watermark

Čo je AI watermark?

AI watermark je viditeľná alebo neviditeľná značka vložená do výstupu generatívneho modelu (obrázka, videa, zvuku či textu), ktorá umožňuje rozpoznať jeho strojový pôvod. Proces jej vkladania sa nazýva AI watermarking a popri metadátach, kryptografických metódach či fingerprintoch je jednou z techník strojovo čitateľného označovania AI obsahu,. Pri neviditeľnom variante je AI watermark pre človeka nepostrehnuteľný, no detektor ho dokáže prečítať priamo z obsahu.

Označovanie obsahu nie je nové ani viazané na AI — neviditeľné digitálne vodoznaky existovali dávno pred AI a viditeľný vodoznak (logo vo fotografii) pozná každý. Pri AI obsahu sa digitálny vodoznak AI obsahu vkladá najčastejšie počas generovania (napríklad zmenou distribúcie tokenov pri texte) alebo post-hoc samostatným systémom; niektoré schémy sú zabudované do modelu počas tréningu.

AI watermark a provenančné metadáta

AI watermarking sa v praxi kombinuje s provenančnými metadátami, no ide o dva odlišné mechanizmy. AI watermark žije v pixeloch, vzorkách zvuku alebo vo výbere tokenov. Provenančný záznam podľa štandardu C2PA je kryptograficky podpísaný manifest, ktorý býva vložený do súboru ako metadáta, prípadne uložený mimo neho.

Rozdiel má priamy prevádzkový dopad. Metadáta sú overiteľné a zásah do nich rozpoznateľný, zo súboru sa však dajú odstrániť — či k tomu dôjde, závisí od platformy a workflow. Robustný AI watermark prežije niektoré prekódovania, pri ktorých sa metadáta stratia, zato je krehkejší voči úpravám obsahu. Štandard C2PA preto po strate manifestu umožňuje obnoviť väzbu na provenančný záznam soft bindingom — napríklad cez watermark alebo fingerprint.

Odolnosť značky má limity. Kompresia, orezanie, zmena rozlíšenia alebo parafrázovanie textu môžu signál poškodiť či odstrániť. Textové watermarky sú obzvlášť citlivé na parafrázovanie a preklad: mierne úpravy signál niekedy prežije, rozsiahle prepísanie alebo preklad detekciu výrazne oslabujú. AI watermarking nemá dokonalú odolnosť voči cieleným útokom a konkrétna robustnosť závisí od schémy aj od typu úpravy.

Praktický tip
Praktický tip:

Ak overuješ pôvod obrázka, nespoliehaj sa na jediný signál. Skontroluj najprv Content Credentials, potom detektor AI watermarku daného poskytovateľa. Ak si súbor prešiel sociálnou sieťou, počítaj s tým, že Content Credentials mohli byť odstránené. Väzbu na originál potom môže obnoviť watermark alebo fingerprint, ak ich poskytovateľ používa. Negatívny výsledok pritom neznamená, že obsah nevytvorila AI, len že sa značka nenašla.

Príklady použitia AI watermarku

Nasadenie v produkcii je nerovnomerné. Časť poskytovateľov používa viditeľné označenie, iní vsádzajú na nepostrehnuteľný AI watermark. Google SynthID pokrýva text, obraz, zvuk aj video a Anthropic v roku 2026 opísal watermarking generovaného textu.

Pre firmy v EÚ sa téma stala prevádzkovou otázkou. Článok 50 ods. 2 AI Actu ukladá poskytovateľom generatívnych systémov zabezpečiť, aby boli výstupy označené v strojovo čitateľnom formáte a rozpoznateľné ako umelo vytvorené či manipulované. Povinnosť sa neuplatní v rozsahu, v akom systém plní pomocnú funkciu pri štandardnej editácii alebo podstatne nemení vstupné údaje poskytnuté deployerom či ich sémantiku, ani vtedy, ak je jeho použitie zákonom povolené na odhaľovanie, prevenciu, vyšetrovanie či stíhanie trestných činov. Povinnosť sa uplatňuje od 2. augusta 2026; poskytovatelia systémov uvedených na trh pred týmto dátumom však majú podľa Nariadenia (EÚ) 2026/1744 čas dosiahnuť súlad do 2. decembra 2026. Systémy uvedené na trh od 2. augusta 2026 tento odklad nemajú.

Mimo regulácie sa watermarking skúma aj pri strojovo generovanom kóde — na určenie proveniencie či modelu, ktorý ho vytvoril (napríklad metóda CodeIP) — bežné produkčné nasadenie zatiaľ nie je doložené. Redakcie a agentúry kombinujú provenančný podpis pri zachytení s watermarkom, aby doložili, ktorou kamerou súbor vznikol a ako sa upravoval. Podpis však nezaručuje, že odfotená scéna nebola AI-generovaná — kamera odfotí aj AI obraz z displeja.

Zdroje k téme:

  • Google Cloud – Content Credentials: https://docs.cloud.google.com/vertex-ai/generative-ai/docs/content-credentials
  • EUR-Lex – Regulation (EU) 2026/1744 of the European Parliament and of the Council of 8 July 2026 amending Regulations (EU) 2024/1689, (EU) 2018/1139 and (EU) 2023/1230 as regards the simplification of the implementation of harmonised rules on artificial intelligence (Digital Omnibus on AI) (Text with EEA relevance): https://eur-lex.europa.eu/eli/reg/2026/1744/oj/eng
  • arXiv – „AI Watermarking“: Bridging Policy Discourse and Technical Capabilities: https://arxiv.org/pdf/2606.28331

Uvedené informácie sú orientačné a môžu sa líšiť v závislosti od verzie, implementácie a prostredia.