Časť obsahu tejto stránky bola vytvorená s pomocou AI
Späť na slovník Bezpečnosť

Watermarking AI obsahu

AI watermarking je technika vkladania neviditeľných značiek do AI-generovaného obsahu (textu, obrázkov, videa) na umožnenie detekcie a autentifikácie zdroja obsahu.

Čo je AI watermarking?

AI watermarking je metóda vloženia skrytej identifikačnej značky do AI-generovaného obsahu bez vizuálnej alebo sluchovej degradácie. Cieľ je umožniť následnú detekciu: "Bol tento obsah vygenerovaný AI?" alebo dokonca "Ktorý model ho vygeneroval?"

S narastajúcim objemom AI obsahu na internete sa watermarking stáva dôležitým nástrojom pre ochranu autorských práv, detekovanie dezinformácií a regulačný compliance.

Technické prístupy

Pre LLM text watermarking: Kirchenbauer et al. (2023) navrhli metódu, kde sa tokeny delia do "zelenej" a "červenej" skupiny na základe pseudonáhodného kľúča. Model uprednostňuje zelené tokeny počas generovania. Detektor môže štatisticky overiť, či text bol generovaný s týmto biasom.

Pre obrázkové watermarky sa používajú frekvenčné modifikácie vo Fourier priestore, ktoré sú neviditeľné okom, ale štatisticky detekovateľné. Stable Signature od Meta integruje watermark priamo do procesu generovania.

Obmedzenia a výzvy

Watermarky nie sú definitívnym riešením. Možné útoky zahŕňajú preformulovanie textu (paraphrasing attacks), pridanie šumu k obrázku (adversarial perturbations) alebo stlačenie/konvertovanie formátu. EU AI Act vyžaduje označovanie AI-generovaného obsahu, čo zvyšuje tlak na robustné watermarking technológie.