Ověřování informací a obrazového materiálu: detekce dezinformací a deepfake obsahu v éře AI

Overovanie informácií a obrazov: Detekcia dezinformácií a deepfakov v ére AI

Proč dnes nestačí „zdravý rozum“

Spektrum manipulativního obsahu se výrazně rozšířilo: od tradičních lží a vytržených citací až po syntetická média (deepfaky), která se vizuálně či zvukově podobají realitě. Modely pro generování obrazu, videa a hlasu jsou dostupné, levné a rychlé. Zároveň se zlepšuje jejich koherence a odolnost vůči jednoduchým „heuristikám“ odhalování. Proto je zapotřebí systematický proces ověřování zdrojů, obrazů a videí podporovaný nástroji – s jasně stanovenými hranicemi jistoty, pravidly publikování a dokumentací.

Taxonomie: co všechno můžeme ověřovat

  • Dezinformace – nepravdivý nebo zavádějící obsah šířený záměrně.
  • Misinformace – nepřesnosti šířené bez zlého úmyslu.
  • Malinformace – pravdivé, ale vytržené informace, které škodí (např. únik soukromých údajů).
  • Syntetická média – vizuální, zvukový či textový obsah generovaný nebo zásadně upravený algoritmicky (deepfake tvář/hlas, obrázky vytvořené AI).
  • Shallow fake – běžné úpravy: zpomalení/zrychlení videa, střih, zavádějící titulek nebo nesprávný kontext.

Principy ověřování: pyramida důvěry

  1. Zdroj – kdo obsah publikoval, jakou má dosavadní reputaci a jakými redakčními pravidly se řídí? Lze potvrdit identitu a původ?
  2. Důkaz – jaké podpůrné materiály existují (více úhlů, originály, surová data)? Lze získat nezávislý záznam?
  3. Soulad – odpovídá tvrzení nezávislým referencím (jiná média, oficiální hlášení, satelitní snímky, meteorologické údaje)?
  4. Provenience – je k obsahu připojena ověřitelná historie původu (obsahové údaje, podpisy, hash)?

Pracovní postup OSINT: nezbytné kroky před sdílením

  1. Zastavte se a zachyťte kontext – kdo, co, kde, kdy, proč. Uložte si kopie (hash, časové razítko), aby bylo možné porovnat pozdější verze.
  2. Obrázek – proveďte reverse image search (starší výskyty, podobné snímky), vyhledejte starší publikace, určete polohu pomocí viditelných znaků (nápisy, dopravní značení, tvar střech).
  3. Video – extrahujte klíčové snímky, použijte zpětné vyhledávání jednotlivých framů, analyzujte stíny, počasí a mapy.
  4. Zvuk – porovnejte hlas s referenčními nahrávkami, sledujte nesrovnalosti v dýchání, prozodické struktuře a dozvuku (kombinace syntetického a reálného prostředí).
  5. Text – zkontrolujte původní citace, neobvyklou interpunkci a „typické fráze modelů“; prověřte překlady a přepisy.
  6. Metadata a křížová data – EXIF/XMP (jsou-li k dispozici), síťové hlavičky, časová razítka, soulad s dopravou, počasím a astronomickými údaji.
  7. Závěrečné tvrzení – stanovte míru jistoty (potvrzené / pravděpodobné / neověřené / nepravdivé) a uveďte použité metody.

Ověřování obrazů: technické i kontextové metody

  • Zpětné vyhledávání – najděte starší výskyty stejného nebo podobného vizuálu; pozor na znovu publikované záběry s novým příběhem.
  • Geolokace – porovnejte dominantní objekty s mapami/Street View/satelitními snímky; sledujte typické urbanistické prvky, texty v místním jazyce a architekturu.
  • Chronolokace – poloha slunce (úhly stínů), fenologie (listnaté stromy, sníh), dočasná infrastruktura (stavby, billboardy).
  • Forenzní analýza – hledejte nesrovnalosti v osvětlení, měřítku a perspektivě; mapy kompresních chyb; rozdíly v šumu (pozor: moderní generátory se těmto testům často vyhnou).
  • Ověření více záběry – požádejte o surové snímky, sérii záběrů před/po; kontinuita snižuje pravděpodobnost syntézy.
  • Provenience – přítomnost content credentials (C2PA) nebo podpisu fotoaparátu; chybějící podpis ještě neznamená falzifikát, přítomnost platného podpisu výrazně zvyšuje důvěryhodnost.

Ověřování videí a deepfake tváří

  • Temporalita – sledujte „mikrotrhání“ kolem kontur, neplynulé přechody stínů, zpoždění mezi zvukem a artikulací.
  • Fyzika scény – nekonzistentní odlesky v očích, nepřirozené „zasekávání“ vlasů při pohybu, změny ostrosti na okrajích obličeje.
  • Kompozice – náhlé, zbytečné střihy, nízké rozlišení v klíčových okamžicích, potlačené pozadí (bokeh) bránící podrobné kontrole.
  • Zvuk – robotické doznívání, chybějící dýchání v očekávaných místech, nevhodná akustika (hlas v „malém pokoji“ nad obrazem z „ulice“).
  • Podpůrná data – více úhlů, záznamy publika, souběžné livestreamy; ideálně nezávislý obrazový zdroj.

Ověřování zvuku a napodobovaného hlasu

  • Biometrie versus chování – podobnost barvy hlasu nestačí; sledujte typické fráze, tempo řeči, výplňová slova a reakční dobu.
  • Artefakty syntézy – „slévání“ souhlásek, chybějící konzistence šumu v pozadí, nesprávná dynamika smíchu, kašle a vzdechů.
  • Ověření kontextu – existuje důkaz, že se daná osoba v době nahrávky nacházela na příslušném místě? Odpovídá obsah dosavadnímu veřejnému projevu dané osoby?

Metadata: pomocník, nikoli svatý grál

EXIF/XMP a systémová metadata mohou potvrdit zařízení, čas a místo, lze je však odstranit nebo podvrhnout. Berte je jako jeden z mnoha signálů. U sdílených platforem počítejte s rekompresí a odstraňováním metadat. Ověřujte pomocí externích indicií: počasí, dopravní kamery, hlášení institucí, svědci.

Obsahové údaje, podpisy a vodoznaky

  • C2PA / Content Credentials – kryptograficky podepsaná „stopa původu“ média (kdo a čím je zachytil/upravil). Lze ověřit i po opětovném nahrání.
  • Podpisy fotoaparátů – některá zařízení vkládají hardwarové podpisy; jsou užitečné pro forenzní kontinuitu.
  • Vodoznaky AI – viditelné/odolné nebo křehké; pomáhají, dokud je útočník neodstraní nebo nezničí rekompresí.

Absence obsahových údajů není důkazem falšování. Jejich přítomnost a platnost však výrazně posouvá ručičku důvěryhodnosti.

Signály manipulací na platformách

  • Nově vytvořené účty, nízká reputace v síti, nekoherentní historie příspěvků.
  • Koordinované publikování – mnoho účtů zveřejní najednou totožné texty, načasování na minuty.
  • Nestandardní odkazování – zkrácené řetězce URL, přesměrování přes více domén, anonymní hostingy bez kontaktních údajů.

Právní a etické rámce publikování

  • Transparentnost – při publikování výsledků ověření uveďte metodiku a míru jistoty; vyhněte se kategorickým tvrzením bez důkazů.
  • Ochrana osob – zvažte dopad na zúčastněné; v konfliktních situacích zvažte rozmazání/zveřejnění bez identifikačních údajů.
  • Právo na opravu – pokud se později prokáže omyl, neprodleně opravte/odstraňte obsah a zdokumentujte, co se změnilo.

Limity detekce: čemu slepě nevěřit

  • „Klasické“ artefakty (křivé uši, šest prstů) nejsou spolehlivé; moderní generátory je často eliminují.
  • Jednorázové skóre „pravosti“ bez vysvětlení zdroje – vyžadujte srozumitelné důvody, nejen procento.
  • Metadata jako jediný důkaz – lze s nimi snadno manipulovat a platformy je odstraňují.

Proces pro redakce a firmy: od incidentu k závěru

  1. Přijetí hlášení – evidujte URL, hash, čas, svědky a kontakty.
  2. Rychlé třídění – zjistěte, zda jde o známou šablonu hoaxu, recyklovaný materiál nebo nový artefakt.
  3. Důkladné ověření – kroky OSINT, technická analýza, kontaktování autorů a institucí.
  4. Peer review – druhý analytik prověří důkazy a shrnutí.
  5. Komunikace – publikujte s jasným verdiktem a mírou jistoty; připravte Q&A pro novináře nebo interní management.
  6. Archivace – bezpečně uložte podklady (originály, poznámky, logy), aby bylo možné rozhodnutí auditovat.

Kontrolní seznam pro jednotlivce (2 minuty před opětovným sdílením)

  1. Vidím původní zdroj (autora/organizaci) a datum?
  2. Nejde o starý materiál v novém kontextu?
  3. Odpovídají místo a čas tomu, co dokážu rozpoznat (jazyk, počasí, architektura)?
  4. Nenašel jsem starší publikace stejného vizuálu?
  5. Je tvrzení ověřeno alespoň dvěma nezávislými zdroji?

Kontrolní seznam pro analytiky (30–60 minut)

  • Zpětné vyhledávání klíčových framů a variant ořezu.
  • Geolokace podle pevných bodů (mosty, vrcholy, značení), chronolokace podle stínů a počasí.
  • Kontrola opětovného nahrávání na platformách, histogramu publikování a sítě šíření.
  • Technická kontrola kompresních artefaktů a nesrovnalostí v osvětlení/perspektivě.
  • Hledání obsahových údajů, podpisů a vodoznaků; pokud jsou k dispozici, ověření kryptografické platnosti.

Příklady formulací verdiktů

  • Potvrzené: „Média obsahují platné obsahové údaje, místo a čas byly nezávisle ověřeny dvěma zdroji.“
  • Pravděpodobné: „Nebyly nalezeny starší výskyty, geolokace odpovídá a nezaznamenali jsme technické anomálie.“
  • Neověřené: „Chybí nezávislé důkazy a původní autor nereaguje. Zdržujeme se sdílení.“
  • Nepravdivé: „Jde o starý záběr z [rok/událost], použitý s novým tvrzením. Kontext je zavádějící.“

Školení a připravenost

  • Simulace – pravidelná cvičení v odhalování s časovým limitem a dokumentací postupu.
  • Runbooky – stručné interní příručky s nástroji a kontakty (pro OSINT, právní oddělení, PR).
  • Bezpečné sdílení – pracovní prostory s řízeným přístupem, aby se neověřené artefakty nekopírovaly mimo tým.

Shrnutí: metodika před instinktem

Realistická syntetická média mění pravidla hry. Místo rychlých vizuálních dojmů je klíčová kombinace postupů: ověřený původ (provenience), křížová data (geolokace, čas), technická analýza a transparentní vyhodnocení míry jistoty. Cílem není odhalit každý deepfake, ale snížit riziko omylu a udržet důvěru publika či organizace v to, že rozhodnutí jsou založena na důkazech.