AI kontra prawdziwe zdjęcia: kompletny przewodnik po obrazach generowanych
Roxy · Zespół redakcyjny SUS IT
Roxy pisze o mediach generowanych przez AI, platformach społecznościowych i autentyczności cyfrowej dla SUS IT.
Jak identyfikować obrazy z Midjourney, DALL-E, Stable Diffusion i Flux — od sygnałów wizualnych po forensykę na poziomie pikseli.
W 2026 roku umiejętność rozróżnienia fotografii od obrazu z AI to praktyczna literacja medialna. Midjourney v6, DALL-E 3, SDXL i Flux potrafią przejść szybką ocenę wzrokową. Obrazy trafiają do newsów, social mediów, dokumentów i kampanii. Warto umieć je oceniać wizualnie i forensycznie.
Dlaczego „na oko” jest coraz trudniej
Starsze generatory miały klasyczne słabości: dłonie, zniekształcony tekst, „woskowa” skóra. Nowe modele — większe dane, lepsza uwaga, trening naprawczy — zamykają wiele oczywistych dziur. Stąd rośnie rola analizy niewidocznej gołym okiem.
Dłonie, zęby, ciało
Ludzka sylwetka wciąż bywa problematyczna: palce przy przedmiotach, stawy, paznokcie pod dziwnym kątem. Uśmiechy bywają „zbyt idealne” albo niezgodne z żuchwą. nietypowe ujęcia ciała częściej ujawniają zniekształcenia.
Tekst i cyfry
Czytelny tekst to wciąż mocny trop: litera „prawie dobra”, zegarek z nonsense’ową tarczą, nagłówek prawie poprawny językowo, ale nie do końca. To szczególnie przydatne przy „zdjęciach prasowych” z AI.
Spójność tła i środowiska
Modele częściej tracą spójność w tle: okna nie trzymają perspektywy, schody prowadzą wnikąd, tekstury się kafelkują, woda nie łączy odbić z niebem nad kadrem.
Światło, cienie, odbicia
Sprawdzaj kierunek cieni, highlighty zgodne ze źródłem światła, odbicia w oczach i szkle. Niespójności bywają subtelne, ale po chwili „ustawienia oka” stają się widoczne.
Podpis szumu
Prawdziwe zdjęcia mają szum matrycy o specyficznej statystyce; obrazy z AI — inną strukturę. Starsze GAN-y zostawiały tekstury na płaskich polach; diffusion modele mają inne artefakty w skali przestrzennej. Forensyka patrzy na statystyki niewidoczne dla człowieka.
Metadane i proveniencja
Prawdziwe zdjęcia często niosą EXIF (body, obiektyw, czas, GPS). AI zwykle go nie ma albo został zrzucony. Brak EXIF nie dowodzi syntezy (publikacja czyści metadane), ale obecność to pozytywny sygnał. Reverse image search czasem znajdzie źródło generacji obok promptu.
Kiedy wizualnie to za mało
Przy wysokich stawkach potrzebna jest analiza pikseli: widmo mocy, rozkład szumu, artefakty kompresji, statystyki krawędzi. Pipeline obrazowy SUS IT łączy te techniki i zwraca wynik z poziomem pewności — uzupełnia, a nie zastępuje, przegląd człowieka.