W dobie powszechnego dostępu do zaawansowanych generatorów obrazów, odróżnienie fotografii wykonanej aparatem od dzieła sztucznej inteligencji staje się coraz trudniejszym wyzwaniem. Algorytmy typu Midjourney, DALL-E czy Stable Diffusion osiągnęły poziom, w którym na pierwszy rzut oka wszystko wydaje się poprawne. Jednak diabeł tkwi w szczegółach, których oprogramowanie jeszcze nie opanowało w sposób doskonały. Umiejętność krytycznej analizy wizualnej to dziś jedna z najważniejszych kompetencji w internecie, pozwalająca uniknąć dezinformacji i nieświadomego udostępniania sfabrykowanych treści.
Dłonie i palce jako pięta achillesowa sztucznej inteligencji
Najbardziej znanym wskaźnikiem ingerencji AI pozostaje anatomia ludzkiego ciała, a w szczególności dłonie. Choć najnowsze modele radzą sobie z tym problemem znacznie lepiej niż ich poprzednicy sprzed roku, nadal zdarzają im się rażące błędy. Przyjrzyj się uważnie liczbie palców – często jest ich sześć lub układają się w nienaturalne, powyginane formy. AI ma ogromny problem z logiką łączenia stawów, dlatego dłoń trzymająca przedmiot często zlewa się z nim w jedną, niemożliwą do zidentyfikowania masę. Jeśli widzisz postać, której palce wyglądają jak roztopiony wosk lub przenikają przez trzymany obiekt, możesz mieć pewność, że to wygenerowana grafika.
Analiza tła i elementów drugoplanowych
Sztuczna inteligencja skupia się na głównym temacie zdjęcia, ignorując często logikę tła. Kiedy przyglądasz się fotografii, przeprowadź tzw. test drugiego planu. Czy postacie za głównym bohaterem mają wyraźne rysy twarzy, czy przypominają rozmytą plamę? Czy budynki w oddali mają proste linie, czy może ich struktura zakrzywia się w nierealny sposób? AI często tworzy chaotyczne wzory, które na pierwszy rzut oka wyglądają jak profesjonalny efekt bokeh, ale przy bliższym poznaniu okazują się zbiorem przypadkowych kształtów, cieni i niedokończonych konstrukcji architektonicznych. W prawdziwej fotografii nawet nieostre elementy zachowują swoją spójną geometrię.
Tekst, litery i nietypowe znaki
Kolejnym obszarem, w którym algorytmy potykają się niemal na każdym kroku, są napisy. Wygenerowana przez AI gazeta, billboard czy koszulka z nadrukiem zazwyczaj zawierają ciąg znaków, który przypomina pismo, ale po literowaniu okazuje się całkowitym bełkotem. Jeśli na zdjęciu widać drogowskaz lub etykietę, która wygląda jak połączenie alfabetu łacińskiego z jakimiś dziwnymi symbolami, masz przed sobą dzieło sieci neuronowej. Maszyny nie czytają tekstu w taki sam sposób jak ludzie; traktują go jako element wizualny, przez co często tworzą zbitki liter niebędące żadnym istniejącym językiem.
Nienaturalne oświetlenie i cienie
Fotografia to gra światła i cienia, którą profesjonalni fotografowie opanowują przez lata. AI natomiast buduje scenę, często stosując wiele źródeł światła, które nie mają logicznego uzasadnienia w przestrzeni. Sprawdź, czy cienie rzucane przez obiekty pokrywają się z kierunkiem padania głównego światła. Często zdarza się, że postać jest oświetlona z przodu, a jej cień sugeruje źródło światła umieszczone zupełnie gdzie indziej. Ponadto skóra na wygenerowanych portretach bywa podejrzanie gładka, wręcz plastikowa, pozbawiona porów, zmarszczek czy naturalnych niedoskonałości, co nadaje zdjęciom charakterystyczny, “cyfrowy” szlif, którego nie da się uzyskać nawet najlepszymi filtrami kosmetycznymi.
Spójność fizyczna przedmiotów i detali
Na koniec warto poświęcić chwilę na detale akcesoriów osobistych, takich jak kolczyki, okulary czy wzory na ubraniach. AI ma tendencję do “gubienia” symetrii. Przyjrzyj się oprawkom okularów – czy zauszniki kończą się w tym samym miejscu? Czy kolczyki w uszach mają identyczny kształt? Często zdarza się, że lewa strona biżuterii wygląda zupełnie inaczej niż prawa, lub wzór na swetrze nagle zmienia kierunek w sposób fizycznie niemożliwy dla splotu tkaniny. Tego typu błędy są wynikiem działania algorytmu próbującego przewidzieć, jak powinien wyglądać dany obiekt, nie rozumiejąc jednak jego konstrukcji i przeznaczenia w rzeczywistym świecie.

