De afgelopen drie jaar zijn door AI gegenereerde beelden waarneembaar door geoefende ogen: subtiele aanwijzingen in de handen, inconsistenties in de belichting, de griezelige vallei van gezichten die er bijna goed uitzagen, maar niet helemaal. Dat tijdperk is voorbij. De nieuwste generatie beeldmodellen heeft een drempel overschreden waarvan onderzoekers voorspelden dat het nog twee tot drie jaar zou duren, en de implicaties voor de media, het recht en het vertrouwen van het publiek zijn diepgaand.
De nieuwe modellen
Drie modellen die in de afgelopen zes maanden zijn uitgebracht – Midjourney v8, Adobe Firefly 4 en Google's Imagen 4 – hebben onafhankelijk de drempel van fotorealisme overschreden. In blinde tests uitgevoerd door onderzoekers van het Media Lab van MIT en gepubliceerd in een preprint op arXiv, identificeerden menselijke beoordelaars door AI gegenereerde beelden slechts 51,3% van de tijd correct – statistisch niet te onderscheiden van willekeurig gokken. Bij het onderzoek werden 10.000 beeldparen gebruikt die aan 2.400 deelnemers werden getoond, waardoor het de grootste gecontroleerde evaluatie van AI-beelddetectie tot nu toe is.
De resultaten werden verzameld in verschillende beeldcategorieën: portretten, landschappen, architectuurfotografie, productfoto's en documentairebeelden in nieuwsstijl. Deelnemers met een professionele fotografieachtergrond presteerden niet beter dan de algemene bevolking. De enige categorie waarin mensen een betekenisvol detectievermogen behielden, waren afbeeldingen die specifieke gebeurtenissen in de echte wereld uitbeeldden – waarbij contextuele kennis, en niet visuele analyse, voor correcte identificatie zorgde.
Wat er technisch is veranderd
De doorbraak kwam van een combinatie van verbeterde diffusie-architecturen, training op samengestelde datasets van hogere kwaliteit en een nieuwe techniek genaamd 'physics-aware rendering' die het gedrag van licht met ongekende nauwkeurigheid modelleert. Eerdere modellen worstelden met spiegelende highlights, ondergrondse verstrooiing in de huid en de complexe interactie van licht met doorschijnende materialen. De nieuwe modellen kunnen dit allemaal correct verwerken.
Handen – lange tijd het veelbetekenende teken van AI-generatie – worden nu met anatomische nauwkeurigheid weergegeven. De modellen hebben niet alleen geleerd hoe handen eruit zien, maar ook hoe ze vervormen onder verschillende grepen, hoe pezen en aderen verschijnen onder verschillende lichtomstandigheden, en hoe vingers elkaar afsluiten in complexe houdingen. Het technische rapport van Adobe schrijft dit toe aan een speciale handgeneratiemodule die is getraind op een dataset van 50 miljoen handfoto's met nauwkeurige anatomische annotaties.
De verificatiecrisis
De gevolgen voor de media, juridische procedures en het vertrouwen van het publiek zijn ernstig. Bestaande AI-detectietools – waaronder Google’s SynthID en Microsoft’s Content Credentials – slagen er niet in om afbeeldingen van de nieuwste modellen te detecteren met een snelheid van boven de 60%. De C2PA-standaard (Coalition for Content Provenance and Authenticity), die cryptografische metagegevens over de herkomst in afbeeldingen insluit tijdens het maken ervan, biedt een betrouwbaardere oplossing – maar alleen voor afbeeldingen die zijn gemaakt door tools die de standaard implementeren, en alleen als de metagegevens tijdens de overdracht niet worden verwijderd.
Nieuwsorganisaties reageren met nieuwe verificatieprotocollen. De Associated Press, Reuters en AFP hebben de afgelopen drie maanden allemaal hun richtlijnen voor beeldverificatie bijgewerkt, waardoor aanvullende herkomstcontroles nodig zijn voor elk beeld uit een bron die niet onafhankelijk kan worden geverifieerd. Verschillende hebben geïnvesteerd in speciale AI-detectieteams. Maar voor het fundamentele probleem – dat visuele analyse alleen niet langer betrouwbaar onderscheid kan maken tussen echt en synthetisch – bestaat geen zuivere technische oplossing.
Juridische en bewijskrachtige implicaties
Rechtbanken in Australië, Groot-Brittannië en de Verenigde Staten worstelen met de toelaatbaarheid van fotografisch bewijsmateriaal in een tijdperk van niet-detecteerbare synthetische beelden. De Federal Rules of Evidence in de VS zijn niet bijgewerkt om door AI gegenereerde beelden aan te pakken, en rechters passen bestaande authenticatiestandaarden – die zijn ontworpen voor een tijdperk waarin foto’s vermoedelijk authentiek waren – toe op een fundamenteel ander bewijslandschap.
Verschillende spraakmakende zaken zijn al gecompliceerd door AI-beeldbewijs. In een lasterzaak in New South Wales introduceerde de beklaagde door AI gegenereerde beelden die de aanklager in een compromitterende situatie wilden laten zien; de afbeeldingen werden uiteindelijk door metadata-analyse als synthetisch geïdentificeerd, maar de zaak benadrukte de kwetsbaarheid van de bestaande wettelijke kaders.
Creatieve toepassingen
Voor legitiem creatief gebruik zijn de nieuwe modellen transformatief. Filmproductiebedrijven gebruiken ze voor pre-visualisatie, waardoor de kosten van conceptontwikkeling met 80-90% worden verlaagd. Reclamebureaus genereren fotorealistische productfoto's zonder fysieke fotografie. Architecten maken renderingen die niet te onderscheiden zijn van foto's van voltooide gebouwen. De creatieve economie wordt rond deze instrumenten geherstructureerd, of de industrie er nu klaar voor is of niet.
De economische ontwrichting van de commerciële fotografie is aanzienlijk. Stockfotografieplatforms melden een daling van 40% in het aantal inzendingen van nieuwe bijdragers in de afgelopen twaalf maanden, omdat kopers steeds vaker aangepaste afbeeldingen genereren in plaats van bestaande afbeeldingen te licentiëren. Professionele fotografen wier werk werd gebruikt om deze modellen te trainen – zonder compensatie of toestemming – voeren class action-rechtszaken in meerdere rechtsgebieden.
Bronnen en verder lezen
- arXiv - "Door AI gegenereerde afbeeldingen detecteren: een overzicht van methoden en benchmarks" (2024)
- C2PA — Coalition for Content Provenance and Authenticity, de open standaard voor de herkomst van afbeeldingen
- Adobe — Witboek van het Content Authenticity Initiative en technische documentatie van Firefly 4
- MIT Media Lab - onderzoek naar studies naar synthetische mediadetectie en menselijke perceptie
- Midjourney - v8-showcase en documentatie van mogelijkheden