AI woordenboek

Wat is text to image?

Text to image is generatieve AI die op basis van een tekstuele beschrijving een compleet nieuwe afbeelding maakt.

Typ je bijvoorbeeld ‘een kat die op de maan skateboardt’, dan levert de AI binnen enkele seconden een bijpassende, nooit eerder bestaande afbeelding op.

Hoe werkt text-to-image?

Het model is getraind op miljoenen afbeeldingen met bijbehorende beschrijvingen, en heeft zo geleerd welke woorden bij welke visuele patronen horen. Bij het genereren begint het model met een soort willekeurige beeldruis, en verfijnt dat stap voor stap tot een beeld dat past bij jouw beschrijving. Dit hele proces duurt meestal maar een paar seconden.

Bekende tools

Bekende voorbeelden van text-to-image tools zijn Midjourney en DALL-E. Deze tools werken meestal met een chatvenster of een simpel tekstvak: je typt je beschrijving in, en krijgt binnen enkele seconden een of meerdere afbeeldingen te zien.

Betere prompts, betere resultaten

De kwaliteit van je beschrijving bepaalt sterk hoe goed het resultaat is. Een vage beschrijving zoals ‘een mooi landschap’ levert een generiek beeld op. Voeg je details toe over stijl, kleuren, belichting en compositie, dan krijg je een resultaat dat veel dichter bij wat je voor ogen had. Dit werkt in de kern hetzelfde als een goede prompt schrijven voor een chatbot.

Discussie rond trainingsdata

Net als bij AI-muziek is er discussie over de miljoenen afbeeldingen waarmee deze modellen getraind zijn. Veel daarvan is auteursrechtelijk beschermd werk van kunstenaars en fotografen, die daar vaak geen toestemming voor gaven of vergoeding voor kregen. Dit onderwerp speelt in meerdere lopende rechtszaken tegen grote AI-bedrijven, wereldwijd.

Let op: labelplicht

Een volledig AI-gegenereerde afbeelding die op een echt persoon, plek of gebeurtenis lijkt, kan onder de regels voor deepfakes vallen. In dat geval moet je in de EU duidelijk en zichtbaar aangeven dat de afbeelding met AI is gemaakt of bewerkt, ook als daar geen kwade bedoeling achter zat.