c’t 08-09/2026
Vibe coding voor developers
Cover van
Cover voor ChatGPT als ontwerptool: van plaatjes naar professionele lay-outs

ChatGPT als ontwerptool: van plaatjes naar professionele lay-outs

Lange tijd werden beeldgeneratoren gezien als een speeltuin om bizarre afbeeldingen te maken, zoals katten die trompet spelen. OpenAI wil ChatGPT Image nu tot een tool maken voor professionele visuele communicatie – met leesbare tekst en nauwkeurige lay-outs. We spraken daarover met Adele Li, productmanager bij OpenAI.

Zo zet ChatGPT tekst om in beeld

De eind april 2026 geïntroduceerde beeldgenerator van ChatGPT koppelt het taalmodel aan het afbeeldingsmodel. ChatGPT kan daar niet alleen fotorealistische afbeeldingen, maar ook infographics, handleidingen en bijschriften consistenter mee genereren dan voorheen. We spraken met Adele Li, de productmanager bij OpenAI voor de beeldgenerator van ChatGPT, over hoe het nieuwe model inhoud en verbanden omzet in afbeeldingen, infographics en lay-outs.

Volgens een anekdote was OpenAI aanvankelijk zelf verrast door de manieren waarop gebruikers ChatGPT inzetten. Welke toepassingen op het gebied van beeldgeneratie kwamen het meest onverwacht voor OpenAI?

Ik heb onlangs gesproken met ouders die ons Images 2.0-model hebben gebruikt om hun kinderen thuis les te geven. Ze hebben er een reeks werkbladen en kinderboeken mee gemaakt om de lessen persoonlijker te maken. Alles draait om de favoriete dieren van de kinderen en om wat ze graag zien. Het is kleurrijk en leuk.

Een ander voorbeeld komt van een vrouw die contact met me opnam en vertelde dat ze met Images 2.0 haar eigen bedrijf heeft kunnen opzetten. Ze heeft een yoghurtwinkel geopend en kon haar bedrijfsmateriaal, branding, advertenties en marketing zelf ontwerpen. Ze heeft bijvoorbeeld handleidingen voor haar medewerkers gemaakt over hoe bepaalde taken in de winkel moeten worden uitgevoerd.

Veel kleine ondernemers maken advertenties en posters voor hun bedrijven. Ze zijn in staat om gebruikersinterfaces van professionele kwaliteit te maken. Die geven ze vervolgens door aan Codex, onze programmeeragent, die ze in hun website integreert.

Dat was een grote verandering: van puur afbeeldingen of afbeeldingen in de stijl van Studio Ghibli naar lay-out en tekst.

De weergave van tekst werd lange tijd beschouwd als een zwak punt van generatieve afbeeldingsmodellen.

Tekst is een van onze speerpunten. We wilden ervoor zorgen dat de tekst leesbaar en coherent is en dat de compositie overtuigend overkomt. Als je het probleem van de tekstweergave oplost, ontstaan er zoveel extra toepassingsmogelijkheden voor afbeeldingsmodellen, zoals infographics.

Waarom is het genereren van tekst nu zoveel beter dan voorheen?

We hebben de volgende generatie ontwikkeld op basis van nieuwe technieken voor pre-training en post-training, waaruit Image 2.0 is voortgekomen.

We hebben bij onze gebruikers vastgesteld dat compositie, leesbaarheid, tekst en beschrijvingen voor hen erg belangrijk zijn en dat ze toepassingen willen realiseren waarin we in het verleden niet bijzonder goed waren, zoals handleidingen, infographics, diagrammen voor posters en presentatiedia’s. Daarom hebben we die gegevens gebruikt om een krachtiger model te trainen.

Jarenlang luidde de aanbeveling om zo gedetailleerde prompts als mogelijk te schrijven. Geldt dat nog steeds?

Er zijn eigenlijk helemaal niet meer zoveel prompts nodig om het gewenste resultaat te bereiken. Onze aanbeveling is: houd het simpel. Je hoeft het model niet meer uitgebreid uit te leggen wat je eigenlijk wilt. Je kunt zelfs heel vaag blijven.

Mijn belangrijkste tip voor prompts is om te beginnen met een referentiefoto, bijvoorbeeld een stijlsjabloon voor een dia of een poster. Het model is uitstekend in staat om de esthetiek te volgen van wat je wilt maken.

Bij generatieve AI krijg je niet altijd het resultaat dat je wilt: je geeft de opdracht om de achtergrond te wijzigen, maar het afbeeldingsmodel verandert ook de voorgrond. Hoe pak je dat probleem aan?

Veel van wat je aanstipt, hangt samen met de interactie- of bewerkingskwaliteit: volgt het model de intentie van de gebruiker? We hebben de granulariteit verbeterd en daarmee het vermogen om gedetailleerder te werk te gaan.

Daarnaast hebben we een reeks producttools ontwikkeld die het voor gebruikers makkelijker maken om gebieden te selecteren die ze willen bewerken.

Je moet precies aangeven wat je wilt zien, anders maakt het model generalisaties. In sommige gevallen waarderen gebruikers juist de creatieve vrijheid van het model, omdat het een andere visie ontwerpt dan ze zelf voor ogen hadden.

Lees dit artikel verder

Lees over tech-trends en achtergronden, nieuwe apparatuur, software en toepassingen voor professioneel gebruik. Met c’t heb je altijd de juiste tech-informatie. Word abonnee en lees onbeperkt alle artikelen.
Bekijk abonnementen Al abonnee? Log in

Hoe verandert het werk van creatieve professionals als een idee direct kan leiden tot een visueel concept, een handleiding of een kant-en-klaar communicatiemiddel?

Voor professionals op het gebied van visuele communicatie zou ChatGPT Image 2.0 een vast onderdeel van hun AI-toolkit moeten zijn. Je kunt er nieuwe ideeën mee verkennen.

Ik denk daarbij aan ons marketingteam, dat content creëert en die via sociale media promoot. Vroeger probeerden ze elke week slechts één of twee campagnevarianten uit. Nu kunnen ze meer ideeën doorrekenen, omdat ze het model eenvoudig kunnen vragen om verschillende soorten inspiratie te genereren.

Bovendien kunnen ze de content in verschillende talen lokaliseren.

Je noemde afbeeldingen in de stijl van Studio Ghibli. De oprichter daarvan was niet enthousiast over het feit dat mensen met ChatGPT afbeeldingen in zijn stijl maakten, en zag dat als een inbreuk op zijn intellectuele eigendom. Hoe gaan jullie om met de juridische aspecten van het genereren van afbeeldingen?

We hebben groot respect voor creatieve makers en kunstenaars en zijn ervan overtuigd dat onze modellen en onze technologie hen ten goede kunnen komen.

Bij de ontwikkeling van onze modellen hebben we kunstenaars en filmstudio’s geraadpleegd om advies te krijgen over hoe we dit model beter kunnen vormgeven.

Met welke inhoud heb je het model getraind?

We gebruiken verschillende propriëtaire gegevensbronnen voor onze training, maar ik maak niet openbaar hoe onze gegevensmix precies samengesteld is. We hechten veel waarde aan het beschermen van de privacy van de auteurs en zorgen ervoor dat de gegevens zijn opgeschoond.

Hoe wil je de beeldgenerator voor gebruikers van ChatGPT verder ontwikkelen?

Aan de gebruikerskant werken we eraan om het model te optimaliseren door middel van een gedetailleerdere aanpak voor beeldbewerking. Het doel is dat gebruikers ChatGPT gaan zien als hun standaardtool wanneer ze vragen hebben over een foto, die willen begrijpen, bewerken of aanpassen.

Het moet het eerste aanspreekpunt zijn waar men interactie heeft met zijn visuele bibliotheek van afbeeldingen en video’s.

Jullie videogenerator Sora was behoorlijk populair en is nu verdwenen. Hoe zit het op het gebied van video?

Bij OpenAI hebben we daar een onderzoeksprogramma voor. Het begrip van de wereld door AI ligt ons na aan het hart. De lancering en het stoppen van Sora is eerder een weerspiegeling van onze aanpak bij de productontwikkeling dan onze overtuiging met betrekking tot het onderzoek.

We werken hier continu aan de verdere ontwikkeling van het onderzoeksprogramma.

Er zijn verschillende formaten, waaronder ook video, die in de toekomst zouden kunnen worden ingezet als we onze modellen verder ontwikkelen.

Hoe zal het genereren van afbeeldingen met AI er volgens jou over drie tot vijf jaar uitzien?

Ons doel is om de uitvoermogelijkheden uit te breiden. Het gaat dus niet alleen om foto’s, maar ook om posters, dia’s en infographics over verschillende onderwerpen.

Een speerpunt ligt op het gebied van de echte wereld, bijvoorbeeld in industrieel ontwerp. We willen ervoor zorgen dat het mogelijk is om CAD-tekeningen en architectuurtekeningen te maken, en de toepasbaarheid voor de productie te verbeteren, zodat het mogelijk is tools en objecten helemaal vanaf nul te bouwen.

Daarnaast is er het product-ecosysteem dat we voor ChatGPT en Codex aan het opbouwen zijn. Een aandachtspunt voor mij is de vraag hoe we ervoor kunnen zorgen dat we het genereren van afbeeldingen in ons product voor ontwikkelaars integreren, zodat zij daar een beter front-end-ontwerp mee kunnen maken. Visuele communicatie is van belang voor alle sectoren en alle toepassingsgebieden.

Je had het over CAD. Bij gebouwen en machines is het essentieel om zeer nauwkeurig te werk te gaan. Dat is iets anders dan het maken van een afbeelding waarop een kat spaghetti eet.

Juist daarom is dat een richting voor de toekomst waarin we graag willen investeren. Nauwkeurigheid en bewerking zijn voor ons een speerpunt. Realisme is een ander gebied waarop we ons bij het 2.0-model hebben gefocust. De modellen kunnen inmiddels realistische scenario’s weergeven.

Realisme speelt echter ook een rol als het gaat om industrieel ontwerp en productie, want het model moet alles begrijpen wat mensen eerder hebben gecreëerd. De lay-out van een infographic komt momenteel waarschijnlijk het dichtst in de buurt van een nauwkeurige visuele weergave.

(André Kramer en Daniel Dupré)

  1. Zo zet ChatGPT tekst om in beeld
  2. Volgens een anekdote was OpenAI aanvankelijk zelf verrast door de manieren waarop gebruikers ChatGPT inzetten. Welke toepassingen op het gebied van beeldgeneratie kwamen het meest onverwacht voor OpenAI?
  3. De weergave van tekst werd lange tijd beschouwd als een zwak punt van generatieve afbeeldingsmodellen.
  4. Waarom is het genereren van tekst nu zoveel beter dan voorheen?
  5. Jarenlang luidde de aanbeveling om zo gedetailleerde prompts als mogelijk te schrijven. Geldt dat nog steeds?
  6. Bij generatieve AI krijg je niet altijd het resultaat dat je wilt: je geeft de opdracht om de achtergrond te wijzigen, maar het afbeeldingsmodel verandert ook de voorgrond. Hoe pak je dat probleem aan?
  7. Hoe verandert het werk van creatieve professionals als een idee direct kan leiden tot een visueel concept, een handleiding of een kant-en-klaar communicatiemiddel?
  8. Je noemde afbeeldingen in de stijl van Studio Ghibli. De oprichter daarvan was niet enthousiast over het feit dat mensen met ChatGPT afbeeldingen in zijn stijl maakten, en zag dat als een inbreuk op zijn intellectuele eigendom. Hoe gaan jullie om met de juridische aspecten van het genereren van afbeeldingen?
  9. Met welke inhoud heb je het model getraind?
  10. Hoe wil je de beeldgenerator voor gebruikers van ChatGPT verder ontwikkelen?
  11. Jullie videogenerator Sora was behoorlijk populair en is nu verdwenen. Hoe zit het op het gebied van video?
  12. Hoe zal het genereren van afbeeldingen met AI er volgens jou over drie tot vijf jaar uitzien?
  13. Je had het over CAD. Bij gebouwen en machines is het essentieel om zeer nauwkeurig te werk te gaan. Dat is iets anders dan het maken van een afbeelding waarop een kat spaghetti eet.

Inspiratie in je mailbox

Blijf bij op IT-gebied en verbreed je expertise. Ontvang elke week artikelen over de laatste tech-ontwikkelingen, toepassingen, nieuwe hard- en software én ontvang tips en aanbiedingen.

Loginmenu afsluiten