Iets meer dan een jaar nadat OpenAI ChatGPT-gebruikers de mogelijkheid gaf om afbeeldingen en tekeningen rechtstreeks vanuit de chatbot te maken, brengt het nu ChatGPT Images 2.0 uit. OpenAI beschrijft het nieuwe systeem als een “stapsverandering” voor modellen voor het genereren van afbeeldingen, vooral als het gaat om het vermogen van de tool om instructies in detail te volgen, dichte tekst weer te geven en objecten in een scène te positioneren en met elkaar in verband te brengen. Voor het eerst heeft OpenAI ook een beeldmodel met redeneermogelijkheden gecreëerd, waardoor het systeem onder meer op internet kan zoeken en de resultaten kan verifiëren. Volgens het bedrijf zouden deze mogelijkheden moeten resulteren in een betrouwbaarder hulpmiddel wanneer precisie, consistentie en visuele samenhang essentieel zijn.
Een voorbeeld van de nieuwe niet-Latijnse weergavemogelijkheden van ChatGPT. (Open AI)
OpenAI zegt dat het hard heeft gewerkt om Images 2.0 beter te maken in het begrijpen en weergeven van niet-Latijnse tekst, met “aanzienlijke winst” als het gaat om de mogelijkheid van het model om met Japans, Koreaans, Chinees, Hindi en Bengaals om te gaan. Tegelijkertijd beweert het bedrijf dat het nieuwe model de specifieke kenmerken van verschillende beeldtalen beter getrouw kan reproduceren. Op dit punt zegt OpenAI dat het Images 2.0 nuttiger maakt voor taken als het maken van gameprototyping en storyboarding. Buiten deze functies is het nieuwe model flexibeler als het gaat om de beeldverhouding, waardoor het afbeeldingen kan genereren tot 3:1 breed en tot 1:3 hoog. Het kan ook projecten uitvoeren met resoluties tot 2K en zelfs tot acht uitvoer in één keer genereren.

Een schildpadkat in de stijl van de derde generatie Pokemon-spellen. (ChatGPT)
Ik kreeg de kans om een voorbeeld van Images 2.0 te bekijken voordat het publiekelijk werd uitgebracht. Eerst vroeg ik ChatGPT om een afbeelding van een schildpadkat te genereren in de pixelkunststijl van Pokémon Generation III. Ik dacht dat het een goede test zou zijn, omdat AI-modellen doorgaans moeite hebben met pixelkunst, en de Game Boy Advance Pokémon-spellen iconisch zijn vanwege hun kunststijl, tot het punt dat als ChatGPT maar in de buurt van die stijl zou komen, het niet goed zou zijn. Het resultaat is de afbeelding die je hierboven ziet en ik denk dat ChatGPT lovenswaardig werk heeft geleverd. Vervolgens heb ik de nieuwe sjabloon opdracht gegeven om de afbeelding naar een transparante PNG te converteren. Als laatste test vroeg ik ChatGPT om een manga van vier pagina’s te maken over mijn kat die geniet van een zonnige dag naast een idyllisch stadsbeekje.

Merk op dat de kat niet precies zo wordt weergegeven als hierboven. (ChatGPT)
Van deze drie tests besteedde ChatGPT de meeste tijd aan de tweede en de uitvoer was iets anders dan de eerste gegenereerde afbeelding, wat volgens mij afweek van mijn suggestie. Het is er echter in geslaagd een adequaat transparant beeld te genereren, iets waar andere beeldmodellen moeite mee hebben om het correct te doen. Zodra meer mensen de kans krijgen om het model op de proef te stellen, krijgen we een beter idee van hoe het zich verhoudt tot Google’s Nano Banana 2 en waar OpenAI verdere verbeteringen kan aanbrengen.
Apple steunt Google na EU-opdracht voor openstelling Android
Jelena Kuznetsova/Shutterstock Apple staat achter Google als het gaat om de kritiek van laatstgenoemde op voorstellen van de Europese Unie die AI-diensten…
KitchenAid introduceert slimme thermometer
Keukenhulp KitchenAid heeft zijn eerste slimme thermometer gelanceerd, het eerste van het populaire keukenmerk. Het model met één sonde zal voor $…








