Echte afbeeldingen en video's gegenereerd met één prompt. Klik op een kaart om de exacte prompt erachter te zien.
ERNIE-Image is een single-stream Diffusion Transformer getraind om de gevallen aan te kunnen die generatieve modellen meestal breken: leesbare tekst, strikte lay-outs, multi-object prompts en tweetalige instructies. Een lichtgewicht Prompt Enhancer breidt korte inputs uit tot gestructureerde beschrijvingen, zodat je niet hoeft te prompt-engineeren om bruikbare output te krijgen.
ERNIE-Image is een 8B single-stream DiT gekoppeld aan een Prompt Enhancer en een Turbo variant. Dit is waar de architectuur echt goed in is.
De ingebouwde Prompt Enhancer zet een eenregels idee om in een gedetailleerde, gestructureerde prompt. Jij blijft in creatieve modus; het model handelt de prompt-engineering laag af.
Lange teksten op posters, koppen op infographics, tekstballonnen in stripverhalen, labels op UI mockups. Karakters renderen helder waar andere diffusiemodellen tekens uitsmeren of letters hallucineren
Meerdere objecten, specifieke ruimtelijke relaties, kennisrijke prompts. Het model volgt wat je daadwerkelijk beschreef in plaats van in te klappen naar een generieke 'mooi plaatje'
Posters, stripverhalen, storyboards, UI frames, infographics. ERNIE-Image redeneert over pagina-indeling en paneel compositie — niet alleen onderwerp en stijl.
Het volledige 8B checkpoint is vrijgegeven onder Apache 2.0 en draait op een enkele 24GB GPU.
Kies voor elke taak het juiste gereedschap en model, stel de beschikbare opties in en bewaar afgerond werk in één geschiedenis.
Genereer afbeeldingen vanuit tekstbeschrijvingen
Transformeer en verbeter bestaande afbeeldingen
Creëer video's vanuit tekstbeschrijvingen
Animeer je afbeeldingen tot video's
Bekijk de generatiestatus en open voltooide beeld- of videoresultaten opnieuw vanuit een gedeelde assetbibliotheek.
Modelnamen, creditkosten en ondersteunde parameters blijven zichtbaar voordat een generatie start.
Alles wat je moet weten over ERNIE-Image