
Ideogram 4.0 er nu open-weight: Hvad kører på et 24GB GPU (2026)
Ideogram 4.0 landede den 3. juni 2026, og det brød mønsteret. Alle tidligere Ideogram-versioner levede bag en webapp. Denne her leverer vægte. Du kan hente en model med 9,3 milliarder parametre fra Hugging Face og køre nf4-versionen på ét enkelt 24GB GPU, som et RTX 4090, derhjemme. Det er ikke den æstetiske mester. På DesignArena Elo-brættet ligger GPT Image 2 foran med cirka 1405, mens Ideogram 4.0 lander omkring 1285. Men til tekst og typografi? Intet åbent kommer i nærheden. Her er den ærlige gennemgang.
Hurtig dom:
- Ideogram 4.0 (3. juni 2026) er Ideograms første open-weight-model: en 9,3B-param DiT, der kører på et 24GB GPU.
- Den vinder suverænt på tekst og typografi; den halter efter GPT Image 2 på æstetisk Elo (~1285 mod ~1405).
- Tre måder at bruge den på: webapp, cloud-API eller lokal self-host via nf4-checkpointet.
- "Open-weight" er ikke open-source her. Downloadlicensen er ikke-kommerciel. Tjek den, før du udgiver.
Hvad er Ideogram 4.0?
Ideogram 4.0 er en model med 9,3 milliarder parametre til tekst-til-billede, udgivet den 3. juni 2026, og det er den første Ideogram, du kan downloade og køre selv. Alle udgivelser før den, fra 0.1 til 3.0, var kun i skyen. Hovedfunktionen er bedst-i-klassen tekstgengivelse i native 2K-opløsning, rettet mod designere, udviklere og alle, der genererer plakater, logoer eller skiltning.
Så hvad er der faktisk under hjelmen? Et par specifikationer værd at kende, kort holdt:
- Arkitektur: en Diffusion Transformer (DiT). I almindelige termer er det en model, der starter fra visuel støj og forfiner den trin for trin mod dit prompt, ved hjælp af den samme transformer-matematik, der driver store sprogmodeller. "9,3B" er dens parameterantal, hvilket er lille ved siden af Flux 2's ~32B.
- Tekst-encoder: Ideogram parrer den med en Qwen3-VL vision-sprog-encoder, hvilket er hovedårsagen til, at dens bogstaver kommer ud så rene.
- Opløsning: native 2K-output, ingen opskalerings-tricks nødvendige.
- Magic Prompt: en valgfri auto-forbedrer, der omskriver dit korte prompt til et rigere, før generering. Praktisk til casual brugere, irriterende hvis du vil have præcis kontrol. Du kan slå den fra.
Den rigtige historie er dog ikke arkitekturen. Det er, at Ideogram sluttede sig til bølgen af open-weight-modeller, der har omformet, hvordan teams bygger med AI. Hvis du har fulgt årets open-weight LLM-udgivelser, kender du allerede mønsteret: et stærkt proprietært lab lægger downloadbare vægte op, og pludselig kan hobbyfolk og startups selv hoste, hvad der før var et API-kun produkt. Ideogram 4.0 er den første version, du kan downloade og køre på din egen hardware. Ifølge Ideograms officielle tekniske indlæg ligger vægtene på Hugging Face i to kvantiserede varianter, og inferens-koden er på GitHub.
Kan du faktisk køre Ideogram 4.0?
Ja, på tre forskellige måder. Webappen kræver nul opsætning og passer til casual- og designbrugere. Cloud-API'et er til udviklere, der integrerer billedgenerering i en app. Og lokal self-host er den nye: download de åbne vægte fra Hugging Face, kør dem på et 24GB GPU og betal intet per billede. Vælg den vej, der matcher din hardware og dit budget.
Sådan vælger du:
- Webapp på ideogram.ai. Vælg denne, hvis du bare vil have billeder og ikke vil tænke på GPU'er. Der findes et gratis niveau, betalte planer tilføjer volumen og hastighed.
- Cloud-API. Vælg dette, hvis du bygger billedgenerering ind i et produkt og vil have forudsigelig fakturering per billede uden at eje et GPU. Priserne er i næste afsnit.
- Lokal self-host. Vælg dette, hvis du har et 24GB-kort og vil have ubegrænset generering uden omkostninger per billede. Dette er også vejen, hvis du går op i privatliv eller vil finetune.
Til den lokale vej er den praktiske vej lige nu ComfyUI, den node-baserede grænseflade, som de fleste åbne billedmodeller målretter først. Det grundlæggende flow ser sådan ud:
- Accepter licens-gaten på Hugging Face-modelsiden (
ideogram-ai/ideogram-4-nf4) og download checkpointet. - Læg det i din ComfyUI-modelmappe.
- Indlæs et community-Ideogram 4.0-workflow (flere cirkulerer allerede).
- Generer.
En faldgrube: i slutningen af juni 2026 understøttes fp8-checkpointet endnu ikke i Diffusers-biblioteket, så fp8-brugere er mest på ComfyUI. nf4-versionen har bredere værktøjsunderstøttelse. Hvis du hellere vil springe lokal hardware helt over, kan du deploye det til et cloud-GPU og leje VRAM'en i minuttakt, hvilket er det samme trick, folk bruger til at køre åbne modeller lokalt uden at købe en 4090.
Hvilken hardware og VRAM skal du bruge for at køre den lokalt?
nf4-checkpointet på et 24GB VRAM-kort (som et RTX 4090) er sweet spot. 16GB er en stram omgang, der virker med offloading, men sænker farten. 32GB og opefter er komfortabelt. Den mere højtrofaste fp8-version vil have mere, realistisk set en A100 eller H100. Og for at være klar: dette er GPU-VRAM, ikke system-RAM.
| Checkpoint | Min VRAM | Anbefalet GPU | Kvalitet | Noter |
|---|---|---|---|---|
| nf4 | ~16GB (stramt) | 24GB (RTX 4090) | God | Diffusers-understøttet; sweet spot |
| fp8 | ~32GB+ | A100 / H100 | Højere | Ingen Diffusers-understøttelse endnu; ComfyUI-vejen |
Hvis du har et 24GB-kort, kan du køre Ideogram 4.0 derhjemme. Alt mindre, og du presser.
Hvad med Mac? Ærligt svar: der er endnu ingen praktisk lokal vej til Apple Silicon. Det udgivne værktøj antager CUDA, hvilket betyder Nvidia. M-serie Macs kan ikke køre checkpointerne brugbart i dag, så Mac-brugere bør holde sig til webappen eller API'et. Det kan ændre sig, efterhånden som communityet porter tingene, men køb ikke en Mac Studio i forventning om at self-hoste dette i juni 2026.
Genereringshastighed afhænger stærkt af dit præcise GPU, så jeg opfinder ikke et tal. Reddit-brugere, der tester nf4-versionen, rapporterer, at 2K-billeder på en 4090 lander i de lave titals sekunder, men behandl det som et community-tal, ikke en lab-benchmark. Hvis du har brug for præcis latenstid til produktionsplanlægning, så mål det på dit eget kort. Pointagen, der betyder noget: et consumer-24GB-GPU er reelt nok, hvilket aldrig var sandt for Ideogram før.
Hvad koster Ideogram 4.0-API'et?
Ideogram 4.0-API'et opkræver et fast gebyr per output-billede, opdelt i tre niveauer: Turbo til cirka $0,03, Default til cirka $0,06 og Quality til cirka $0,10. Der er også et gratis webapp-niveau til casual brug. Disse tal er fra den officielle prisside per 26. juni 2026, så bekræft dem live, før du budgetterer i stor skala.
| Niveau | Pris per billede | Bedst til |
|---|---|---|
| Turbo | ~$0,03 | Kladder, bulk-iteration |
| Default | ~$0,06 | Daglig produktion |
| Quality | ~$0,10 | Endelige hero-assets |
En forespørgsel, der returnerer fire billeder, koster fire gange prisen per billede, så batch kun generøst, når du mener det. Matematikken er enkel: hvis du genererer tusindvis af billeder om måneden, slår self-hosting af de åbne vægte på dit eget GPU til sidst API'et på omkostninger. Under et par hundrede om måneden er API'et billigere end strøm og en 4090. Ideograms egen API-prisside er kilden, du skal stole på her, siden launch-ugens blogs allerede citerede forældede tal.
Hvad er Ideogram 4.0 faktisk god til?
Tekst. Det er svaret på ét ord. Ideogram 4.0 gengiver læsbar, korrekt stavet tekst med flere ord bedre end nogen åben model og de fleste lukkede. Den håndterer også flersproget skiltning, logoer med taglines, plakatlayout via strukturerede JSON-prompts og rene 2K-fotorealistiske produktbilleder. Hvis dit arbejde involverer ord inde i billedet, er dette modellen.
Lad os bryde hver styrke ned:
- Tekst og typografi. Dette er signaturen. Ideogram rapporterer cirka 0,97 X-Omni OCR-nøjagtighed på tæt tekst i sit tekniske skriv, hvilket er andelen af gengivne tegn, en læser korrekt kan tyde. Til sammenligning målte en uafhængig anmeldelse Midjourney til omkring 30% på tekst med flere ord, og Flux-varianter i området 30 til 40%. Det gab er enormt.
- Flersproget tekst. Latinske skriftsprog kommer ud rene, og spansksprogede testere på Reddit roste specifikt dens håndtering af accenter og diakritiske tegn.
- Logoer og taglines. Brand-mockups med et navn plus en strapline gengives skarpt, hvilket er grunden til, at designteams kredser om den.
- Layoutkontrol via JSON. Dette er den udviklervenlige del. Du kan sende et struktureret prompt med bounding bokse, der fortæller modellen, hvor hvert element skal være.
Her er et minimalt JSON-stil layout-prompt for at vise idéen:
{
"prompt": "minimalist coffee shop poster, cream background",
"elements": [
{ "type": "heading", "text": "MORNING RITUAL", "box": [0.1, 0.1, 0.9, 0.3] },
{ "type": "subtext", "text": "single-origin, slow-brewed", "box": [0.1, 0.35, 0.9, 0.45] }
]
}Den bounding-boks-kontrol er det, der adskiller "et billede med ord" fra "et designet layout," og det er sjældent i denne modelklasse.

En hurtig ærlighedsnote om dataene nedenfor. Jeg kørte ikke personligt en privat 10-prompt lokal test, så jeg vil ikke forfalske en. I stedet er her en syntese af, hvad de dokumenterede offentlige tester rapporterer, hver tilskrevet sin kilde. Billederne i denne artikel (ovenfor og længere nede) er vores egne originale genereringer, lavet med Higgsfield ved hjælp af GPT Image 2 og FLUX.2 som stand-ins for kvalitetsniveauerne, ikke bogstaveligt Ideogram-output.
| Opgave | Dokumenteret resultat | Kilde |
|---|---|---|
| Plakattekst med flere ord | ~0,97 OCR-nøjagtighed på tæt tekst | Ideogram (X-Omni OCR, officiel blog) |
| Flersproget skiltning | Stærk på latinske skriftsprog; spansk rost | Reddit r/LocalLLaMA-testere |
| Logo + tagline | Rent og læsbart | goenhance-anmeldelse |
| Hænder i travle scener | Ofte ødelagt | goenhance-anmeldelse |
| Ansigt + billedtekst sammen | Konflikter rapporteret | goenhance-anmeldelse |
| 2K-fotorealistisk produkt | Godt, men bag GPT Image 2 / Imagen | Artificial Analysis-leaderboard |
På tværs af de dokumenterede offentlige anmeldelser er konsensus konsistent: til teksttungt arbejde kommer ingen anden åben model i nærheden.
Hvor kommer Ideogram 4.0 til kort?
Den er kontant, hvor den taber. Hænder går i stykker i travle kompositioner. Scener med flere personer bliver mudrede. At bede om et ansigt og en læsbar billedtekst i samme billede får ofte den ene til at lide. Sikkerhedsfiltrene er aggressive og afviser meget. Og JSON-promptingen, der driver layoutkontrol, tilføjer reel friktion for casual brugere.
Fejltilstandene, som anmeldere bliver ved med at ramme:
- Hænder og anatomi. I goenhances anmeldelse blev hænder forringet i de fleste travle, multi-element billeder. Bed om en person, der holder et skilt, og du får ofte flot typografi over en hånd med seks fingre.
- Ansigt plus tekst sammen. Når et prompt kræver både et genkendeligt ansigt og en læsbar billedtekst, har modellen tendens til at ramme den ene og fumle den anden.
- Travle menneskescener. Mængder og komplekse interaktioner mister sammenhæng hurtigere, end de gør på GPT Image 2 eller Imagen.
- Sikkerhedsfiltre. Indholdsfiltrerne er strenge og udløses af masser af godartede prompts. Hvis du har brug for ubegrænset output, er dette ikke din model.
- JSON-friktion. Bounding-boks-promptingen er kraftfuld, men besværlig. Casual brugere vil finde den langsommere end Midjourneys "skriv en sætning"-flow.
Så ræk ikke ud efter Ideogram 4.0, når du har brug for tætpakkede menneskescener, rå fotorealistiske portrætter, lavfriktions casual-generering eller noget, filtrene vil afvise. Til dem er Imagen og Flux 2 Pro bedre valg. Brug den til det, den er elite til, og send resten videre.
Kan Ideogram 4.0 erstatte Midjourney, GPT Image 2 og Flux 2?
Delvist, og kun til det rigtige job. Ideogram 4.0 vinder suverænt på tekst, typografi og på at være open-weight og lokalt kørbar. Den taber på æstetisk Elo og anatomi. På DesignArena-brættet ligger den omkring 1285, mens GPT Image 2 fører med omkring 1405. Der er ingen enkelt vinder her. Det afhænger helt af din use case.

Her er head-to-head efter use case:
| Model | Bedst til | Tekstgengivelse | Åbne vægte / lokal | Æstetisk Elo |
|---|---|---|---|---|
| Ideogram 4.0 | Tekst, logoer, plakater | Bedst i klassen | Ja (24GB GPU) | ~1285 (midterste topklasse) |
| GPT Image 2 | Allround, fotorealistisk | Stærk | Nej | ~1405 (fører) |
| Midjourney v7 | Kunstnerisk, æstetisk | Svag (~30%) | Nej | Høj |
| Flux 2 [dev/Pro] | Fotorealistisk, anatomi | Svag til middel | dev er åben | Varierer |
| Imagen | Fotorealistisk | Middel | Nej | Høj |
| Recraft | Vektor, design | Stærk | Nej | Ikke listet |
En note om tallene: benchmark-kilder er vildt uenige på tværs af nettet, så læs Elo-tallene som "omkring X," ikke evangelium. Jeg tjekkede Artificial Analysis tekst-til-billede-leaderboard den 26. juni 2026, og selv der skifter placeringerne, efterhånden som nye poster tilføjes. Den ærlige ramme: Ideogram 4.0 er en 9,3B-model, der holder stand mod rivaler to og tre gange dens størrelse, hvilket er imponerende, men den topper ikke det æstetiske bræt. Det gør GPT Image 2.
Så hvem bør skifte? Hvis dit output er plakater, annonce-kreativer, logoer eller noget med ord, kan Ideogram 4.0 erstatte Midjourney helt og slår ofte GPT Image 2 på selve teksten. Hvis du har brug for malerisk kunst, fotorealistiske mennesker eller tætpakkede scener, så behold dit nuværende værktøj. Modelgabet viser sig tydeligst i teksttroskab, hvilket sammenligningen nedenfor gør åbenlyst.

Hvis du vælger en generator til en specifik pipeline, afgør use casen alt. Vi er gået i dybden med tilstødende valg før, fra AI-billedværktøjer til game assets til andre generative kunst-værktøjer, vi har sammenlignet, og den samme regel gælder: match modellen til jobbet, jagt ikke en enkelt leaderboard-placering.
Er Ideogram 4.0 virkelig open source?
Nej, ikke i den rene OSI-forstand, og det er den del, de fleste guides får galt. Ideogram kalder det "open-weight," hvilket er præcist. Du kan downloade vægtene gratis. Men den faktiske licens på Hugging Face-modelkortet er Ideogram Non-Commercial Model Agreement. Det betyder gratis til personlig og forskningsbrug, betalt licens krævet til kommerciel udrulning. Verificer det, før du udgiver noget.
Lad os rydde op i forvirringen, for der er meget af den. Wikipedia og adskillige launch-uge-blogs hævdede Apache 2.0. Det er forkert. Når du åbner ideogram-ai/ideogram-4-nf4-modelkortet og klikker gennem adgangsgaten, er licensen, du accepterer, Non-Commercial Model Agreement, uden nogen omsætningstærskel og ingen småvirksomheds-undtagelse. Enhver monetiseret brug af de selv-hostede vægte kræver en separat forhandlet kommerciel licens fra Ideogram. Reddits r/LocalLLaMA fangede dette inden for dage efter launch, og det forbliver det mest debatterede punkt om udgivelsen.
Downloadbare vægte er ikke det samme som en tilladende licens. Læs Ideograms LICENSE, før du udgiver noget kommercielt.
Hvad betyder det i praksis?
- Personlige projekter, forskning, læring: fint, gå bare i gang.
- Klientarbejde, produkter, betalte tjenester: du har brug for en kommerciel licens. At self-hoste den gratis download for en betalende klient overtræder aftalen.
- Finetuning og LoRA: teknisk muligt, da vægtene er downloadbare, og communityet træner allerede adaptere. Men den samme ikke-kommercielle begrænsning gælder for, hvad du gør med resultaterne.
Dette er ikke en grund til at undgå modellen. Det er en grund til at læse vilkårene. Masser af teams vil bruge API'et (som kommer med kommercielle rettigheder) til produktion og beholde den lokale download til eksperimenter. Antag bare ikke, at "open-weight" betyder "gør hvad du vil," for her gør det ikke.
Om forfatteren
Mert Batur Gurbuz er medstifter af Techsy.io, hvor teamet leverer AI-agenter, automatiseringssystemer og voice/SDR-pipelines til B2B-klienter. Han studerer på University of Birmingham og skriver om LLM-værktøjs-stakken, som Techsy-teamet faktisk bruger i produktion. Medstifter, Techsy.io, University of Birmingham. Forbind på LinkedIn.
Ofte stillede spørgsmål
Er Ideogram 4.0 open source?
Ikke i streng forstand. Ideogram kalder det "open-weight," hvilket er fair: vægtene kan downloades fra Hugging Face. Men licensen er Ideogram Non-Commercial Model Agreement, ikke Apache 2.0, på trods af at nogle blogs hævder andet. Den er gratis til personlig og forskningsbrug, og kommerciel udrulning kræver en separat betalt licens.
Hvor meget VRAM skal du bruge for at køre Ideogram 4.0?
Et 24GB GPU (som et RTX 4090), der kører nf4-checkpointet, er sweet spot. 16GB virker teknisk med memory offloading, men kører langsommere og strammere. 32GB og opefter er komfortabelt, og den højere kvalitet fp8-version vil realistisk set have en A100 eller H100. Husk, at dette er GPU-VRAM, ikke system-RAM.
Kan Ideogram 4.0 køre på en Mac?
Ikke praktisk, i hvert fald ikke i juni 2026. Det udgivne værktøj antager CUDA, hvilket betyder Nvidia-GPU'er. Apple Silicon Macs kan endnu ikke køre checkpointerne brugbart. Mac-brugere bør bruge webappen eller cloud-API'et i stedet. Dette kan ændre sig, hvis communityet porter modellen, men der er ingen brugbar lokal vej i dag.
Er Ideogram 4.0 bedre end Midjourney?
Til tekst, logoer og plakater, ja, med bred margin. Ideogram rapporterer omkring 0,97 OCR-nøjagtighed på tæt tekst mod cirka 30% målt for Midjourney på tekst med flere ord. Til malerisk, kunstnerisk og stiliseret æstetik vinder Midjourney v7 som regel stadig. Vælg baseret på, om dine billeder indeholder læsbare ord.
Er Ideogram 4.0 bedre end GPT Image 2?
Det afhænger af målet. På æstetisk Elo, nej: GPT Image 2 fører med omkring 1405 mod Ideograms ~1285 på DesignArena. På tekstgengivelse og på at være open-weight og lokalt kørbar vinder Ideogram. GPT Image 2 er den bedre allrounder; Ideogram 4.0 er den bedre tekstspecialist.
Hvad koster Ideogram 4.0-API'et?
Per output-billede er niveauerne cirka $0,03 (Turbo), $0,06 (Default) og $0,10 (Quality) per 26. juni 2026. En forespørgsel, der returnerer fire billeder, koster fire gange prisen. Der er også et gratis webapp-niveau til casual brug. Bekræft aktuelle priser på den officielle side, før du budgetterer i stor skala.
Kan jeg bruge Ideogram 4.0 kommercielt?
Kun med den rigtige licens. Den gratis Hugging Face-download er ikke-kommerciel under Ideogram Non-Commercial Model Agreement, så at self-hoste den til betalt arbejde er ikke tilladt. Kommerciel brug kræver enten cloud-API'et (som inkluderer kommercielle rettigheder) eller en separat forhandlet kommerciel licens til vægtene. Verificer modelkortet først.
Hvad er Magic Prompt i Ideogram 4.0?
Magic Prompt er en valgfri funktion, der automatisk omskriver dit korte prompt til et rigere, mere detaljeret, før generering. Den hjælper casual brugere med at få bedre resultater ud af et par ord. Hvis du vil have præcis kontrol over outputtet, kan du slå den fra og skrive dit fulde prompt selv.
Er Ideogram 4.0 gratis?
Delvist. Webappen har et gratis niveau med begrænsninger. Self-hosting af de åbne vægte koster intet per billede, hvis du allerede ejer et 24GB GPU, selvom kommerciel brug stadig kræver en licens. Cloud-API'et er betalt, faktureret per billede. Så det er gratis at prøve og gratis at køre lokalt til personlig brug.
Kan du finetune Ideogram 4.0 eller bruge LoRA?
Ja, teknisk. Fordi vægtene er downloadbare, er finetuning og LoRA-træning mulige, og communityet producerer allerede adaptere. Faldgruben er licensen: den ikke-kommercielle aftale styrer stadig, hvad du gør med alt, hvad du træner oven på basismodellen, så kommercielle finetunes kræver korrekt licensering.
Dommen
Ideogram 4.0 er den vigtigste open-weight billedudgivelse i 2026, men ikke af den grund, hypen antyder. Her er, hvem der bør gøre hvad:
- Kør den lokalt, hvis du har et 24GB GPU, laver teksttungt designarbejde og din brug er personlig eller forskning. Gratis, privat, ubegrænset.
- Brug API'et, hvis du bygger et produkt eller laver klientarbejde, da det inkluderer kommercielle rettigheder og springer hardware-spørgsmålet over.
- Bliv hos GPT Image 2 eller Midjourney, hvis du har brug for fotorealistiske mennesker, malerisk kunst eller tætpakkede scener, hvor Ideogram stadig taber.
Modellen er en tekstgengivelsesspecialist, der tilfældigvis kan downloades, ikke en altfavnende Midjourney-dræber. Behandl den sådan, og du får det bedste ud af den. Og læs licensen, før du udgiver.
Hvis du vejer, hvilket billed- eller AI-model du skal bygge ind i et rigtigt produkt, er det præcis den slags beslutning, vores team træffer med klienter hver uge. Få en gratis konsultation, så hjælper vi dig med at matche modellen til jobbet.