
Ideogram 4.0 er nå open-weight: Hva som kjører på 24 GB GPU (2026)
Ideogram 4.0 kom 3. juni 2026, og det brøt mønsteret. Alle tidligere Ideogram-versjoner levde bak en nettapp. Denne leveres med vekter. Du kan laste ned en 9,3 milliarder parametere stor modell fra Hugging Face og kjøre nf4-bygget på ett enkelt 24 GB GPU, som en RTX 4090, hjemme hos deg. Den er ikke den estetiske vinneren. På DesignArena Elo-lista ligger GPT Image 2 foran med rundt 1405, mens Ideogram 4.0 lander nær 1285. Men for tekst og typografi? Ingen åpen modell er i nærheten. Her er den ærlige gjennomgangen.
Rask konklusjon:
- Ideogram 4.0 (3. juni 2026) er Ideograms første open-weight-modell: en 9,3B-parameter DiT som kjører på 24 GB GPU.
- Den vinner klart på tekst og typografi; den taper mot GPT Image 2 på estetisk Elo (~1285 mot ~1405).
- Tre måter å bruke den på: nettapp, sky-API eller lokal selvhosting via nf4-checkpointet.
- «Open-weight» er ikke open-source her. Nedlastingslisensen er ikke-kommersiell. Les den før du bruker den i produksjon.
Hva er Ideogram 4.0?
Ideogram 4.0 er en 9,3 milliarder parametere stor tekst-til-bilde-modell utgitt 3. juni 2026, og den er den første Ideogram-modellen du kan laste ned og kjøre selv. Alle tidligere versjoner, fra 0.1 til 3.0, var kun tilgjengelige i skyen. Hovedfunksjonen er klassens beste tekstgjengivelse i native 2K-oppløsning, rettet mot designere, utviklere og alle som lager plakater, logoer eller skiltmateriell.
Hva er egentlig under panseret? Noen spesifikasjoner verdt å kjenne til:
- Arkitektur: en Diffusion Transformer (DiT). Enkelt sagt er det en modell som starter fra visuelt støy og raffinerer det steg for steg mot promptet ditt, ved hjelp av den samme transformer-matematikken som driver store språkmodeller. «9,3B» er antall parametere, noe som er lite sammenlignet med Flux 2s ~32B.
- Tekstkoder: Ideogram kombinerer det med en Qwen3-VL syn-og-språk-koder, som er den viktigste grunnen til at bokstavene kommer ut så rene.
- Oppløsning: native 2K-utdata, ingen oppskalering nødvendig.
- Magic Prompt: en valgfri automatisk forbedrer som skriver om det korte promptet ditt til et rikere ett før generering. Praktisk for vanlige brukere, irriterende hvis du vil ha nøyaktig kontroll. Du kan slå det av.
Den egentlige historien er ikke arkitekturen. Det er at Ideogram ble med i bølgen av open-weight-modeller som har omformet hvordan team bygger med AI. Hvis du har fulgt de åpne LLM-utgivelsene i år, kjenner du mønsteret allerede: et sterkt proprietært laboratorium legger ut nedlastbare vekter, og plutselig kan hobbyister og oppstartsbedrifter selvhoste det som pleide å være et kun API-tilgjengelig produkt. Ideogram 4.0 er den første versjonen du kan laste ned og kjøre på din egen maskinvare. Ifølge Ideograms offisielle tekniske innlegg ligger vektene på Hugging Face i to kvantiserte varianter, og inferenskoden er på GitHub.
Kan du faktisk kjøre Ideogram 4.0?
Ja, på tre forskjellige måter. Nettappen krever null oppsett og passer for vanlige brukere og designere. Sky-API er for utviklere som kobler bildegenerering inn i en app. Og lokal selvhosting er den nye: last ned de åpne vektene fra Hugging Face, kjør dem på et 24 GB GPU, og betal ingenting per bilde. Velg den veien som passer din maskinvare og ditt budsjett.
Slik velger du:
- Nettapp på ideogram.ai. Velg dette hvis du bare vil ha bilder og ikke ønsker å tenke på GPU-er. Det finnes et gratisnivå; betalte planer gir mer volum og hastighet.
- Sky-API. Velg dette hvis du bygger bildegenerering inn i et produkt og vil ha forutsigbar fakturering per bilde uten å eie et GPU. Priser er i neste avsnitt.
- Lokal selvhosting. Velg dette hvis du har et 24 GB-kort og vil ha ubegrenset generering uten kostnad per bilde. Dette er også veien hvis du bryr deg om personvern eller vil finjustere modellen.
For den lokale veien er den praktiske ruten akkurat nå ComfyUI, det node-baserte grensesnittet de fleste åpne bildemodeller støtter først. Den grunnleggende flyten ser slik ut:
- Godta lisensportalen på Hugging Face-modellsiden (
ideogram-ai/ideogram-4-nf4) og last ned checkpointet. - Legg det i ComfyUI-modellmappen din.
- Last inn en Ideogram 4.0-arbeidsflyt fra samfunnet (flere sirkulerer allerede).
- Generer.
En ting å merke seg: per slutten av juni 2026 støttes ikke fp8-checkpointet i Diffusers-biblioteket ennå, så fp8-brukere bruker i stor grad ComfyUI. nf4-bygget har bredere verktøystøtte. Hvis du heller vil unngå lokal maskinvare helt, kan du distribuere det til et sky-GPU og leie VRAM per minutt, noe som er det samme trikset folk bruker for å kjøre åpne modeller lokalt uten å kjøpe en 4090.
Hvilken maskinvare og VRAM trenger du for å kjøre det lokalt?
nf4-checkpointet på et 24 GB VRAM-kort (som en RTX 4090) er søtsonen. 16 GB er trangt men fungerer med offloading, bare tregere. 32 GB og oppover er komfortabelt. Den høyere-kvalitets fp8-bygget vil ha mer, realistisk sett et A100 eller H100. Og for å være tydelig: dette er GPU VRAM, ikke system-RAM.
| Checkpoint | Min. VRAM | Anbefalt GPU | Kvalitet | Merknader |
|---|---|---|---|---|
| nf4 | ~16 GB (trangt) | 24 GB (RTX 4090) | Bra | Diffusers-støttet; søtsonen |
| fp8 | ~32 GB+ | A100 / H100 | Høyere | Ingen Diffusers-støtte ennå; ComfyUI-rute |
Har du et 24 GB-kort, kan du kjøre Ideogram 4.0 hjemme. Har du mindre, kjemper du.
Hva med Mac? Ærlig svar: det finnes ingen praktisk Apple Silicon lokal vei ennå. Det utgitte verktøyet forutsetter CUDA, som betyr Nvidia. M-seriens Mac-er kan ikke kjøre checkpointene brukbart i dag, så Mac-brukere bør holde seg til nettappen eller API-et. Det kan endre seg etter hvert som fellesskapet porterer ting, men ikke kjøp en Mac Studio og forvent å selvhoste dette i juni 2026.
Genereringshastigheten avhenger sterkt av det eksakte GPU-et ditt, så jeg finner ikke opp et tall. Reddit-brukere som tester nf4-bygget rapporterer at 2K-bilder på en 4090 tar noen få titalls sekunder, men behandle det som et samfunnstall, ikke et lab-benchmark. Trenger du nøyaktig ventetid for produksjonsplanlegging, timer du det på ditt eget kort. Konklusjonen som teller: et forbrukerkort med 24 GB GPU er faktisk nok, noe som aldri var sant for Ideogram tidligere.
Hva koster Ideogram 4.0 API-et?
Ideogram 4.0 API-et tar en flat avgift per utdatabilde, delt i tre nivåer: Turbo til rundt $0,03, Default til rundt $0,06, og Quality til rundt $0,10. Det finnes også et gratis nettapp-nivå for vanlig bruk. Disse tallene er fra den offisielle prissiden per 26. juni 2026, så bekreft dem direkte før du budsjetterer med høyt volum.
| Nivå | Pris per bilde | Best for |
|---|---|---|
| Turbo | ~$0,03 | Utkast, masseiterasjon |
| Default | ~$0,06 | Daglig produksjon |
| Quality | ~$0,10 | Endelige hoved-ressurser |
En forespørsel som returnerer fire bilder koster fire ganger prisen per bilde, så bruk batch-generering fornuftig. Regnestykket er enkelt: genererer du tusenvis av bilder per måned, slår selvhosting av de åpne vektene på ditt eget GPU til slutt API-et på kostnad. Under noen hundre per måned er API-et billigere enn strøm og en 4090. Ideograms offisielle API-prisside er kilden du bør stole på, siden blogger fra lanseringsuka allerede har sitert utdaterte tall.
Hva er Ideogram 4.0 faktisk godt til?
Tekst. Det er svaret på ett ord. Ideogram 4.0 gjengir lesbar, korrekt stavet flervords-tekst bedre enn noen åpen modell og de fleste lukkede. Den håndterer også flerspråklig skiltmateriell, logoer med slagord, plakatlayout via strukturerte JSON-prompter, og rene 2K fotorealistiske produktbilder. Hvis arbeidet ditt inneholder ord inne i bildet, er dette modellen.
La oss gå gjennom hver styrke:
- Tekst og typografi. Dette er signaturen. Ideogram rapporterer omtrent 0,97 X-Omni OCR-nøyaktighet på tett tekst i sitt tekniske notat, som er andelen gjengitte tegn en leser korrekt kan tyde. Til sammenligning målte en uavhengig anmeldelse Midjourney til rundt 30% på flervords-tekst, og Flux-varianter i 30 til 40%-området. Det gapet er enormt.
- Flerspråklig tekst. Latinske skriftsystemer kommer ut rene, og spanskspråklige testere på Reddit roste spesielt håndteringen av aksenter og diakritiske tegn.
- Logoer og slagord. Merkevaremodeller med navn pluss et slagord gjengis rent, noe som er grunnen til at designteam nå sirkulerer rundt det.
- Layoutkontroll via JSON. Dette er den utviklervennlige delen. Du kan sende et strukturert prompt med avgrensningsbokser som forteller modellen hvor hvert element plasseres.
Her er et minimalt JSON-stil layoutprompt for å illustrere ideen:
{
"prompt": "minimalist coffee shop poster, cream background",
"elements": [
{ "type": "heading", "text": "MORNING RITUAL", "box": [0.1, 0.1, 0.9, 0.3] },
{ "type": "subtext", "text": "single-origin, slow-brewed", "box": [0.1, 0.35, 0.9, 0.45] }
]
}Den avgrensningsboks-kontrollen er det som skiller «et bilde med ord» fra «et designet oppsett», og det er sjeldent i denne klassen av modeller.

En rask ærlighetsnotat om dataene nedenfor. Jeg gjennomførte ikke personlig en privat 10-prompt lokal test, så jeg finner ikke på en. Her er i stedet en syntese av hva de dokumenterte offentlige testene rapporterer, hver tilskrevet sin kilde. Bildene i denne artikkelen (ovenfor og lenger ned) er våre egne originale generasjoner, laget med Higgsfield ved hjelp av GPT Image 2 og FLUX.2 som erstatninger for kvalitetsnivåene, ikke faktisk Ideogram-utdata.
| Oppgave | Dokumentert resultat | Kilde |
|---|---|---|
| Flervords plakattekst | ~0,97 OCR-nøyaktighet på tett tekst | Ideogram (X-Omni OCR, offisiell blogg) |
| Flerspråklig skiltmateriell | Sterkt på latinske skriftsystemer; spansk ros | Reddit r/LocalLLaMA-testere |
| Logo + slagord | Rent og lesbart | goenhance-anmeldelse |
| Hender i travle scener | Hyppig brudd | goenhance-anmeldelse |
| Ansikt + bildetekst sammen | Konflikter rapportert | goenhance-anmeldelse |
| 2K fotorealistisk produkt | Bra men bak GPT Image 2 / Imagen | Artificial Analysis-lista |
På tvers av de dokumenterte offentlige anmeldelsene er konsensus konsistent: for teksttungt arbeid er ingen annen åpen modell i nærheten.
Hvor svikter Ideogram 4.0?
Det er ærlig om hvor det taper. Hender brekker i travle komposisjoner. Scener med flere personer blir uklare. Å be om et ansikt og en lesbar bildetekst i samme bilde får ofte det ene til å lide. Sikkerhetsfiltrene er aggressive og avviser mye. Og JSON-promptingen som driver layoutkontroll gir reel friksjon for vanlige brukere.
Feilmodiene anmeldere støter på igjen og igjen:
- Hender og anatomi. I goenhance sin anmeldelse degraderte hender i de fleste travle, flerelement-bilder. Be om en person som holder et skilt, og du ender ofte med flott skriving over en hånd med seks fingre.
- Ansikt pluss tekst sammen. Når et prompt krever både et gjenkjennelig ansikt og en lesbar bildetekst, pleier modellen å treffe det ene og bomme på det andre.
- Travle menneskescener. Folkemengder og komplekse interaksjoner mister sammenheng raskere enn de gjør på GPT Image 2 eller Imagen.
- Sikkerhetsfiltre. Innholdsfiltrene er strenge og utløses på mange ufarlige prompter. Trenger du ubegrenset utdata, er ikke dette modellen din.
- JSON-friksjon. Avgrensningsboks-promptingen er kraftig men finkjørig. Vanlige brukere vil finne det tregere enn Midjourneys «skriv en setning»-flyt.
Ikke nå for Ideogram 4.0 når du trenger folksomme menneskescener, rå fotorealistisk portrettfotografering, lavfriksjons uformell generering, eller noe filtrene vil avvise. For det er Imagen og Flux 2 Pro bedre valg. Bruk det til det det er best på, og send resten et annet sted.
Kan Ideogram 4.0 erstatte Midjourney, GPT Image 2 og Flux 2?
Delvis, og bare for rett jobb. Ideogram 4.0 vinner klart på tekst, typografi og det å være open-weight og lokalt kjørbart. Det taper på estetisk Elo og anatomi. På DesignArena-lista ligger det nær 1285, mens GPT Image 2 leder på rundt 1405. Det er ingen enkelt vinner her. Det avhenger helt av bruksområdet ditt.

Her er hode-mot-hode per brukstilfelle:
| Modell | Best for | Tekstgjengivelse | Åpne vekter / lokal | Estetisk Elo |
|---|---|---|---|---|
| Ideogram 4.0 | Tekst, logoer, plakater | Klassens beste | Ja (24 GB GPU) | ~1285 (midtre toppnivå) |
| GPT Image 2 | Allsidig, fotorealistisk | Sterk | Nei | ~1405 (leder) |
| Midjourney v7 | Artistisk, estetisk | Svak (~30%) | Nei | Høy |
| Flux 2 [dev/Pro] | Fotorealistisk, anatomi | Svak til midtre | dev er åpen | Varierer |
| Imagen | Fotorealistisk | Midtre | Nei | Høy |
| Recraft | Vektor, design | Sterk | Nei | Ikke listet |
En merknad om tallene: benchmarkkilder er svært uenige på nettet, så les Elo-tallene som «rundt X», ikke som absolutte sannheter. Jeg sjekket Artificial Analysis tekst-til-bilde-lista den 26. juni 2026, og selv der skifter rangeringene etter hvert som nye oppføringer legges til. Den ærlige formuleringen: Ideogram 4.0 er en 9,3B-modell som holder seg mot rivaler to og tre ganger sin størrelse, noe som er imponerende, men den topper ikke det estetiske leaderboardet. GPT Image 2 gjør det.
Hvem bør bytte? Hvis utdataene dine er plakater, annonsekreativt, logoer eller noe med ord, kan Ideogram 4.0 erstatte Midjourney direkte og slår ofte GPT Image 2 på selve teksten. Trenger du malerisk kunst, fotorealistiske mennesker eller folksomme scener, behold det nåværende verktøyet. Modellgapet vises tydeligst i teksttrofasthet, noe sammenligningen nedenfor gjør åpenbart.

Hvis du velger en generator for en spesifikk pipeline, avgjør bruksområdet alt. Vi har gått dypt inn i tilstøtende valg tidligere, fra AI-bildeverktøy for spillressurser til andre generative kunstverktøy vi har sammenlignet, og den samme regelen gjelder: match modellen til jobben, ikke jag etter en enkelt lederboard-rangering.
Er Ideogram 4.0 virkelig open source?
Nei, ikke i den rene OSI-forstand, og dette er den delen de fleste guider tar feil om. Ideogram kaller det «open-weight», noe som er nøyaktig. Du kan laste ned vektene gratis. Men den faktiske lisensen på Hugging Face-modellkortet er Ideogram Non-Commercial Model Agreement. Det betyr gratis for personlig og forskningsmessig bruk, betalt lisens kreves for kommersiell distribusjon. Bekreft det før du leverer noe som helst.
La oss rydde opp i forvirringen, for det er mye av den. Wikipedia og flere lanseringsuke-blogger hevdet Apache 2.0. Det er feil. Når du åpner ideogram-ai/ideogram-4-nf4-modellkortet og klikker gjennom tilgangsporten, er lisensen du godtar Non-Commercial Model Agreement, uten inntektsterskel og uten fritak for små bedrifter. All inntektsgenererende bruk av de selvhostede vektene krever en separat forhandlet kommersiell lisens fra Ideogram. Reddit sitt r/LocalLLaMA fanget dette innen dager etter lanseringen, og det er fortsatt det mest debatterte punktet om utgivelsen.
Nedlastbare vekter er ikke det samme som en tillatende lisens. Les Ideograms LICENSE før du leverer noe kommersielt.
Hva betyr det i praksis?
- Personlige prosjekter, forskning, læring: greit, bare kjør løs.
- Klientarbeid, produkter, betalte tjenester: du trenger en kommersiell lisens. Selvhosting av den gratis nedlastingen for en betalende klient bryter avtalen.
- Finjustering og LoRA: teknisk sett mulig siden vektene er nedlastbare, og fellesskapet trener allerede adaptere. Men den samme ikke-kommersielle begrensningen gjelder for det du gjør med resultatene.
Dette er ikke en grunn til å unngå modellen. Det er en grunn til å lese vilkårene. Mange team vil bruke API-et (som inkluderer kommersielle rettigheter) for produksjon og beholde den lokale nedlastingen for eksperimentering. Bare ikke anta at «open-weight» betyr «gjør hva du vil», for her gjør det ikke det.
Om forfatteren
Mert Batur er medgründer av Techsy.io, der teamet leverer AI-agenter, automatiseringssystemer og stemme/SDR-pipelines for B2B-klienter. Han skriver om LLM-verktøystakken Techsy-teamet faktisk bruker i produksjon. Medgründer, Techsy.io. Koble til på LinkedIn.
Ofte stilte spørsmål
Er Ideogram 4.0 open source?
Ikke i streng forstand. Ideogram kaller det «open-weight», som er passende: vektene er nedlastbare fra Hugging Face. Men lisensen er Ideogram Non-Commercial Model Agreement, ikke Apache 2.0, til tross for at noen blogger hevder noe annet. Det er gratis for personlig og forskningsmessig bruk, og kommersiell distribusjon krever en separat betalt lisens.
Hvor mye VRAM trenger du for å kjøre Ideogram 4.0?
Et 24 GB GPU (som en RTX 4090) som kjører nf4-checkpointet er søtsonen. 16 GB fungerer teknisk sett med minneoffloading, men kjører tregere og strammere. 32 GB og oppover er komfortabelt, og den høyere-kvalitets fp8-bygget vil realistisk sett ha et A100 eller H100. Husk at dette er GPU VRAM, ikke system-RAM.
Kan Ideogram 4.0 kjøre på en Mac?
Ikke praktisk, i alle fall ikke i juni 2026. Det utgitte verktøyet forutsetter CUDA, som betyr Nvidia GPU-er. Apple Silicon Mac-er kan ikke kjøre checkpointene brukbart ennå. Mac-brukere bør bruke nettappen eller sky-API-et i stedet. Dette kan endre seg hvis fellesskapet porterer modellen, men det finnes ingen brukbar lokal vei i dag.
Er Ideogram 4.0 bedre enn Midjourney?
For tekst, logoer og plakater, ja, med stor margin. Ideogram rapporterer om lag 0,97 OCR-nøyaktighet på tett tekst mot rundt 30% målt for Midjourney på flervords-tekst. For malerisk, artistisk og stilisert estetikk vinner Midjourney v7 vanligvis fortsatt. Velg basert på om bildene dine inneholder lesbare ord.
Er Ideogram 4.0 bedre enn GPT Image 2?
Det avhenger av måleparametere. På estetisk Elo, nei: GPT Image 2 leder med rundt 1405 mot Ideograms ~1285 på DesignArena. På tekstgjengivelse og det å være open-weight og lokalt kjørbart, vinner Ideogram. GPT Image 2 er den bedre allrounderen; Ideogram 4.0 er den bedre tekstspesialisten.
Hva koster Ideogram 4.0 API-et?
Per utdatabilde er nivåene omtrent $0,03 (Turbo), $0,06 (Default) og $0,10 (Quality) per 26. juni 2026. En forespørsel som returnerer fire bilder koster fire ganger prisen. Det finnes også et gratis nettapp-nivå for vanlig bruk. Bekreft gjeldende priser på den offisielle siden før du budsjetterer med høyt volum.
Kan jeg bruke Ideogram 4.0 kommersielt?
Bare med riktig lisens. Den gratis Hugging Face-nedlastingen er ikke-kommersiell under Ideogram Non-Commercial Model Agreement, så selvhosting for betalt arbeid er ikke tillatt. Kommersiell bruk krever enten sky-API-et (som inkluderer kommersielle rettigheter) eller en separat forhandlet kommersiell lisens for vektene. Verifiser modellkortet først.
Hva er Magic Prompt i Ideogram 4.0?
Magic Prompt er en valgfri funksjon som automatisk skriver om det korte promptet ditt til et rikere, mer detaljert ett før generering. Det hjelper vanlige brukere å få bedre resultater fra noen få ord. Vil du ha nøyaktig kontroll over utdataene, kan du slå det av og skrive hele promptet ditt selv.
Er Ideogram 4.0 gratis?
Delvis. Nettappen har et gratisnivå med begrensninger. Selvhosting av de åpne vektene koster ingenting per bilde hvis du allerede eier et 24 GB GPU, selv om kommersiell bruk fortsatt krever en lisens. Sky-API-et er betalt, fakturert per bilde. Så det er gratis å prøve og gratis å kjøre lokalt for personlig bruk.
Kan du finjustere Ideogram 4.0 eller bruke LoRA?
Ja, teknisk sett. Fordi vektene er nedlastbare, er finjustering og LoRA-trening mulig, og fellesskapet produserer allerede adaptere. Haken er lisensen: den ikke-kommersielle avtalen gjelder fortsatt for det du gjør med alt du trener på toppen av basismodellen, så kommersielle finjusteringer krever riktig lisensiering.
Konklusjonen
Ideogram 4.0 er den viktigste open-weight bildeutgivelsen i 2026, men ikke av den grunnen hypet antyder. Her er hvem som bør gjøre hva:
- Kjør det lokalt hvis du har et 24 GB GPU, gjør teksttungt designarbeid, og bruken er personlig eller forskningsmessig. Gratis, privat, ubegrenset.
- Bruk API-et hvis du bygger et produkt eller gjør klientarbeid, siden det inkluderer kommersielle rettigheter og unngår maskinvare-spørsmålet.
- Hold deg til GPT Image 2 eller Midjourney hvis du trenger fotorealistiske mennesker, malerisk kunst eller folksomme scener, der Ideogram fortsatt taper.
Modellen er en tekstgjengivelsesspesialist som tilfeldigvis er nedlastbar, ikke en altomfattende Midjourney-dreper. Behandle den slik og du får det beste ut av den. Og les lisensen før du leverer.
Hvis du vurderer hvilken bilde- eller AI-modell du skal bygge inn i et ekte produkt, er det nøyaktig den typen beslutning teamet vårt tar med klienter hver uke. Få en gratis konsultasjon og vi hjelper deg med å matche modellen til jobben.