Techsy
Kontakt
Kom i gang
Tilbage til blog
guides

Skær 90 % af din Claude Code-regning: Kør OpenRouter, Ollama eller LiteLLM

Skrevet af Mert Batur Gürbüz
Opdateret Jul 5, 2026
14 minutters læsning
Indholdsfortegnelse
Skær 90 % af din Claude Code-regning: Kør OpenRouter, Ollama eller LiteLLM

Claude Code leveres med Anthropic-modeller, men en enkelt miljøvariabel, ANTHROPIC_BASE_URL, lader dig dirigere forespørgsler til praktisk talt enhver LLM-udbyder. Det betyder, at du kan skifte til DeepSeek til cirka $0,27 pr. million output-tokens i stedet for Claude Opus til $25, eller køre modeller lokalt via Ollama helt gratis. Denne guide dækker alle metoder til at bruge forskellige modeller i Claude Code og bygger videre på vores detaljerede Claude Code-sammenligning med hands-on opsætning for hver tilgang.

Alle metoder på ét blik

Vælg den metode, der passer til din situation, og spring til dens sektion for opsætningskode.

MetodeBedst tilOmkostningerOpsætningModeller
OpenRouterModelvariation, én API-nøgleBetaling pr. token (gennemgående)Nem300+
OllamaPrivatliv, gratis, offlineGratis (din hardware)Nem50+ open-source
LM StudioLokale modeller med GUIGratis (din hardware)Nem50+ open-source
claude-code-routerSmart routing pr. opgaveVarierer efter udbyderMediumAfhænger af konfiguration
claude-code-proxyGemini/OpenAI-backendUdbyderpriserMediumOpenAI + Gemini
LiteLLMEnterprise, load balancingUdbyderpriserAvanceret100+ på tværs af udbydere

Læs videre for trinvis opsætning af hver metode, eller spring til beslutningsgrundlaget, hvis du allerede ved, hvad du har brug for.

Hvordan fungerer modelskift i Claude Code egentlig?

Før du konfigurerer en proxy, skal du forstå, hvorfor de fleste tutorials efterlader dig med en ødelagt opsætning. Claude Code bruger internt tre modelslots, ikke én:

  • Haiku-slot, baggrundsopgaver som filopsummering og tab-fuldførelse
  • Sonnet-slot, standardkodning, den model du interagerer mest med
  • Opus-slot, kompleks ræsonnering, planlægning og flertrins agentopgaver

Når du ændrer modellen med /model eller --model, ændrer du kun den primære slot. Claude Code forsøger stadig at kalde de to andre slots via Anthropics API. Hvis du har peget ANTHROPIC_BASE_URL mod en proxy, men kun sat én model, fejler de andre slots med en "model not found"-fejl.

Løsningen: Sæt alle tre miljøvariabler, så hver slot dirigeres gennem din proxy.

bash
# Cut Claude Code's Bill 90%: Run OpenRouter, Ollama or LiteLLM
export ANTHROPIC_DEFAULT_HAIKU_MODEL="your-haiku-equivalent"
export ANTHROPIC_DEFAULT_SONNET_MODEL="your-sonnet-equivalent"
export ANTHROPIC_DEFAULT_OPUS_MODEL="your-opus-equivalent"
<!-- IMAGE: Architecture diagram showing Claude Code request routing through ANTHROPIC_BASE_URL to multiple providers (OpenRouter, Ollama, LiteLLM, claude-code-router) -->

Naturligt modelskift (Anthropic-modeller)

Hvis du bliver inden for Anthropics modelfamilie, er skift ligetil. Brug /model-kommandoen inde i Claude Code, angiv --model ved opstart fra terminalen, eller tilføj modeller til availableModels-arrayet i din konfigurationsfil. Anthropic bliver ved med at tilføje muligheder her, og vores oversigt over de nyeste Claude Code-funktioner til 2026 følger med i, hvad der er blevet udgivet for nylig.

opusplan-strategien

opusplan er Claude Codes indbyggede multimodel-routing. Den sender baggrundsopgaver til Haiku og kanaliserer kompleks ræsonnering til Opus, automatisk. Du konfigurerer den ikke manuelt; vælg den blot som din model. Det er Anthropics eget svar på "hvorfor betaler jeg Opus-priser for en filliste?"-problemet. Værd at prøve, før du rækker ud efter en tredjeparts-router, sammen med Anthropics hurtige tilstand, hvis rå hastighed er din prioritet.

OpenRouter – én API-nøgle, 300+ modeller

OpenRouter fungerer som en API-aggregator. Du får én API-nøgle og adgang til 300+ modeller fra Anthropic, Google, Meta, Mistral, DeepSeek og flere. Priserne er gennemgående for de fleste modeller, ingen tillæg.

Opsætningstrin

  1. Opret en konto på openrouter.ai og generér en API-nøgle
  2. Kør claude /logout for at rydde en eksisterende Anthropic-session
  3. Sæt dine miljøvariabler:
bash
export ANTHROPIC_BASE_URL="https://openrouter.ai/api"
export ANTHROPIC_API_KEY="sk-or-v1-your-key-here"

# Map all three model slots
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek/deepseek-chat-v3"
export ANTHROPIC_DEFAULT_SONNET_MODEL="anthropic/claude-sonnet-4"
export ANTHROPIC_DEFAULT_OPUS_MODEL="anthropic/claude-opus-4"
  1. Start claude og verificér forbindelsen

Bemærk de tre slot-variabler – spring dem over, og du rammer "model not found"-fejlen, vi dækkede ovenfor. Den officielle OpenRouter-integrationsguide bekræfter denne opsætning.

Anbefalede modeller via OpenRouter

Ikke alle modeller på OpenRouter håndterer Claude Codes værktøjskald pålideligt. Her er, hvad der faktisk fungerer godt:

OpgaveModelHvorfor
Billige baggrundsopgaverDeepSeek V3.2$0,27/$1,10 pr. MTok, anstændigt værktøjskald
StandardkodningClaude Sonnet 4Samme kvalitet som direkte, konsolideret fakturering
Kæmpe kodebaser (1M kontekst)Gemini 2.5 Flash$0,15/$0,60 pr. MTok, massivt kontekstvindue
Kompleks ræsonneringClaude Opus 4Bedste agentkodningskvalitet

Omkostninger og fakturering

OpenRouter opkræver gennemgående priser på de fleste modeller. Du betaler præcis det, den underliggende udbyder opkræver, plus et lille tillæg på nogle tredjepartsmodeller. Sæt udgiftsgrænser i dit OpenRouter-dashboard for at undgå overraskelser.

Dom: OpenRouter er den bedste mulighed for udviklere, der ønsker maksimal modelvariation med minimal opsætning. Én API-nøgle, ét faktureringsdashboard, 300+ modeller. Svært at slå på fleksibilitet.

Ollama – gratis, lokalt og privat

Ollama kører modeller udelukkende på din maskine. Siden v0.14.0 (januar 2026) understøtter den Anthropic Messages API naturligt, hvilket betyder, at Claude Code kan tale med den uden noget oversættelseslag. Din kode forlader aldrig din maskine.

Forudsætninger og hardware

Du skal bruge anstændig hardware for en brugbar oplevelse:

  • 7B-modeller (hurtige redigeringer, simple opgaver): 16 GB RAM minimum
  • 14B-modeller (solid kodningskvalitet): 32 GB RAM, GPU anbefalet
  • 32B+-modeller (nær-cloud kvalitet): 64 GB RAM eller dedikeret GPU med 24 GB+ VRAM

For en dybere gennemgang af hardwarekrav og modelvalg, se vores guide til at køre LLM'er lokalt.

Opsætningstrin

  1. Installér Ollama fra ollama.com
  2. Hent en kodningsfokuseret model
  3. Start med Claude Code-kompatibilitet
  4. Sæt dine miljøvariabler
bash
# Install and pull a coding model
ollama pull qwen2.5-coder:14b

# Launch with Claude Code compatibility
ollama launch claude

# Set env vars
export ANTHROPIC_BASE_URL="http://localhost:11434"
export ANTHROPIC_API_KEY="ollama"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_SONNET_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_OPUS_MODEL="qwen2.5-coder:14b"

Ollama-integrationsdokumentationen anbefaler modeller med 64k+ token kontekstvinduer for den bedste Claude Code-oplevelse.

Bedste lokale modeller til kodning

ModelStørrelseStyrkeNoter
Qwen 2.5 Coder 14B14BBedste samlede lokale kodningStærkt værktøjskald, god konteksthåndtering
devstral24BMistrals kodningsspecialistFremragende til refaktoring og kodegennemgang
GLM 4.79BGenerel ræsonneringGod balance mellem hastighed og kvalitet

Vær ærlig over for dig selv om én ting: Lokale modeller producerer mærkbart lavere kvalitet kode end Claude Sonnet til komplekse, flertrins agentopgaver. Værktøjskald er mindre pålideligt, og du vil se flere hallucinerede filstier. De er fantastiske til hurtige redigeringer, simpel generering og privatlivsfølsomt arbejde – forvent bare ikke indbygget Claude-kvalitet på en 50-fils refaktoring.

Dom: Ollama er det bedste valg for privatlivsfølsomt arbejde og udviklere, der ønsker gratis, ubegrænset brug. Hvis du har hardwaren, er det svært at argumentere mod "nul dollars for evigt."

Ollama Cloud vs OpenRouter: Priser og hvornår hver vinder

Ollama og OpenRouter løser omkostningsproblemet fra modsatte ender. Ollama kører modeller på hardware, du kontrollerer, til nul tokenomkostninger, mens OpenRouter opkræver gennemgående priser på tværs af 300+ hostede modeller uden hardware at administrere. Denne guide sætter Ollama op lokalt, og den samme faste-omkostninger-mod-per-token-matematik gælder, hvis du kører dens hostede tier i stedet.

FaktorOllamaOpenRouter
OmkostningsmodelGratis lokalt, du betaler for hardwareGennemgående pr. token, ingen tillæg på de fleste modeller
Eksempelpris$0 pr. tokenDeepSeek V3.2 til $0,27/$1,10, Gemini 2.5 Flash til $0,15/$0,60 pr. MTok
Hardware16 GB RAM (7B) op til 24 GB+ VRAM (32B+)Ingen, fuldt hostet
Modeladgang50+ open-source modeller300+ på tværs af udbydere
PrivatlivKoden forlader aldrig din maskineForespørgsler går gennem OpenRouter

Vælg Ollama, når privatliv, offline-brug eller høj volumen af rutineredigeringer betyder noget, og du allerede ejer hardwaren. Vælg OpenRouter, når du ønsker modelvariation, ingen forudgående hardware og betaling-kun-for-det-du-bruger-fakturering.

LM Studio – lokale modeller med GUI

LM Studio tilbyder den samme lokale modelkørsel som Ollama, men med en visuel grænseflade. Du browser modeller i en GUI, vælger kvantiseringsniveauer med et klik og tester chat, før du peger Claude Code mod den. Samme hardwarekrav som Ollama. Hvis du sammenligner runnere, dækker vores guide til de bedste værktøjer til at køre LLM'er lokalt afvejningerne.

Opsætning

  1. Download LM Studio og installér det
  2. Søg efter og download en kodningsmodel (Qwen 2.5 Coder, devstral osv.)
  3. Start den lokale server fra LM Studio-grænsefladen
  4. Peg Claude Code mod den:
bash
# Point Claude Code to LM Studio's local server
export ANTHROPIC_BASE_URL="http://localhost:1234/v1"
export ANTHROPIC_API_KEY="lm-studio"
export ANTHROPIC_DEFAULT_SONNET_MODEL="your-loaded-model-name"

LM Studio-bloggen har en gennemgang med skærmbilleder, hvis du foretrækker visuelle opsætningsguider.

Dom: LM Studio er bedst for udviklere, der foretrækker en GUI frem for CLI til at administrere lokale modeller. Hvis du allerede er tryg ved ollama pull og konfigurationsfiler, så bliv ved Ollama. Hvis du vil browse modeller visuelt og justere indstillinger med skydere, er LM Studio dit valg.

claude-code-router – smart model-routing

claude-code-router er en npm-pakke, der kører en lokal proxy mellem Claude Code og dine konfigurerede udbydere. Det, der gør den interessant, er kontekstbevidst routing – du kan sende billige baggrundsopgaver til DeepSeek, standardkodning til Sonnet og kompleks ræsonnering til Opus, alt sammen automatisk.

Projektet har 30k+ GitHub-stjerner og understøtter OpenRouter, DeepSeek, Gemini, Ollama, Groq, Volcengine og SiliconFlow som udbydere.

Installation og opsætning

bash
npm install -g claude-code-router
claude-code-router init
claude-code-router start

init-kommandoen opretter en config.json, hvor du definerer dine udbydere og modeltilknytninger:

json
{
  "providers": {
    "openrouter": {
      "apiKey": "sk-or-v1-...",
      "models": {
        "haiku": "deepseek/deepseek-chat-v3",
        "sonnet": "anthropic/claude-sonnet-4",
        "opus": "anthropic/claude-opus-4"
      }
    }
  }
}

Konfiguration af kontekstbevidst routing

Det er her, claude-code-router skinner. Du kan dirigere forskellige opgavetyper til forskellige modeller baseret på kompleksitet. Baggrundsopsummering går til en billig model, mens planlægning og arkitekturarbejde går til din bedste model. Routeren håndterer al slot-tilknytning transparent.

Du kan også blande udbydere – brug Ollama til privatlivsfølsomme repos og OpenRouter til alt andet, med skift via /model-kommandoen inde i Claude Code.

Dom: claude-code-router er bedst for power users, der ønsker finkornet kontrol over, hvilken model der håndterer hver opgavetype. Det er den mest konfigurerbare mulighed, men den fleksibilitet kommer med mere opsætning end et simpelt ANTHROPIC_BASE_URL-skift.

claude-code-proxy og LiteLLM – avancerede opsætninger

Disse to metoder tjener forskellige behov, men deler én egenskab: De er begge proxyservere, der oversætter mellem API-formater.

claude-code-proxy (Gemini og OpenAI-backend)

claude-code-proxy er et Python-værktøj (3,3k GitHub-stjerner), der accepterer Anthropic-format forespørgsler fra Claude Code og oversætter dem til OpenAI- eller Gemini-format via LiteLLM under overfladen. Det er den simpleste måde at bruge Gemini eller GPT-modeller specifikt med Claude Code.

bash
pip install claude-code-proxy
claude-code-proxy --port 8080

# Then point Claude Code at it
export ANTHROPIC_BASE_URL="http://localhost:8080"
export ANTHROPIC_API_KEY="your-gemini-or-openai-key"

Hvis du specifikt vil have Gemnis 1M token-kontekst til store monorepos, er dette den mest direkte vej.

LiteLLM (enterprise universel proxy)

LiteLLM er en enterprise-grade proxy, der understøtter 100+ udbydere med load balancing, fallback-kæder, rate limiting og audit logging. Det er overkill for en solo-udvikler, men essentielt for teams, der har brug for governance omkring AI-modelbrug.

Opsætningen bruger en YAML-konfiguration:

yaml
model_list:
  - model_name: claude-sonnet-4-20250514
    litellm_params:
      model: gemini/gemini-2.5-flash
      api_key: os.environ/GEMINI_API_KEY
  - model_name: claude-haiku-3-5-20241022
    litellm_params:
      model: deepseek/deepseek-chat
      api_key: os.environ/DEEPSEEK_API_KEY
bash
# Start LiteLLM proxy
litellm --config config.yaml --port 4000

# Point Claude Code to LiteLLM
export ANTHROPIC_BASE_URL="http://localhost:4000"
export ANTHROPIC_API_KEY="sk-litellm"

En vigtig note fra den officielle Claude Code-dokumentation: "Anthropic godkender, vedligeholder eller reviderer ikke LiteLLM." Brug det, men vid, at det er et fællesskabsværktøj, ikke et Anthropic-produkt. LiteLLM-tutorialen har flere avancerede konfigurationseksempler.

Dom: Brug claude-code-proxy, hvis du vil have Gemini- eller OpenAI-modeller specifikt. Brug LiteLLM, hvis dit team har brug for load balancing, fallback og audit logging på tværs af udbydere.

Claude Code Router vs LiteLLM: Hvilken skal du bruge?

Claude Code Router er det simplere valg for solo-udviklere, der ønsker model-routing pr. opgave, mens LiteLLM er bygget til teams, der har brug for load balancing, fallback-kæder og audit logging. Router installeres via npm og læser en config.json; LiteLLM kører en enterprise YAML-konfigureret proxy på tværs af 100+ udbydere.

FaktorClaude Code RouterLiteLLM
OpsætningsvanskelighedMedium: npm install, redigér config.jsonAvanceret: YAML-konfigurationsfil
Bedst tilSolo-udviklere der ønsker routing pr. opgaveTeams der har brug for governance
Konfigurationsformatconfig.jsonYAML model_list
Fremhævet funktionKontekstbevidst routing pr. opgaveLoad balancing, fallback, audit logging
UdbydereOpenRouter, DeepSeek, Gemini, Ollama, Groq og flere100+ på tværs af udbydere
Modenhed30k+ GitHub-stjerner, bygget til Claude CodeEnterprise-proxy, fællesskabsværktøj (ikke Anthropic-godkendt)

Vælg claude-code-router, hvis du er en solo-udvikler, der vil have billige baggrundsopgaver på DeepSeek og kompleks ræsonnering på Opus uden meget opsætning. Vælg LiteLLM, hvis dit team har brug for load balancing, rate limiting og audit logs på tværs af udbydere.

Overvejer du også andre proxyer? Vores oversigt over de bedste LLM gateway-værktøjer sammenligner dem side om side.

Hvad koster hver metode faktisk?

Lad os sætte reelle tal på. Her er, hvad du betaler pr. 1M tokens på tværs af de mest almindelige model/metode-kombinationer:

Model / MetodeInput (pr. 1M tokens)Output (pr. 1M tokens)Månedligt estimat (moderat brug)
Claude Opus 4.6 (direkte)$5,00$25,00~$50-150
Claude Sonnet 4.6 (direkte)$3,00$15,00~$30-60
Claude Sonnet via OpenRouter$3,00$15,00Samme (gennemgående)
DeepSeek V3.2 (OpenRouter)$0,27$1,10~$3-8
Gemini 2.5 Flash (OpenRouter)$0,15$0,60~$2-5
Ollama (lokalt)GratisGratis$0 (hardwareomkostninger)

Prisdata fra Anthropics officielle prisside og OpenRouter. Moderat brug antager ~5-10M tokens/måned for daglige kodningssessioner.

"Cost per 1M Output Tokens by Model"

"Claude Opus 4.6 costs $25 per 1M output tokens vs DeepSeek V3.2 at $1.10 -- a 23x cost difference. Ollama runs completely free on local hardware."
Datatable
"Cost per 1M Output Tokens by Model"
"Model""Output Cost"
"Opus 4.6"25
"Sonnet 4.6"15
"DeepSeek V3.2"1.1
"Gemini 2.5 Flash"0.6
"Ollama (local)"0

Omkostningsforskellen er betydelig, men billigere modeller producerer lavere kvalitet kode, især til komplekse agentopgaver, hvor værktøjskaldspålidelighed betyder noget. DeepSeek til $1,10/MTok output er fremragende til rutineredigeringer. Til en flerfils refaktoring, hvor Claude Code skal læse, planlægge, redigere og verificere på tværs af 20 filer? Der vil du stadig ønske Sonnet eller Opus.

Dom: For omkostningsbesparelser med acceptabel kvalitet tilbyder OpenRouter + DeepSeek det bedste forhold. For nul omkostninger er Ollama uslåelig, hvis du har hardwaren. For maksimal kvalitet forbliver Anthropic direkte konge.

Hvilken metode skal du bruge? – Beslutningsgrundlag

Her er sektionen, alle andre tutorials springer over. I stedet for at fortælle dig "brug bare OpenRouter", lad os matche metoder til faktiske behov:

Hvis du har brug for...Brug denne metodeHvorfor
Maksimal modelvariation, én API-nøgleOpenRouter300+ modeller, nem opsætning, betaling pr. brug
Gratis, ubegrænset, koden bliver lokaltOllamaNul omkostninger, fuldt privatliv, offline-kapabel
Lokale modeller med en visuel grænsefladeLM StudioGUI-modelbrowser, nem kvantiseringsvalg
Smart routing pr. opgaveclaude-code-routerDirigér ræsonnering til Opus, hurtige redigeringer til DeepSeek
Gemini- eller OpenAI-modeller specifiktclaude-code-proxyOversætter Anthropic-format til OpenAI/Gemini
Enterprise: load balancing, auditLiteLLMRate limiting, fallback-kæder, teamkontroller

Bør du overhovedet skifte?

Ærlig vurdering: For de fleste udviklere, der laver kompleks agentkodning, flerfils refaktoring, arkitekturplanlægning, fejlfinding af tricky concurrency-problemer, forbliver Claude Sonnet via direkte Anthropic den bedste mulighed. Indbygget Claude har det mest pålidelige værktøjskald, den bedste forståelse af sin egen agentworkflow og nul proxy-latens.

Modelskift er en optimering til specifikke scenarier:

  • Du brænder tokens af på baggrundsopgaver, der ikke har brug for Sonnet-kvalitet, eller du bliver ved med at ramme Claudes 2x brugsgrænser
  • Du har brug for Gemnis 1M kontekstvindue til en massiv monorepo
  • Din kode kan ikke forlade din maskine (myndigheder, sundhedsvæsen, finans)
  • Du er på et stramt budget, og acceptabel kvalitet slår perfekt kvalitet

Hvis ingen af disse gælder, er opusplan (Anthropics indbyggede routing) måske alt, du har brug for.

Værktøjskaldspålidelighed er den kvalitetsmetrik, der betyder mest her. Hierarkiet er: indbygget Claude >> OpenRouter Claude >> DeepSeek/Gemini >> lokale modeller. Jo længere ned du går, jo flere fejlslagne værktøjskald, hallucinerede filstier og ufuldstændige redigeringer vil du se.

Fejlfinding af almindelige problemer

"Model not found"-fejl

Dette er det absolut mest almindelige problem. Det sker, når du sætter ANTHROPIC_BASE_URL, men glemmer at tilknytte alle tre modelslots. Claude Code forsøger at kalde Haiku eller Opus gennem din proxy, proxyen genkender ikke standard Anthropic-modelnavnet, og du får fejlen.

bash
# Fix: set ALL three model slot variables
export ANTHROPIC_DEFAULT_HAIKU_MODEL="your-model"
export ANTHROPIC_DEFAULT_SONNET_MODEL="your-model"
export ANTHROPIC_DEFAULT_OPUS_MODEL="your-model"

Connection refused / timeout

Din proxy kører ikke, eller Claude Code rammer den forkerte port. Verificér, at proxyprocessen er aktiv, og dobbelttjek porten i ANTHROPIC_BASE_URL. Firewalls og VPN'er kan også blokere localhost-forbindelser.

Værktøjskaldsfejl

Modellen understøtter ikke Anthropics værktøjsbrugsformat korrekt. Symptomer: Claude Code hænger, producerer tomme værktøjskald eller redigerer de forkerte filer. Skift til en model med verificeret værktøjskaldsunderstøttelse – Qwen 2.5 Coder og devstral håndterer det bedst blandt lokale modeller.

Streaming-problemer

Nogle proxyer håndterer ikke server-sent events korrekt. Svar vises på én gang i stedet for at streame, eller de afkortes midt i svaret. Sørg for, at din proxyversion er opdateret, og tjek dens GitHub-issues for kendte streaming-bugs.

Kontekstvindue overskredet

Lokale modeller har ofte standard 4K-8K kontekstvinduer. Claude Code har brug for meget mere end det til reelle kodningssessioner. Brug modeller med 32K+ kontekst, eller dirigér langkontekstopgaver til Gemini (1M vindue) via OpenRouter.

Du skal logge ud først for OpenRouter

Hvis du skifter fra direkte Anthropic til OpenRouter, så kør claude /logout først. Claude Code cacher godkendelse og vil blive ved med at forsøge at bruge din Anthropic-nøgle, selv efter du ændrer base-URL'en.

bash
# Clear cached authentication before switching providers
claude /logout

FAQ

Kan du bruge Claude Code med GPT-4 eller Gemini?

Ja. claude-code-proxy oversætter Anthropic-format forespørgsler til OpenAI- eller Gemini-format. Du kan også få adgang til begge via OpenRouter med én API-nøgle. Værktøjskald kan være mindre pålideligt end indbygget Claude, især til komplekse flertrinsopgaver.

Hvordan bruger jeg Claude Code uden en Anthropic API-nøgle?

Brug Ollama til fuldt gratis lokal brug – ingen API-nøgle fra nogen udbyder nødvendig. Alternativt brug OpenRouter med deres API-nøgleformat. Du sætter stadig ANTHROPIC_API_KEY-miljøvariablen, men den peger på din proxys nøgle (f.eks. sk-or-v1-... for OpenRouter, "ollama" for Ollama).

Hvordan sætter jeg Claude Code op med Ollama?

Installér Ollama, hent en model som qwen2.5-coder:14b, kør ollama launch claude, og sæt tre miljøvariabler: ANTHROPIC_BASE_URL, ANTHROPIC_API_KEY og de tre modelslot-variabler. Se Ollama-sektionen ovenfor for den komplette kode.

Hvilke modeller fungerer bedst med Claude Code?

Til cloud: Claude Sonnet 4 leverer den bedste kodningskvalitet, mens DeepSeek V3.2 tilbyder den bedste værdi. Til lokalt: Qwen 2.5 Coder 14B er den nuværende guldstandard. Den afgørende faktor er værktøjskaldspålidelighed – Claude Code er stærkt afhængig af det til filoperationer, og indbyggede Claude-modeller håndterer det bedst.

Hvordan fikser jeg "model not found"-fejlen i Claude Code?

Sæt alle tre modelslot-miljøvariabler: ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL og ANTHROPIC_DEFAULT_OPUS_MODEL. Denne fejl opstår, fordi Claude Code bruger tre interne modelslots, og en utilknyttet slot forsøger at kalde et modelnavn, din proxy ikke genkender.

Kan Claude Code fungere offline med lokale modeller?

Ja. Både Ollama og LM Studio kører modeller udelukkende på din maskine uden internetforbindelse. Din kode forlader aldrig din hardware. Du skal bruge tilstrækkelige specifikationer – 16 GB RAM minimum for 7B-modeller, 32 GB+ for alt større.

Kan jeg bruge LM Studio med Claude Code?

Ja. LM Studio kører en lokal server, som Claude Code forbinder til ved at sætte ANTHROPIC_BASE_URL til http://localhost:1234/v1 og ANTHROPIC_API_KEY til lm-studio. Download en kodningsmodel som Qwen 2.5 Coder, start serveren fra LM Studios GUI, og tilknyt derefter din modelslot. Det er det visuelle alternativ til Ollamas CLI.

Hvad er ANTHROPIC_BASE_URL, og hvordan bruger jeg den?

Det er miljøvariablen, der fortæller Claude Code, hvor API-forespørgsler skal sendes hen. Som standard peger den på https://api.anthropic.com. Ændr den til enhver Anthropic-kompatibel endpoint – OpenRouter (https://openrouter.ai/api), Ollama (http://localhost:11434), LiteLLM (http://localhost:4000) osv.

Er claude-code-router bedre end LiteLLM?

Forskellige værktøjer til forskellige problemer. claude-code-router er simplere (npm install, redigér config.json, færdig) og designet specifikt til Claude Code. LiteLLM er enterprise-grade med load balancing, rate limiting, fallback-kæder og audit logging. Solo-udvikler? Brug claude-code-router. Team med governance-behov? Brug LiteLLM.

Hvor meget kan jeg spare ved at bruge ikke-Anthropic modeller?

At skifte fra Claude Opus 4.6 til DeepSeek V3.2 skærer output-tokenomkostninger med cirka 95 % ($25 vs $1,10 pr. million tokens). Ollama bringer det til nul, hvis du har hardwaren. Men kvalitetsafvejninger er reelle – forvent lavere nøjagtighed på komplekse flertrins agentopgaver, mindre pålideligt værktøjskald og flere hallucinerede filstier.

Virker værktøjskald med alle proxymetoder?

Ikke pålideligt på tværs af boardet. Indbygget Claude har den bedste værktøjskaldsunderstøttelse. OpenRouter med Claude-modeller fungerer næsten lige så godt. DeepSeek og Gemini har delvis understøttelse – simple værktøjskald virker, men komplekse kæder kan fejle. Lokale modeller via Ollama har det mindst pålidelige værktøjskald. Dette er den største kvalitetsbekymring ved at skifte væk fra Anthropic.

Kilder

  • Modelkonfiguration, Claude Code-dokumentation
  • LLM Gateway-konfiguration, Claude Code-dokumentation
  • Claude Code-integration, OpenRouter-dokumentation
  • Claude Code-integration, Ollama-dokumentation
  • Claude API-priser, Anthropic
  • claude-code-router, GitHub
  • claude-code-proxy, GitHub
  • Brug Claude Code med ikke-Anthropic modeller, LiteLLM-dokumentation

Tags

claude-codeopenrouterollamalitellmclaude-code-routerlokale-modellerai-kodevaerktoejer

Del denne artikel

Relaterede artikler

Mere fra guides

guides
Jul 18, 2026

Sammenligning af LLM API-priser 2026: Alle store modeller, prissat

En komplet sammenligning af LLM API-priser for 2026 — Claude, GPT-5.6, Gemini, DeepSeek, Qwen, GLM og Mistral prissat side om side per million tokens, direkte fra de officielle prissider.

12 min read minutters læsning
Læs
guides
Apr 12, 2026

Surfer SEO-guide 2026: Content Editor, NLP-scoring og AI-søgning

En praktisk Surfer SEO-guide, der dækker workflowet i Content Editor, NLP-scoringssystemet, AI Tracker til GEO-optimering og API-automatisering. Baseret på tests af over 50 artikler.

14 min read minutters læsning
Læs
guides
Apr 12, 2026

Semrush-guide 2026: Alle værktøjer forklaret (med eksempler)

En praktisk Semrush-guide, der dækker søgeordsresearch, site-audit, konkurrentanalyse, AI-synlighedssporing og opsætning af MCP-server. Indeholder kodeeksempler og workflows fra en rigtig SEO-pipeline.

14 min read minutters læsning
Læs
Se alle indlæg
Start dit projekt

Klar til at bygge noget ekstraoordinær?

Lad os gøre din vision til virkelighed. Vores team står klar til at hjælpe dig med at skabe software, der gør en forskel.

Book et 30 min. scopemødeSe vores arbejde

Fra biblioteket

Claude Skills

Se alle
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI-automatiseringer

Se alle
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Fra biblioteket

Claude Skills

Se alle
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI-automatiseringer

Se alle
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Tjenester

  • Entertainmentløsninger
  • Mobilapps
  • Webapplikationer

Løsninger

  • CRM-systemer
  • AI-integration
  • ERP-løsninger
  • Stemmeargenter
  • Processautomatisering
  • Cybersikkerhed

Bibliotek

  • Blog
  • Portfolio

Fællesskab

  • AI-automatiseringer
  • Claude Skills

Værktøjer

  • Pris på mobil-app
  • OpenAI / LLM API-prisreknemaskine
  • Pris på MVP
  • Pris på stemme-AI-agent

Virksomhed

  • Om
  • Partnere
  • Kontakt

Juridisk

  • Privatlivspolitik
  • Salgsbetingelser
  • Cookiepolitik

Tjenester

  • Entertainmentløsninger
  • Mobilapps
  • Webapplikationer

Løsninger

  • CRM-systemer
  • AI-integration
  • ERP-løsninger
  • Stemmeargenter
  • Processautomatisering
  • Cybersikkerhed

Bibliotek

  • Blog
  • Portfolio

Fællesskab

  • AI-automatiseringer
  • Claude Skills

Værktøjer

  • Pris på mobil-app
  • OpenAI / LLM API-prisreknemaskine
  • Pris på MVP
  • Pris på stemme-AI-agent

Virksomhed

  • Om
  • Partnere
  • Kontakt
JuridiskPrivatlivspolitikSalgsbetingelserCookiepolitik
TECHSY
© 2026 Techsy. Alle rettigheder forbeholdes.