guides

Kutt Claude Code-regningen med 90 %: Bruk OpenRouter, Ollama eller LiteLLM

Skrevet av Mert Batur
Oppdatert Jul 5, 2026
14 lesing
Kutt Claude Code-regningen med 90 %: Bruk OpenRouter, Ollama eller LiteLLM

Claude Code leveres med Anthropic-modeller, men én enkelt miljøvariabel -- ANTHROPIC_BASE_URL -- lar deg rute forespørsler til praktisk talt hvilken som helst LLM-leverandør. Det betyr at du kan bytte til DeepSeek for omtrent 0,27 $ per million utdatatoken i stedet for Claude Opus til 25 $, eller kjøre modeller lokalt via Ollama gratis. Denne guiden dekker alle metoder for å bruke forskjellige modeller i Claude Code, og bygger på vår detaljerte Claude Code-sammenligning med praktisk oppsett for hver tilnærming.

Alle metoder på ett øyekast

Velg metoden som passer din situasjon, og hopp deretter til dens seksjon for oppsettskoden.

MetodeBest forKostnadOppsettModeller
OpenRouterModellvariasjon, én API-nøkkelBetal-per-token (gjennomtransport)Enkel300+
OllamaPersonvern, gratis, frakobletGratis (din maskinvare)Enkel50+ åpen kildekode
LM StudioLokale modeller med GUIGratis (din maskinvare)Enkel50+ åpen kildekode
claude-code-routerSmart oppgavebasert rutingVarierer per leverandørMiddelsAvhenger av konfigurasjon
claude-code-proxyGemini/OpenAI-backendLeverandørpriserMiddelsOpenAI + Gemini
LiteLLMBedrift, lastbalanseringLeverandørpriserAvansert100+ hos ulike leverandører

Fortsett å lese for trinnvis oppsett av hver metode, eller hopp direkte til beslutningsrammeverket hvis du allerede vet hva du trenger.

Hvordan fungerer Claude Code-modellbytte egentlig?

Før du konfigurerer en proxy, må du forstå hvorfor de fleste veiledninger lar deg sitte igjen med et ødelagt oppsett. Claude Code bruker internt tre modellsporer -- ikke én:

  • Haiku-spor -- bakgrunnsoppgaver som filsammendrag og fane-fullføring
  • Sonnet-spor -- standard koding, modellen du samhandler mest med
  • Opus-spor -- kompleks resonnering, planlegging og flertrinnede agentoppgaver

Når du endrer modellen med /model eller --model, endrer du bare det primære sporet. Claude Code prøver fortsatt å kalle de andre to sporene ved hjelp av Anthropics API. Hvis du har pekt ANTHROPIC_BASE_URL mot en proxy men bare angitt én modell, mislykkes disse andre sporene med en "model not found"-feil.

Løsningen: angi alle tre miljøvariablene slik at hvert spor rutes gjennom proxyen din.

bash
# Angi alle tre sporene for å gå gjennom proxyen din
export ANTHROPIC_DEFAULT_HAIKU_MODEL="din-haiku-ekvivalent"
export ANTHROPIC_DEFAULT_SONNET_MODEL="din-sonnet-ekvivalent"
export ANTHROPIC_DEFAULT_OPUS_MODEL="din-opus-ekvivalent"
<!-- IMAGE: Architecture diagram showing Claude Code request routing through ANTHROPIC_BASE_URL to multiple providers (OpenRouter, Ollama, LiteLLM, claude-code-router) -->

Innebygd modellbytte (Anthropic-modeller)

Hvis du holder deg innenfor Anthropics modellfamilie, er byttet enkelt. Bruk /model-kommandoen inne i Claude Code, send --model når du starter fra terminalen, eller legg til modeller i availableModels-arrayen i din innstillingsfil. Anthropic legger stadig til flere alternativer her, og vår oversikt over de nyeste Claude Code-funksjonene for 2026 sporer det som nylig er sluppet.

opusplan-strategien

opusplan er Claude Codes innebygde multi-modellruting. Det sender bakgrunnsoppgaver til Haiku og kanaliserer kompleks resonnering til Opus -- automatisk. Du konfigurerer det ikke manuelt; velg det bare som modellen din. Det er Anthropics eget svar på problemet "hvorfor betaler jeg Opus-priser for en filliste?". Verdt å prøve før du tar i bruk en tredjeparts-router, sammen med Anthropics fast mode hvis rå hastighet er din prioritet.

OpenRouter -- Én API-nøkkel, 300+ modeller

OpenRouter fungerer som en API-aggregator. Du får én enkelt API-nøkkel og tilgang til 300+ modeller fra Anthropic, Google, Meta, Mistral, DeepSeek og mer. Prising er gjennomtransport for de fleste modeller -- ingen påslag.

Oppsetttrinn

  1. Opprett en konto på openrouter.ai og generer en API-nøkkel
  2. Kjør claude /logout for å fjerne eksisterende Anthropic-økt
  3. Angi miljøvariablene dine:
bash
export ANTHROPIC_BASE_URL="https://openrouter.ai/api"
export ANTHROPIC_API_KEY="sk-or-v1-din-nokkel-her"

# Kart alle tre modellsporene
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek/deepseek-chat-v3"
export ANTHROPIC_DEFAULT_SONNET_MODEL="anthropic/claude-sonnet-4"
export ANTHROPIC_DEFAULT_OPUS_MODEL="anthropic/claude-opus-4"
  1. Start claude og verifiser tilkoblingen

Legg merke til de tre sporvariablene -- hopp over dem og du får "model not found"-feilen vi dekket ovenfor. Den offisielle OpenRouter-integrasjonsguiden bekrefter dette oppsettet.

Anbefalte modeller via OpenRouter

Ikke alle modeller på OpenRouter håndterer Claude Codes verktøyanrop pålitelig. Her er hva som faktisk fungerer bra:

OppgaveModellHvorfor
Billige bakgrunnsoppgaverDeepSeek V3.20,27 $/1,10 $ per MTok, anstendig verktøyanrop
Standard kodingClaude Sonnet 4Samme kvalitet som direkte, samlet fakturering
Enorme kodebaser (1M kontekst)Gemini 2.5 Flash0,15 $/0,60 $ per MTok, massivt kontekstvindu
Kompleks resonneringClaude Opus 4Beste agentiske kodingskvalitet

Kostnad og fakturering

OpenRouter tar gjennomtransportpriser for de fleste modeller. Du betaler nøyaktig det den underliggende leverandøren tar, pluss en liten margin på noen tredjepartsmodeller. Angi forbruksgrenser i OpenRouter-dashbordet ditt for å unngå overraskelser.

Verdikt: OpenRouter er det beste alternativet for utviklere som vil ha maksimal modellvariasjon med minimalt oppsett. Én API-nøkkel, ett faktureringsdashbord, 300+ modeller. Vanskelig å slå for fleksibilitet.

Ollama -- Gratis, lokalt og privat

Ollama kjører modeller helt på maskinen din. Siden v0.14.0 (januar 2026) støtter den Anthropic Messages API innebygd, noe som betyr at Claude Code kan kommunisere med den uten noe oversettingslag. Koden din forlater aldri maskinen din. Se også vår Windsurf vs Cursor-sammenligning.

Forutsetninger og maskinvare

Du trenger anstendig maskinvare for en brukbar opplevelse:

  • 7B-modeller (raske redigeringer, enkle oppgaver): 16 GB RAM minimum
  • 14B-modeller (solid kodingskvalitet): 32 GB RAM, GPU anbefalt
  • 32B+-modeller (nær skykvalitet): 64 GB RAM eller dedikert GPU med 24 GB+ VRAM

For en dypere dykk i maskinvarekrav og modellvalg, sjekk guiden vår for å kjøre LLM-er lokalt.

Oppsetttrinn

  1. Installer Ollama fra ollama.com
  2. Last ned en kodingsfokusert modell
  3. Start med Claude Code-kompatibilitet
  4. Angi miljøvariablene dine
bash
# Installer og last ned en kodingsmodell
ollama pull qwen2.5-coder:14b

# Start med Claude Code-kompatibilitet
ollama launch claude

# Angi miljøvariabler
export ANTHROPIC_BASE_URL="http://localhost:11434"
export ANTHROPIC_API_KEY="ollama"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_SONNET_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_OPUS_MODEL="qwen2.5-coder:14b"

Ollamas integrasjonsdokumentasjon anbefaler modeller med 64k+ token kontekstvinduer for den beste Claude Code-opplevelsen.

Beste lokale modeller for koding

ModellStørrelseStyrkeNotater
Qwen 2.5 Coder 14B14BBeste generelle lokale kodingSterk verktøyanrop, god kontekstbehandling
devstral24BMistrals kodingsspesialistFlott for refaktorering og kodegjennomgang
GLM 4.79BGenerell resonneringGod balanse mellom hastighet og kvalitet

Vær ærlig med deg selv om én ting: lokale modeller produserer merkbart lavere kodekvalitet enn Claude Sonnet for komplekse, flertrinnede agentoppgaver. Verktøyanrop er mindre pålitelig, og du vil se flere hallusinerte filbaner. De er fantastiske for raske redigeringer, enkel generering og personvernssensitivt arbeid -- forvent bare ikke innebygd Claude-kvalitet på en 50-filers refaktorering.

Verdikt: Ollama er det beste valget for personvernssensitivt arbeid og utviklere som ønsker gratis, ubegrenset bruk. Hvis du har maskinvaren, er det vanskelig å argumentere mot "null kroner for alltid."

Ollama Cloud vs OpenRouter: Priser og når hver vinner

Ollama og OpenRouter løser kostnadsproblemet fra hver sin ende. Ollama kjører modeller på maskinvare du selv kontrollerer til null kostnad per token, mens OpenRouter tar gjennomtransportpriser på tvers av 300+ hostede modeller uten maskinvare å administrere. Denne guiden setter opp Ollama lokalt, og den samme fastkostnad-versus-per-token-matematikken gjelder hvis du kjører den hostede varianten i stedet.

FaktorOllamaOpenRouter
KostnadsmodellGratis lokalt, du betaler for maskinvarenGjennomtransport per token, ingen påslag på de fleste modeller
Eksempelpris0 $ per tokenDeepSeek V3.2 til 0,27 $/1,10 $, Gemini 2.5 Flash til 0,15 $/0,60 $ per MTok
Maskinvare16 GB RAM (7B) opptil 24 GB+ VRAM (32B+)Ingen, fullt hostet
Modelltilgang50+ åpen kildekode-modeller300+ hos ulike leverandører
PersonvernKoden forlater aldri maskinen dinForespørsler går gjennom OpenRouter

Velg Ollama når personvern, frakoblet bruk eller høyvolum rutinemessige redigeringer betyr noe, og du allerede eier maskinvaren. Velg OpenRouter når du vil ha modellvariasjon, ingen forhåndsinvestering i maskinvare, og fakturering der du bare betaler for det du bruker.

LM Studio -- Lokale modeller med et GUI

LM Studio tilbyr den samme lokale modellkjøringen som Ollama, men med et visuelt grensesnitt. Du blar gjennom modeller i et GUI, velger kvantiseringsnivåer med ett klikk og tester chat før du peker Claude Code mot det. Samme maskinvarekrav som Ollama. Hvis du sammenligner kjøremiljøer, dekker vår guide til de beste verktøyene for å kjøre LLM-er lokalt avveiningene.

Oppsett

  1. Last ned LM Studio og installer det
  2. Søk etter og last ned en kodingsmodell (Qwen 2.5 Coder, devstral, osv.)
  3. Start den lokale serveren fra LM Studio-grensesnittet
  4. Pek Claude Code mot det:
bash
# Pek Claude Code til LM Studios lokale server
export ANTHROPIC_BASE_URL="http://localhost:1234/v1"
export ANTHROPIC_API_KEY="lm-studio"
export ANTHROPIC_DEFAULT_SONNET_MODEL="ditt-lastede-modellnavn"

LM Studio-bloggen har en gjennomgang med skjermbilder hvis du foretrekker visuelle oppsettguider.

Verdikt: LM Studio er best for utviklere som foretrekker et GUI over CLI for å administrere lokale modeller. Hvis du allerede er komfortabel med ollama pull og konfigurasjonsfiler, hold deg til Ollama. Hvis du vil bla gjennom modeller visuelt og justere innstillinger med glidebrytere, er LM Studio ditt valg.

claude-code-router -- Smart modellruting

claude-code-router er en npm-pakke som kjører en lokal proxy mellom Claude Code og dine konfigurerte leverandører. Det som gjør den interessant er kontekstbevisst ruting -- du kan sende billige bakgrunnsoppgaver til DeepSeek, standardkoding til Sonnet og kompleks resonnering til Opus, alt automatisk.

Prosjektet har 30k+ GitHub-stjerner og støtter OpenRouter, DeepSeek, Gemini, Ollama, Groq, Volcengine og SiliconFlow som leverandører.

Installasjon og oppsett

bash
npm install -g claude-code-router
claude-code-router init
claude-code-router start

init-kommandoen oppretter en config.json der du definerer leverandørene dine og modellmappingene:

json
{
  "providers": {
    "openrouter": {
      "apiKey": "sk-or-v1-...",
      "models": {
        "haiku": "deepseek/deepseek-chat-v3",
        "sonnet": "anthropic/claude-sonnet-4",
        "opus": "anthropic/claude-opus-4"
      }
    }
  }
}

Konfigurasjon for kontekstbevisst ruting

Dette er der claude-code-router skinner. Du kan rute forskjellige oppgavetyper til forskjellige modeller basert på kompleksitet. Bakgrunnssammendrag går til en billig modell, mens planlegging og arkitekturarbeid går til den beste modellen din. Ruteren håndterer alle spormappinger transparent.

Du kan også blande leverandører -- bruk Ollama for personvernssensitive repos og OpenRouter for alt annet, og bytt med /model-kommandoen inne i Claude Code.

Verdikt: claude-code-router er best for avanserte brukere som vil ha detaljert kontroll over hvilken modell som håndterer hvilken oppgavetype. Det er det mest konfigurerbare alternativet, men den fleksibiliteten kommer med mer oppsett enn et enkelt ANTHROPIC_BASE_URL-bytte.

claude-code-proxy og LiteLLM -- Avanserte oppsett

Disse to metodene tjener forskjellige behov, men deler ett trekk: begge er proxy-servere som oversetter mellom API-formater.

claude-code-proxy (Gemini og OpenAI-backend)

claude-code-proxy er et Python-verktøy (3,3k GitHub-stjerner) som aksepterer Anthropic-formaterte forespørsler fra Claude Code og oversetter dem til OpenAI- eller Gemini-format via LiteLLM under panseret. Det er den enkleste måten å spesifikt bruke Gemini eller GPT-modeller med Claude Code. Du kan også være interessert i beste AI-stack for SaaS.

bash
pip install claude-code-proxy
claude-code-proxy --port 8080

# Pek deretter Claude Code mot det
export ANTHROPIC_BASE_URL="http://localhost:8080"
export ANTHROPIC_API_KEY="din-gemini-eller-openai-nokkel"

Hvis du spesifikt vil ha Geminis 1M token-kontekst for store monorepos, er dette den mest direkte veien.

LiteLLM (Bedriftens universelle proxy)

LiteLLM er en bedriftsklassifisert proxy som støtter 100+ leverandører med lastbalansering, reservekjeder, hastighetsbegrensning og revisjonslogging. Det er overdreven for en solo-utvikler, men essensielt for team som trenger styring rundt AI-modellbruk.

Oppsettet bruker en YAML-konfigurasjon:

yaml
model_list:
  - model_name: claude-sonnet-4-20250514
    litellm_params:
      model: gemini/gemini-2.5-flash
      api_key: os.environ/GEMINI_API_KEY
  - model_name: claude-haiku-3-5-20241022
    litellm_params:
      model: deepseek/deepseek-chat
      api_key: os.environ/DEEPSEEK_API_KEY
bash
# Start LiteLLM-proxy
litellm --config config.yaml --port 4000

# Pek Claude Code mot LiteLLM
export ANTHROPIC_BASE_URL="http://localhost:4000"
export ANTHROPIC_API_KEY="sk-litellm"

En viktig merknad fra den offisielle Claude Code-dokumentasjonen: "Anthropic godkjenner ikke, vedlikeholder ikke eller reviderer ikke LiteLLM." Bruk det, men vet at det er et fellesskapsverktøy, ikke et Anthropic-produkt. LiteLLM-veiledningen har flere avanserte konfigurasjonseksempler.

Verdikt: Bruk claude-code-proxy hvis du spesifikt vil ha Gemini- eller OpenAI-modeller. Bruk LiteLLM hvis teamet ditt trenger lastbalansering, reserve og revisjonslogging på tvers av leverandører.

Claude Code Router vs LiteLLM: Hvilken bør du bruke?

Claude Code Router er det enklere valget for solo-utviklere som vil ha oppgavebasert modellruting, mens LiteLLM er bygget for team som trenger lastbalansering, reservekjeder og revisjonslogging. Router installeres via npm og leser en config.json; LiteLLM kjører en bedrifts-YAML-konfigurert proxy på tvers av 100+ leverandører.

FaktorClaude Code RouterLiteLLM
OppsettsvanskelighetMiddels: npm install, rediger config.jsonAvansert: YAML-konfigurasjonsfil
Best forSolo-utviklere som vil ha oppgavebasert rutingTeam som trenger styring
Konfigurasjonsformatconfig.jsonYAML model_list
Fremtredende funksjonKontekstbevisst oppgavebasert rutingLastbalansering, reserve, revisjonslogging
LeverandørerOpenRouter, DeepSeek, Gemini, Ollama, Groq og flere100+ hos ulike leverandører
Modenhet30k+ GitHub-stjerner, bygget for Claude CodeBedrifts-proxy, fellesskapsverktøy (ikke Anthropic-godkjent)

Velg claude-code-router hvis du er en solo-utvikler som vil ha billige bakgrunnsoppgaver på DeepSeek og kompleks resonnering på Opus uten mye oppsett. Velg LiteLLM hvis teamet ditt trenger lastbalansering, hastighetsbegrensning og revisjonslogger på tvers av leverandører.

Vurderer du andre proxyer også? Vår oversikt over de beste LLM-gatewayverktøyene sammenligner dem side om side.

Hva koster egentlig hver metode?

La oss sette reelle tall på dette. Her er hva du betaler per 1 million tokens for de vanligste modell/metode-kombinasjonene:

Modell / MetodeInn (per 1M tokens)Ut (per 1M tokens)Månedlig estimat (moderat bruk)
Claude Opus 4.6 (direkte)280 kr1 400 kr~2 800-8 400 kr
Claude Sonnet 4.6 (direkte)168 kr840 kr~1 680-3 360 kr
Claude Sonnet via OpenRouter168 kr840 krSamme (gjennomtransport)
DeepSeek V3.2 (OpenRouter)15 kr62 kr~186-500 kr
Gemini 2.5 Flash (OpenRouter)8,5 kr33,6 kr~112-282 kr
Ollama (lokalt)GratisGratis0 kr (maskinvarekostnader)

Prisdata fra Anthropics offisielle prisside og OpenRouter. Estimert USD/NOK-kurs: 56 kr. Moderat bruk antar ~5-10M tokens/måned for daglige kodingsøkter.

"Kostnad per 1M utdatatoken etter modell"

"Claude Opus 4.6 koster 1 400 kr per 1M utdatatoken mot DeepSeek V3.2 til 62 kr -- en 23x kostnadsforskjell. Ollama kjører helt gratis på lokal maskinvare."
Datatabell
"Kostnad per 1M utdatatoken etter modell"
"Modell""Utdatakostnad"
"Opus 4.6"1400
"Sonnet 4.6"840
"DeepSeek V3.2"62
"Gemini 2.5 Flash"33.6
"Ollama (lokalt)"0

Kostnadsgapet er betydelig, men billigere modeller produserer lavere kodekvalitet -- spesielt for komplekse agentoppgaver der påliteligheten til verktøyanrop er viktig. DeepSeek til 62 kr/MTok utdata er flott for rutinemessige redigeringer. For en refaktorering av flere filer der Claude Code trenger å lese, planlegge, redigere og verifisere over 20 filer? Du vil fortsatt ha Sonnet eller Opus.

Verdikt: For kostnadsbesparelser med akseptabel kvalitet tilbyr OpenRouter + DeepSeek det beste forholdet. For null kostnad er Ollama uslåelig hvis du har maskinvaren. For maksimal kvalitet er Anthropic direkte fortsatt kongen.

Hvilken metode bør du bruke? -- Beslutningsrammeverk

Her er seksjonen som alle andre veiledninger hopper over. I stedet for å fortelle deg "bare bruk OpenRouter", la oss matche metoder med faktiske behov:

Hvis du trenger...Bruk denne metodenHvorfor
Maksimal modellvariasjon, én API-nøkkelOpenRouter300+ modeller, enkelt oppsett, betal-per-bruk
Gratis, ubegrenset, koden forblir lokalOllamaNull kostnad, full personvern, offline-kapabel
Lokale modeller med visuelt grensesnittLM StudioGUI-modellnettleser, enkel kvantiseringsvalg
Smart oppgavebasert rutingclaude-code-routerResonnering til Opus, raske redigeringer til DeepSeek
Spesifikt Gemini- eller OpenAI-modellerclaude-code-proxyOversetter Anthropic-format til OpenAI/Gemini
Bedrift: lastbalansering, revisjonLiteLLMHastighetsbegrensning, reservekjeder, teamkontroller

Bør du til og med bytte?

Ærlig vurdering: for de fleste utviklere som gjør kompleks agentisk koding -- refaktorering av flere filer, arkitekturplanlegging, feilsøking av vanskelige samtidigetsproblem -- forblir Claude Sonnet via direkte Anthropic det beste alternativet. Innebygd Claude har det mest pålitelige verktøyanropet, den beste forståelsen av sin egen agentiske arbeidsflyt og null proxy-latens.

Modellbytte er en optimalisering for spesifikke scenarioer:

  • Du brenner tokens på bakgrunnsoppgaver som ikke trenger Sonnet-kvalitet, eller du stadig treffer Claudes 2x bruksgrenser
  • Du trenger Geminis 1M kontekstvindu for et massivt monorepo
  • Koden din kan ikke forlate maskinen din (myndigheter, helsevesen, finans)
  • Du har et stramt budsjett og akseptabel kvalitet slår perfekt kvalitet

Hvis ingen av disse gjelder, kan opusplan (Anthropics innebygde ruting) være alt du trenger.

Påliteligheten til verktøyanrop er kvalitetsmålet som betyr mest her. Hierarkiet er: innebygd Claude >> OpenRouter Claude >> DeepSeek/Gemini >> lokale modeller. Jo lenger ned du går, desto flere mislykkede verktøyanrop, hallusinerte filbaner og ufullstendige redigeringer ser du.

Feilsøking av vanlige problemer

"model not found"-feilen

Dette er det vanligste problemet. Det skjer når du angir ANTHROPIC_BASE_URL, men glemmer å kartlegge alle tre modellsporene. Claude Code prøver å kalle Haiku eller Opus via proxyen din, proxyen gjenkjenner ikke Anthropics standard modellnavn, og du får feilen.

bash
# Fix: angi ALLE tre modellsporvariablene
export ANTHROPIC_DEFAULT_HAIKU_MODEL="din-modell"
export ANTHROPIC_DEFAULT_SONNET_MODEL="din-modell"
export ANTHROPIC_DEFAULT_OPUS_MODEL="din-modell"

Tilkobling avvist / tidsavbrudd

Proxyen din kjører ikke, eller Claude Code treffer feil port. Verifiser at proxy-prosessen er aktiv og dobbeltsjekk porten i ANTHROPIC_BASE_URL. Brannmurer og VPN-er kan også blokkere localhost-tilkoblinger. Les mer om beste AI-verktøy for startups.

Verktøyanropsfeil

Modellen støtter ikke Anthropics verktøybruksformat riktig. Symptomer: Claude Code henger, produserer tomme verktøyanrop, eller redigerer de feil filene. Bytt til en modell med verifisert støtte for verktøyanrop -- Qwen 2.5 Coder og devstral håndterer det best blant lokale modeller.

Strømmingsproblemer

Noen proxyer håndterer ikke server-sent events riktig. Svar vises alle på en gang i stedet for å strømme, eller de avkortes midt i svaret. Sørg for at proxy-versjonen din er oppdatert og sjekk GitHub-problemene for kjente strømmingsfeil.

Kontekstvindu overskredet

Lokale modeller har ofte standard 4K-8K kontekstvinduer. Claude Code trenger mye mer enn det for ekte kodingsøkter. Bruk modeller med 32K+ kontekst, eller rut oppgaver med lang kontekst til Gemini (1M vindu) via OpenRouter.

Må logge ut først for OpenRouter

Hvis du bytter fra direkte Anthropic til OpenRouter, kjør claude /logout først. Claude Code bufrer autentisering og vil fortsette å prøve å bruke Anthropic-nøkkelen din selv etter at du har endret basis-URL-en.

bash
# Fjern bufret autentisering før du bytter leverandør
claude /logout

FAQ

Kan du bruke Claude Code med GPT-4 eller Gemini?

Ja. claude-code-proxy oversetter Anthropic-formaterte forespørsler til OpenAI- eller Gemini-format. Du kan også få tilgang til begge via OpenRouter med én enkelt API-nøkkel. Verktøyanrop kan være mindre pålitelig enn innebygd Claude, spesielt for komplekse flertrinnede oppgaver.

Hvordan bruker jeg Claude Code uten en Anthropic API-nøkkel?

Bruk Ollama for helt gratis lokal bruk -- ingen API-nøkkel fra noen leverandør nødvendig. Alternativt, bruk OpenRouter med deres API-nøkkelformat. Du angir fortsatt miljøvariabelen ANTHROPIC_API_KEY, men den peker til proxy-nøkkelen din (f.eks. sk-or-v1-... for OpenRouter, "ollama" for Ollama).

Hvordan setter jeg opp Claude Code med Ollama?

Installer Ollama, last ned en modell som qwen2.5-coder:14b, kjør ollama launch claude og angi tre miljøvariabler: ANTHROPIC_BASE_URL, ANTHROPIC_API_KEY og de tre modellsporvariablene. Se Ollama-seksjonen ovenfor for den fullstendige koden.

Hvilke modeller fungerer best med Claude Code?

For sky: Claude Sonnet 4 leverer den beste kodingskvaliteten, mens DeepSeek V3.2 tilbyr den beste verdien. For lokalt: Qwen 2.5 Coder 14B er den nåværende gullstandarden. Den avgjørende faktoren er påliteligheten til verktøyanrop -- Claude Code er sterkt avhengig av det for filoperasjoner, og innebygde Claude-modeller håndterer det best.

Hvordan fikser jeg "model not found"-feilen i Claude Code?

Angi alle tre modellspor-miljøvariablene: ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL og ANTHROPIC_DEFAULT_OPUS_MODEL. Denne feilen oppstår fordi Claude Code bruker tre interne modellsporer, og et ikke-kartlagt spor prøver å kalle et modellnavn som proxyen din ikke gjenkjenner.

Kan Claude Code fungere frakoblet med lokale modeller?

Ja. Både Ollama og LM Studio kjører modeller helt på maskinen din uten Internett-tilkobling. Koden din forlater aldri maskinvaren din. Du trenger tilstrekkelige spesifikasjoner -- minimum 16 GB RAM for 7B-modeller, 32 GB+ for alt større.

Kan jeg bruke LM Studio med Claude Code?

Ja. LM Studio kjører en lokal server som Claude Code kobler til ved å sette ANTHROPIC_BASE_URL til http://localhost:1234/v1 og ANTHROPIC_API_KEY til lm-studio. Last ned en kodingsmodell som Qwen 2.5 Coder, start serveren fra LM Studios GUI, og kartlegg deretter modellsporet ditt. Det er det visuelle alternativet til Ollamas CLI.

Hva er ANTHROPIC_BASE_URL og hvordan bruker jeg det?

Det er miljøvariabelen som forteller Claude Code hvor API-forespørsler skal sendes. Som standard peker den til https://api.anthropic.com. Endre den til et Anthropic-kompatibelt endepunkt -- OpenRouter (https://openrouter.ai/api), Ollama (http://localhost:11434), LiteLLM (http://localhost:4000), osv.

Er claude-code-router bedre enn LiteLLM?

Forskjellige verktøy for forskjellige problemer. claude-code-router er enklere (npm install, rediger config.json, ferdig) og designet spesifikt for Claude Code. LiteLLM er bedriftsklasse med lastbalansering, hastighetsbegrensning, reservekjeder og revisjonslogging. Solo-utvikler? Bruk claude-code-router. Team med styrings behov? Bruk LiteLLM.

Hvor mye kan jeg spare ved å bruke ikke-Anthropic-modeller?

Å bytte fra Claude Opus 4.6 til DeepSeek V3.2 reduserer kostnadene for utdatatoken med omtrent 95% (1 400 kr vs 62 kr per million tokens). Ollama bringer det til null hvis du har maskinvaren. Men kvalitetskompromissene er reelle -- forvent lavere nøyaktighet på komplekse flertrinnede agentoppgaver, mindre pålitelig verktøyanrop og flere hallusinerte filbaner.

Fungerer verktøyanrop med alle proxy-metoder?

Ikke pålitelig over hele linjen. Innebygd Claude har den beste støtten for verktøyanrop. OpenRouter med Claude-modeller fungerer nesten like bra. DeepSeek og Gemini har delvis støtte -- enkle verktøyanrop fungerer, men komplekse kjeder kan mislykkes. Lokale modeller via Ollama har den minst pålitelige verktøyanropet. Dette er den viktigste kvalitetsproblematikken når man forlater Anthropic.

Kilder

Emneord

claude-codeopenrouterollamalitellmclaude-code-routerlokale-modellerai-kodingsverktoy

Del denne artikkelen

Kom i gang

Klar til å bygge noe ekstraordinært?

La oss gjøre visjonen din til virkelighet. Teamet vårt er klart til å hjelpe deg med å lage programvare som utgjør en forskjell.