
Claude Code leveres med Anthropic-modeller, men én enkelt miljøvariabel -- ANTHROPIC_BASE_URL -- lar deg rute forespørsler til praktisk talt hvilken som helst LLM-leverandør. Det betyr at du kan bytte til DeepSeek for omtrent 0,27 $ per million utdatatoken i stedet for Claude Opus til 25 $, eller kjøre modeller lokalt via Ollama gratis. Denne guiden dekker alle metoder for å bruke forskjellige modeller i Claude Code, og bygger på vår detaljerte Claude Code-sammenligning med praktisk oppsett for hver tilnærming.
Alle metoder på ett øyekast
Velg metoden som passer din situasjon, og hopp deretter til dens seksjon for oppsettskoden.
| Metode | Best for | Kostnad | Oppsett | Modeller |
|---|---|---|---|---|
| OpenRouter | Modellvariasjon, én API-nøkkel | Betal-per-token (gjennomtransport) | Enkel | 300+ |
| Ollama | Personvern, gratis, frakoblet | Gratis (din maskinvare) | Enkel | 50+ åpen kildekode |
| LM Studio | Lokale modeller med GUI | Gratis (din maskinvare) | Enkel | 50+ åpen kildekode |
| claude-code-router | Smart oppgavebasert ruting | Varierer per leverandør | Middels | Avhenger av konfigurasjon |
| claude-code-proxy | Gemini/OpenAI-backend | Leverandørpriser | Middels | OpenAI + Gemini |
| LiteLLM | Bedrift, lastbalansering | Leverandørpriser | Avansert | 100+ hos ulike leverandører |
Fortsett å lese for trinnvis oppsett av hver metode, eller hopp direkte til beslutningsrammeverket hvis du allerede vet hva du trenger.
Hvordan fungerer Claude Code-modellbytte egentlig?
Før du konfigurerer en proxy, må du forstå hvorfor de fleste veiledninger lar deg sitte igjen med et ødelagt oppsett. Claude Code bruker internt tre modellsporer -- ikke én:
- Haiku-spor -- bakgrunnsoppgaver som filsammendrag og fane-fullføring
- Sonnet-spor -- standard koding, modellen du samhandler mest med
- Opus-spor -- kompleks resonnering, planlegging og flertrinnede agentoppgaver
Når du endrer modellen med /model eller --model, endrer du bare det primære sporet. Claude Code prøver fortsatt å kalle de andre to sporene ved hjelp av Anthropics API. Hvis du har pekt ANTHROPIC_BASE_URL mot en proxy men bare angitt én modell, mislykkes disse andre sporene med en "model not found"-feil.
Løsningen: angi alle tre miljøvariablene slik at hvert spor rutes gjennom proxyen din.
# Angi alle tre sporene for å gå gjennom proxyen din
export ANTHROPIC_DEFAULT_HAIKU_MODEL="din-haiku-ekvivalent"
export ANTHROPIC_DEFAULT_SONNET_MODEL="din-sonnet-ekvivalent"
export ANTHROPIC_DEFAULT_OPUS_MODEL="din-opus-ekvivalent"Innebygd modellbytte (Anthropic-modeller)
Hvis du holder deg innenfor Anthropics modellfamilie, er byttet enkelt. Bruk /model-kommandoen inne i Claude Code, send --model når du starter fra terminalen, eller legg til modeller i availableModels-arrayen i din innstillingsfil. Anthropic legger stadig til flere alternativer her, og vår oversikt over de nyeste Claude Code-funksjonene for 2026 sporer det som nylig er sluppet.
opusplan-strategien
opusplan er Claude Codes innebygde multi-modellruting. Det sender bakgrunnsoppgaver til Haiku og kanaliserer kompleks resonnering til Opus -- automatisk. Du konfigurerer det ikke manuelt; velg det bare som modellen din. Det er Anthropics eget svar på problemet "hvorfor betaler jeg Opus-priser for en filliste?". Verdt å prøve før du tar i bruk en tredjeparts-router, sammen med Anthropics fast mode hvis rå hastighet er din prioritet.
OpenRouter -- Én API-nøkkel, 300+ modeller
OpenRouter fungerer som en API-aggregator. Du får én enkelt API-nøkkel og tilgang til 300+ modeller fra Anthropic, Google, Meta, Mistral, DeepSeek og mer. Prising er gjennomtransport for de fleste modeller -- ingen påslag.
Oppsetttrinn
- Opprett en konto på openrouter.ai og generer en API-nøkkel
- Kjør
claude /logoutfor å fjerne eksisterende Anthropic-økt - Angi miljøvariablene dine:
export ANTHROPIC_BASE_URL="https://openrouter.ai/api"
export ANTHROPIC_API_KEY="sk-or-v1-din-nokkel-her"
# Kart alle tre modellsporene
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek/deepseek-chat-v3"
export ANTHROPIC_DEFAULT_SONNET_MODEL="anthropic/claude-sonnet-4"
export ANTHROPIC_DEFAULT_OPUS_MODEL="anthropic/claude-opus-4"- Start
claudeog verifiser tilkoblingen
Legg merke til de tre sporvariablene -- hopp over dem og du får "model not found"-feilen vi dekket ovenfor. Den offisielle OpenRouter-integrasjonsguiden bekrefter dette oppsettet.
Anbefalte modeller via OpenRouter
Ikke alle modeller på OpenRouter håndterer Claude Codes verktøyanrop pålitelig. Her er hva som faktisk fungerer bra:
| Oppgave | Modell | Hvorfor |
|---|---|---|
| Billige bakgrunnsoppgaver | DeepSeek V3.2 | 0,27 $/1,10 $ per MTok, anstendig verktøyanrop |
| Standard koding | Claude Sonnet 4 | Samme kvalitet som direkte, samlet fakturering |
| Enorme kodebaser (1M kontekst) | Gemini 2.5 Flash | 0,15 $/0,60 $ per MTok, massivt kontekstvindu |
| Kompleks resonnering | Claude Opus 4 | Beste agentiske kodingskvalitet |
Kostnad og fakturering
OpenRouter tar gjennomtransportpriser for de fleste modeller. Du betaler nøyaktig det den underliggende leverandøren tar, pluss en liten margin på noen tredjepartsmodeller. Angi forbruksgrenser i OpenRouter-dashbordet ditt for å unngå overraskelser.
Verdikt: OpenRouter er det beste alternativet for utviklere som vil ha maksimal modellvariasjon med minimalt oppsett. Én API-nøkkel, ett faktureringsdashbord, 300+ modeller. Vanskelig å slå for fleksibilitet.
Ollama -- Gratis, lokalt og privat
Ollama kjører modeller helt på maskinen din. Siden v0.14.0 (januar 2026) støtter den Anthropic Messages API innebygd, noe som betyr at Claude Code kan kommunisere med den uten noe oversettingslag. Koden din forlater aldri maskinen din. Se også vår Windsurf vs Cursor-sammenligning.
Forutsetninger og maskinvare
Du trenger anstendig maskinvare for en brukbar opplevelse:
- 7B-modeller (raske redigeringer, enkle oppgaver): 16 GB RAM minimum
- 14B-modeller (solid kodingskvalitet): 32 GB RAM, GPU anbefalt
- 32B+-modeller (nær skykvalitet): 64 GB RAM eller dedikert GPU med 24 GB+ VRAM
For en dypere dykk i maskinvarekrav og modellvalg, sjekk guiden vår for å kjøre LLM-er lokalt.
Oppsetttrinn
- Installer Ollama fra ollama.com
- Last ned en kodingsfokusert modell
- Start med Claude Code-kompatibilitet
- Angi miljøvariablene dine
# Installer og last ned en kodingsmodell
ollama pull qwen2.5-coder:14b
# Start med Claude Code-kompatibilitet
ollama launch claude
# Angi miljøvariabler
export ANTHROPIC_BASE_URL="http://localhost:11434"
export ANTHROPIC_API_KEY="ollama"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_SONNET_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_OPUS_MODEL="qwen2.5-coder:14b"Ollamas integrasjonsdokumentasjon anbefaler modeller med 64k+ token kontekstvinduer for den beste Claude Code-opplevelsen.
Beste lokale modeller for koding
| Modell | Størrelse | Styrke | Notater |
|---|---|---|---|
| Qwen 2.5 Coder 14B | 14B | Beste generelle lokale koding | Sterk verktøyanrop, god kontekstbehandling |
| devstral | 24B | Mistrals kodingsspesialist | Flott for refaktorering og kodegjennomgang |
| GLM 4.7 | 9B | Generell resonnering | God balanse mellom hastighet og kvalitet |
Vær ærlig med deg selv om én ting: lokale modeller produserer merkbart lavere kodekvalitet enn Claude Sonnet for komplekse, flertrinnede agentoppgaver. Verktøyanrop er mindre pålitelig, og du vil se flere hallusinerte filbaner. De er fantastiske for raske redigeringer, enkel generering og personvernssensitivt arbeid -- forvent bare ikke innebygd Claude-kvalitet på en 50-filers refaktorering.
Verdikt: Ollama er det beste valget for personvernssensitivt arbeid og utviklere som ønsker gratis, ubegrenset bruk. Hvis du har maskinvaren, er det vanskelig å argumentere mot "null kroner for alltid."
Ollama Cloud vs OpenRouter: Priser og når hver vinner
Ollama og OpenRouter løser kostnadsproblemet fra hver sin ende. Ollama kjører modeller på maskinvare du selv kontrollerer til null kostnad per token, mens OpenRouter tar gjennomtransportpriser på tvers av 300+ hostede modeller uten maskinvare å administrere. Denne guiden setter opp Ollama lokalt, og den samme fastkostnad-versus-per-token-matematikken gjelder hvis du kjører den hostede varianten i stedet.
| Faktor | Ollama | OpenRouter |
|---|---|---|
| Kostnadsmodell | Gratis lokalt, du betaler for maskinvaren | Gjennomtransport per token, ingen påslag på de fleste modeller |
| Eksempelpris | 0 $ per token | DeepSeek V3.2 til 0,27 $/1,10 $, Gemini 2.5 Flash til 0,15 $/0,60 $ per MTok |
| Maskinvare | 16 GB RAM (7B) opptil 24 GB+ VRAM (32B+) | Ingen, fullt hostet |
| Modelltilgang | 50+ åpen kildekode-modeller | 300+ hos ulike leverandører |
| Personvern | Koden forlater aldri maskinen din | Forespørsler går gjennom OpenRouter |
Velg Ollama når personvern, frakoblet bruk eller høyvolum rutinemessige redigeringer betyr noe, og du allerede eier maskinvaren. Velg OpenRouter når du vil ha modellvariasjon, ingen forhåndsinvestering i maskinvare, og fakturering der du bare betaler for det du bruker.
LM Studio -- Lokale modeller med et GUI
LM Studio tilbyr den samme lokale modellkjøringen som Ollama, men med et visuelt grensesnitt. Du blar gjennom modeller i et GUI, velger kvantiseringsnivåer med ett klikk og tester chat før du peker Claude Code mot det. Samme maskinvarekrav som Ollama. Hvis du sammenligner kjøremiljøer, dekker vår guide til de beste verktøyene for å kjøre LLM-er lokalt avveiningene.
Oppsett
- Last ned LM Studio og installer det
- Søk etter og last ned en kodingsmodell (Qwen 2.5 Coder, devstral, osv.)
- Start den lokale serveren fra LM Studio-grensesnittet
- Pek Claude Code mot det:
# Pek Claude Code til LM Studios lokale server
export ANTHROPIC_BASE_URL="http://localhost:1234/v1"
export ANTHROPIC_API_KEY="lm-studio"
export ANTHROPIC_DEFAULT_SONNET_MODEL="ditt-lastede-modellnavn"LM Studio-bloggen har en gjennomgang med skjermbilder hvis du foretrekker visuelle oppsettguider.
Verdikt: LM Studio er best for utviklere som foretrekker et GUI over CLI for å administrere lokale modeller. Hvis du allerede er komfortabel med ollama pull og konfigurasjonsfiler, hold deg til Ollama. Hvis du vil bla gjennom modeller visuelt og justere innstillinger med glidebrytere, er LM Studio ditt valg.
claude-code-router -- Smart modellruting
claude-code-router er en npm-pakke som kjører en lokal proxy mellom Claude Code og dine konfigurerte leverandører. Det som gjør den interessant er kontekstbevisst ruting -- du kan sende billige bakgrunnsoppgaver til DeepSeek, standardkoding til Sonnet og kompleks resonnering til Opus, alt automatisk.
Prosjektet har 30k+ GitHub-stjerner og støtter OpenRouter, DeepSeek, Gemini, Ollama, Groq, Volcengine og SiliconFlow som leverandører.
Installasjon og oppsett
npm install -g claude-code-router
claude-code-router init
claude-code-router startinit-kommandoen oppretter en config.json der du definerer leverandørene dine og modellmappingene:
{
"providers": {
"openrouter": {
"apiKey": "sk-or-v1-...",
"models": {
"haiku": "deepseek/deepseek-chat-v3",
"sonnet": "anthropic/claude-sonnet-4",
"opus": "anthropic/claude-opus-4"
}
}
}
}Konfigurasjon for kontekstbevisst ruting
Dette er der claude-code-router skinner. Du kan rute forskjellige oppgavetyper til forskjellige modeller basert på kompleksitet. Bakgrunnssammendrag går til en billig modell, mens planlegging og arkitekturarbeid går til den beste modellen din. Ruteren håndterer alle spormappinger transparent.
Du kan også blande leverandører -- bruk Ollama for personvernssensitive repos og OpenRouter for alt annet, og bytt med /model-kommandoen inne i Claude Code.
Verdikt: claude-code-router er best for avanserte brukere som vil ha detaljert kontroll over hvilken modell som håndterer hvilken oppgavetype. Det er det mest konfigurerbare alternativet, men den fleksibiliteten kommer med mer oppsett enn et enkelt ANTHROPIC_BASE_URL-bytte.
claude-code-proxy og LiteLLM -- Avanserte oppsett
Disse to metodene tjener forskjellige behov, men deler ett trekk: begge er proxy-servere som oversetter mellom API-formater.
claude-code-proxy (Gemini og OpenAI-backend)
claude-code-proxy er et Python-verktøy (3,3k GitHub-stjerner) som aksepterer Anthropic-formaterte forespørsler fra Claude Code og oversetter dem til OpenAI- eller Gemini-format via LiteLLM under panseret. Det er den enkleste måten å spesifikt bruke Gemini eller GPT-modeller med Claude Code. Du kan også være interessert i beste AI-stack for SaaS.
pip install claude-code-proxy
claude-code-proxy --port 8080
# Pek deretter Claude Code mot det
export ANTHROPIC_BASE_URL="http://localhost:8080"
export ANTHROPIC_API_KEY="din-gemini-eller-openai-nokkel"Hvis du spesifikt vil ha Geminis 1M token-kontekst for store monorepos, er dette den mest direkte veien.
LiteLLM (Bedriftens universelle proxy)
LiteLLM er en bedriftsklassifisert proxy som støtter 100+ leverandører med lastbalansering, reservekjeder, hastighetsbegrensning og revisjonslogging. Det er overdreven for en solo-utvikler, men essensielt for team som trenger styring rundt AI-modellbruk.
Oppsettet bruker en YAML-konfigurasjon:
model_list:
- model_name: claude-sonnet-4-20250514
litellm_params:
model: gemini/gemini-2.5-flash
api_key: os.environ/GEMINI_API_KEY
- model_name: claude-haiku-3-5-20241022
litellm_params:
model: deepseek/deepseek-chat
api_key: os.environ/DEEPSEEK_API_KEY# Start LiteLLM-proxy
litellm --config config.yaml --port 4000
# Pek Claude Code mot LiteLLM
export ANTHROPIC_BASE_URL="http://localhost:4000"
export ANTHROPIC_API_KEY="sk-litellm"En viktig merknad fra den offisielle Claude Code-dokumentasjonen: "Anthropic godkjenner ikke, vedlikeholder ikke eller reviderer ikke LiteLLM." Bruk det, men vet at det er et fellesskapsverktøy, ikke et Anthropic-produkt. LiteLLM-veiledningen har flere avanserte konfigurasjonseksempler.
Verdikt: Bruk claude-code-proxy hvis du spesifikt vil ha Gemini- eller OpenAI-modeller. Bruk LiteLLM hvis teamet ditt trenger lastbalansering, reserve og revisjonslogging på tvers av leverandører.
Claude Code Router vs LiteLLM: Hvilken bør du bruke?
Claude Code Router er det enklere valget for solo-utviklere som vil ha oppgavebasert modellruting, mens LiteLLM er bygget for team som trenger lastbalansering, reservekjeder og revisjonslogging. Router installeres via npm og leser en config.json; LiteLLM kjører en bedrifts-YAML-konfigurert proxy på tvers av 100+ leverandører.
| Faktor | Claude Code Router | LiteLLM |
|---|---|---|
| Oppsettsvanskelighet | Middels: npm install, rediger config.json | Avansert: YAML-konfigurasjonsfil |
| Best for | Solo-utviklere som vil ha oppgavebasert ruting | Team som trenger styring |
| Konfigurasjonsformat | config.json | YAML model_list |
| Fremtredende funksjon | Kontekstbevisst oppgavebasert ruting | Lastbalansering, reserve, revisjonslogging |
| Leverandører | OpenRouter, DeepSeek, Gemini, Ollama, Groq og flere | 100+ hos ulike leverandører |
| Modenhet | 30k+ GitHub-stjerner, bygget for Claude Code | Bedrifts-proxy, fellesskapsverktøy (ikke Anthropic-godkjent) |
Velg claude-code-router hvis du er en solo-utvikler som vil ha billige bakgrunnsoppgaver på DeepSeek og kompleks resonnering på Opus uten mye oppsett. Velg LiteLLM hvis teamet ditt trenger lastbalansering, hastighetsbegrensning og revisjonslogger på tvers av leverandører.
Vurderer du andre proxyer også? Vår oversikt over de beste LLM-gatewayverktøyene sammenligner dem side om side.
Hva koster egentlig hver metode?
La oss sette reelle tall på dette. Her er hva du betaler per 1 million tokens for de vanligste modell/metode-kombinasjonene:
| Modell / Metode | Inn (per 1M tokens) | Ut (per 1M tokens) | Månedlig estimat (moderat bruk) |
|---|---|---|---|
| Claude Opus 4.6 (direkte) | 280 kr | 1 400 kr | ~2 800-8 400 kr |
| Claude Sonnet 4.6 (direkte) | 168 kr | 840 kr | ~1 680-3 360 kr |
| Claude Sonnet via OpenRouter | 168 kr | 840 kr | Samme (gjennomtransport) |
| DeepSeek V3.2 (OpenRouter) | 15 kr | 62 kr | ~186-500 kr |
| Gemini 2.5 Flash (OpenRouter) | 8,5 kr | 33,6 kr | ~112-282 kr |
| Ollama (lokalt) | Gratis | Gratis | 0 kr (maskinvarekostnader) |
Prisdata fra Anthropics offisielle prisside og OpenRouter. Estimert USD/NOK-kurs: 56 kr. Moderat bruk antar ~5-10M tokens/måned for daglige kodingsøkter.
"Kostnad per 1M utdatatoken etter modell"
Datatabell
| "Modell" | "Utdatakostnad" |
|---|---|
| "Opus 4.6" | 1400 |
| "Sonnet 4.6" | 840 |
| "DeepSeek V3.2" | 62 |
| "Gemini 2.5 Flash" | 33.6 |
| "Ollama (lokalt)" | 0 |
Kostnadsgapet er betydelig, men billigere modeller produserer lavere kodekvalitet -- spesielt for komplekse agentoppgaver der påliteligheten til verktøyanrop er viktig. DeepSeek til 62 kr/MTok utdata er flott for rutinemessige redigeringer. For en refaktorering av flere filer der Claude Code trenger å lese, planlegge, redigere og verifisere over 20 filer? Du vil fortsatt ha Sonnet eller Opus.
Verdikt: For kostnadsbesparelser med akseptabel kvalitet tilbyr OpenRouter + DeepSeek det beste forholdet. For null kostnad er Ollama uslåelig hvis du har maskinvaren. For maksimal kvalitet er Anthropic direkte fortsatt kongen.
Hvilken metode bør du bruke? -- Beslutningsrammeverk
Her er seksjonen som alle andre veiledninger hopper over. I stedet for å fortelle deg "bare bruk OpenRouter", la oss matche metoder med faktiske behov:
| Hvis du trenger... | Bruk denne metoden | Hvorfor |
|---|---|---|
| Maksimal modellvariasjon, én API-nøkkel | OpenRouter | 300+ modeller, enkelt oppsett, betal-per-bruk |
| Gratis, ubegrenset, koden forblir lokal | Ollama | Null kostnad, full personvern, offline-kapabel |
| Lokale modeller med visuelt grensesnitt | LM Studio | GUI-modellnettleser, enkel kvantiseringsvalg |
| Smart oppgavebasert ruting | claude-code-router | Resonnering til Opus, raske redigeringer til DeepSeek |
| Spesifikt Gemini- eller OpenAI-modeller | claude-code-proxy | Oversetter Anthropic-format til OpenAI/Gemini |
| Bedrift: lastbalansering, revisjon | LiteLLM | Hastighetsbegrensning, reservekjeder, teamkontroller |
Bør du til og med bytte?
Ærlig vurdering: for de fleste utviklere som gjør kompleks agentisk koding -- refaktorering av flere filer, arkitekturplanlegging, feilsøking av vanskelige samtidigetsproblem -- forblir Claude Sonnet via direkte Anthropic det beste alternativet. Innebygd Claude har det mest pålitelige verktøyanropet, den beste forståelsen av sin egen agentiske arbeidsflyt og null proxy-latens.
Modellbytte er en optimalisering for spesifikke scenarioer:
- Du brenner tokens på bakgrunnsoppgaver som ikke trenger Sonnet-kvalitet, eller du stadig treffer Claudes 2x bruksgrenser
- Du trenger Geminis 1M kontekstvindu for et massivt monorepo
- Koden din kan ikke forlate maskinen din (myndigheter, helsevesen, finans)
- Du har et stramt budsjett og akseptabel kvalitet slår perfekt kvalitet
Hvis ingen av disse gjelder, kan opusplan (Anthropics innebygde ruting) være alt du trenger.
Påliteligheten til verktøyanrop er kvalitetsmålet som betyr mest her. Hierarkiet er: innebygd Claude >> OpenRouter Claude >> DeepSeek/Gemini >> lokale modeller. Jo lenger ned du går, desto flere mislykkede verktøyanrop, hallusinerte filbaner og ufullstendige redigeringer ser du.
Feilsøking av vanlige problemer
"model not found"-feilen
Dette er det vanligste problemet. Det skjer når du angir ANTHROPIC_BASE_URL, men glemmer å kartlegge alle tre modellsporene. Claude Code prøver å kalle Haiku eller Opus via proxyen din, proxyen gjenkjenner ikke Anthropics standard modellnavn, og du får feilen.
# Fix: angi ALLE tre modellsporvariablene
export ANTHROPIC_DEFAULT_HAIKU_MODEL="din-modell"
export ANTHROPIC_DEFAULT_SONNET_MODEL="din-modell"
export ANTHROPIC_DEFAULT_OPUS_MODEL="din-modell"Tilkobling avvist / tidsavbrudd
Proxyen din kjører ikke, eller Claude Code treffer feil port. Verifiser at proxy-prosessen er aktiv og dobbeltsjekk porten i ANTHROPIC_BASE_URL. Brannmurer og VPN-er kan også blokkere localhost-tilkoblinger. Les mer om beste AI-verktøy for startups.
Verktøyanropsfeil
Modellen støtter ikke Anthropics verktøybruksformat riktig. Symptomer: Claude Code henger, produserer tomme verktøyanrop, eller redigerer de feil filene. Bytt til en modell med verifisert støtte for verktøyanrop -- Qwen 2.5 Coder og devstral håndterer det best blant lokale modeller.
Strømmingsproblemer
Noen proxyer håndterer ikke server-sent events riktig. Svar vises alle på en gang i stedet for å strømme, eller de avkortes midt i svaret. Sørg for at proxy-versjonen din er oppdatert og sjekk GitHub-problemene for kjente strømmingsfeil.
Kontekstvindu overskredet
Lokale modeller har ofte standard 4K-8K kontekstvinduer. Claude Code trenger mye mer enn det for ekte kodingsøkter. Bruk modeller med 32K+ kontekst, eller rut oppgaver med lang kontekst til Gemini (1M vindu) via OpenRouter.
Må logge ut først for OpenRouter
Hvis du bytter fra direkte Anthropic til OpenRouter, kjør claude /logout først. Claude Code bufrer autentisering og vil fortsette å prøve å bruke Anthropic-nøkkelen din selv etter at du har endret basis-URL-en.
# Fjern bufret autentisering før du bytter leverandør
claude /logoutFAQ
Kan du bruke Claude Code med GPT-4 eller Gemini?
Ja. claude-code-proxy oversetter Anthropic-formaterte forespørsler til OpenAI- eller Gemini-format. Du kan også få tilgang til begge via OpenRouter med én enkelt API-nøkkel. Verktøyanrop kan være mindre pålitelig enn innebygd Claude, spesielt for komplekse flertrinnede oppgaver.
Hvordan bruker jeg Claude Code uten en Anthropic API-nøkkel?
Bruk Ollama for helt gratis lokal bruk -- ingen API-nøkkel fra noen leverandør nødvendig. Alternativt, bruk OpenRouter med deres API-nøkkelformat. Du angir fortsatt miljøvariabelen ANTHROPIC_API_KEY, men den peker til proxy-nøkkelen din (f.eks. sk-or-v1-... for OpenRouter, "ollama" for Ollama).
Hvordan setter jeg opp Claude Code med Ollama?
Installer Ollama, last ned en modell som qwen2.5-coder:14b, kjør ollama launch claude og angi tre miljøvariabler: ANTHROPIC_BASE_URL, ANTHROPIC_API_KEY og de tre modellsporvariablene. Se Ollama-seksjonen ovenfor for den fullstendige koden.
Hvilke modeller fungerer best med Claude Code?
For sky: Claude Sonnet 4 leverer den beste kodingskvaliteten, mens DeepSeek V3.2 tilbyr den beste verdien. For lokalt: Qwen 2.5 Coder 14B er den nåværende gullstandarden. Den avgjørende faktoren er påliteligheten til verktøyanrop -- Claude Code er sterkt avhengig av det for filoperasjoner, og innebygde Claude-modeller håndterer det best.
Hvordan fikser jeg "model not found"-feilen i Claude Code?
Angi alle tre modellspor-miljøvariablene: ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL og ANTHROPIC_DEFAULT_OPUS_MODEL. Denne feilen oppstår fordi Claude Code bruker tre interne modellsporer, og et ikke-kartlagt spor prøver å kalle et modellnavn som proxyen din ikke gjenkjenner.
Kan Claude Code fungere frakoblet med lokale modeller?
Ja. Både Ollama og LM Studio kjører modeller helt på maskinen din uten Internett-tilkobling. Koden din forlater aldri maskinvaren din. Du trenger tilstrekkelige spesifikasjoner -- minimum 16 GB RAM for 7B-modeller, 32 GB+ for alt større.
Kan jeg bruke LM Studio med Claude Code?
Ja. LM Studio kjører en lokal server som Claude Code kobler til ved å sette ANTHROPIC_BASE_URL til http://localhost:1234/v1 og ANTHROPIC_API_KEY til lm-studio. Last ned en kodingsmodell som Qwen 2.5 Coder, start serveren fra LM Studios GUI, og kartlegg deretter modellsporet ditt. Det er det visuelle alternativet til Ollamas CLI.
Hva er ANTHROPIC_BASE_URL og hvordan bruker jeg det?
Det er miljøvariabelen som forteller Claude Code hvor API-forespørsler skal sendes. Som standard peker den til https://api.anthropic.com. Endre den til et Anthropic-kompatibelt endepunkt -- OpenRouter (https://openrouter.ai/api), Ollama (http://localhost:11434), LiteLLM (http://localhost:4000), osv.
Er claude-code-router bedre enn LiteLLM?
Forskjellige verktøy for forskjellige problemer. claude-code-router er enklere (npm install, rediger config.json, ferdig) og designet spesifikt for Claude Code. LiteLLM er bedriftsklasse med lastbalansering, hastighetsbegrensning, reservekjeder og revisjonslogging. Solo-utvikler? Bruk claude-code-router. Team med styrings behov? Bruk LiteLLM.
Hvor mye kan jeg spare ved å bruke ikke-Anthropic-modeller?
Å bytte fra Claude Opus 4.6 til DeepSeek V3.2 reduserer kostnadene for utdatatoken med omtrent 95% (1 400 kr vs 62 kr per million tokens). Ollama bringer det til null hvis du har maskinvaren. Men kvalitetskompromissene er reelle -- forvent lavere nøyaktighet på komplekse flertrinnede agentoppgaver, mindre pålitelig verktøyanrop og flere hallusinerte filbaner.
Fungerer verktøyanrop med alle proxy-metoder?
Ikke pålitelig over hele linjen. Innebygd Claude har den beste støtten for verktøyanrop. OpenRouter med Claude-modeller fungerer nesten like bra. DeepSeek og Gemini har delvis støtte -- enkle verktøyanrop fungerer, men komplekse kjeder kan mislykkes. Lokale modeller via Ollama har den minst pålitelige verktøyanropet. Dette er den viktigste kvalitetsproblematikken når man forlater Anthropic.
Kilder
- Modellkonfigurasjon -- Claude Code-dokumentasjon
- LLM-gatewaykonfigurasjon -- Claude Code-dokumentasjon
- Claude Code-integrasjon -- OpenRouter-dokumentasjon
- Claude Code-integrasjon -- Ollama-dokumentasjon
- Claude API-priser -- Anthropic
- claude-code-router -- GitHub
- claude-code-proxy -- GitHub
- Bruke Claude Code med ikke-Anthropic-modeller -- LiteLLM-dokumentasjon