
Claude Code levereras med Anthropics modeller, men en enda miljövariabel -- ANTHROPIC_BASE_URL -- låter dig dirigera förfrågningar till praktiskt taget vilken LLM-leverantör som helst. Det betyder att du kan byta till DeepSeek för ungefär 0,27 $ per miljon utdatatoken istället för Claude Opus för 25 $, eller köra modeller lokalt via Ollama gratis. Den här guiden täcker alla metoder för att använda olika modeller i Claude Code, och bygger på vår detaljerade Claude Code-jämförelse med praktisk installation för varje metod.
Alla metoder i ett ögonkast
Välj den metod som passar din situation och hoppa sedan till dess avsnitt för installationskoden.
| Metod | Bäst för | Kostnad | Installation | Modeller |
|---|---|---|---|---|
| OpenRouter | Modellvariation, en API-nyckel | Pay-per-token (genomtransport) | Enkel | 300+ |
| Ollama | Integritet, gratis, offline | Gratis (din hårdvara) | Enkel | 50+ öppen källkod |
| LM Studio | Lokala modeller med GUI | Gratis (din hårdvara) | Enkel | 50+ öppen källkod |
| claude-code-router | Smart uppgiftsbaserad dirigering | Varierar per leverantör | Medel | Beror på konfiguration |
| claude-code-proxy | Gemini/OpenAI-backend | Leverantörens priser | Medel | OpenAI + Gemini |
| LiteLLM | Företag, lastbalansering | Leverantörens priser | Avancerad | 100+ hos olika leverantörer |
Fortsätt läsa för steg-för-steg-installation av varje metod, eller hoppa direkt till beslutsramverket om du redan vet vad du behöver.
Hur fungerar Claude Code-modellbyte egentligen?
Innan du konfigurerar någon proxy måste du förstå varför de flesta handledningar lämnar dig med en trasig installation. Claude Code använder internt tre modellplatser -- inte en:
- Haiku-plats -- bakgrundsuppgifter som filsammanfattning och flikifyllning
- Sonnet-plats -- standard kodning, modellen du interagerar mest med
- Opus-plats -- komplex resonemang, planering och flerstegs agentuppgifter
När du ändrar modellen med /model eller --model ändrar du bara den primära platsen. Claude Code försöker fortfarande anropa de andra två platserna med Anthropics API. Om du har pekat ANTHROPIC_BASE_URL mot en proxy men bara ställt in en modell misslyckas de andra platserna med ett "model not found"-fel.
Lösningen: ställ in alla tre miljövariablerna så att varje plats dirigeras via din proxy.
# Ställ in alla tre platser för att gå genom din proxy
export ANTHROPIC_DEFAULT_HAIKU_MODEL="din-haiku-motsvarighet"
export ANTHROPIC_DEFAULT_SONNET_MODEL="din-sonnet-motsvarighet"
export ANTHROPIC_DEFAULT_OPUS_MODEL="din-opus-motsvarighet"Inbyggt modellbyte (Anthropic-modeller)
Om du stannar inom Anthropics modellfamilj är bytet enkelt. Använd kommandot /model inne i Claude Code, skicka --model när du startar från terminalen, eller lägg till modeller i availableModels-arrayen i din inställningsfil. Anthropic lägger ständigt till fler alternativ här, och vår sammanställning av de senaste Claude Code-funktionerna för 2026 håller koll på vad som nyligen har lanserats.
opusplan-strategin
opusplan är Claude Codes inbyggda multi-modelldirigering. Det skickar bakgrundsuppgifter till Haiku och kanaliserar komplex resonemang till Opus -- automatiskt. Du konfigurerar det inte manuellt; välj det bara som din modell. Det är Anthropics eget svar på problemet "varför betalar jag Opus-priser för en fillista?". Värt att prova innan du tar till en tredjepartsrouter, tillsammans med Anthropics fast mode om ren hastighet är din prioritet.
OpenRouter -- En API-nyckel, 300+ modeller
OpenRouter fungerar som en API-aggregator. Du får en enda API-nyckel och tillgång till 300+ modeller från Anthropic, Google, Meta, Mistral, DeepSeek och mer. Prissättningen är genomtransport för de flesta modeller -- ingen pålägg.
Installationssteg
- Skapa ett konto på openrouter.ai och generera en API-nyckel
- Kör
claude /logoutför att rensa eventuell befintlig Anthropic-session - Ställ in dina miljövariabler:
export ANTHROPIC_BASE_URL="https://openrouter.ai/api"
export ANTHROPIC_API_KEY="sk-or-v1-din-nyckel-här"
# Mappa alla tre modellplatser
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek/deepseek-chat-v3"
export ANTHROPIC_DEFAULT_SONNET_MODEL="anthropic/claude-sonnet-4"
export ANTHROPIC_DEFAULT_OPUS_MODEL="anthropic/claude-opus-4"- Starta
claudeoch verifiera anslutningen
Notera de tre platsvariablerna -- hoppa över dem och du får "model not found"-felet vi täckte ovan. Den officiella OpenRouter-integrationsguiden bekräftar denna installation.
Rekommenderade modeller via OpenRouter
Inte varje modell på OpenRouter hanterar Claude Codes verktygsanrop tillförlitligt. Här är vad som faktiskt fungerar bra:
| Uppgift | Modell | Varför |
|---|---|---|
| Billiga bakgrundsuppgifter | DeepSeek V3.2 | 0,27 $/1,10 $ per MTok, hyggliga verktygsanrop |
| Standard kodning | Claude Sonnet 4 | Samma kvalitet som direkt, samlad fakturering |
| Enorma kodbaser (1M kontext) | Gemini 2.5 Flash | 0,15 $/0,60 $ per MTok, massivt kontextfönster |
| Komplex resonemang | Claude Opus 4 | Bästa agentiska kodningskvaliteten |
Kostnad och fakturering
OpenRouter tar ut genomtransportpriser för de flesta modeller. Du betalar exakt vad den underliggande leverantören tar ut, plus en liten marginal på vissa tredjepartsmodeller. Ställ in utgiftsgränser i din OpenRouter-instrumentpanel för att undvika överraskningar.
Omdöme: OpenRouter är det bästa alternativet för utvecklare som vill ha maximal modellvariation med minimal installation. En API-nyckel, en faktureringsinstrumentpanel, 300+ modeller. Svårt att slå i flexibilitet.
Ollama -- Gratis, lokalt och privat
Ollama kör modeller helt på din maskin. Sedan v0.14.0 (januari 2026) stöder det Anthropic Messages API inbyggt, vilket innebär att Claude Code kan kommunicera med det utan något översättningslager. Din kod lämnar aldrig din maskin.
Förutsättningar och hårdvara
Du behöver anständig hårdvara för en användbar upplevelse:
- 7B-modeller (snabba redigeringar, enkla uppgifter): 16 GB RAM minimum
- 14B-modeller (solid kodningskvalitet): 32 GB RAM, GPU rekommenderas
- 32B+-modeller (nära molnkvalitet): 64 GB RAM eller dedikerat GPU med 24 GB+ VRAM
För en djupare inblick i hårdvarukrav och modellval, kolla vår guide till att köra LLM:er lokalt.
Installationssteg
- Installera Ollama från ollama.com
- Hämta en kodningsfokuserad modell
- Starta med Claude Code-kompatibilitet
- Ställ in dina miljövariabler
# Installera och hämta en kodningsmodell
ollama pull qwen2.5-coder:14b
# Starta med Claude Code-kompatibilitet
ollama launch claude
# Ställ in miljövariabler
export ANTHROPIC_BASE_URL="http://localhost:11434"
export ANTHROPIC_API_KEY="ollama"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_SONNET_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_OPUS_MODEL="qwen2.5-coder:14b"Ollamas integrationsdokumentation rekommenderar modeller med 64k+ token kontextfönster för den bästa Claude Code-upplevelsen.
Bästa lokala modeller för kodning
| Modell | Storlek | Styrka | Anteckningar |
|---|---|---|---|
| Qwen 2.5 Coder 14B | 14B | Bästa övergripande lokala kodning | Stark verktygsanrop, bra kontexthantering |
| devstral | 24B | Mistrals kodningsspecialist | Utmärkt för refaktorering och kodgranskning |
| GLM 4.7 | 9B | Allmänt resonemang | Bra balans mellan hastighet och kvalitet |
Var ärlig mot dig själv om en sak: lokala modeller producerar märkbart lägre kodkvalitet än Claude Sonnet för komplexa, flerstegs agentuppgifter. Verktygsanrop är mindre tillförlitligt, och du kommer att se fler hallucinerade filsökvägar. De är fantastiska för snabba redigeringar, enkel generering och integritetstunsitivt arbete -- förvänta dig bara inte inhemsk Claude-kvalitet på en 50-fils refaktorering.
Omdöme: Ollama är det bästa valet för integritetskänsligt arbete och utvecklare som vill ha gratis, obegränsad användning. Om du har hårdvaran är det svårt att argumentera mot "noll kronor för alltid."
Ollama Cloud vs OpenRouter: priser och när respektive vinner
Ollama och OpenRouter löser kostnadsproblemet från motsatta håll. Ollama kör modeller på hårdvara du själv kontrollerar till noll kostnad per token, medan OpenRouter tar ut genomtransportpriser över 300+ hostade modeller utan någon hårdvara att hantera. Den här guiden ställer in Ollama lokalt, men samma matematik med fast kostnad kontra pris per token gäller om du istället kör dess hostade nivå.
| Faktor | Ollama | OpenRouter |
|---|---|---|
| Kostnadsmodell | Gratis lokalt, du betalar för hårdvaran | Genomtransport per token, ingen pålägg på de flesta modeller |
| Exempelpris | 0 $ per token | DeepSeek V3.2 för 0,27 $/1,10 $, Gemini 2.5 Flash för 0,15 $/0,60 $ per MTok |
| Hårdvara | 16 GB RAM (7B) upp till 24 GB+ VRAM (32B+) | Ingen, helt hostat |
| Modelltillgång | 50+ öppen källkod-modeller | 300+ hos olika leverantörer |
| Integritet | Koden lämnar aldrig din maskin | Förfrågningar går via OpenRouter |
Välj Ollama när integritet, offline-användning eller högvolyms rutinredigeringar spelar roll och du redan äger hårdvaran. Välj OpenRouter när du vill ha modellvariation, ingen hårdvara i förväg och betala-bara-för-det-du-använder-fakturering.
LM Studio -- Lokala modeller med ett GUI
LM Studio erbjuder samma lokala modellkörning som Ollama, men med ett visuellt gränssnitt. Du bläddrar bland modeller i ett GUI, väljer kvantiseringsnivåer med ett klick och testar chatten innan du pekar Claude Code mot det. Samma hårdvarukrav som Ollama. Om du jämför olika körningsalternativ täcker vår guide till de bästa verktygen för att köra LLM:er lokalt avvägningarna.
Installation
- Ladda ner LM Studio och installera det
- Sök efter och ladda ner en kodningsmodell (Qwen 2.5 Coder, devstral, etc.)
- Starta den lokala servern från LM Studio-gränssnittet
- Peka Claude Code mot det:
# Peka Claude Code mot LM Studios lokala server
export ANTHROPIC_BASE_URL="http://localhost:1234/v1"
export ANTHROPIC_API_KEY="lm-studio"
export ANTHROPIC_DEFAULT_SONNET_MODEL="ditt-laddade-modellnamn"LM Studio-bloggen har en genomgång med skärmdumpar om du föredrar visuella installationsguider.
Omdöme: LM Studio är bäst för utvecklare som föredrar ett GUI framför CLI för att hantera lokala modeller. Om du redan är bekväm med ollama pull och konfigurationsfiler, håll dig till Ollama. Om du vill bläddra bland modeller visuellt och justera inställningar med reglage är LM Studio ditt val.
claude-code-router -- Smart modelldirigering
claude-code-router är ett npm-paket som kör en lokal proxy mellan Claude Code och dina konfigurerade leverantörer. Det som gör det intressant är kontextmedveten dirigering -- du kan skicka billiga bakgrundsuppgifter till DeepSeek, standardkodning till Sonnet och komplex resonemang till Opus, allt automatiskt.
Projektet har 30k+ GitHub-stjärnor och stöder OpenRouter, DeepSeek, Gemini, Ollama, Groq, Volcengine och SiliconFlow som leverantörer.
Installation och konfiguration
npm install -g claude-code-router
claude-code-router init
claude-code-router startKommandot init skapar en config.json där du definierar dina leverantörer och modellmappningar:
{
"providers": {
"openrouter": {
"apiKey": "sk-or-v1-...",
"models": {
"haiku": "deepseek/deepseek-chat-v3",
"sonnet": "anthropic/claude-sonnet-4",
"opus": "anthropic/claude-opus-4"
}
}
}
}Konfiguration för kontextmedveten dirigering
Det är här claude-code-router lyser. Du kan dirigera olika uppgiftstyper till olika modeller baserat på komplexitet. Bakgrundssammanfattning går till en billig modell, medan planering och arkitekturarbete går till din bästa modell. Routern hanterar alla platsmappningar transparent.
Du kan också blanda leverantörer -- använd Ollama för integritetskänsliga repo:s och OpenRouter för allt annat, och byt med kommandot /model inne i Claude Code.
Omdöme: claude-code-router är bäst för kraftanvändare som vill ha detaljerad kontroll över vilken modell som hanterar varje uppgiftstyp. Det är det mest konfigurerbara alternativet, men den flexibiliteten kommer med mer installation än ett enkelt ANTHROPIC_BASE_URL-byte.
claude-code-proxy och LiteLLM -- Avancerade installationer
Dessa två metoder tjänar olika behov men delar ett drag: de är båda proxyservrar som översätter mellan API-format.
claude-code-proxy (Gemini och OpenAI-backend)
claude-code-proxy är ett Python-verktyg (3,3k GitHub-stjärnor) som accepterar Anthropic-formaterade förfrågningar från Claude Code och översätter dem till OpenAI- eller Gemini-format via LiteLLM under huven. Det är det enklaste sättet att specifikt använda Gemini eller GPT-modeller med Claude Code.
pip install claude-code-proxy
claude-code-proxy --port 8080
# Peka sedan Claude Code mot det
export ANTHROPIC_BASE_URL="http://localhost:8080"
export ANTHROPIC_API_KEY="din-gemini-eller-openai-nyckel"Om du specifikt vill ha Geminis 1M token-kontext för stora monorepos är detta den mest direkta vägen.
LiteLLM (Företagets universella proxy)
LiteLLM är en företagsklassad proxy som stöder 100+ leverantörer med lastbalansering, reservkedjor, hastighetsbegränsning och revisionsloggning. Det är överdrivet för en ensam utvecklare men nödvändigt för team som behöver styrning kring AI-modellanvändning.
Installationen använder en YAML-konfiguration:
model_list:
- model_name: claude-sonnet-4-20250514
litellm_params:
model: gemini/gemini-2.5-flash
api_key: os.environ/GEMINI_API_KEY
- model_name: claude-haiku-3-5-20241022
litellm_params:
model: deepseek/deepseek-chat
api_key: os.environ/DEEPSEEK_API_KEY# Starta LiteLLM-proxy
litellm --config config.yaml --port 4000
# Peka Claude Code mot LiteLLM
export ANTHROPIC_BASE_URL="http://localhost:4000"
export ANTHROPIC_API_KEY="sk-litellm"En viktig anmärkning från den officiella Claude Code-dokumentationen: "Anthropic godkänner, underhåller eller granskar inte LiteLLM." Använd det, men vet att det är ett community-verktyg, inte en Anthropic-produkt. LiteLLM-handledningen har fler avancerade konfigurationsexempel.
Omdöme: Använd claude-code-proxy om du specifikt vill ha Gemini- eller OpenAI-modeller. Använd LiteLLM om ditt team behöver lastbalansering, reserv och revisionsloggning över leverantörer.
Claude Code Router vs LiteLLM: Vilken ska du använda?
Claude Code Router är det enklare valet för ensamutvecklare som vill ha uppgiftsbaserad modelldirigering, medan LiteLLM är byggt för team som behöver lastbalansering, reservkedjor och revisionsloggning. Router installeras via npm och läser en config.json; LiteLLM kör en företagsklassad YAML-konfigurerad proxy över 100+ leverantörer.
| Faktor | Claude Code Router | LiteLLM |
|---|---|---|
| Installationssvårighet | Medel: npm install, redigera config.json | Avancerad: YAML-konfigurationsfil |
| Bäst för | Ensamutvecklare som vill ha uppgiftsbaserad dirigering | Team som behöver styrning |
| Konfigurationsformat | config.json | YAML model_list |
| Utmärkande funktion | Kontextmedveten uppgiftsbaserad dirigering | Lastbalansering, reserv, revisionsloggning |
| Leverantörer | OpenRouter, DeepSeek, Gemini, Ollama, Groq med flera | 100+ hos olika leverantörer |
| Mognad | 30k+ GitHub-stjärnor, byggt för Claude Code | Företagsproxy, community-verktyg (inte godkänt av Anthropic) |
Välj claude-code-router om du är en ensamutvecklare som vill ha billiga bakgrundsuppgifter på DeepSeek och komplext resonemang på Opus utan mycket installation. Välj LiteLLM om ditt team behöver lastbalansering, hastighetsbegränsning och revisionsloggar över leverantörer.
Väger du andra proxyalternativ också? Vår sammanställning av de bästa LLM-gatewayverktygen jämför dem sida vid sida.
Vad kostar varje metod egentligen?
Låt oss sätta verkliga siffror på detta. Här är vad du betalar per 1 miljon tokens för de vanligaste modell/metod-kombinationerna:
| Modell / Metod | Indata (per 1M tokens) | Utdata (per 1M tokens) | Månadsuppskattning (måttlig användning) |
|---|---|---|---|
| Claude Opus 4.6 (direkt) | 52 kr | 260 kr | ~520-1 560 kr |
| Claude Sonnet 4.6 (direkt) | 31 kr | 155 kr | ~310-620 kr |
| Claude Sonnet via OpenRouter | 31 kr | 155 kr | Samma (genomtransport) |
| DeepSeek V3.2 (OpenRouter) | 2,80 kr | 11,40 kr | ~34-90 kr |
| Gemini 2.5 Flash (OpenRouter) | 1,55 kr | 6,20 kr | ~21-52 kr |
| Ollama (lokalt) | Gratis | Gratis | 0 kr (hårdvarukostnader) |
Prisdata från Anthropics officiella prissida och OpenRouter. Uppskattad USD/SEK-kurs: 10,38 kr. Måttlig användning antar ~5-10M tokens/månad för dagliga kodningssessioner.
"Kostnad per 1M utdatatoken efter modell"
Datatabell
| "Modell" | "Utdatakostnad" |
|---|---|
| "Opus 4.6" | 260 |
| "Sonnet 4.6" | 155 |
| "DeepSeek V3.2" | 11.4 |
| "Gemini 2.5 Flash" | 6.2 |
| "Ollama (lokalt)" | 0 |
Kostnadsskillnaden är betydande, men billigare modeller producerar lägre kodkvalitet -- speciellt för komplexa agentuppgifter där tillförlitligheten för verktygsanrop spelar roll. DeepSeek på 11,40 kr/MTok utdata är utmärkt för rutinredigeringar. För en refaktorering av flera filer där Claude Code behöver läsa, planera, redigera och verifiera över 20 filer? Du vill fortfarande ha Sonnet eller Opus.
Omdöme: För kostnadsbesparingar med acceptabel kvalitet erbjuder OpenRouter + DeepSeek det bästa förhållandet. För noll kostnad är Ollama oöverträffat om du har hårdvaran. För maximal kvalitet förblir Anthropic direkt kung.
Vilken metod bör du använda? -- Beslutsramverk
Här är avsnittet som varje annan handledning hoppar över. Istället för att berätta "använd bara OpenRouter," låt oss matcha metoder med faktiska behov:
| Om du behöver... | Använd den här metoden | Varför |
|---|---|---|
| Maximal modellvariation, en API-nyckel | OpenRouter | 300+ modeller, enkel installation, pay-per-use |
| Gratis, obegränsat, koden stannar lokalt | Ollama | Noll kostnad, full integritet, offline-kapabelt |
| Lokala modeller med visuellt gränssnitt | LM Studio | GUI-modellbläddrare, enkel kvantiseringsval |
| Smart uppgiftsbaserad dirigering | claude-code-router | Resonemang till Opus, snabba redigeringar till DeepSeek |
| Specifikt Gemini- eller OpenAI-modeller | claude-code-proxy | Översätter Anthropic-format till OpenAI/Gemini |
| Företag: lastbalansering, revision | LiteLLM | Hastighetsbegränsning, reservkedjor, teamkontroller |
Bör du ens byta?
Ärlig bedömning: för de flesta utvecklare som gör komplex agentisk kodning -- refaktorering av flera filer, arkitekturplanering, felsökning av knepiga samtidighetsproblem -- förblir Claude Sonnet via direkt Anthropic det bästa alternativet. Inbyggd Claude har det mest tillförlitliga verktygsanropet, den bästa förståelsen av sitt eget agentiska arbetsflöde och noll proxyfördröjning.
Modellbyte är en optimering för specifika scenarier:
- Du bränner tokens på bakgrundsuppgifter som inte behöver Sonnet-kvalitet, eller om du ständigt slår i Claudes 2x-användningsgränser
- Du behöver Geminis 1M kontextfönster för ett massivt monorepo
- Din kod kan inte lämna din maskin (myndigheter, sjukvård, finans)
- Du har en snäv budget och acceptabel kvalitet slår perfekt kvalitet
Om inget av dessa gäller kan opusplan (Anthropics inbyggda dirigering) vara allt du behöver.
Tillförlitligheten för verktygsanrop är det kvalitetsmått som spelar störst roll här. Hierarkin är: inbyggd Claude >> OpenRouter Claude >> DeepSeek/Gemini >> lokala modeller. Ju längre ner du går, desto fler misslyckade verktygsanrop, hallucinerade filsökvägar och ofullständiga redigeringar ser du.
Felsökning av vanliga problem
Felet "model not found"
Detta är det vanligaste problemet. Det händer när du ställer in ANTHROPIC_BASE_URL men glömmer att mappa alla tre modellplatser. Claude Code försöker anropa Haiku eller Opus via din proxy, proxyn känner inte igen Anthropics standardmodellnamn och du får felet.
# Fix: ställ in ALLA tre modellplatsvariablerna
export ANTHROPIC_DEFAULT_HAIKU_MODEL="din-modell"
export ANTHROPIC_DEFAULT_SONNET_MODEL="din-modell"
export ANTHROPIC_DEFAULT_OPUS_MODEL="din-modell"Anslutning nekad / timeout
Din proxy körs inte, eller Claude Code träffar fel port. Verifiera att proxyprocessen är aktiv och dubbelkolla porten i ANTHROPIC_BASE_URL. Brandväggar och VPN kan också blockera localhost-anslutningar.
Misslyckanden med verktygsanrop
Modellen stöder inte Anthropics verktygsanropsformat korrekt. Symtom: Claude Code hänger, producerar tomma verktygsanrop eller redigerar fel filer. Byt till en modell med verifierat stöd för verktygsanrop -- Qwen 2.5 Coder och devstral hanterar det bäst bland lokala modeller.
Streamingproblem
Vissa proxys hanterar inte server-sent events korrekt. Svar visas alla på en gång istället för att streamas, eller de trunkeras mitt i svaret. Se till att din proxyversion är aktuell och kontrollera GitHub-problem för kända streamingbuggar.
Kontextfönstret överskridet
Lokala modeller har ofta standardmässigt 4K-8K kontextfönster. Claude Code behöver mycket mer än så för riktiga kodningssessioner. Använd modeller med 32K+ kontext, eller dirigera uppgifter med lång kontext till Gemini (1M fönster) via OpenRouter.
Måste logga ut först för OpenRouter
Om du byter från direkt Anthropic till OpenRouter, kör claude /logout först. Claude Code cachar autentisering och fortsätter att försöka använda din Anthropic-nyckel även efter att du ändrar bas-URL:en.
# Rensa cachad autentisering innan du byter leverantör
claude /logoutVanliga frågor
Kan du använda Claude Code med GPT-4 eller Gemini?
Ja. claude-code-proxy översätter Anthropic-formaterade förfrågningar till OpenAI- eller Gemini-format. Du kan också komma åt båda via OpenRouter med en enda API-nyckel. Verktygsanrop kan vara mindre tillförlitligt än inbyggt Claude, speciellt för komplexa flerstegsuppgifter.
Hur använder jag Claude Code utan en Anthropic API-nyckel?
Använd Ollama för helt gratis lokal användning -- ingen API-nyckel från någon leverantör behövs. Alternativt, använd OpenRouter med deras API-nyckelformat. Du ställer fortfarande in miljövariabeln ANTHROPIC_API_KEY, men den pekar på din proxys nyckel (t.ex. sk-or-v1-... för OpenRouter, "ollama" för Ollama).
Hur konfigurerar jag Claude Code med Ollama?
Installera Ollama, hämta en modell som qwen2.5-coder:14b, kör ollama launch claude och ställ in tre miljövariabler: ANTHROPIC_BASE_URL, ANTHROPIC_API_KEY och de tre modellplatsvariablerna. Se Ollama-avsnittet ovan för den fullständiga koden.
Vilka modeller fungerar bäst med Claude Code?
För molnet: Claude Sonnet 4 ger den bästa kodningskvaliteten, medan DeepSeek V3.2 erbjuder det bästa värdet. För lokalt: Qwen 2.5 Coder 14B är den nuvarande guldstandarden. Den avgörande faktorn är tillförlitligheten för verktygsanrop -- Claude Code är starkt beroende av det för filoperationer, och inbyggda Claude-modeller hanterar det bäst.
Hur åtgärdar jag felet "model not found" i Claude Code?
Ställ in alla tre modellplatsmiljövariablerna: ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL och ANTHROPIC_DEFAULT_OPUS_MODEL. Det här felet uppstår eftersom Claude Code använder tre interna modellplatser, och en omappd plats försöker anropa ett modellnamn som din proxy inte känner igen.
Kan Claude Code fungera offline med lokala modeller?
Ja. Både Ollama och LM Studio kör modeller helt på din maskin utan Internetanslutning. Din kod lämnar aldrig din hårdvara. Du behöver tillräckliga specifikationer -- minst 16 GB RAM för 7B-modeller, 32 GB+ för allt större.
Kan jag använda LM Studio med Claude Code?
Ja. LM Studio kör en lokal server som Claude Code ansluter till genom att ställa in ANTHROPIC_BASE_URL till http://localhost:1234/v1 och ANTHROPIC_API_KEY till lm-studio. Ladda ner en kodningsmodell som Qwen 2.5 Coder, starta servern från LM Studios GUI och mappa sedan din modellplats. Det är det visuella alternativet till Ollamas CLI.
Vad är ANTHROPIC_BASE_URL och hur använder jag det?
Det är miljövariabeln som berättar för Claude Code var API-förfrågningar ska skickas. Som standard pekar den mot https://api.anthropic.com. Ändra det till valfri Anthropic-kompatibel slutpunkt -- OpenRouter (https://openrouter.ai/api), Ollama (http://localhost:11434), LiteLLM (http://localhost:4000), etc.
Är claude-code-router bättre än LiteLLM?
Olika verktyg för olika problem. claude-code-router är enklare (npm install, redigera config.json, klart) och designat specifikt för Claude Code. LiteLLM är företagsklass med lastbalansering, hastighetsbegränsning, reservkedjor och revisionsloggning. Ensam utvecklare? Använd claude-code-router. Team med styrningsbehov? Använd LiteLLM.
Hur mycket kan jag spara genom att använda icke-Anthropic-modeller?
Att byta från Claude Opus 4.6 till DeepSeek V3.2 minskar kostnaden för utdatatoken med ungefär 95% (260 kr vs 11,40 kr per miljon tokens). Ollama tar det till noll om du har hårdvaran. Men kvalitetskompromisserna är verkliga -- förvänta dig lägre noggrannhet på komplexa flerstegs agentuppgifter, mindre tillförlitliga verktygsanrop och fler hallucinerade filsökvägar.
Fungerar verktygsanrop med alla proxymetoder?
Inte tillförlitligt genomgående. Inbyggt Claude har det bästa stödet för verktygsanrop. OpenRouter med Claude-modeller fungerar nästan lika bra. DeepSeek och Gemini har partiellt stöd -- enkla verktygsanrop fungerar, men komplexa kedjor kan misslyckas. Lokala modeller via Ollama har de minst tillförlitliga verktygsanropen. Detta är den viktigaste kvalitetsoron när man lämnar Anthropic.
Källor
- Modellkonfiguration -- Claude Code-dokumentation
- LLM-gatewaykonfiguration -- Claude Code-dokumentation
- Claude Code-integration -- OpenRouter-dokumentation
- Claude Code-integration -- Ollama-dokumentation
- Claude API-prissättning -- Anthropic
- claude-code-router -- GitHub
- claude-code-proxy -- GitHub
- Använda Claude Code med icke-Anthropic-modeller -- LiteLLM-dokumentation