guides

90% besparen op je Claude Code-rekening: OpenRouter, Ollama of LiteLLM

Geschreven door Mert Batur
Bijgewerkt Jul 5, 2026
14 leestijd
90% besparen op je Claude Code-rekening: OpenRouter, Ollama of LiteLLM

Claude Code wordt geleverd met Anthropic-modellen, maar één omgevingsvariabele -- ANTHROPIC_BASE_URL -- laat je verzoeken doorsturen naar vrijwel elke LLM-provider. Dat betekent dat je kunt overschakelen naar DeepSeek voor ongeveer $0,27 per miljoen output-tokens in plaats van Claude Opus voor $25, of modellen lokaal via Ollama gratis kunt uitvoeren. Deze gids behandelt elke methode om verschillende modellen te gebruiken in Claude Code, voortbouwend op onze gedetailleerde Claude Code-vergelijking met hands-on setup voor elke aanpak.

Alle methoden in één oogopslag

Kies de methode die bij jouw situatie past en spring naar het betreffende gedeelte voor de setupcode.

MethodeBeste voorKostenSetupModellen
OpenRouterModelvarieteit, één API-sleutelPay-per-token (doorvoer)Eenvoudig300+
OllamaPrivacy, gratis, offlineGratis (eigen hardware)Eenvoudig50+ open-source
LM StudioLokale modellen met GUIGratis (eigen hardware)Eenvoudig50+ open-source
claude-code-routerSlim per-taak routingVarieert per providerGemiddeldAfhankelijk van configuratie
claude-code-proxyGemini/OpenAI-backendProviderprijzenGemiddeldOpenAI + Gemini
LiteLLMEnterprise, taakverdelingProviderprijzenGeavanceerd100+ bij diverse providers

Lees verder voor stapsgewijze setup van elke methode, of spring direct naar het beslissingskader als je al weet wat je nodig hebt.

Hoe werkt het wisselen van Claude Code-modellen eigenlijk?

Voordat je een proxy configureert, moet je begrijpen waarom de meeste tutorials je achterlaten met een kapotte setup. Claude Code gebruikt intern drie modelslots -- niet één:

  • Haiku-slot -- achtergrondtaken zoals bestandssamenvatting en tabvoltooiing
  • Sonnet-slot -- standaard codering, het model waarmee je het meest interacteert
  • Opus-slot -- complex redeneren, plannen en meerstaps agentische taken

Wanneer je het model verandert met /model of --model, verander je alleen het primaire slot. Claude Code probeert nog steeds de andere twee slots aan te roepen via de Anthropic API. Als je ANTHROPIC_BASE_URL naar een proxy hebt gewezen maar slechts één model hebt ingesteld, mislukken die andere slots met een "model not found"-fout.

De oplossing: stel alle drie de omgevingsvariabelen in zodat elk slot door jouw proxy verloopt.

bash
# Alle drie slots door je proxy leiden
export ANTHROPIC_DEFAULT_HAIKU_MODEL="jouw-haiku-equivalent"
export ANTHROPIC_DEFAULT_SONNET_MODEL="jouw-sonnet-equivalent"
export ANTHROPIC_DEFAULT_OPUS_MODEL="jouw-opus-equivalent"
<!-- IMAGE: Architecture diagram showing Claude Code request routing through ANTHROPIC_BASE_URL to multiple providers (OpenRouter, Ollama, LiteLLM, claude-code-router) -->

Nativo modellen wisselen (Anthropic-modellen)

Als je binnen de Anthropic-modellfamilie blijft, is wisselen eenvoudig. Gebruik het /model-commando in Claude Code, geef --model mee bij het starten vanuit de terminal, of voeg modellen toe aan de availableModels-array in je instellingenbestand. Anthropic blijft hier opties toevoegen, en ons overzicht van de nieuwste Claude Code-functies voor 2026 houdt bij wat er recent is uitgebracht.

De opusplan-strategie

opusplan is Claude Codes ingebouwde multi-model routing. Het stuurt achtergrondtaken naar Haiku en funneert complex redeneren naar Opus -- automatisch. Je configureert het niet handmatig; selecteer het gewoon als je model. Het is Anthropics eigen antwoord op het "waarom betaal ik Opus-prijzen voor een bestandslijst?"-probleem. Het is de moeite waard om te proberen voordat je naar een derde-partij router grijpt, naast Anthropics fast mode als ruwe snelheid je prioriteit is.

OpenRouter -- Één API-sleutel, 300+ modellen

OpenRouter fungeert als een API-aggregator. Je krijgt één API-sleutel en toegang tot 300+ modellen van Anthropic, Google, Meta, Mistral, DeepSeek en meer. Prijsstelling is doorvoer voor de meeste modellen -- geen opslag.

Setupstappen

  1. Maak een account aan op openrouter.ai en genereer een API-sleutel
  2. Voer claude /logout uit om eventuele bestaande Anthropic-sessie te wissen
  3. Stel je omgevingsvariabelen in:
bash
export ANTHROPIC_BASE_URL="https://openrouter.ai/api"
export ANTHROPIC_API_KEY="sk-or-v1-jouw-sleutel-hier"

# Alle drie modelslots koppelen
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek/deepseek-chat-v3"
export ANTHROPIC_DEFAULT_SONNET_MODEL="anthropic/claude-sonnet-4"
export ANTHROPIC_DEFAULT_OPUS_MODEL="anthropic/claude-opus-4"
  1. Start claude en verifieer de verbinding

Let op de drie slotvariabelen -- laat ze weg en je krijgt de "model not found"-fout die we hierboven behandeld hebben. De officiële OpenRouter-integratiegids bevestigt deze setup.

Aanbevolen modellen via OpenRouter

Niet elk model op OpenRouter verwerkt het tool calling van Claude Code betrouwbaar. Hier is wat echt goed werkt:

TaakModelWaarom
Goedkope achtergrondtakenDeepSeek V3.2$0,27/$1,10 per MTok, behoorlijk tool calling
Standaard coderingClaude Sonnet 4Zelfde kwaliteit als direct, geconsolideerde facturering
Grote codebases (1M context)Gemini 2.5 Flash$0,15/$0,60 per MTok, enorm contextvenster
Complex redenerenClaude Opus 4Beste agentische coderingskwaliteit

Kosten en facturering

OpenRouter rekent doorvoerprijzen voor de meeste modellen. Je betaalt precies wat de onderliggende provider rekent, plus een kleine marge op sommige modellen van derden. Stel bestedingslimieten in je OpenRouter-dashboard in om verrassingen te voorkomen.

Oordeel: OpenRouter is de beste optie voor ontwikkelaars die maximale modelvarieteit willen met minimale setup. Één API-sleutel, één factureringsdashboard, 300+ modellen. Moeilijk te verslaan qua flexibiliteit.

Ollama -- Gratis, lokaal en privé

Ollama draait modellen volledig op je machine. Sinds v0.14.0 (januari 2026) ondersteunt het de Anthropic Messages API native, wat betekent dat Claude Code ermee kan communiceren zonder een vertaallaag. Je code verlaat nooit je machine.

Vereisten en hardware

Je hebt behoorlijke hardware nodig voor een bruikbare ervaring:

  • 7B-modellen (snelle bewerkingen, eenvoudige taken): minimaal 16 GB RAM
  • 14B-modellen (solide coderingskwaliteit): 32 GB RAM, GPU aanbevolen
  • 32B+-modellen (bijna cloudkwaliteit): 64 GB RAM of dedicated GPU met 24 GB+ VRAM

Voor een diepere duik in hardwarevereisten en modelselectie, bekijk onze gids voor het lokaal draaien van LLMs.

Setupstappen

  1. Installeer Ollama van ollama.com
  2. Download een codering-gefocust model
  3. Start met Claude Code-compatibiliteit
  4. Stel je omgevingsvariabelen in
bash
# Installeer en download een coderingsmodel
ollama pull qwen2.5-coder:14b

# Start met Claude Code-compatibiliteit
ollama launch claude

# Omgevingsvariabelen instellen
export ANTHROPIC_BASE_URL="http://localhost:11434"
export ANTHROPIC_API_KEY="ollama"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_SONNET_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_OPUS_MODEL="qwen2.5-coder:14b"

De Ollama-integratiedocumentatie beveelt modellen aan met 64k+ token contextvensters voor de beste Claude Code-ervaring.

Beste lokale modellen voor codering

ModelGrootteSterk puntOpmerkingen
Qwen 2.5 Coder 14B14BBeste algehele lokale coderingSterk tool calling, goede contextverwerking
devstral24BMistrals coderingsspecialistGeweldig voor refactoring en code review
GLM 4.79BAlgemeen redenerenGoede balans tussen snelheid en kwaliteit

Wees eerlijk met jezelf over één ding: lokale modellen produceren merkbaar lagere codekwaliteit dan Claude Sonnet voor complexe, meerstaps agentische taken. Tool calling is minder betrouwbaar, en je ziet meer gehalluceerde bestandspaden. Ze zijn fantastisch voor snelle bewerkingen, eenvoudige generatie en privacygevoelig werk -- verwacht echter geen native Claude-kwaliteit bij een refactoring van 50 bestanden.

Oordeel: Ollama is de beste keuze voor privacygevoelig werk en ontwikkelaars die gratis, onbeperkt gebruik willen. Als je de hardware hebt, is het moeilijk te argumenteren tegen "nul euro voor altijd."

Ollama Cloud vs. OpenRouter: prijzen en wanneer wat wint

Ollama en OpenRouter lossen het kostenprobleem vanuit tegengestelde hoeken op. Ollama draait modellen op hardware die je zelf beheert tegen nul kosten per token, terwijl OpenRouter doorvoerprijzen rekent over 300+ gehoste modellen zonder dat je hardware hoeft te beheren. Deze gids zet Ollama lokaal op, en dezelfde vaste-kosten-versus-per-token-rekensom geldt als je in plaats daarvan de gehoste laag gebruikt.

FactorOllamaOpenRouter
KostenmodelGratis lokaal, jij betaalt voor hardwareDoorvoerprijs per token, geen opslag op de meeste modellen
Voorbeeldprijs€0 per tokenDeepSeek V3.2 op €0,25/€1,01, Gemini 2.5 Flash op €0,14/€0,55 per MTok
Hardware16 GB RAM (7B) tot 24 GB+ VRAM (32B+)Geen, volledig gehost
Modeltoegang50+ open-source modellen300+ bij diverse providers
PrivacyCode verlaat nooit je machineVerzoeken lopen via OpenRouter

Kies Ollama wanneer privacy, offline gebruik of veelvuldige routinebewerkingen belangrijk zijn en je de hardware al hebt. Kies OpenRouter wanneer je modelvarieteit wilt, geen hardware vooraf, en facturering op basis van alleen wat je gebruikt.

LM Studio -- Lokale modellen met een GUI

LM Studio biedt dezelfde lokale modeluitvoering als Ollama, maar met een visuele interface. Je bladert door modellen in een GUI, kiest kwantisatieniveaus met één klik en test chat voordat je Claude Code erop richt. Dezelfde hardwarevereisten als Ollama. Vergelijk je verschillende runners? Onze gids over de beste tools om LLM's lokaal te draaien behandelt de afwegingen.

Setup

  1. Download LM Studio en installeer het
  2. Zoek naar en download een coderingsmodel (Qwen 2.5 Coder, devstral, enz.)
  3. Start de lokale server vanuit de LM Studio-interface
  4. Wijs Claude Code erop:
bash
# Claude Code naar LM Studios lokale server wijzen
export ANTHROPIC_BASE_URL="http://localhost:1234/v1"
export ANTHROPIC_API_KEY="lm-studio"
export ANTHROPIC_DEFAULT_SONNET_MODEL="naam-van-jouw-geladen-model"

De LM Studio-blog heeft een walkthrough met schermafbeeldingen als je de voorkeur geeft aan visuele setupgidsen.

Oordeel: LM Studio is het beste voor ontwikkelaars die de voorkeur geven aan een GUI boven CLI voor het beheren van lokale modellen. Als je al vertrouwd bent met ollama pull en configuratiebestanden, blijf dan bij Ollama. Als je visueel modellen wilt doorbladeren en instellingen met sliders wilt aanpassen, is LM Studio jouw keuze.

claude-code-router -- Slim modelrouting

claude-code-router is een npm-pakket dat een lokale proxy draait tussen Claude Code en je geconfigureerde providers. Wat het interessant maakt, is contextbewuste routing -- je kunt goedkope achtergrondtaken naar DeepSeek sturen, standaard codering naar Sonnet en complex redeneren naar Opus, alles automatisch.

Het project heeft 30k+ GitHub-sterren en ondersteunt OpenRouter, DeepSeek, Gemini, Ollama, Groq, Volcengine en SiliconFlow als providers.

Installatie en setup

bash
npm install -g claude-code-router
claude-code-router init
claude-code-router start

Het init-commando maakt een config.json aan waar je je providers en modelkoppelingen definieert:

json
{
  "providers": {
    "openrouter": {
      "apiKey": "sk-or-v1-...",
      "models": {
        "haiku": "deepseek/deepseek-chat-v3",
        "sonnet": "anthropic/claude-sonnet-4",
        "opus": "anthropic/claude-opus-4"
      }
    }
  }
}

Contextbewuste routingconfiguratie

Dit is waar claude-code-router uitblinkt. Je kunt verschillende taaktypen naar verschillende modellen routeren op basis van complexiteit. Achtergrond-samenvatting gaat naar een goedkoop model, terwijl plannings- en architectuurwerk naar je beste model gaat. De router handelt alle slotkoppelingen transparant af.

Je kunt ook providers mixen -- gebruik Ollama voor privacygevoelige repositories en OpenRouter voor al het andere, wisselen met het /model-commando in Claude Code.

Oordeel: claude-code-router is het beste voor power-users die fijnkorrelige controle willen over welk model welk taaktype afhandelt. Het is de meest configureerbare optie, maar die flexibiliteit komt met meer setup dan een eenvoudige ANTHROPIC_BASE_URL-wissel.

claude-code-proxy en LiteLLM -- Geavanceerde setups

Deze twee methoden dienen verschillende behoeften maar delen één kenmerk: het zijn allebei proxyservers die tussen API-indelingen vertalen.

claude-code-proxy (Gemini en OpenAI-backend)

claude-code-proxy is een Python-tool (3,3k GitHub-sterren) die Anthropic-formaat verzoeken van Claude Code accepteert en ze vertaalt naar OpenAI- of Gemini-formaat via LiteLLM onder de motorkap. Het is de eenvoudigste manier om specifiek Gemini of GPT-modellen te gebruiken met Claude Code.

bash
pip install claude-code-proxy
claude-code-proxy --port 8080

# Wijs Claude Code er vervolgens op
export ANTHROPIC_BASE_URL="http://localhost:8080"
export ANTHROPIC_API_KEY="jouw-gemini-of-openai-sleutel"

Als je specifiek Gemini's 1M token context wilt voor grote monorepos, is dit het meest directe pad.

LiteLLM (Enterprise universele proxy)

LiteLLM is een enterprise-grade proxy die 100+ providers ondersteunt met taakverdeling, fallback-ketens, snelheidsbegrenzing en auditlogboekregistratie. Het is overdreven voor een soloentwickler maar essentieel voor teams die governance rond AI-modelgebruik nodig hebben.

De setup gebruikt een YAML-configuratie:

yaml
model_list:
  - model_name: claude-sonnet-4-20250514
    litellm_params:
      model: gemini/gemini-2.5-flash
      api_key: os.environ/GEMINI_API_KEY
  - model_name: claude-haiku-3-5-20241022
    litellm_params:
      model: deepseek/deepseek-chat
      api_key: os.environ/DEEPSEEK_API_KEY
bash
# LiteLLM-proxy starten
litellm --config config.yaml --port 4000

# Claude Code naar LiteLLM wijzen
export ANTHROPIC_BASE_URL="http://localhost:4000"
export ANTHROPIC_API_KEY="sk-litellm"

Een belangrijke opmerking uit de officiële Claude Code-documentatie: "Anthropic onderschrijft, onderhoudt of auditeert LiteLLM niet." Gebruik het, maar weet dat het een community-tool is, geen Anthropic-product. De LiteLLM-tutorial heeft meer geavanceerde configuratievoorbeelden.

Oordeel: Gebruik claude-code-proxy als je specifiek Gemini- of OpenAI-modellen wilt. Gebruik LiteLLM als je team taakverdeling, fallback en auditlogboekregistratie nodig heeft bij providers.

Claude Code Router vs. LiteLLM: welke moet je gebruiken?

Claude Code Router is de eenvoudigere keuze voor soloontwikkelaars die per-taak modelrouting willen, terwijl LiteLLM gebouwd is voor teams die taakverdeling, fallback-ketens en auditlogboekregistratie nodig hebben. Router installeer je via npm en het leest een config.json; LiteLLM draait een enterprise YAML-geconfigureerde proxy bij 100+ providers.

FactorClaude Code RouterLiteLLM
SetupmoeilijkheidGemiddeld: npm install, config.json bewerkenGeavanceerd: YAML-configuratiebestand
Beste voorSoloontwikkelaars die per-taak routing willenTeams die governance nodig hebben
Configuratieformaatconfig.jsonYAML model_list
Opvallende functieContextbewuste per-taak routingTaakverdeling, fallback, auditlogboekregistratie
ProvidersOpenRouter, DeepSeek, Gemini, Ollama, Groq en meer100+ bij diverse providers
Volwassenheid30k+ GitHub-sterren, gebouwd voor Claude CodeEnterprise proxy, community-tool (niet door Anthropic goedgekeurd)

Kies claude-code-router als je een soloontwikkelaar bent die goedkope achtergrondtaken op DeepSeek wil en complex redeneren op Opus, zonder veel setup. Kies LiteLLM als je team taakverdeling, snelheidsbegrenzing en auditlogs nodig heeft bij providers.

Weeg je ook andere proxies af? Ons overzicht van de beste LLM-gatewaytools vergelijkt ze naast elkaar.

Wat kost elke methode eigenlijk?

Laten we echte cijfers hierop zetten. Dit is wat je betaalt per 1 miljoen tokens voor de meest voorkomende model/methode-combinaties:

Model / MethodeInvoer (per 1M tokens)Uitvoer (per 1M tokens)Maandelijkse schatting (gematigd gebruik)
Claude Opus 4.6 (direct)€4,60€23,00~€46-138
Claude Sonnet 4.6 (direct)€2,75€13,80~€28-55
Claude Sonnet via OpenRouter€2,75€13,80Hetzelfde (doorvoer)
DeepSeek V3.2 (OpenRouter)€0,25€1,01~€3-7
Gemini 2.5 Flash (OpenRouter)€0,14€0,55~€2-5
Ollama (lokaal)GratisGratis€0 (hardwarekosten)

Prijsgegevens van Anthropics officiële prijspagina en OpenRouter. Gematigd gebruik gaat uit van ~5-10M tokens/maand voor dagelijkse coderingsessies.

"Kosten per 1M output-tokens per model"

"Claude Opus 4.6 kost €23 per 1M output-tokens versus DeepSeek V3.2 op €1,01 -- een 23x kostenverschil. Ollama draait volledig gratis op lokale hardware."
Gegevenstabel
"Kosten per 1M output-tokens per model"
"Model""Uitvoerkosten"
"Opus 4.6"23
"Sonnet 4.6"13.8
"DeepSeek V3.2"1.01
"Gemini 2.5 Flash"0.55
"Ollama (lokaal)"0

Het kostenverschil is aanzienlijk, maar goedkopere modellen produceren lagere codekwaliteit -- vooral voor complexe agentische taken waarbij de betrouwbaarheid van tool calling ertoe doet. DeepSeek op €1,01/MTok uitvoer is geweldig voor routinebewerkingen. Voor een refactoring van meerdere bestanden waarbij Claude Code over 20 bestanden moet lezen, plannen, bewerken en verifiëren? Je wilt nog steeds Sonnet of Opus.

Oordeel: Voor kostenbesparing met acceptabele kwaliteit biedt OpenRouter + DeepSeek de beste verhouding. Voor nul kosten is Ollama onverslaanbaar als je de hardware hebt. Voor maximale kwaliteit blijft Anthropic direct de koning.

Welke methode moet je gebruiken? -- Beslissingskader

Hier is het gedeelte dat elke andere tutorial overslaat. In plaats van je te vertellen "gebruik gewoon OpenRouter", laten we methoden koppelen aan echte behoeften:

Als je nodig hebt...Gebruik deze methodeWaarom
Maximale modelvarieteit, één API-sleutelOpenRouter300+ modellen, eenvoudige setup, pay-per-use
Gratis, onbeperkt, code blijft lokaalOllamaNul kosten, volledige privacy, offline capabel
Lokale modellen met visuele interfaceLM StudioGUI modelbrowser, eenvoudige kwantisatieselectie
Slim per-taak routingclaude-code-routerRedeneren naar Opus, snelle bewerkingen naar DeepSeek
Specifiek Gemini- of OpenAI-modellenclaude-code-proxyVertaalt Anthropic-formaat naar OpenAI/Gemini
Enterprise: taakverdeling, auditLiteLLMSnelheidsbegrenzing, fallback-ketens, teamcontroles

Moet je überhaupt wisselen?

Eerlijke beoordeling: voor de meeste ontwikkelaars die complexe agentische codering doen -- refactorings van meerdere bestanden, architectuurplanning, debuggen van lastige concurrentieproblemen -- blijft Claude Sonnet via direct Anthropic de beste optie. Native Claude heeft het meest betrouwbare tool calling, het beste begrip van zijn eigen agentische workflow en nul proxylatentie.

Modellen wisselen is een optimalisatie voor specifieke scenario's:

  • Je verbrandt tokens bij achtergrondtaken die geen Sonnet-kwaliteit nodig hebben, of je loopt steeds tegen Claude's 2x-gebruikslimieten aan
  • Je hebt Gemini's 1M contextvenster nodig voor een enorme monorepo
  • Je code mag je machine niet verlaten (overheid, gezondheidszorg, financiën)
  • Je hebt een krap budget en acceptabele kwaliteit verslaat perfecte kwaliteit

Als geen van die van toepassing is, is opusplan (Anthropics ingebouwde routing) misschien alles wat je nodig hebt.

Betrouwbaarheid van tool calling is de kwaliteitsmetriek die hier het meest telt. De hiërarchie is: native Claude >> OpenRouter Claude >> DeepSeek/Gemini >> lokale modellen. Hoe verder je naar beneden gaat, hoe meer mislukte tool calls, gehalluceerde bestandspaden en onvolledige bewerkingen je ziet.

Veelvoorkomende problemen oplossen

"Model not found"-fout

Dit is het meest voorkomende probleem. Het treedt op wanneer je ANTHROPIC_BASE_URL instelt maar vergeet alle drie modelslots te koppelen. Claude Code probeert Haiku of Opus via je proxy aan te roepen, de proxy herkent de standaard Anthropic-modelnaam niet en je krijgt de fout.

bash
# Oplossing: ALLE drie modelslot-variabelen instellen
export ANTHROPIC_DEFAULT_HAIKU_MODEL="jouw-model"
export ANTHROPIC_DEFAULT_SONNET_MODEL="jouw-model"
export ANTHROPIC_DEFAULT_OPUS_MODEL="jouw-model"

Verbinding geweigerd / timeout

Je proxy draait niet, of Claude Code treft de verkeerde poort. Verifieer dat het proxyproces actief is en controleer de poort in ANTHROPIC_BASE_URL. Firewalls en VPN's kunnen ook localhost-verbindingen blokkeren.

Mislukkingen van tool calling

Het model ondersteunt het tool use-formaat van Anthropic niet correct. Symptomen: Claude Code hangt, produceert lege tool calls of bewerkt de verkeerde bestanden. Schakel over naar een model met geverifieerde tool calling-ondersteuning -- Qwen 2.5 Coder en devstral verwerken dit het beste onder de lokale modellen.

Streamingproblemen

Sommige proxies verwerken server-sent events niet correct. Antwoorden verschijnen allemaal tegelijk in plaats van te streamen, of ze worden halverwege afgebroken. Zorg ervoor dat je proxyversie actueel is en controleer de GitHub-issues op bekende streamingbugs.

Contextvenster overschreden

Lokale modellen hebben vaak standaard 4K-8K contextvensters. Claude Code heeft veel meer nodig dan dat voor echte coderingsessies. Gebruik modellen met 32K+ context, of stuur lange-context taken via OpenRouter door naar Gemini (1M venster).

Moet eerst uitloggen voor OpenRouter

Als je overschakelt van direct Anthropic naar OpenRouter, voer dan eerst claude /logout uit. Claude Code cacht authenticatie en blijft proberen je Anthropic-sleutel te gebruiken, zelfs nadat je de basis-URL hebt gewijzigd.

bash
# Gecachte authenticatie wissen voor het wisselen van providers
claude /logout

FAQ

Kun je Claude Code gebruiken met GPT-4 of Gemini?

Ja. claude-code-proxy vertaalt Anthropic-formaat verzoeken naar OpenAI- of Gemini-formaat. Je kunt ook via OpenRouter toegang krijgen tot beide met één API-sleutel. Tool calling kan minder betrouwbaar zijn dan native Claude, vooral voor complexe meerstaps taken.

Hoe gebruik ik Claude Code zonder een Anthropic API-sleutel?

Gebruik Ollama voor volledig gratis lokaal gebruik -- geen API-sleutel van welke provider dan ook nodig. Als alternatief gebruik je OpenRouter met hun API-sleutelformaat. Je stelt nog steeds de omgevingsvariabele ANTHROPIC_API_KEY in, maar die wijst naar de sleutel van je proxy (bijv. sk-or-v1-... voor OpenRouter, "ollama" voor Ollama).

Hoe stel ik Claude Code in met Ollama?

Installeer Ollama, download een model zoals qwen2.5-coder:14b, voer ollama launch claude uit en stel drie omgevingsvariabelen in: ANTHROPIC_BASE_URL, ANTHROPIC_API_KEY en de drie modelslot-variabelen. Zie het Ollama-gedeelte hierboven voor de volledige code.

Welke modellen werken het beste met Claude Code?

Voor cloud: Claude Sonnet 4 levert de beste coderingskwaliteit, terwijl DeepSeek V3.2 de beste waarde biedt. Voor lokaal: Qwen 2.5 Coder 14B is de huidige gouden standaard. De beslissende factor is de betrouwbaarheid van tool calling -- Claude Code is er sterk op afhankelijk voor bestandsoperaties, en native Claude-modellen verwerken het het beste.

Hoe herstel ik de "model not found"-fout in Claude Code?

Stel alle drie modelslot-omgevingsvariabelen in: ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL en ANTHROPIC_DEFAULT_OPUS_MODEL. Deze fout treedt op omdat Claude Code drie interne modelslots gebruikt, en een niet-gekoppeld slot probeert een modelnaam aan te roepen die je proxy niet herkent.

Kan Claude Code offline werken met lokale modellen?

Ja. Zowel Ollama als LM Studio draaien modellen volledig op je machine zonder internetverbinding. Je code verlaat nooit je hardware. Je hebt adequate specificaties nodig -- minimaal 16 GB RAM voor 7B-modellen, 32 GB+ voor alles groter.

Kan ik LM Studio gebruiken met Claude Code?

Ja. LM Studio draait een lokale server waarmee Claude Code verbinding maakt door ANTHROPIC_BASE_URL in te stellen op http://localhost:1234/v1 en ANTHROPIC_API_KEY op lm-studio. Download een coderingsmodel zoals Qwen 2.5 Coder, start de server vanuit de GUI van LM Studio, en koppel vervolgens je modelslot. Het is het visuele alternatief voor Ollama's CLI.

Wat is ANTHROPIC_BASE_URL en hoe gebruik ik het?

Het is de omgevingsvariabele die Claude Code vertelt waar API-verzoeken naartoe te sturen. Standaard wijst het naar https://api.anthropic.com. Verander het naar elk Anthropic-compatibel eindpunt -- OpenRouter (https://openrouter.ai/api), Ollama (http://localhost:11434), LiteLLM (http://localhost:4000), enz.

Is claude-code-router beter dan LiteLLM?

Verschillende tools voor verschillende problemen. claude-code-router is eenvoudiger (npm install, bewerk config.json, klaar) en specifiek ontworpen voor Claude Code. LiteLLM is enterprise-grade met taakverdeling, snelheidsbegrenzing, fallback-ketens en auditlogboekregistratie. Soloentwickler? Gebruik claude-code-router. Team met governancebehoeften? Gebruik LiteLLM.

Hoeveel kan ik besparen door niet-Anthropic-modellen te gebruiken?

Overschakelen van Claude Opus 4.6 naar DeepSeek V3.2 verlaagt de output-tokenkosten met ongeveer 95% (€23 vs. €1,01 per miljoen tokens). Ollama brengt dat naar nul als je de hardware hebt. Maar kwaliteitscompromissen zijn echt -- verwacht lagere nauwkeurigheid bij complexe meerstaps agentische taken, minder betrouwbaar tool calling en meer gehalluceerde bestandspaden.

Werkt tool calling met alle proxymethoden?

Niet betrouwbaar over de hele linie. Native Claude heeft de beste tool calling-ondersteuning. OpenRouter met Claude-modellen werkt bijna net zo goed. DeepSeek en Gemini hebben gedeeltelijke ondersteuning -- eenvoudige tool calls werken, maar complexe ketens kunnen mislukken. Lokale modellen via Ollama hebben het minst betrouwbare tool calling. Dit is de belangrijkste kwaliteitszorg bij het overstappen van Anthropic.

Bronnen

Tags

claude-codeopenrouterollamalitellmclaude-code-routerlokale-modellenai-coding-tools

Dit artikel delen

Start je project

Klaar om iets buitengewoons te bouwen?

Laten we je idee werkelijkheid maken. Ons team staat klaar om software te bouwen die het verschil maakt.