
Claude Code se dodává s modely Anthropic, ale jediná proměnná prostředí, ANTHROPIC_BASE_URL, vám umožní směrovat požadavky prakticky na jakéhokoli poskytovatele LLM. To znamená, že můžete nasadit DeepSeek za zhruba 0,27 $ za milion výstupních tokenů místo Claude Opus za 25 $, nebo spouštět modely lokálně přes Ollama zcela zdarma. Tento průvodce pokrývá všechny způsoby, jak používat různé modely v Claude Code, a navazuje na naše podrobné srovnání Claude Code s praktickým nastavením pro každý přístup.
Všechny metody na jednom místě
Vyberte metodu, která odpovídá vaší situaci, a přejděte do příslušné sekce s kódem pro nastavení.
| Metoda | Nejlepší pro | Náklady | Nastavení | Modely |
|---|---|---|---|---|
| OpenRouter | Rozmanitost modelů, jeden API klíč | Platba za token (průchozí) | Snadné | 300+ |
| Ollama | Soukromí, zdarma, offline | Zdarma (váš hardware) | Snadné | 50+ open-source |
| LM Studio | Lokální modely s GUI | Zdarma (váš hardware) | Snadné | 50+ open-source |
| claude-code-router | Chytré směrování podle úlohy | Liší se dle poskytovatele | Střední | Závisí na konfiguraci |
| claude-code-proxy | Backend Gemini/OpenAI | Ceny poskytovatele | Střední | OpenAI + Gemini |
| LiteLLM | Enterprise, vyvažování zátěže | Ceny poskytovatele | Pokročilé | 100+ napříč poskytovateli |
Čtěte dál pro podrobné nastavení každé metody, nebo přejděte rovnou na rozhodovací rámec, pokud už víte, co potřebujete.
Jak přepínání modelů v Claude Code vlastně funguje?
Než začnete konfigurovat jakýkoli proxy server, musíte pochopit, proč většina návodů končí rozbitým nastavením. Claude Code interně používá tři modelové sloty, ne jeden:
- Haiku slot, úlohy na pozadí jako sumarizace souborů a doplňování tabulátoru
- Sonnet slot, výchozí kódování, model, se kterým pracujete nejčastěji
- Opus slot, složité uvažování, plánování a vícekrokové agentní úlohy
Když změníte model pomocí /model nebo --model, měníte pouze primární slot. Claude Code se stále snaží volat další dva sloty přes API Anthropic. Pokud jste nasměrovali ANTHROPIC_BASE_URL na proxy, ale nastavili jen jeden model, tyto další sloty selžou s chybou „model not found".
Řešení: nastavte všechny tři proměnné prostředí, aby každý slot procházel přes váš proxy server.
# Cut Claude Code's Bill 90%: Run OpenRouter, Ollama or LiteLLM
export ANTHROPIC_DEFAULT_HAIKU_MODEL="your-haiku-equivalent"
export ANTHROPIC_DEFAULT_SONNET_MODEL="your-sonnet-equivalent"
export ANTHROPIC_DEFAULT_OPUS_MODEL="your-opus-equivalent"Nativní přepínání modelů (modely Anthropic)
Pokud zůstáváte v rodině modelů Anthropic, je přepínání přímočaré. Použijte příkaz /model uvnitř Claude Code, předejte --model při spouštění z terminálu, nebo přidejte modely do pole availableModels ve vašem konfiguračním souboru. Anthropic sem neustále přidává nové možnosti a náš přehled nejnovějších funkcí Claude Code pro rok 2026 sleduje, co bylo nedávno vydáno.
Strategie opusplan
opusplan je vestavěné vícemodelové směrování v Claude Code. Úlohy na pozadí posílá na Haiku a složité uvažování směruje na Opus, a to automaticky. Nemusíte nic konfigurovat ručně; stačí jej vybrat jako svůj model. Je to vlastní odpověď Anthropic na otázku „proč platím ceny Opus za výpis souborů?" Stojí za vyzkoušení, než sáhnete po routeru třetí strany, spolu s rychlým režimem Anthropic, pokud je vaší prioritou čistá rychlost.
OpenRouter – jeden API klíč, 300+ modelů
OpenRouter funguje jako API agregátor. Získáte jeden API klíč a přístup k více než 300 modelům od Anthropic, Google, Meta, Mistral, DeepSeek a dalších. Ceny jsou průchozí pro většinu modelů, bez přirážky.
Kroky nastavení
- Vytvořte si účet na openrouter.ai a vygenerujte API klíč
- Spusťte
claude /logoutpro vymazání existující relace Anthropic - Nastavte proměnné prostředí:
export ANTHROPIC_BASE_URL="https://openrouter.ai/api"
export ANTHROPIC_API_KEY="sk-or-v1-your-key-here"
# Map all three model slots
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek/deepseek-chat-v3"
export ANTHROPIC_DEFAULT_SONNET_MODEL="anthropic/claude-sonnet-4"
export ANTHROPIC_DEFAULT_OPUS_MODEL="anthropic/claude-opus-4"- Spusťte
claudea ověřte připojení
Všimněte si tří proměnných pro sloty – pokud je přeskočíte, narazíte na chybu „model not found", kterou jsme popsali výše. Oficiální průvodce integrací OpenRouter toto nastavení potvrzuje.
Doporučené modely přes OpenRouter
Ne každý model na OpenRouteru spolehlivě zvládá volání nástrojů Claude Code. Zde je přehled toho, co skutečně funguje dobře:
| Úloha | Model | Proč |
|---|---|---|
| Levné úlohy na pozadí | DeepSeek V3.2 | 0,27 $/1,10 $ za MTok, slušné volání nástrojů |
| Výchozí kódování | Claude Sonnet 4 | Stejná kvalita jako přímo, konsolidované účtování |
| Obrovské kódové základny (1M kontext) | Gemini 2.5 Flash | 0,15 $/0,60 $ za MTok, masivní kontextové okno |
| Složité uvažování | Claude Opus 4 | Nejlepší kvalita agentního kódování |
Náklady a účtování
OpenRouter účtuje průchozí ceny u většiny modelů. Platíte přesně to, co si účtuje základní poskytovatel, plus malou přirážku u některých modelů třetích stran. V dashboardu OpenRouteru si nastavte limity výdajů, abyste se vyhnuli překvapením.
Verdikt: OpenRouter je nejlepší volbou pro vývojáře, kteří chtějí maximální rozmanitost modelů s minimálním nastavením. Jeden API klíč, jeden dashboard pro účtování, 300+ modelů. Těžko hledat lepší flexibilitu.
Ollama – zdarma, lokálně a soukromě
Ollama spouští modely přímo na vašem stroji. Od verze 0.14.0 (leden 2026) nativně podporuje Anthropic Messages API, což znamená, že s ním Claude Code komunikuje bez jakékoli překladové vrstvy. Váš kód nikdy neopustí váš počítač.
Předpoklady a hardware
Pro použitelný zážitek budete potřebovat slušný hardware:
- 7B modely (rychlé úpravy, jednoduché úlohy): minimálně 16 GB RAM
- 14B modely (solidní kvalita kódování): 32 GB RAM, doporučené GPU
- 32B+ modely (kvalita blízká cloudu): 64 GB RAM nebo dedikované GPU s 24 GB+ VRAM
Pro podrobnější přehled hardwarových požadavků a výběru modelů se podívejte na našeho průvodce lokálním spouštěním LLM.
Kroky nastavení
- Nainstalujte Ollama z ollama.com
- Stáhněte model zaměřený na kódování
- Spusťte s kompatibilitou pro Claude Code
- Nastavte proměnné prostředí
# Install and pull a coding model
ollama pull qwen2.5-coder:14b
# Launch with Claude Code compatibility
ollama launch claude
# Set env vars
export ANTHROPIC_BASE_URL="http://localhost:11434"
export ANTHROPIC_API_KEY="ollama"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_SONNET_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_OPUS_MODEL="qwen2.5-coder:14b"Dokumentace integrace Ollama doporučuje modely s kontextovým oknem 64k+ tokenů pro nejlepší zážitek s Claude Code.
Nejlepší lokální modely pro kódování
| Model | Velikost | Silná stránka | Poznámky |
|---|---|---|---|
| Qwen 2.5 Coder 14B | 14B | Nejlepší celkové lokální kódování | Silné volání nástrojů, dobré zpracování kontextu |
| devstral | 24B | Specialista Mistral na kódování | Skvělý pro refaktoring a code review |
| GLM 4.7 | 9B | Obecné uvažování | Dobrá rovnováha rychlosti a kvality |
Buďte k sobě upřímní v jedné věci: lokální modely produkují znatelně nižší kvalitu kódu než Claude Sonnet u složitých, vícekrokových agentních úloh. Volání nástrojů je méně spolehlivé a uvidíte více halucinovaných cest k souborům. Jsou fantastické pro rychlé úpravy, jednoduchou generaci a práci citlivou na soukromí – jen nečekejte nativní kvalitu Claude u refaktoringu 50 souborů.
Verdikt: Ollama je nejlepší volbou pro práci citlivou na soukromí a vývojáře, kteří chtějí bezplatné, neomezené používání. Pokud máte hardware, těžko se dá polemizovat s „nula dolarů navždy."
Ollama Cloud vs OpenRouter: Ceny a kdy se který vyplatí
Ollama a OpenRouter řeší problém nákladů z opačných konců. Ollama spouští modely na hardwaru, který ovládáte, s nulovými náklady za token, zatímco OpenRouter účtuje průchozí ceny napříč 300+ hostovanými modely bez nutnosti spravovat hardware. Tento průvodce nastavuje Ollama lokálně a stejná matematika fixních nákladů versus cena za token platí, pokud místo toho použijete jeho hostovanou úroveň.
| Faktor | Ollama | OpenRouter |
|---|---|---|
| Model nákladů | Zdarma lokálně, platíte za hardware | Průchozí cena za token, bez přirážky u většiny modelů |
| Příklad ceny | 0 $ za token | DeepSeek V3.2 za 0,27 $/1,10 $, Gemini 2.5 Flash za 0,15 $/0,60 $ za MTok |
| Hardware | 16 GB RAM (7B) až 24 GB+ VRAM (32B+) | Žádný, plně hostováno |
| Přístup k modelům | 50+ open-source modelů | 300+ napříč poskytovateli |
| Soukromí | Kód nikdy neopustí váš stroj | Požadavky procházejí přes OpenRouter |
Vyberte Ollama, pokud je pro vás důležité soukromí, offline použití nebo vysoký objem rutinních úprav a hardware už vlastníte. Vyberte OpenRouter, pokud chcete rozmanitost modelů, žádný počáteční hardware a účtování pouze za to, co využijete.
LM Studio – lokální modely s GUI
LM Studio nabízí stejné lokální spouštění modelů jako Ollama, ale s vizuálním rozhraním. Modely procházíte v GUI, úrovně kvantizace vybíráte kliknutím a chat testujete, než na něj nasměrujete Claude Code. Stejné hardwarové požadavky jako Ollama. Pokud porovnáváte spouštěče, náš průvodce nejlepšími nástroji pro lokální spouštění LLM pokrývá kompromisy.
Nastavení
- Stáhněte LM Studio a nainstalujte jej
- Vyhledejte a stáhněte model pro kódování (Qwen 2.5 Coder, devstral atd.)
- Spusťte lokální server z rozhraní LM Studio
- Nasměrujte na něj Claude Code:
# Point Claude Code to LM Studio's local server
export ANTHROPIC_BASE_URL="http://localhost:1234/v1"
export ANTHROPIC_API_KEY="lm-studio"
export ANTHROPIC_DEFAULT_SONNET_MODEL="your-loaded-model-name"Blog LM Studio obsahuje návod se snímky obrazovky, pokud preferujete vizuální průvodce nastavením.
Verdikt: LM Studio je nejlepší pro vývojáře, kteří preferují GUI před CLI pro správu lokálních modelů. Pokud vám už vyhovuje ollama pull a konfigurační soubory, zůstaňte u Ollama. Pokud chcete procházet modely vizuálně a ladit nastavení posuvníky, LM Studio je vaše volba.
claude-code-router – chytré směrování modelů
claude-code-router je npm balíček, který spouští lokální proxy mezi Claude Code a vámi nakonfigurovanými poskytovateli. Co jej dělá zajímavým, je směrování podle kontextu – levné úlohy na pozadí můžete poslat na DeepSeek, výchozí kódování na Sonnet a složité uvažování na Opus, vše automaticky.
Projekt má 30k+ hvězdiček na GitHubu a podporuje OpenRouter, DeepSeek, Gemini, Ollama, Groq, Volcengine a SiliconFlow jako poskytovatele.
Instalace a nastavení
npm install -g claude-code-router
claude-code-router init
claude-code-router startPříkaz init vytvoří config.json, kde definujete poskytovatele a mapování modelů:
{
"providers": {
"openrouter": {
"apiKey": "sk-or-v1-...",
"models": {
"haiku": "deepseek/deepseek-chat-v3",
"sonnet": "anthropic/claude-sonnet-4",
"opus": "anthropic/claude-opus-4"
}
}
}
}Konfigurace směrování podle kontextu
Zde claude-code-router září. Různé typy úloh můžete směrovat na různé modely podle složitosti. Sumarizace na pozadí jde na levný model, zatímco plánování a architektonická práce jde na váš nejlepší model. Router transparentně zpracovává veškeré mapování slotů.
Můžete také kombinovat poskytovatele – používat Ollama pro repozitáře citlivé na soukromí a OpenRouter pro vše ostatní, s přepínáním pomocí příkazu /model uvnitř Claude Code.
Verdikt: claude-code-router je nejlepší pro pokročilé uživatele, kteří chtějí jemnou kontrolu nad tím, který model zpracovává každý typ úlohy. Je to nejkonfigurovatelnější možnost, ale tato flexibilita přichází s větším úsilím při nastavení než jednoduchá výměna ANTHROPIC_BASE_URL.
claude-code-proxy a LiteLLM – pokročilá nastavení
Tyto dvě metody slouží různým potřebám, ale sdílejí jednu vlastnost: oba jsou proxy servery, které překládají mezi formáty API.
claude-code-proxy (backend Gemini a OpenAI)
claude-code-proxy je nástroj v Pythonu (3,3k hvězdiček na GitHubu), který přijímá požadavky ve formátu Anthropic od Claude Code a překládá je do formátu OpenAI nebo Gemini pomocí LiteLLM v pozadí. Je to nejjednodušší způsob, jak používat Gemini nebo modely GPT konkrétně s Claude Code.
pip install claude-code-proxy
claude-code-proxy --port 8080
# Then point Claude Code at it
export ANTHROPIC_BASE_URL="http://localhost:8080"
export ANTHROPIC_API_KEY="your-gemini-or-openai-key"Pokud konkrétně chcete 1M tokenový kontext Gemini pro velké monorepozitáře, toto je nejpřímější cesta.
LiteLLM (enterprise univerzální proxy)
LiteLLM je proxy server enterprise úrovně, který podporuje 100+ poskytovatelů s vyvažováním zátěže, záložními řetězci, omezením rychlosti a auditním protokolováním. Pro sólového vývojáře je to zbytečnost, ale pro týmy, které potřebují správu kolem používání AI modelů, je nezbytný.
Nastavení používá konfiguraci YAML:
model_list:
- model_name: claude-sonnet-4-20250514
litellm_params:
model: gemini/gemini-2.5-flash
api_key: os.environ/GEMINI_API_KEY
- model_name: claude-haiku-3-5-20241022
litellm_params:
model: deepseek/deepseek-chat
api_key: os.environ/DEEPSEEK_API_KEY# Start LiteLLM proxy
litellm --config config.yaml --port 4000
# Point Claude Code to LiteLLM
export ANTHROPIC_BASE_URL="http://localhost:4000"
export ANTHROPIC_API_KEY="sk-litellm"Jedna důležitá poznámka z oficiální dokumentace Claude Code: „Anthropic nepodporuje, neudržuje ani neaudituje LiteLLM." Používejte jej, ale vězte, že jde o komunitní nástroj, ne produkt Anthropic. Výukový program LiteLLM obsahuje pokročilejší příklady konfigurace.
Verdikt: Použijte claude-code-proxy, pokud chcete konkrétně modely Gemini nebo OpenAI. Použijte LiteLLM, pokud váš tým potřebuje vyvažování zátěže, záložní mechanismy a auditní protokolování napříč poskytovateli.
Claude Code Router vs LiteLLM: Který byste měli použít?
Claude Code Router je jednodušší volbou pro sólové vývojáře, kteří chtějí směrování modelů podle úloh, zatímco LiteLLM je navržen pro týmy, které potřebují vyvažování zátěže, záložní řetězce a auditní protokolování. Router se instaluje přes npm a čte config.json; LiteLLM spouští enterprise proxy konfigurovaný přes YAML napříč 100+ poskytovateli.
| Faktor | Claude Code Router | LiteLLM |
|---|---|---|
| Obtížnost nastavení | Střední: npm install, úprava config.json | Pokročilá: konfigurační soubor YAML |
| Nejlepší pro | Sólové vývojáře chtějící směrování podle úloh | Týmy potřebující správu |
| Formát konfigurace | config.json | YAML model_list |
| Vynikající funkce | Směrování podle kontextu úlohy | Vyvažování zátěže, záložní mechanismy, auditní protokolování |
| Poskytovatelé | OpenRouter, DeepSeek, Gemini, Ollama, Groq a další | 100+ napříč poskytovateli |
| Vyspělost | 30k+ hvězdiček na GitHubu, vytvořeno pro Claude Code | Enterprise proxy, komunitní nástroj (není schválen Anthropic) |
Vyberte claude-code-router, pokud jste sólový vývojář, který chce levné úlohy na pozadí na DeepSeek a složité uvažování na Opus bez velkého nastavování. Vyberte LiteLLM, pokud váš tým potřebuje vyvažování zátěže, omezení rychlosti a auditní protokoly napříč poskytovateli.
Zvažujete i jiné proxy? Náš přehled nejlepších nástrojů LLM gateway je porovnává vedle sebe.
Kolik každá metoda skutečně stojí?
Pojďme k tomu přiřadit reálná čísla. Zde je přehled, kolik zaplatíte za 1M tokenů u nejběžnějších kombinací modelů a metod:
| Model / Metoda | Vstup (za 1M tokenů) | Výstup (za 1M tokenů) | Měsíční odhad (střední využití) |
|---|---|---|---|
| Claude Opus 4.6 (přímo) | 5,00 $ | 25,00 $ | ~50–150 $ |
| Claude Sonnet 4.6 (přímo) | 3,00 $ | 15,00 $ | ~30–60 $ |
| Claude Sonnet přes OpenRouter | 3,00 $ | 15,00 $ | Stejné (průchozí) |
| DeepSeek V3.2 (OpenRouter) | 0,27 $ | 1,10 $ | ~3–8 $ |
| Gemini 2.5 Flash (OpenRouter) | 0,15 $ | 0,60 $ | ~2–5 $ |
| Ollama (lokálně) | Zdarma | Zdarma | 0 $ (náklady na hardware) |
Cenové údaje z oficiální cenové stránky Anthropic a OpenRouteru. Střední využití předpokládá ~5–10M tokenů/měsíc při denních kódovacích relacích.
"Cost per 1M Output Tokens by Model"
Tabulka dat
| "Model" | "Output Cost" |
|---|---|
| "Opus 4.6" | 25 |
| "Sonnet 4.6" | 15 |
| "DeepSeek V3.2" | 1.1 |
| "Gemini 2.5 Flash" | 0.6 |
| "Ollama (local)" | 0 |
Cenový rozdíl je významný, ale levnější modely produkují nižší kvalitu kódu, zejména u složitých agentních úloh, kde záleží na spolehlivosti volání nástrojů. DeepSeek za 1,10 $/MTok výstup je skvělý pro rutinní úpravy. Pro vícesouborový refaktoring, kde Claude Code potřebuje číst, plánovat, upravovat a ověřovat napříč 20 soubory? Tam stále budete chtít Sonnet nebo Opus.
Verdikt: Pro úsporu nákladů s přijatelnou kvalitou nabízí OpenRouter + DeepSeek nejlepší poměr. Pro nulové náklady je Ollama nepřekonatelná, pokud máte hardware. Pro maximální kvalitu zůstává Anthropic přímo králem.
Kterou metodu byste měli použít? – Rozhodovací rámec
Zde je sekce, kterou každý jiný návod přeskakuje. Místo abychom vám říkali „prostě použijte OpenRouter", pojďme přiřadit metody ke skutečným potřebám:
| Pokud potřebujete... | Použijte tuto metodu | Proč |
|---|---|---|
| Maximální rozmanitost modelů, jeden API klíč | OpenRouter | 300+ modelů, snadné nastavení, platba za použití |
| Zdarma, neomezeně, kód zůstává lokálně | Ollama | Nulové náklady, plné soukromí, offline schopnost |
| Lokální modely s vizuálním rozhraním | LM Studio | GUI prohlížeč modelů, snadný výběr kvantizace |
| Chytré směrování podle úlohy | claude-code-router | Uvažování na Opus, rychlé úpravy na DeepSeek |
| Konkrétně modely Gemini nebo OpenAI | claude-code-proxy | Překládá formát Anthropic na OpenAI/Gemini |
| Enterprise: vyvažování zátěže, audit | LiteLLM | Omezení rychlosti, záložní řetězce, týmové ovládání |
Měli byste vůbec přepínat?
Upřímný pohled: pro většinu vývojářů dělajících složité agentní kódování, vícesouborové refaktoringy, architektonické plánování, ladění složitých problémů souběžnosti, zůstává Claude Sonnet přímo přes Anthropic nejlepší volbou. Nativní Claude má nejspolehlivější volání nástrojů, nejlepší porozumění vlastnímu agentnímu pracovnímu postupu a nulovou latenci proxy.
Přepínání modelů je optimalizace pro specifické scénáře:
- Spalujete tokeny na úlohách na pozadí, které nepotřebují kvalitu Sonnet, nebo neustále narážíte na 2x limity využití Claude
- Potřebujete 1M kontextové okno Gemini pro masivní monorepozitář
- Váš kód nemůže opustit váš stroj (státní správa, zdravotnictví, finance)
- Máte omezený rozpočet a přijatelná kvalita vítězí nad dokonalou kvalitou
Pokud se vás nic z toho netýká, opusplan (vestavěné směrování Anthropic) může být vše, co potřebujete.
Spolehlivost volání nástrojů je metrika kvality, na které zde záleží nejvíce. Hierarchie je: nativní Claude >> OpenRouter Claude >> DeepSeek/Gemini >> lokální modely. Čím dál jdete dolů, tím více uvidíte selhaná volání nástrojů, halucinované cesty k souborům a neúplné úpravy.
Řešení běžných problémů
Chyba „Model not found"
Toto je zdaleka nejčastější problém. Nastane, když nastavíte ANTHROPIC_BASE_URL, ale zapomenete namapovat všechny tři modelové sloty. Claude Code se pokusí zavolat Haiku nebo Opus přes váš proxy, proxy nerozpozná výchozí název modelu Anthropic a vy dostanete chybu.
# Fix: set ALL three model slot variables
export ANTHROPIC_DEFAULT_HAIKU_MODEL="your-model"
export ANTHROPIC_DEFAULT_SONNET_MODEL="your-model"
export ANTHROPIC_DEFAULT_OPUS_MODEL="your-model"Connection refused / timeout
Váš proxy neběží, nebo Claude Code míří na špatný port. Ověřte, že proces proxy je aktivní, a zkontrolujte port v ANTHROPIC_BASE_URL. Firewally a VPN mohou také blokovat připojení na localhost.
Selhání volání nástrojů
Model správně nepodporuje formát volání nástrojů Anthropic. Příznaky: Claude Code se zasekává, produkuje prázdná volání nástrojů nebo upravuje špatné soubory. Přepněte na model s ověřenou podporou volání nástrojů – Qwen 2.5 Coder a devstral to zvládají nejlépe mezi lokálními modely.
Problémy se streamováním
Některé proxy nezpracovávají server-sent events správně. Odpovědi se zobrazí najednou místo streamování, nebo se uprostřed zkrátí. Ujistěte se, že vaše verze proxy je aktuální, a zkontrolujte známé chyby streamování v issues na GitHubu.
Překročení kontextového okna
Lokální modely mají často výchozí kontextové okno 4K–8K. Claude Code potřebuje pro reálné kódovací relace mnohem více. Používejte modely s kontextem 32K+, nebo směrujte úlohy s dlouhým kontextem na Gemini (1M okno) přes OpenRouter.
Nejprve se musíte odhlásit pro OpenRouter
Pokud přecházíte z přímého Anthropic na OpenRouter, spusťte nejprve claude /logout. Claude Code ukládá autentizaci do mezipaměti a bude se stále snažit použít váš klíč Anthropic, i když změníte základní URL.
# Clear cached authentication before switching providers
claude /logoutČasté dotazy
Můžete používat Claude Code s GPT-4 nebo Gemini?
Ano. claude-code-proxy překládá požadavky ve formátu Anthropic do formátu OpenAI nebo Gemini. Oba můžete také používat přes OpenRouter s jedním API klíčem. Volání nástrojů může být méně spolehlivé než u nativního Claude, zejména u složitých vícekrokových úloh.
Jak používat Claude Code bez API klíče Anthropic?
Použijte Ollama pro zcela bezplatné lokální používání – API klíč od žádného poskytovatele není potřeba. Alternativně použijte OpenRouter s jejich formátem API klíče. Stále nastavujete proměnnou prostředí ANTHROPIC_API_KEY, ale ukazuje na klíč vašeho proxy (např. sk-or-v1-... pro OpenRouter, "ollama" pro Ollama).
Jak nastavit Claude Code s Ollama?
Nainstalujte Ollama, stáhněte model jako qwen2.5-coder:14b, spusťte ollama launch claude a nastavte tři proměnné prostředí: ANTHROPIC_BASE_URL, ANTHROPIC_API_KEY a tři proměnné pro modelové sloty. Kompletní kód najdete v sekci Ollama výše.
Které modely fungují s Claude Code nejlépe?
Pro cloud: Claude Sonnet 4 poskytuje nejlepší kvalitu kódování, zatímco DeepSeek V3.2 nabízí nejlepší poměr cena/výkon. Pro lokální použití: Qwen 2.5 Coder 14B je současný zlatý standard. Rozhodujícím faktorem je spolehlivost volání nástrojů – Claude Code na ní silně závisí při souborových operacích a nativní modely Claude ji zvládají nejlépe.
Jak opravit chybu „model not found" v Claude Code?
Nastavte všechny tři proměnné prostředí pro modelové sloty: ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL a ANTHROPIC_DEFAULT_OPUS_MODEL. Tato chyba nastává, protože Claude Code používá tři interní modelové sloty a nenamapovaný slot se pokusí zavolat název modelu, který váš proxy nerozpozná.
Může Claude Code pracovat offline s lokálními modely?
Ano. Ollama i LM Studio spouštějí modely zcela na vašem stroji bez nutnosti připojení k internetu. Váš kód nikdy neopustí váš hardware. Budete potřebovat adekvátní specifikace – minimálně 16 GB RAM pro 7B modely, 32 GB+ pro cokoli většího.
Mohu používat LM Studio s Claude Code?
Ano. LM Studio spouští lokální server, ke kterému se Claude Code připojí nastavením ANTHROPIC_BASE_URL na http://localhost:1234/v1 a ANTHROPIC_API_KEY na lm-studio. Stáhněte model pro kódování jako Qwen 2.5 Coder, spusťte server z GUI LM Studio a poté namapujte svůj modelový slot. Je to vizuální alternativa k CLI Ollama.
Co je ANTHROPIC_BASE_URL a jak jej používat?
Je to proměnná prostředí, která říká Claude Code, kam posílat API požadavky. Ve výchozím nastavení ukazuje na https://api.anthropic.com. Změňte ji na jakýkoli endpoint kompatibilní s Anthropic – OpenRouter (https://openrouter.ai/api), Ollama (http://localhost:11434), LiteLLM (http://localhost:4000) atd.
Je claude-code-router lepší než LiteLLM?
Různé nástroje pro různé problémy. claude-code-router je jednodušší (npm install, úprava config.json, hotovo) a navržen speciálně pro Claude Code. LiteLLM je enterprise úrovně s vyvažováním zátěže, omezením rychlosti, záložními řetězci a auditním protokolováním. Sólový vývojář? Použijte claude-code-router. Tým s potřebami správy? Použijte LiteLLM.
Kolik mohu ušetřit používáním ne-Anthropic modelů?
Přechod z Claude Opus 4.6 na DeepSeek V3.2 sníží náklady na výstupní tokeny přibližně o 95 % (25 $ vs 1,10 $ za milion tokenů). Ollama to stáhne na nulu, pokud máte hardware. Ale kompromisy v kvalitě jsou reálné – čekejte nižší přesnost u složitých vícekrokových agentních úloh, méně spolehlivé volání nástrojů a více halucinovaných cest k souborům.
Funguje volání nástrojů se všemi proxy metodami?
Ne spolehlivě napříč všemi. Nativní Claude má nejlepší podporu volání nástrojů. OpenRouter s modely Claude funguje téměř stejně dobře. DeepSeek a Gemini mají částečnou podporu – jednoduchá volání nástrojů fungují, ale složité řetězce mohou selhat. Lokální modely přes Ollama mají nejméně spolehlivé volání nástrojů. Toto je hlavní obava ohledně kvality při přechodu od Anthropic.
Zdroje
- Konfigurace modelů, dokumentace Claude Code
- Konfigurace LLM Gateway, dokumentace Claude Code
- Integrace Claude Code, dokumentace OpenRouter
- Integrace Claude Code, dokumentace Ollama
- Ceny Claude API, Anthropic
- claude-code-router, GitHub
- claude-code-proxy, GitHub
- Použití Claude Code s ne-Anthropic modely, dokumentace LiteLLM