Techsy
Kontakt
Začít
Zpět na blog
guides

Ušetřete 90 % z účtu za Claude Code: Použijte OpenRouter, Ollama nebo LiteLLM

Napsal Mert Batur Gürbüz
Aktualizováno Jul 5, 2026
14 minut čtení
Obsah
Ušetřete 90 % z účtu za Claude Code: Použijte OpenRouter, Ollama nebo LiteLLM

Claude Code se dodává s modely Anthropic, ale jediná proměnná prostředí, ANTHROPIC_BASE_URL, vám umožní směrovat požadavky prakticky na jakéhokoli poskytovatele LLM. To znamená, že můžete nasadit DeepSeek za zhruba 0,27 $ za milion výstupních tokenů místo Claude Opus za 25 $, nebo spouštět modely lokálně přes Ollama zcela zdarma. Tento průvodce pokrývá všechny způsoby, jak používat různé modely v Claude Code, a navazuje na naše podrobné srovnání Claude Code s praktickým nastavením pro každý přístup.

Všechny metody na jednom místě

Vyberte metodu, která odpovídá vaší situaci, a přejděte do příslušné sekce s kódem pro nastavení.

MetodaNejlepší proNákladyNastaveníModely
OpenRouterRozmanitost modelů, jeden API klíčPlatba za token (průchozí)Snadné300+
OllamaSoukromí, zdarma, offlineZdarma (váš hardware)Snadné50+ open-source
LM StudioLokální modely s GUIZdarma (váš hardware)Snadné50+ open-source
claude-code-routerChytré směrování podle úlohyLiší se dle poskytovateleStředníZávisí na konfiguraci
claude-code-proxyBackend Gemini/OpenAICeny poskytovateleStředníOpenAI + Gemini
LiteLLMEnterprise, vyvažování zátěžeCeny poskytovatelePokročilé100+ napříč poskytovateli

Čtěte dál pro podrobné nastavení každé metody, nebo přejděte rovnou na rozhodovací rámec, pokud už víte, co potřebujete.

Jak přepínání modelů v Claude Code vlastně funguje?

Než začnete konfigurovat jakýkoli proxy server, musíte pochopit, proč většina návodů končí rozbitým nastavením. Claude Code interně používá tři modelové sloty, ne jeden:

  • Haiku slot, úlohy na pozadí jako sumarizace souborů a doplňování tabulátoru
  • Sonnet slot, výchozí kódování, model, se kterým pracujete nejčastěji
  • Opus slot, složité uvažování, plánování a vícekrokové agentní úlohy

Když změníte model pomocí /model nebo --model, měníte pouze primární slot. Claude Code se stále snaží volat další dva sloty přes API Anthropic. Pokud jste nasměrovali ANTHROPIC_BASE_URL na proxy, ale nastavili jen jeden model, tyto další sloty selžou s chybou „model not found".

Řešení: nastavte všechny tři proměnné prostředí, aby každý slot procházel přes váš proxy server.

bash
# Cut Claude Code's Bill 90%: Run OpenRouter, Ollama or LiteLLM
export ANTHROPIC_DEFAULT_HAIKU_MODEL="your-haiku-equivalent"
export ANTHROPIC_DEFAULT_SONNET_MODEL="your-sonnet-equivalent"
export ANTHROPIC_DEFAULT_OPUS_MODEL="your-opus-equivalent"
<!-- IMAGE: Architecture diagram showing Claude Code request routing through ANTHROPIC_BASE_URL to multiple providers (OpenRouter, Ollama, LiteLLM, claude-code-router) -->

Nativní přepínání modelů (modely Anthropic)

Pokud zůstáváte v rodině modelů Anthropic, je přepínání přímočaré. Použijte příkaz /model uvnitř Claude Code, předejte --model při spouštění z terminálu, nebo přidejte modely do pole availableModels ve vašem konfiguračním souboru. Anthropic sem neustále přidává nové možnosti a náš přehled nejnovějších funkcí Claude Code pro rok 2026 sleduje, co bylo nedávno vydáno.

Strategie opusplan

opusplan je vestavěné vícemodelové směrování v Claude Code. Úlohy na pozadí posílá na Haiku a složité uvažování směruje na Opus, a to automaticky. Nemusíte nic konfigurovat ručně; stačí jej vybrat jako svůj model. Je to vlastní odpověď Anthropic na otázku „proč platím ceny Opus za výpis souborů?" Stojí za vyzkoušení, než sáhnete po routeru třetí strany, spolu s rychlým režimem Anthropic, pokud je vaší prioritou čistá rychlost.

OpenRouter – jeden API klíč, 300+ modelů

OpenRouter funguje jako API agregátor. Získáte jeden API klíč a přístup k více než 300 modelům od Anthropic, Google, Meta, Mistral, DeepSeek a dalších. Ceny jsou průchozí pro většinu modelů, bez přirážky.

Kroky nastavení

  1. Vytvořte si účet na openrouter.ai a vygenerujte API klíč
  2. Spusťte claude /logout pro vymazání existující relace Anthropic
  3. Nastavte proměnné prostředí:
bash
export ANTHROPIC_BASE_URL="https://openrouter.ai/api"
export ANTHROPIC_API_KEY="sk-or-v1-your-key-here"

# Map all three model slots
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek/deepseek-chat-v3"
export ANTHROPIC_DEFAULT_SONNET_MODEL="anthropic/claude-sonnet-4"
export ANTHROPIC_DEFAULT_OPUS_MODEL="anthropic/claude-opus-4"
  1. Spusťte claude a ověřte připojení

Všimněte si tří proměnných pro sloty – pokud je přeskočíte, narazíte na chybu „model not found", kterou jsme popsali výše. Oficiální průvodce integrací OpenRouter toto nastavení potvrzuje.

Doporučené modely přes OpenRouter

Ne každý model na OpenRouteru spolehlivě zvládá volání nástrojů Claude Code. Zde je přehled toho, co skutečně funguje dobře:

ÚlohaModelProč
Levné úlohy na pozadíDeepSeek V3.20,27 $/1,10 $ za MTok, slušné volání nástrojů
Výchozí kódováníClaude Sonnet 4Stejná kvalita jako přímo, konsolidované účtování
Obrovské kódové základny (1M kontext)Gemini 2.5 Flash0,15 $/0,60 $ za MTok, masivní kontextové okno
Složité uvažováníClaude Opus 4Nejlepší kvalita agentního kódování

Náklady a účtování

OpenRouter účtuje průchozí ceny u většiny modelů. Platíte přesně to, co si účtuje základní poskytovatel, plus malou přirážku u některých modelů třetích stran. V dashboardu OpenRouteru si nastavte limity výdajů, abyste se vyhnuli překvapením.

Verdikt: OpenRouter je nejlepší volbou pro vývojáře, kteří chtějí maximální rozmanitost modelů s minimálním nastavením. Jeden API klíč, jeden dashboard pro účtování, 300+ modelů. Těžko hledat lepší flexibilitu.

Ollama – zdarma, lokálně a soukromě

Ollama spouští modely přímo na vašem stroji. Od verze 0.14.0 (leden 2026) nativně podporuje Anthropic Messages API, což znamená, že s ním Claude Code komunikuje bez jakékoli překladové vrstvy. Váš kód nikdy neopustí váš počítač.

Předpoklady a hardware

Pro použitelný zážitek budete potřebovat slušný hardware:

  • 7B modely (rychlé úpravy, jednoduché úlohy): minimálně 16 GB RAM
  • 14B modely (solidní kvalita kódování): 32 GB RAM, doporučené GPU
  • 32B+ modely (kvalita blízká cloudu): 64 GB RAM nebo dedikované GPU s 24 GB+ VRAM

Pro podrobnější přehled hardwarových požadavků a výběru modelů se podívejte na našeho průvodce lokálním spouštěním LLM.

Kroky nastavení

  1. Nainstalujte Ollama z ollama.com
  2. Stáhněte model zaměřený na kódování
  3. Spusťte s kompatibilitou pro Claude Code
  4. Nastavte proměnné prostředí
bash
# Install and pull a coding model
ollama pull qwen2.5-coder:14b

# Launch with Claude Code compatibility
ollama launch claude

# Set env vars
export ANTHROPIC_BASE_URL="http://localhost:11434"
export ANTHROPIC_API_KEY="ollama"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_SONNET_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_OPUS_MODEL="qwen2.5-coder:14b"

Dokumentace integrace Ollama doporučuje modely s kontextovým oknem 64k+ tokenů pro nejlepší zážitek s Claude Code.

Nejlepší lokální modely pro kódování

ModelVelikostSilná stránkaPoznámky
Qwen 2.5 Coder 14B14BNejlepší celkové lokální kódováníSilné volání nástrojů, dobré zpracování kontextu
devstral24BSpecialista Mistral na kódováníSkvělý pro refaktoring a code review
GLM 4.79BObecné uvažováníDobrá rovnováha rychlosti a kvality

Buďte k sobě upřímní v jedné věci: lokální modely produkují znatelně nižší kvalitu kódu než Claude Sonnet u složitých, vícekrokových agentních úloh. Volání nástrojů je méně spolehlivé a uvidíte více halucinovaných cest k souborům. Jsou fantastické pro rychlé úpravy, jednoduchou generaci a práci citlivou na soukromí – jen nečekejte nativní kvalitu Claude u refaktoringu 50 souborů.

Verdikt: Ollama je nejlepší volbou pro práci citlivou na soukromí a vývojáře, kteří chtějí bezplatné, neomezené používání. Pokud máte hardware, těžko se dá polemizovat s „nula dolarů navždy."

Ollama Cloud vs OpenRouter: Ceny a kdy se který vyplatí

Ollama a OpenRouter řeší problém nákladů z opačných konců. Ollama spouští modely na hardwaru, který ovládáte, s nulovými náklady za token, zatímco OpenRouter účtuje průchozí ceny napříč 300+ hostovanými modely bez nutnosti spravovat hardware. Tento průvodce nastavuje Ollama lokálně a stejná matematika fixních nákladů versus cena za token platí, pokud místo toho použijete jeho hostovanou úroveň.

FaktorOllamaOpenRouter
Model nákladůZdarma lokálně, platíte za hardwarePrůchozí cena za token, bez přirážky u většiny modelů
Příklad ceny0 $ za tokenDeepSeek V3.2 za 0,27 $/1,10 $, Gemini 2.5 Flash za 0,15 $/0,60 $ za MTok
Hardware16 GB RAM (7B) až 24 GB+ VRAM (32B+)Žádný, plně hostováno
Přístup k modelům50+ open-source modelů300+ napříč poskytovateli
SoukromíKód nikdy neopustí váš strojPožadavky procházejí přes OpenRouter

Vyberte Ollama, pokud je pro vás důležité soukromí, offline použití nebo vysoký objem rutinních úprav a hardware už vlastníte. Vyberte OpenRouter, pokud chcete rozmanitost modelů, žádný počáteční hardware a účtování pouze za to, co využijete.

LM Studio – lokální modely s GUI

LM Studio nabízí stejné lokální spouštění modelů jako Ollama, ale s vizuálním rozhraním. Modely procházíte v GUI, úrovně kvantizace vybíráte kliknutím a chat testujete, než na něj nasměrujete Claude Code. Stejné hardwarové požadavky jako Ollama. Pokud porovnáváte spouštěče, náš průvodce nejlepšími nástroji pro lokální spouštění LLM pokrývá kompromisy.

Nastavení

  1. Stáhněte LM Studio a nainstalujte jej
  2. Vyhledejte a stáhněte model pro kódování (Qwen 2.5 Coder, devstral atd.)
  3. Spusťte lokální server z rozhraní LM Studio
  4. Nasměrujte na něj Claude Code:
bash
# Point Claude Code to LM Studio's local server
export ANTHROPIC_BASE_URL="http://localhost:1234/v1"
export ANTHROPIC_API_KEY="lm-studio"
export ANTHROPIC_DEFAULT_SONNET_MODEL="your-loaded-model-name"

Blog LM Studio obsahuje návod se snímky obrazovky, pokud preferujete vizuální průvodce nastavením.

Verdikt: LM Studio je nejlepší pro vývojáře, kteří preferují GUI před CLI pro správu lokálních modelů. Pokud vám už vyhovuje ollama pull a konfigurační soubory, zůstaňte u Ollama. Pokud chcete procházet modely vizuálně a ladit nastavení posuvníky, LM Studio je vaše volba.

claude-code-router – chytré směrování modelů

claude-code-router je npm balíček, který spouští lokální proxy mezi Claude Code a vámi nakonfigurovanými poskytovateli. Co jej dělá zajímavým, je směrování podle kontextu – levné úlohy na pozadí můžete poslat na DeepSeek, výchozí kódování na Sonnet a složité uvažování na Opus, vše automaticky.

Projekt má 30k+ hvězdiček na GitHubu a podporuje OpenRouter, DeepSeek, Gemini, Ollama, Groq, Volcengine a SiliconFlow jako poskytovatele.

Instalace a nastavení

bash
npm install -g claude-code-router
claude-code-router init
claude-code-router start

Příkaz init vytvoří config.json, kde definujete poskytovatele a mapování modelů:

json
{
  "providers": {
    "openrouter": {
      "apiKey": "sk-or-v1-...",
      "models": {
        "haiku": "deepseek/deepseek-chat-v3",
        "sonnet": "anthropic/claude-sonnet-4",
        "opus": "anthropic/claude-opus-4"
      }
    }
  }
}

Konfigurace směrování podle kontextu

Zde claude-code-router září. Různé typy úloh můžete směrovat na různé modely podle složitosti. Sumarizace na pozadí jde na levný model, zatímco plánování a architektonická práce jde na váš nejlepší model. Router transparentně zpracovává veškeré mapování slotů.

Můžete také kombinovat poskytovatele – používat Ollama pro repozitáře citlivé na soukromí a OpenRouter pro vše ostatní, s přepínáním pomocí příkazu /model uvnitř Claude Code.

Verdikt: claude-code-router je nejlepší pro pokročilé uživatele, kteří chtějí jemnou kontrolu nad tím, který model zpracovává každý typ úlohy. Je to nejkonfigurovatelnější možnost, ale tato flexibilita přichází s větším úsilím při nastavení než jednoduchá výměna ANTHROPIC_BASE_URL.

claude-code-proxy a LiteLLM – pokročilá nastavení

Tyto dvě metody slouží různým potřebám, ale sdílejí jednu vlastnost: oba jsou proxy servery, které překládají mezi formáty API.

claude-code-proxy (backend Gemini a OpenAI)

claude-code-proxy je nástroj v Pythonu (3,3k hvězdiček na GitHubu), který přijímá požadavky ve formátu Anthropic od Claude Code a překládá je do formátu OpenAI nebo Gemini pomocí LiteLLM v pozadí. Je to nejjednodušší způsob, jak používat Gemini nebo modely GPT konkrétně s Claude Code.

bash
pip install claude-code-proxy
claude-code-proxy --port 8080

# Then point Claude Code at it
export ANTHROPIC_BASE_URL="http://localhost:8080"
export ANTHROPIC_API_KEY="your-gemini-or-openai-key"

Pokud konkrétně chcete 1M tokenový kontext Gemini pro velké monorepozitáře, toto je nejpřímější cesta.

LiteLLM (enterprise univerzální proxy)

LiteLLM je proxy server enterprise úrovně, který podporuje 100+ poskytovatelů s vyvažováním zátěže, záložními řetězci, omezením rychlosti a auditním protokolováním. Pro sólového vývojáře je to zbytečnost, ale pro týmy, které potřebují správu kolem používání AI modelů, je nezbytný.

Nastavení používá konfiguraci YAML:

yaml
model_list:
  - model_name: claude-sonnet-4-20250514
    litellm_params:
      model: gemini/gemini-2.5-flash
      api_key: os.environ/GEMINI_API_KEY
  - model_name: claude-haiku-3-5-20241022
    litellm_params:
      model: deepseek/deepseek-chat
      api_key: os.environ/DEEPSEEK_API_KEY
bash
# Start LiteLLM proxy
litellm --config config.yaml --port 4000

# Point Claude Code to LiteLLM
export ANTHROPIC_BASE_URL="http://localhost:4000"
export ANTHROPIC_API_KEY="sk-litellm"

Jedna důležitá poznámka z oficiální dokumentace Claude Code: „Anthropic nepodporuje, neudržuje ani neaudituje LiteLLM." Používejte jej, ale vězte, že jde o komunitní nástroj, ne produkt Anthropic. Výukový program LiteLLM obsahuje pokročilejší příklady konfigurace.

Verdikt: Použijte claude-code-proxy, pokud chcete konkrétně modely Gemini nebo OpenAI. Použijte LiteLLM, pokud váš tým potřebuje vyvažování zátěže, záložní mechanismy a auditní protokolování napříč poskytovateli.

Claude Code Router vs LiteLLM: Který byste měli použít?

Claude Code Router je jednodušší volbou pro sólové vývojáře, kteří chtějí směrování modelů podle úloh, zatímco LiteLLM je navržen pro týmy, které potřebují vyvažování zátěže, záložní řetězce a auditní protokolování. Router se instaluje přes npm a čte config.json; LiteLLM spouští enterprise proxy konfigurovaný přes YAML napříč 100+ poskytovateli.

FaktorClaude Code RouterLiteLLM
Obtížnost nastaveníStřední: npm install, úprava config.jsonPokročilá: konfigurační soubor YAML
Nejlepší proSólové vývojáře chtějící směrování podle úlohTýmy potřebující správu
Formát konfiguraceconfig.jsonYAML model_list
Vynikající funkceSměrování podle kontextu úlohyVyvažování zátěže, záložní mechanismy, auditní protokolování
PoskytovateléOpenRouter, DeepSeek, Gemini, Ollama, Groq a další100+ napříč poskytovateli
Vyspělost30k+ hvězdiček na GitHubu, vytvořeno pro Claude CodeEnterprise proxy, komunitní nástroj (není schválen Anthropic)

Vyberte claude-code-router, pokud jste sólový vývojář, který chce levné úlohy na pozadí na DeepSeek a složité uvažování na Opus bez velkého nastavování. Vyberte LiteLLM, pokud váš tým potřebuje vyvažování zátěže, omezení rychlosti a auditní protokoly napříč poskytovateli.

Zvažujete i jiné proxy? Náš přehled nejlepších nástrojů LLM gateway je porovnává vedle sebe.

Kolik každá metoda skutečně stojí?

Pojďme k tomu přiřadit reálná čísla. Zde je přehled, kolik zaplatíte za 1M tokenů u nejběžnějších kombinací modelů a metod:

Model / MetodaVstup (za 1M tokenů)Výstup (za 1M tokenů)Měsíční odhad (střední využití)
Claude Opus 4.6 (přímo)5,00 $25,00 $~50–150 $
Claude Sonnet 4.6 (přímo)3,00 $15,00 $~30–60 $
Claude Sonnet přes OpenRouter3,00 $15,00 $Stejné (průchozí)
DeepSeek V3.2 (OpenRouter)0,27 $1,10 $~3–8 $
Gemini 2.5 Flash (OpenRouter)0,15 $0,60 $~2–5 $
Ollama (lokálně)ZdarmaZdarma0 $ (náklady na hardware)

Cenové údaje z oficiální cenové stránky Anthropic a OpenRouteru. Střední využití předpokládá ~5–10M tokenů/měsíc při denních kódovacích relacích.

"Cost per 1M Output Tokens by Model"

"Claude Opus 4.6 costs $25 per 1M output tokens vs DeepSeek V3.2 at $1.10 -- a 23x cost difference. Ollama runs completely free on local hardware."
Tabulka dat
"Cost per 1M Output Tokens by Model"
"Model""Output Cost"
"Opus 4.6"25
"Sonnet 4.6"15
"DeepSeek V3.2"1.1
"Gemini 2.5 Flash"0.6
"Ollama (local)"0

Cenový rozdíl je významný, ale levnější modely produkují nižší kvalitu kódu, zejména u složitých agentních úloh, kde záleží na spolehlivosti volání nástrojů. DeepSeek za 1,10 $/MTok výstup je skvělý pro rutinní úpravy. Pro vícesouborový refaktoring, kde Claude Code potřebuje číst, plánovat, upravovat a ověřovat napříč 20 soubory? Tam stále budete chtít Sonnet nebo Opus.

Verdikt: Pro úsporu nákladů s přijatelnou kvalitou nabízí OpenRouter + DeepSeek nejlepší poměr. Pro nulové náklady je Ollama nepřekonatelná, pokud máte hardware. Pro maximální kvalitu zůstává Anthropic přímo králem.

Kterou metodu byste měli použít? – Rozhodovací rámec

Zde je sekce, kterou každý jiný návod přeskakuje. Místo abychom vám říkali „prostě použijte OpenRouter", pojďme přiřadit metody ke skutečným potřebám:

Pokud potřebujete...Použijte tuto metoduProč
Maximální rozmanitost modelů, jeden API klíčOpenRouter300+ modelů, snadné nastavení, platba za použití
Zdarma, neomezeně, kód zůstává lokálněOllamaNulové náklady, plné soukromí, offline schopnost
Lokální modely s vizuálním rozhranímLM StudioGUI prohlížeč modelů, snadný výběr kvantizace
Chytré směrování podle úlohyclaude-code-routerUvažování na Opus, rychlé úpravy na DeepSeek
Konkrétně modely Gemini nebo OpenAIclaude-code-proxyPřekládá formát Anthropic na OpenAI/Gemini
Enterprise: vyvažování zátěže, auditLiteLLMOmezení rychlosti, záložní řetězce, týmové ovládání

Měli byste vůbec přepínat?

Upřímný pohled: pro většinu vývojářů dělajících složité agentní kódování, vícesouborové refaktoringy, architektonické plánování, ladění složitých problémů souběžnosti, zůstává Claude Sonnet přímo přes Anthropic nejlepší volbou. Nativní Claude má nejspolehlivější volání nástrojů, nejlepší porozumění vlastnímu agentnímu pracovnímu postupu a nulovou latenci proxy.

Přepínání modelů je optimalizace pro specifické scénáře:

  • Spalujete tokeny na úlohách na pozadí, které nepotřebují kvalitu Sonnet, nebo neustále narážíte na 2x limity využití Claude
  • Potřebujete 1M kontextové okno Gemini pro masivní monorepozitář
  • Váš kód nemůže opustit váš stroj (státní správa, zdravotnictví, finance)
  • Máte omezený rozpočet a přijatelná kvalita vítězí nad dokonalou kvalitou

Pokud se vás nic z toho netýká, opusplan (vestavěné směrování Anthropic) může být vše, co potřebujete.

Spolehlivost volání nástrojů je metrika kvality, na které zde záleží nejvíce. Hierarchie je: nativní Claude >> OpenRouter Claude >> DeepSeek/Gemini >> lokální modely. Čím dál jdete dolů, tím více uvidíte selhaná volání nástrojů, halucinované cesty k souborům a neúplné úpravy.

Řešení běžných problémů

Chyba „Model not found"

Toto je zdaleka nejčastější problém. Nastane, když nastavíte ANTHROPIC_BASE_URL, ale zapomenete namapovat všechny tři modelové sloty. Claude Code se pokusí zavolat Haiku nebo Opus přes váš proxy, proxy nerozpozná výchozí název modelu Anthropic a vy dostanete chybu.

bash
# Fix: set ALL three model slot variables
export ANTHROPIC_DEFAULT_HAIKU_MODEL="your-model"
export ANTHROPIC_DEFAULT_SONNET_MODEL="your-model"
export ANTHROPIC_DEFAULT_OPUS_MODEL="your-model"

Connection refused / timeout

Váš proxy neběží, nebo Claude Code míří na špatný port. Ověřte, že proces proxy je aktivní, a zkontrolujte port v ANTHROPIC_BASE_URL. Firewally a VPN mohou také blokovat připojení na localhost.

Selhání volání nástrojů

Model správně nepodporuje formát volání nástrojů Anthropic. Příznaky: Claude Code se zasekává, produkuje prázdná volání nástrojů nebo upravuje špatné soubory. Přepněte na model s ověřenou podporou volání nástrojů – Qwen 2.5 Coder a devstral to zvládají nejlépe mezi lokálními modely.

Problémy se streamováním

Některé proxy nezpracovávají server-sent events správně. Odpovědi se zobrazí najednou místo streamování, nebo se uprostřed zkrátí. Ujistěte se, že vaše verze proxy je aktuální, a zkontrolujte známé chyby streamování v issues na GitHubu.

Překročení kontextového okna

Lokální modely mají často výchozí kontextové okno 4K–8K. Claude Code potřebuje pro reálné kódovací relace mnohem více. Používejte modely s kontextem 32K+, nebo směrujte úlohy s dlouhým kontextem na Gemini (1M okno) přes OpenRouter.

Nejprve se musíte odhlásit pro OpenRouter

Pokud přecházíte z přímého Anthropic na OpenRouter, spusťte nejprve claude /logout. Claude Code ukládá autentizaci do mezipaměti a bude se stále snažit použít váš klíč Anthropic, i když změníte základní URL.

bash
# Clear cached authentication before switching providers
claude /logout

Časté dotazy

Můžete používat Claude Code s GPT-4 nebo Gemini?

Ano. claude-code-proxy překládá požadavky ve formátu Anthropic do formátu OpenAI nebo Gemini. Oba můžete také používat přes OpenRouter s jedním API klíčem. Volání nástrojů může být méně spolehlivé než u nativního Claude, zejména u složitých vícekrokových úloh.

Jak používat Claude Code bez API klíče Anthropic?

Použijte Ollama pro zcela bezplatné lokální používání – API klíč od žádného poskytovatele není potřeba. Alternativně použijte OpenRouter s jejich formátem API klíče. Stále nastavujete proměnnou prostředí ANTHROPIC_API_KEY, ale ukazuje na klíč vašeho proxy (např. sk-or-v1-... pro OpenRouter, "ollama" pro Ollama).

Jak nastavit Claude Code s Ollama?

Nainstalujte Ollama, stáhněte model jako qwen2.5-coder:14b, spusťte ollama launch claude a nastavte tři proměnné prostředí: ANTHROPIC_BASE_URL, ANTHROPIC_API_KEY a tři proměnné pro modelové sloty. Kompletní kód najdete v sekci Ollama výše.

Které modely fungují s Claude Code nejlépe?

Pro cloud: Claude Sonnet 4 poskytuje nejlepší kvalitu kódování, zatímco DeepSeek V3.2 nabízí nejlepší poměr cena/výkon. Pro lokální použití: Qwen 2.5 Coder 14B je současný zlatý standard. Rozhodujícím faktorem je spolehlivost volání nástrojů – Claude Code na ní silně závisí při souborových operacích a nativní modely Claude ji zvládají nejlépe.

Jak opravit chybu „model not found" v Claude Code?

Nastavte všechny tři proměnné prostředí pro modelové sloty: ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL a ANTHROPIC_DEFAULT_OPUS_MODEL. Tato chyba nastává, protože Claude Code používá tři interní modelové sloty a nenamapovaný slot se pokusí zavolat název modelu, který váš proxy nerozpozná.

Může Claude Code pracovat offline s lokálními modely?

Ano. Ollama i LM Studio spouštějí modely zcela na vašem stroji bez nutnosti připojení k internetu. Váš kód nikdy neopustí váš hardware. Budete potřebovat adekvátní specifikace – minimálně 16 GB RAM pro 7B modely, 32 GB+ pro cokoli většího.

Mohu používat LM Studio s Claude Code?

Ano. LM Studio spouští lokální server, ke kterému se Claude Code připojí nastavením ANTHROPIC_BASE_URL na http://localhost:1234/v1 a ANTHROPIC_API_KEY na lm-studio. Stáhněte model pro kódování jako Qwen 2.5 Coder, spusťte server z GUI LM Studio a poté namapujte svůj modelový slot. Je to vizuální alternativa k CLI Ollama.

Co je ANTHROPIC_BASE_URL a jak jej používat?

Je to proměnná prostředí, která říká Claude Code, kam posílat API požadavky. Ve výchozím nastavení ukazuje na https://api.anthropic.com. Změňte ji na jakýkoli endpoint kompatibilní s Anthropic – OpenRouter (https://openrouter.ai/api), Ollama (http://localhost:11434), LiteLLM (http://localhost:4000) atd.

Je claude-code-router lepší než LiteLLM?

Různé nástroje pro různé problémy. claude-code-router je jednodušší (npm install, úprava config.json, hotovo) a navržen speciálně pro Claude Code. LiteLLM je enterprise úrovně s vyvažováním zátěže, omezením rychlosti, záložními řetězci a auditním protokolováním. Sólový vývojář? Použijte claude-code-router. Tým s potřebami správy? Použijte LiteLLM.

Kolik mohu ušetřit používáním ne-Anthropic modelů?

Přechod z Claude Opus 4.6 na DeepSeek V3.2 sníží náklady na výstupní tokeny přibližně o 95 % (25 $ vs 1,10 $ za milion tokenů). Ollama to stáhne na nulu, pokud máte hardware. Ale kompromisy v kvalitě jsou reálné – čekejte nižší přesnost u složitých vícekrokových agentních úloh, méně spolehlivé volání nástrojů a více halucinovaných cest k souborům.

Funguje volání nástrojů se všemi proxy metodami?

Ne spolehlivě napříč všemi. Nativní Claude má nejlepší podporu volání nástrojů. OpenRouter s modely Claude funguje téměř stejně dobře. DeepSeek a Gemini mají částečnou podporu – jednoduchá volání nástrojů fungují, ale složité řetězce mohou selhat. Lokální modely přes Ollama mají nejméně spolehlivé volání nástrojů. Toto je hlavní obava ohledně kvality při přechodu od Anthropic.

Zdroje

  • Konfigurace modelů, dokumentace Claude Code
  • Konfigurace LLM Gateway, dokumentace Claude Code
  • Integrace Claude Code, dokumentace OpenRouter
  • Integrace Claude Code, dokumentace Ollama
  • Ceny Claude API, Anthropic
  • claude-code-router, GitHub
  • claude-code-proxy, GitHub
  • Použití Claude Code s ne-Anthropic modely, dokumentace LiteLLM

Štítky

claude-codeopenrouterollamalitellmclaude-code-routerlokalni-modelyai-nastroje-pro-kodovani

Sdílet článek

Související články

Více z kategorie guides

guides
Jul 18, 2026

Srovnání cen LLM API 2026: Ceny všech hlavních modelů

Kompletní srovnání cen LLM API pro rok 2026 — Claude, GPT-5.6, Gemini, DeepSeek, Qwen, GLM a Mistral vedle sebe za milion tokenů, přímo z oficiálních ceníků.

12 min read minut čtení
Číst
guides
Apr 12, 2026

Průvodce Surfer SEO 2026: Editor obsahu, bodování NLP a vyhledávání pomocí AI

Praktický průvodce nástrojem Surfer SEO pokrývající pracovní postup v Editoru obsahu, systém bodování NLP, AI Tracker pro optimalizaci GEO a automatizaci přes API. Na základě testování na více než 50 článcích.

14 min read minut čtení
Číst
guides
Apr 12, 2026

Průvodce Semrush 2026: Každý nástroj vysvětlen (s příklady)

Praktický průvodce Semrush pokrývající výzkum klíčových slov, audit webu, analýzu konkurence, sledování AI Visibility a nastavení MCP serveru. Zahrnuje ukázky kódu a pracovní postupy z reálného SEO pipeline.

14 min read minut čtení
Číst
Zobrazit všechny články
Začněte svůj projekt

Pojďme něco postavit nevšedního?

Proměňme vaši vizi ve skutečnost. Náš tým je připraven vám pomoct vytvořit software, který dělá rozdíl.

Rezervovat 30minutový úvodní hovorNaše projekty

Než z knihovny

Claude dovednosti

Zobrazit vše
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI automatizace

Zobrazit vše
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Než z knihovny

Claude dovednosti

Zobrazit vše
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI automatizace

Zobrazit vše
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Služby

  • Podniková řešení
  • Mobilní aplikace
  • Webové aplikace

Řešení

  • CRM systémy
  • Integrace AI
  • ERP systémy
  • Hlasoví agenti
  • Automatizace procesů
  • Kybernetická bezpečnost

Knihovna

  • Blog
  • Reference

Komunita

  • AI automatizace
  • Claude dovednosti

Nástroje

  • Kalkulátor ceny mobilní aplikace
  • Kalkulátor ceny OpenAI / LLM API
  • Kalkulátor ceny MVP
  • Kalkulátor ceny hlasového AI agenta

Společnost

  • O projektu
  • Partneři
  • Kontakt

Právní informace

  • Zásady ochrany osobních údajů
  • Podmínky poskytování služeb
  • Zásady používání cookies

Služby

  • Podniková řešení
  • Mobilní aplikace
  • Webové aplikace

Řešení

  • CRM systémy
  • Integrace AI
  • ERP systémy
  • Hlasoví agenti
  • Automatizace procesů
  • Kybernetická bezpečnost

Knihovna

  • Blog
  • Reference

Komunita

  • AI automatizace
  • Claude dovednosti

Nástroje

  • Kalkulátor ceny mobilní aplikace
  • Kalkulátor ceny OpenAI / LLM API
  • Kalkulátor ceny MVP
  • Kalkulátor ceny hlasového AI agenta

Společnost

  • O projektu
  • Partneři
  • Kontakt
Právní informaceZásady ochrany osobních údajůPodmínky poskytování služebZásady používání cookies
TECHSY
© 2026 Techsy. Všechna práva vyhrazena.