
Claude Code viene fornito con i modelli Anthropic, ma una singola variabile d'ambiente -- ANTHROPIC_BASE_URL -- ti permette di instradare le richieste verso praticamente qualsiasi provider LLM. Questo significa che puoi passare a DeepSeek a circa $0,27 per milione di token in output invece di Claude Opus a $25, oppure eseguire modelli localmente tramite Ollama gratuitamente. Questa guida copre tutti i metodi per utilizzare diversi modelli in Claude Code, costruendo sulla nostra dettagliata comparazione di Claude Code con configurazione pratica per ogni approccio.
Tutti i metodi in un colpo d'occhio
Scegli il metodo che si adatta alla tua situazione, poi salta alla sua sezione per il codice di configurazione.
| Metodo | Ideale per | Costo | Configurazione | Modelli |
|---|---|---|---|---|
| OpenRouter | Varietà di modelli, una chiave API | Pay-per-token (pass-through) | Facile | 300+ |
| Ollama | Privacy, gratis, offline | Gratis (tuo hardware) | Facile | 50+ open-source |
| LM Studio | Modelli locali con GUI | Gratis (tuo hardware) | Facile | 50+ open-source |
| claude-code-router | Routing intelligente per attività | Varia per provider | Medio | Dipende dalla configurazione |
| claude-code-proxy | Backend Gemini/OpenAI | Prezzi del provider | Medio | OpenAI + Gemini |
| LiteLLM | Enterprise, bilanciamento del carico | Prezzi del provider | Avanzato | 100+ su vari provider |
Continua a leggere per la configurazione passo-passo di ciascun metodo, o salta direttamente al framework decisionale se sai già di cosa hai bisogno.
Come funziona davvero il cambio di modello in Claude Code?
Prima di configurare qualsiasi proxy, devi capire perché la maggior parte dei tutorial ti lascia con una configurazione non funzionante. Claude Code usa internamente tre slot di modello -- non uno solo:
- Slot Haiku -- attività in background come il riassunto di file e il completamento delle schede
- Slot Sonnet -- codifica predefinita, il modello con cui interagisci di più
- Slot Opus -- ragionamento complesso, pianificazione e attività agentiche multi-step
Quando cambi il modello con /model o --model, stai cambiando solo lo slot principale. Claude Code continua a cercare di chiamare gli altri due slot usando l'API di Anthropic. Se hai puntato ANTHROPIC_BASE_URL a un proxy ma hai impostato solo un modello, quegli altri slot falliscono con un errore "model not found".
La soluzione: imposta tutte e tre le variabili d'ambiente in modo che ogni slot passi attraverso il tuo proxy.
# Imposta tutti e tre gli slot per passare attraverso il tuo proxy
export ANTHROPIC_DEFAULT_HAIKU_MODEL="il-tuo-equivalente-haiku"
export ANTHROPIC_DEFAULT_SONNET_MODEL="il-tuo-equivalente-sonnet"
export ANTHROPIC_DEFAULT_OPUS_MODEL="il-tuo-equivalente-opus"Cambio di modello nativo (modelli Anthropic)
Se rimani all'interno della famiglia di modelli Anthropic, il cambio è semplice. Usa il comando /model all'interno di Claude Code, passa --model quando avvii dal terminale, o aggiungi modelli all'array availableModels nel tuo file di impostazioni. Anthropic continua ad aggiungere opzioni qui, e la nostra rassegna delle nuove funzionalità di Claude Code per il 2026 traccia le novità più recenti.
La strategia opusplan
opusplan è il routing multi-modello integrato di Claude Code. Invia le attività in background a Haiku e convoglia il ragionamento complesso verso Opus -- automaticamente. Non lo configuri manualmente; selezionalo semplicemente come tuo modello. È la risposta di Anthropic al problema "perché sto pagando prezzi Opus per una lista di file?". Vale la pena provarlo prima di ricorrere a un router di terze parti, insieme alla modalità fast di Anthropic se la velocità pura è la tua priorità.
OpenRouter -- Una chiave API, 300+ modelli
OpenRouter funge da aggregatore API. Ottieni una singola chiave API e accesso a 300+ modelli di Anthropic, Google, Meta, Mistral, DeepSeek e altri. Il pricing è in pass-through per la maggior parte dei modelli -- nessuna maggiorazione.
Passi di configurazione
- Crea un account su openrouter.ai e genera una chiave API
- Esegui
claude /logoutper cancellare qualsiasi sessione Anthropic esistente - Imposta le variabili d'ambiente:
export ANTHROPIC_BASE_URL="https://openrouter.ai/api"
export ANTHROPIC_API_KEY="sk-or-v1-la-tua-chiave-qui"
# Mappa tutti e tre gli slot del modello
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek/deepseek-chat-v3"
export ANTHROPIC_DEFAULT_SONNET_MODEL="anthropic/claude-sonnet-4"
export ANTHROPIC_DEFAULT_OPUS_MODEL="anthropic/claude-opus-4"- Avvia
claudee verifica la connessione
Nota le tre variabili di slot -- omettile e otterrai l'errore "model not found" che abbiamo trattato sopra. La guida ufficiale di integrazione di OpenRouter conferma questa configurazione.
Modelli raccomandati tramite OpenRouter
Non tutti i modelli su OpenRouter gestiscono il tool calling di Claude Code in modo affidabile. Ecco cosa funziona davvero bene:
| Attività | Modello | Perché |
|---|---|---|
| Attività in background economiche | DeepSeek V3.2 | $0,27/$1,10 per MTok, tool calling decente |
| Codifica predefinita | Claude Sonnet 4 | Stessa qualità diretta, fatturazione consolidata |
| Codebase enormi (contesto 1M) | Gemini 2.5 Flash | $0,15/$0,60 per MTok, finestra di contesto massiccia |
| Ragionamento complesso | Claude Opus 4 | Migliore qualità di codifica agentica |
Costo e fatturazione
OpenRouter applica prezzi in pass-through sulla maggior parte dei modelli. Paghi esattamente quello che addebita il provider sottostante, più un piccolo margine su alcuni modelli di terze parti. Imposta limiti di spesa nel tuo dashboard OpenRouter per evitare sorprese.
Verdetto: OpenRouter è la migliore opzione per gli sviluppatori che vogliono massima varietà di modelli con configurazione minima. Una chiave API, un dashboard di fatturazione, 300+ modelli. Difficile da battere per flessibilità.
Ollama -- Gratuito, locale e privato
Ollama esegue modelli interamente sulla tua macchina. Dalla v0.14.0 (gennaio 2026), supporta nativamente l'API Anthropic Messages, il che significa che Claude Code può comunicarci senza alcun livello di traduzione. Il tuo codice non lascia mai la tua macchina.
Prerequisiti e hardware
Avrai bisogno di hardware decente per un'esperienza utilizzabile:
- Modelli 7B (modifiche rapide, attività semplici): 16 GB RAM minimo
- Modelli 14B (buona qualità di codifica): 32 GB RAM, GPU consigliata
- Modelli 32B+ (qualità quasi cloud): 64 GB RAM o GPU dedicata con 24 GB+ VRAM
Per un'analisi più approfondita dei requisiti hardware e della selezione del modello, consulta la nostra guida all'esecuzione locale di LLM.
Passi di configurazione
- Installa Ollama da ollama.com
- Scarica un modello focalizzato sulla codifica
- Avvia con compatibilità Claude Code
- Imposta le variabili d'ambiente
# Installa e scarica un modello di codifica
ollama pull qwen2.5-coder:14b
# Avvia con compatibilità Claude Code
ollama launch claude
# Imposta le variabili d'ambiente
export ANTHROPIC_BASE_URL="http://localhost:11434"
export ANTHROPIC_API_KEY="ollama"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_SONNET_MODEL="qwen2.5-coder:14b"
export ANTHROPIC_DEFAULT_OPUS_MODEL="qwen2.5-coder:14b"La documentazione di integrazione Ollama raccomanda modelli con finestre di contesto di 64k+ token per la migliore esperienza con Claude Code.
Migliori modelli locali per la codifica
| Modello | Dimensione | Punto di forza | Note |
|---|---|---|---|
| Qwen 2.5 Coder 14B | 14B | Migliore codifica locale complessiva | Tool calling solido, buona gestione del contesto |
| devstral | 24B | Specialista di codifica di Mistral | Ottimo per refactoring e code review |
| GLM 4.7 | 9B | Ragionamento generale | Buon equilibrio tra velocità e qualità |
Sii onesto con te stesso su una cosa: i modelli locali producono una qualità del codice notevolmente inferiore a Claude Sonnet per attività agentiche complesse e multi-step. Il tool calling è meno affidabile, e vedrai più percorsi di file allucinati. Sono fantastici per modifiche rapide, generazione semplice e lavoro sensibile alla privacy -- semplicemente non aspettarti qualità Claude nativa su un refactoring di 50 file.
Verdetto: Ollama è la migliore scelta per il lavoro sensibile alla privacy e gli sviluppatori che vogliono utilizzo gratuito e illimitato. Se hai l'hardware, è difficile argomentare contro "zero euro per sempre."
Ollama Cloud vs OpenRouter: prezzi e quando vince ciascuno
Ollama e OpenRouter risolvono il problema dei costi da lati opposti. Ollama esegue i modelli su hardware che controlli tu a costo zero per token, mentre OpenRouter applica prezzi pass-through su oltre 300 modelli ospitati senza hardware da gestire. Questa guida configura Ollama in locale, e la stessa logica di costo fisso contro costo per token si applica se usi il suo livello ospitato.
| Fattore | Ollama | OpenRouter |
|---|---|---|
| Modello di costo | Gratis in locale, paghi l'hardware | Pass-through per token, nessuna maggiorazione sulla maggior parte dei modelli |
| Prezzo esempio | $0 per token | DeepSeek V3.2 a $0,27/$1,10, Gemini 2.5 Flash a $0,15/$0,60 per MTok |
| Hardware | 16 GB RAM (7B) fino a 24 GB+ VRAM (32B+) | Nessuno, completamente ospitato |
| Accesso ai modelli | 50+ modelli open-source | 300+ su vari provider |
| Privacy | Il codice non lascia mai la tua macchina | Le richieste passano attraverso OpenRouter |
Scegli Ollama quando privacy, uso offline o modifiche di routine ad alto volume contano e possiedi già l'hardware. Scegli OpenRouter quando vuoi varietà di modelli, nessun hardware iniziale e fatturazione paga-solo-per-quello-che-usi.
LM Studio -- Modelli locali con una GUI
LM Studio offre la stessa esecuzione di modelli locali di Ollama, ma con un'interfaccia visiva. Puoi sfogliare i modelli in una GUI, scegliere i livelli di quantizzazione con un clic e testare la chat prima di puntare Claude Code verso di esso. Stessi requisiti hardware di Ollama. Se stai confrontando i vari runner, la nostra guida ai migliori strumenti per eseguire LLM in locale copre i compromessi.
Configurazione
- Scarica LM Studio e installalo
- Cerca e scarica un modello di codifica (Qwen 2.5 Coder, devstral, ecc.)
- Avvia il server locale dall'interfaccia di LM Studio
- Punta Claude Code verso di esso:
# Punta Claude Code al server locale di LM Studio
export ANTHROPIC_BASE_URL="http://localhost:1234/v1"
export ANTHROPIC_API_KEY="lm-studio"
export ANTHROPIC_DEFAULT_SONNET_MODEL="nome-del-tuo-modello-caricato"Il blog di LM Studio ha una procedura dettagliata con screenshot se preferisci guide di configurazione visive.
Verdetto: LM Studio è il migliore per gli sviluppatori che preferiscono una GUI alla CLI per gestire i modelli locali. Se sei già a tuo agio con ollama pull e file di configurazione, resta con Ollama. Se vuoi sfogliare i modelli visivamente e modificare le impostazioni con cursori, LM Studio è la tua scelta.
claude-code-router -- Routing intelligente dei modelli
claude-code-router è un pacchetto npm che esegue un proxy locale tra Claude Code e i tuoi provider configurati. Ciò che lo rende interessante è il routing consapevole del contesto -- puoi inviare attività in background economiche a DeepSeek, codifica predefinita a Sonnet e ragionamento complesso a Opus, tutto automaticamente.
Il progetto ha 30k+ stelle GitHub e supporta OpenRouter, DeepSeek, Gemini, Ollama, Groq, Volcengine e SiliconFlow come provider.
Installazione e configurazione
npm install -g claude-code-router
claude-code-router init
claude-code-router startIl comando init crea un config.json dove definisci i tuoi provider e le mappature dei modelli:
{
"providers": {
"openrouter": {
"apiKey": "sk-or-v1-...",
"models": {
"haiku": "deepseek/deepseek-chat-v3",
"sonnet": "anthropic/claude-sonnet-4",
"opus": "anthropic/claude-opus-4"
}
}
}
}Configurazione del routing consapevole del contesto
È qui che claude-code-router brilla. Puoi instradare diversi tipi di attività verso diversi modelli in base alla complessità. Il riassunto in background va a un modello economico, mentre la pianificazione e il lavoro di architettura vanno al tuo modello migliore. Il router gestisce tutte le mappature degli slot in modo trasparente.
Puoi anche mescolare i provider -- usa Ollama per i repository sensibili alla privacy e OpenRouter per tutto il resto, passando con il comando /model all'interno di Claude Code.
Verdetto: claude-code-router è il migliore per gli utenti avanzati che vogliono un controllo granulare su quale modello gestisce ogni tipo di attività. È l'opzione più configurabile, ma questa flessibilità comporta più configurazione rispetto a un semplice cambio di ANTHROPIC_BASE_URL.
claude-code-proxy e LiteLLM -- Configurazioni avanzate
Questi due metodi servono esigenze diverse ma condividono un tratto: sono entrambi server proxy che traducono tra formati API.
claude-code-proxy (Backend Gemini e OpenAI)
claude-code-proxy è uno strumento Python (3,3k stelle GitHub) che accetta richieste in formato Anthropic da Claude Code e le traduce in formato OpenAI o Gemini tramite LiteLLM sotto il cofano. È il modo più semplice per utilizzare specificamente Gemini o modelli GPT con Claude Code.
pip install claude-code-proxy
claude-code-proxy --port 8080
# Poi punta Claude Code verso di esso
export ANTHROPIC_BASE_URL="http://localhost:8080"
export ANTHROPIC_API_KEY="la-tua-chiave-gemini-o-openai"Se vuoi specificamente il contesto di 1M token di Gemini per monorepo di grandi dimensioni, questo è il percorso più diretto.
LiteLLM (Proxy universale enterprise)
LiteLLM è un proxy di livello enterprise che supporta 100+ provider con bilanciamento del carico, catene di fallback, limitazione della velocità e registrazione di audit. È eccessivo per uno sviluppatore individuale ma essenziale per i team che necessitano di governance sull'utilizzo dei modelli IA.
La configurazione utilizza un file YAML:
model_list:
- model_name: claude-sonnet-4-20250514
litellm_params:
model: gemini/gemini-2.5-flash
api_key: os.environ/GEMINI_API_KEY
- model_name: claude-haiku-3-5-20241022
litellm_params:
model: deepseek/deepseek-chat
api_key: os.environ/DEEPSEEK_API_KEY# Avvia il proxy LiteLLM
litellm --config config.yaml --port 4000
# Punta Claude Code verso LiteLLM
export ANTHROPIC_BASE_URL="http://localhost:4000"
export ANTHROPIC_API_KEY="sk-litellm"Una nota importante dalla documentazione ufficiale di Claude Code: "Anthropic non approva, mantiene o verifica LiteLLM." Usalo, ma sappi che è uno strumento della community, non un prodotto Anthropic. Il tutorial LiteLLM ha esempi di configurazione più avanzati.
Verdetto: Usa claude-code-proxy se vuoi specificamente modelli Gemini o OpenAI. Usa LiteLLM se il tuo team ha bisogno di bilanciamento del carico, fallback e registrazione di audit tra i provider.
Claude Code Router vs LiteLLM: quale dovresti usare?
Claude Code Router è la scelta più semplice per gli sviluppatori solitari che vogliono un routing dei modelli per singola attività, mentre LiteLLM è costruito per i team che hanno bisogno di bilanciamento del carico, catene di fallback e registrazione di audit. Router si installa via npm e legge un config.json; LiteLLM esegue un proxy enterprise configurato in YAML su 100+ provider.
| Fattore | Claude Code Router | LiteLLM |
|---|---|---|
| Difficoltà di configurazione | Media: npm install, modifica config.json | Avanzata: file di configurazione YAML |
| Ideale per | Sviluppatori solitari che vogliono routing per attività | Team che necessitano di governance |
| Formato di configurazione | config.json | YAML model_list |
| Funzionalità distintiva | Routing consapevole del contesto per attività | Bilanciamento del carico, fallback, registrazione di audit |
| Provider | OpenRouter, DeepSeek, Gemini, Ollama, Groq e altri | 100+ su vari provider |
| Maturità | 30k+ stelle GitHub, costruito per Claude Code | Proxy enterprise, strumento della community (non approvato da Anthropic) |
Scegli claude-code-router se sei uno sviluppatore solitario che vuole attività in background economiche su DeepSeek e ragionamento complesso su Opus senza troppa configurazione. Scegli LiteLLM se il tuo team ha bisogno di bilanciamento del carico, limitazione della velocità e log di audit tra i provider.
Stai valutando anche altri proxy? La nostra rassegna dei migliori strumenti LLM gateway li confronta fianco a fianco.
Quanto costa davvero ogni metodo?
Mettiamo numeri reali su questo. Ecco cosa pagherai per 1 milione di token nelle combinazioni modello/metodo più comuni:
| Modello / Metodo | Input (per 1M token) | Output (per 1M token) | Stima mensile (uso moderato) |
|---|---|---|---|
| Claude Opus 4.6 (diretto) | €4,60 | €23,00 | ~€46-138 |
| Claude Sonnet 4.6 (diretto) | €2,75 | €13,80 | ~€28-55 |
| Claude Sonnet via OpenRouter | €2,75 | €13,80 | Uguale (pass-through) |
| DeepSeek V3.2 (OpenRouter) | €0,25 | €1,01 | ~€3-7 |
| Gemini 2.5 Flash (OpenRouter) | €0,14 | €0,55 | ~€2-5 |
| Ollama (locale) | Gratis | Gratis | €0 (costi hardware) |
Dati sui prezzi dalla pagina ufficiale dei prezzi di Anthropic e OpenRouter. L'uso moderato assume ~5-10M token/mese per sessioni di codifica giornaliere.
"Costo per 1M token di output per modello"
Tabella dei dati
| "Modello" | "Costo di output" |
|---|---|
| "Opus 4.6" | 23 |
| "Sonnet 4.6" | 13.8 |
| "DeepSeek V3.2" | 1.01 |
| "Gemini 2.5 Flash" | 0.55 |
| "Ollama (locale)" | 0 |
Il divario di costo è significativo, ma i modelli più economici producono una qualità del codice inferiore -- specialmente per attività agentiche complesse dove la affidabilità del tool calling è importante. DeepSeek a €1,01/MTok di output è ottimo per le modifiche di routine. Per un refactoring multi-file dove Claude Code deve leggere, pianificare, modificare e verificare su 20 file? Vorrai ancora Sonnet o Opus.
Verdetto: Per risparmiare con qualità accettabile, OpenRouter + DeepSeek offre il miglior rapporto. Per costo zero, Ollama è imbattibile se hai l'hardware. Per qualità massima, Anthropic diretto rimane il re.
Quale metodo dovresti usare? -- Framework decisionale
Ecco la sezione che tutti gli altri tutorial saltano. Invece di dirti "usa semplicemente OpenRouter," abbiniamo i metodi alle esigenze reali:
| Se hai bisogno di... | Usa questo metodo | Perché |
|---|---|---|
| Massima varietà di modelli, una chiave API | OpenRouter | 300+ modelli, configurazione facile, pay-per-use |
| Gratis, illimitato, il codice rimane locale | Ollama | Zero costi, piena privacy, capace offline |
| Modelli locali con interfaccia visiva | LM Studio | Browser di modelli GUI, facile selezione della quantizzazione |
| Routing intelligente per attività | claude-code-router | Ragionamento verso Opus, modifiche rapide verso DeepSeek |
| Specificamente modelli Gemini o OpenAI | claude-code-proxy | Traduce il formato Anthropic in OpenAI/Gemini |
| Enterprise: bilanciamento del carico, audit | LiteLLM | Limitazione della velocità, catene di fallback, controlli del team |
Dovresti anche cambiare?
Parere onesto: per la maggior parte degli sviluppatori che fanno codifica agentica complessa -- refactoring multi-file, pianificazione dell'architettura, debug di problemi di concorrenza complicati -- Claude Sonnet tramite Anthropic diretto rimane l'opzione migliore. Claude nativo ha il tool calling più affidabile, la migliore comprensione del suo stesso flusso di lavoro agentico e zero latenza proxy.
Il cambio di modello è un'ottimizzazione per scenari specifici:
- Stai bruciando token su attività in background che non necessitano della qualità Sonnet, oppure continui a raggiungere i limiti di utilizzo 2x di Claude
- Hai bisogno della finestra di contesto da 1M token di Gemini per un monorepo massiccio
- Il tuo codice non può uscire dalla tua macchina (governo, sanità, finanza)
- Hai un budget limitato e la qualità accettabile supera la qualità perfetta
Se nessuno di questi si applica, opusplan (il routing integrato di Anthropic) potrebbe essere tutto ciò di cui hai bisogno.
L'affidabilità del tool calling è la metrica di qualità più importante qui. La gerarchia è: Claude nativo >> Claude OpenRouter >> DeepSeek/Gemini >> modelli locali. Più scendi, più vedrai chiamate agli strumenti fallite, percorsi di file allucinati e modifiche incomplete.
Risoluzione dei problemi comuni
Errore "model not found"
Questo è il problema più comune. Si verifica quando imposti ANTHROPIC_BASE_URL ma dimentichi di mappare tutti e tre gli slot del modello. Claude Code cerca di chiamare Haiku o Opus attraverso il tuo proxy, il proxy non riconosce il nome del modello Anthropic predefinito e ottieni l'errore.
# Correzione: imposta TUTTI e tre le variabili dello slot del modello
export ANTHROPIC_DEFAULT_HAIKU_MODEL="il-tuo-modello"
export ANTHROPIC_DEFAULT_SONNET_MODEL="il-tuo-modello"
export ANTHROPIC_DEFAULT_OPUS_MODEL="il-tuo-modello"Connessione rifiutata / timeout
Il tuo proxy non è in esecuzione, o Claude Code sta raggiungendo la porta sbagliata. Verifica che il processo del proxy sia attivo e ricontrolla la porta in ANTHROPIC_BASE_URL. I firewall e le VPN possono anche bloccare le connessioni localhost.
Errori del tool calling
Il modello non supporta correttamente il formato di utilizzo degli strumenti di Anthropic. Sintomi: Claude Code si blocca, produce chiamate agli strumenti vuote o modifica i file sbagliati. Passa a un modello con supporto al tool calling verificato -- Qwen 2.5 Coder e devstral lo gestiscono meglio tra i modelli locali.
Problemi di streaming
Alcuni proxy non gestiscono correttamente gli eventi inviati dal server. Le risposte appaiono tutte in una volta invece di essere trasmesse in streaming, o vengono troncate a metà risposta. Assicurati che la tua versione del proxy sia aggiornata e controlla i problemi GitHub per bug di streaming noti.
Finestra di contesto superata
I modelli locali spesso hanno finestre di contesto di 4K-8K per impostazione predefinita. Claude Code ha bisogno di molto di più per sessioni di codifica reali. Usa modelli con contesto 32K+, o instrada le attività con contesto lungo verso Gemini (finestra 1M) tramite OpenRouter.
È necessario disconnettersi prima per OpenRouter
Se stai passando da Anthropic diretto a OpenRouter, esegui prima claude /logout. Claude Code memorizza nella cache l'autenticazione e continuerà a cercare di usare la tua chiave Anthropic anche dopo aver cambiato l'URL base.
# Cancella l'autenticazione nella cache prima di cambiare provider
claude /logoutFAQ
Puoi usare Claude Code con GPT-4 o Gemini?
Sì. claude-code-proxy traduce le richieste in formato Anthropic in formato OpenAI o Gemini. Puoi anche accedere a entrambi tramite OpenRouter con una singola chiave API. Il tool calling può essere meno affidabile del Claude nativo, specialmente per attività complesse multi-step.
Come uso Claude Code senza una chiave API Anthropic?
Usa Ollama per l'utilizzo locale completamente gratuito -- nessuna chiave API da nessun provider necessaria. In alternativa, usa OpenRouter con il loro formato di chiave API. Imposti ancora la variabile d'ambiente ANTHROPIC_API_KEY, ma punta alla chiave del tuo proxy (ad es. sk-or-v1-... per OpenRouter, "ollama" per Ollama).
Come configuro Claude Code con Ollama?
Installa Ollama, scarica un modello come qwen2.5-coder:14b, esegui ollama launch claude e imposta tre variabili d'ambiente: ANTHROPIC_BASE_URL, ANTHROPIC_API_KEY e le tre variabili dello slot del modello. Vedi la sezione Ollama sopra per il codice completo.
Quali modelli funzionano meglio con Claude Code?
Per il cloud: Claude Sonnet 4 offre la migliore qualità di codifica, mentre DeepSeek V3.2 offre il miglior valore. Per il locale: Qwen 2.5 Coder 14B è l'attuale standard di riferimento. Il fattore decisivo è l'affidabilità del tool calling -- Claude Code dipende fortemente da esso per le operazioni sui file, e i modelli Claude nativi lo gestiscono meglio.
Come correggo l'errore "model not found" in Claude Code?
Imposta tutte e tre le variabili d'ambiente dello slot del modello: ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL e ANTHROPIC_DEFAULT_OPUS_MODEL. Questo errore si verifica perché Claude Code usa tre slot di modello interni, e uno slot non mappato cerca di chiamare un nome di modello che il tuo proxy non riconosce.
Claude Code può funzionare offline con modelli locali?
Sì. Sia Ollama che LM Studio eseguono i modelli completamente sulla tua macchina senza connessione Internet richiesta. Il tuo codice non lascia mai il tuo hardware. Avrai bisogno di specifiche adeguate -- 16 GB RAM minimo per i modelli 7B, 32 GB+ per qualcosa di più grande.
Posso usare LM Studio con Claude Code?
Sì. LM Studio esegue un server locale a cui Claude Code si connette impostando ANTHROPIC_BASE_URL su http://localhost:1234/v1 e ANTHROPIC_API_KEY su lm-studio. Scarica un modello di codifica come Qwen 2.5 Coder, avvia il server dall'interfaccia GUI di LM Studio, poi mappa il tuo slot del modello. È l'alternativa visiva alla CLI di Ollama.
Cos'è ANTHROPIC_BASE_URL e come si usa?
È la variabile d'ambiente che dice a Claude Code dove inviare le richieste API. Per impostazione predefinita, punta a https://api.anthropic.com. Cambiala con qualsiasi endpoint compatibile con Anthropic -- OpenRouter (https://openrouter.ai/api), Ollama (http://localhost:11434), LiteLLM (http://localhost:4000), ecc.
claude-code-router è migliore di LiteLLM?
Strumenti diversi per problemi diversi. claude-code-router è più semplice (npm install, modifica config.json, fatto) e progettato specificamente per Claude Code. LiteLLM è di livello enterprise con bilanciamento del carico, limitazione della velocità, catene di fallback e registrazione di audit. Sviluppatore solo? Usa claude-code-router. Team con esigenze di governance? Usa LiteLLM.
Quanto posso risparmiare usando modelli non Anthropic?
Passare da Claude Opus 4.6 a DeepSeek V3.2 riduce i costi dei token di output di circa 95% (€23 vs €1,01 per milione di token). Ollama porta questo a zero se hai l'hardware. Ma i compromessi sulla qualità sono reali -- aspettati minore precisione su attività agentiche complesse multi-step, tool calling meno affidabile e più percorsi di file allucinati.
Il tool calling funziona con tutti i metodi proxy?
Non in modo affidabile su tutta la linea. Claude nativo ha il miglior supporto al tool calling. OpenRouter con modelli Claude funziona quasi altrettanto bene. DeepSeek e Gemini hanno supporto parziale -- le chiamate agli strumenti semplici funzionano, ma le catene complesse possono fallire. I modelli locali tramite Ollama hanno il tool calling meno affidabile. Questa è la principale preoccupazione di qualità quando si abbandona Anthropic.
Fonti
- Configurazione del modello -- Documentazione Claude Code
- Configurazione del gateway LLM -- Documentazione Claude Code
- Integrazione Claude Code -- Documentazione OpenRouter
- Integrazione Claude Code -- Documentazione Ollama
- Prezzi API Claude -- Anthropic
- claude-code-router -- GitHub
- claude-code-proxy -- GitHub
- Usare Claude Code con modelli non Anthropic -- Documentazione LiteLLM