Modelli disponibili
Per l’impostazionemodel in Claude Code, è possibile configurare:
- Un alias del modello
- Un nome del modello
- API Anthropic: un nome del modello completo
- Amazon Bedrock: un ARN del profilo di inferenza
- Microsoft Foundry: un nome di distribuzione
- Agent Platform di Google Cloud: un nome di versione
ANTHROPIC_BASE_URL cambia dove vengono inviate le richieste, non quale modello le risponde. Per instradare Claude attraverso un gateway LLM, consultare Gateway LLM.Alias dei modelli
Utilizzare un alias del modello per selezionare le impostazioni del modello senza ricordare i numeri di versione esatti:
La versione a cui si risolvono gli alias
opus e sonnet dipende dal provider:
A meno che non impostiate
ANTHROPIC_DEFAULT_FABLE_MODEL, l’alias fable si risolve in Fable 5.1, tranne nelle sessioni di gateway delle app Claude, dove fable e best si risolvono in Fable 5.
Un gateway non configurato per servire claude-fable-5-1 rifiuta le richieste per quel modello. Per utilizzare Fable 5.1 attraverso un gateway che lo serve, selezionarlo con /model claude-fable-5-1.
Dove un alias si risolve in un modello più vecchio, i modelli più recenti sono disponibili selezionando il nome completo del modello esplicitamente o impostando ANTHROPIC_DEFAULT_OPUS_MODEL o ANTHROPIC_DEFAULT_SONNET_MODEL.
Le versioni precedenti risolvono questi alias a modelli più vecchi. Per la versione in cui ogni alias è cambiato, consultare Cronologia delle versioni.
Gli alias puntano alla versione consigliata per il vostro provider e si aggiornano nel tempo. Per fissare una versione specifica, utilizzare il nome completo del modello, ad esempio claude-opus-5-5, o impostare la variabile di ambiente corrispondente come ANTHROPIC_DEFAULT_OPUS_MODEL.
Sonnet 5.5 richiede Claude Code v2.1.284 o successiva, e Opus 5.5 richiede v2.1.280 o successiva. Eseguire
claude update per aggiornare.Lavorare con Fable
Claude Fable 5.1 e Claude Fable 5 sono i modelli più capaci in Claude Code, adatti a compiti più grandi di una singola sessione. Sostengono lunghe sessioni autonome, investigano prima di agire e verificano il loro lavoro più spesso rispetto ai modelli più piccoli. Fable 5.1 è la versione più recente. Nessuno dei due modelli Fable è il valore predefinito del tipo di account su alcun piano o provider. Selezionarne uno esplicitamente:- Fable 5.1: eseguire
/model fable, o avviare conclaude --model fable. Nelle sessioni di gateway delle app Claude, dove l’alias si risolve in Fable 5, eseguire invece/model claude-fable-5-1. - Fable 5: selezionarlo per ID del modello. Sull’API Anthropic, eseguire
/model claude-fable-5o avviare conclaude --model claude-fable-5. Su altri provider, utilizzare l’ID del modello Fable 5 del vostro provider o fissarlo conANTHROPIC_DEFAULT_FABLE_MODEL.
claude-fable-5 o claude-fable-5[1m] come modello, ad esempio perché avete selezionato Fable nel selettore /model prima della v2.1.257, Claude Code cambia quel valore salvato nell’alias fable o fable[1m] la prima volta che eseguite v2.1.257 o successiva. La riga del modello di avvio mostra (auto-updated) una volta. Un valore claude-fable-5 nelle impostazioni di progetto, locali o gestite rimane come è.
Le richieste che i classificatori di sicurezza di un modello Fable contrassegnano, più spesso nei domini della sicurezza informatica e della biologia, attivano il fallback automatico del modello.
Per ottenere il massimo da Fable:
- Descrivere il risultato, non i passaggi: fornitegli il risultato che desiderate e lasciate che pianifichi il percorso. Per mantenerlo orientato verso quel risultato, impostare un obiettivo.
- Fornitegli problemi ambigui: le indagini sulla causa principale, il debug dei disservizi e le decisioni architettoniche sono dove l’investigazione e la verifica aggiuntive ripagano.
- Saltate i promemoria di verifica: verifica il suo lavoro con meno sollecitazioni, quindi i promemoria per testare o controllare sono solitamente non necessari.
- Dimensionate i compiti più grandi: fornitegli il lavoro che normalmente dividereste in pezzi. Sostiene lunghe sessioni senza perdere il filo.
Fable 5.1 richiede Claude Code v2.1.257 o successiva. Se una richiesta da una versione precedente non riesce, consultare Claude Code non supporta questo modello. Eseguire
claude update per aggiornare. Per la disponibilità con conservazione dati zero, consultare Disponibilità del modello con ZDR./model a meno che availableModels o restrizioni del modello dell’organizzazione lo escludano. Quando la vostra organizzazione non può utilizzare Fable affatto, ad esempio con conservazione dati zero, la riga rimane nel selettore disattivata, con una nota sul motivo.
Fable e crediti di utilizzo
A seconda del vostro piano e livello di posto, l’utilizzo di Fable può fatturare ai crediti di utilizzo invece di attingere ai limiti inclusi nel vostro piano. Quando lo fa, il selettore/model mostra “Richiede crediti di utilizzo” sulla riga Fable. Per gestire i crediti di utilizzo, consultare Aggiungere crediti di utilizzo al vostro abbonamento.
Nelle sessioni interattive, Claude Code mostra un prompt di consenso prima che una richiesta Fable fatturi i crediti di utilizzo. I membri dei piani Enterprise con fatturazione organizzativa non vedono il prompt. Potete continuare su Fable utilizzando i crediti di utilizzo o passare al vostro modello predefinito. Potete anche chiudere il prompt:
- Nel selettore
/model, mantenete il vostro modello attuale. - A metà sessione, Claude Code continua il turno sul vostro modello predefinito.
dialogExpiry, cinque minuti per impostazione predefinita. Se nessuno ha risposto entro la scadenza, Claude Code termina il turno senza inviare la richiesta e aggiunge un avviso alla trascrizione, che il client Remote Control mostra anche. La vostra selezione del modello rimane invariata e Claude Code chiede di nuovo il consenso al vostro prossimo messaggio.
Quello che potete fare mentre il prompt è in attesa dipende dalla sessione:
- Con Remote Control connesso o in una sessione di un compagno, premete un tasto qualsiasi al terminale per annullare la scadenza, e Claude Code attende la vostra risposta.
- In una sessione in background, rispondete prima della scadenza.
- Se inviate un nuovo messaggio dal client remoto prima che qualcuno abbia digitato al terminale, Claude Code termina il turno allo stesso modo e il vostro nuovo messaggio inizia il turno successivo. Dopo che qualcuno digita al terminale, Claude Code continua ad aspettare la risposta e mette in coda il vostro nuovo messaggio dietro di essa.
-p e attraverso l’Agent SDK, Claude Code non mostra mai il prompt di consenso. Quando una richiesta Fable lì fatturasse ai crediti di utilizzo, Claude Code la fattura senza chiedere.
Impostazione del vostro modello
Potete configurare il vostro modello in diversi modi, elencati in ordine di priorità:- Durante la sessione: utilizzare
/model <alias|name>per passare immediatamente, o eseguire/modelsenza argomenti per aprire il selettore. Consultare quando Claude Code vi chiede di confermare il passaggio - All’avvio: avviare con
claude --model <alias|name> - Variabile di ambiente: impostare
ANTHROPIC_MODEL=<alias|name> - Impostazioni: configurare permanentemente nel vostro file di impostazioni utilizzando il campo
model - Valore predefinito per le nuove sessioni: impostare
ANTHROPIC_DEFAULT_MODEL=<alias|name>
/model salva la vostra scelta come valore predefinito per le nuove sessioni scrivendo il campo model nelle impostazioni dell’utente. Nel selettore:
Enter: passa il modello e salva come vostro valore predefinitos: passa il modello solo per questa sessione e lascia il vostro valore predefinito invariato. Per utilizzare un tasto diverso, riassegnaremodelPicker:thisSessionOnly
/model <name> direttamente si comporta come Enter. Per passare solo per questa sessione, aprire il selettore con /model e premere s sulla riga del modello.
Su un piano Enterprise, quando siete connessi con il vostro account claude.ai e salvate un valore predefinito con /model, Claude Code registra anche la scelta su quell’account. Questo richiede Claude Code v2.1.280 o successiva.
- Quando il vostro amministratore non ha impostato un modello predefinito dell’organizzazione, l’opzione Predefinito può risolversi al modello registrato, e quando lo fa, la riga Predefinito del selettore mostra il nome di quel modello.
- Se le restrizioni del modello escludono il modello registrato o non è disponibile per il vostro account, e il vostro amministratore non ha impostato un modello predefinito dell’organizzazione, l’opzione Predefinito si risolve come se nulla fosse stato registrato.
- Se scegliete Predefinito o
opusplanin/model, la scelta registrata non cambia.
/model, il passaggio raggiunge anche i subagenti che ereditano il modello della conversazione principale, perché Claude Code risolve il loro modello da quello che la vostra sessione sta utilizzando quando Claude li avvia. Passate a Opus prima che Claude deleghi ricerche o esecuzioni di test a uno di loro, e quel lavoro viene eseguito su Opus anche. Per mantenere un subagente personalizzato su un modello più piccolo, impostare model nella sua definizione.
Se impostate un modello con /model in modalità non interattiva, con il flag -p, la vostra scelta si applica solo alla sessione corrente e non viene salvata come vostro valore predefinito; /model in quella modalità richiede Claude Code v2.1.205 o successiva. Le impostazioni di progetto e gestite hanno ancora la precedenza e si riapplicano al prossimo avvio. Un modello predefinito dell’organizzazione che il vostro amministratore ha configurato per ignorare la selezione dell’utente si riapplica anche al prossimo avvio.
Nella v2.1.144 attraverso v2.1.152, /model si applicava solo alla sessione corrente e d nel selettore salvava un valore predefinito.
Il flag --model e la variabile di ambiente ANTHROPIC_MODEL si applicano solo alla sessione che avviate con loro. Per eseguire modelli diversi in terminali diversi contemporaneamente, avviate ciascuno con il suo flag --model piuttosto che passare con /model.
I prezzi nel selettore /model appaiono quando Claude Code parla all’API Anthropic, direttamente o attraverso un gateway LLM che lo fa da proxy, e il prezzo su una riga è il prezzo del modello che quella riga seleziona. Su provider di terze parti come Amazon Bedrock e sul gateway delle app Claude, il vostro provider o gateway determina quello che pagate, quindi le righe del selettore non mostrano alcun prezzo. Il prezzo è solo un’etichetta di visualizzazione; non influisce su quale modello una riga seleziona o su quello che il vostro provider fattura. Prima della v2.1.206, Claude Platform on AWS e le sessioni del gateway mostravano i prezzi di listino di Anthropic, e una riga poteva mostrare il prezzo di un modello diverso da quello che selezionava.
Le sessioni riprese avviate con claude --resume, --continue, o il selettore /resume mantengono il modello che stavano utilizzando quando la trascrizione è stata salvata, indipendentemente dall’impostazione model corrente. Se il modello ripristinato è stato ritirato o è escluso da availableModels, la sessione ricade nell’ordine di precedenza normale. Questo impedisce che la scelta /model di un’altra sessione cambi il modello al ripristino. Su provider che utilizzano ID di distribuzione specifici del provider piuttosto che ID di modello Anthropic, come Amazon Bedrock, Agent Platform di Google Cloud e Microsoft Foundry, il modello della trascrizione non viene affatto ripristinato e la sessione risolve il suo modello attraverso l’ordine di precedenza normale.
Un modello che scegliete per il nuovo avvio con --model o ANTHROPIC_MODEL ha ancora la precedenza sul modello ripristinato. A partire dalla v2.1.195, così come una variabile della famiglia ANTHROPIC_DEFAULT_OPUS_MODEL. ANTHROPIC_DEFAULT_MODEL può anche, secondo le condizioni elencate nella sua sezione.
Quando il modello attivo all’avvio proviene dalle impostazioni di progetto o gestite piuttosto che dalla vostra selezione, l’intestazione di avvio mostra quale file di impostazioni lo ha impostato. Eseguire /model per ignorare; l’impostazione di progetto o gestita si riapplica al prossimo avvio. Su piattaforme che incorporano Claude Code e impostano CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST, la configurazione del modello dell’host ha la precedenza sulle impostazioni del modello gestite, mentre un elenco di consentiti availableModels gestito rimane in vigore a meno che l’host non fornisca il suo; Eccezioni alla precedenza delle impostazioni gestite dice quali chiavi e variabili l’host ignora.
Se voi o la vostra organizzazione configurate hook PreModelSwitch, vengono eseguiti prima che un passaggio richiesto si applichi e possono bloccarlo o chiedervi di confermare.
Quando Claude Code non può dire quali hook PreModelSwitch i plugin gestiti della vostra organizzazione forniscono, ad esempio perché un plugin gestito non è riuscito a caricarsi, rifiuta il passaggio piuttosto che applicarlo senza controllo, e controlla di nuovo ad ogni nuovo tentativo. Consultare Il passaggio del modello è stato bloccato da un hook PreModelSwitch per il messaggio e il recupero.
Quando passate i modelli attraverso il metodo setModel() dell’Agent SDK o da un dispositivo connesso attraverso Remote Control, o un’app come l’app Desktop che esegue il CLI di Claude Code passa per voi, Claude Code controlla che la stringa sia una che riconosce prima di salvarla. Questo controllo richiede Claude Code v2.1.200 o successiva. Controllare una scelta di Remote Control richiede Claude Code v2.1.260 o successiva sulla vostra macchina. Sull’API Anthropic, Claude Code riconosce:
- un alias del modello
- una voce dal selettore
/model - qualsiasi nome che inizia con
claude- - un valore che avete configurato voi stessi come opzione di modello personalizzato o in
modelOverrides
Model "<name>" is not a recognized model id. e la sessione mantiene il suo modello attuale, invece di salvare la stringa e fallire alla prossima richiesta. Consultare il riferimento dell’errore per i passaggi di recupero.
Il controllo viene eseguito solo sull’API Anthropic. Su Amazon Bedrock, Agent Platform di Google Cloud, Microsoft Foundry, Claude Platform on AWS, e dietro un gateway LLM o un ANTHROPIC_BASE_URL personalizzato, il vostro provider o gateway definisce i nomi dei modelli, quindi Claude Code passa qualsiasi stringa senza controllarla. Il controllo non copre nemmeno il flag --model, la variabile di ambiente ANTHROPIC_MODEL, o l’impostazione model; un valore digitato male lì produce C’è un problema con il modello selezionato alla prima richiesta. Claude Code può comunque scrivere la riga diagnostica del modello non riconosciuto al momento della richiesta, su ogni provider.
Quando il modello richiesto ha una data di ritiro programmata o viene automaticamente rimappato a una versione più recente, Claude Code mostra un avviso che nomina il modello richiesto. Le sessioni interattive lo mostrano come un avviso di avvio. Dalla v2.1.182, lo stesso avviso viene scritto su stderr in modalità non interattiva quando si utilizza il formato di output di testo predefinito. Il controllo copre anche un model impostato nel frontmatter del subagente. L’avviso su stderr è soppresso per --output-format json e stream-json; leggere il modello effettivo dal campo modelUsage del messaggio di risultato invece.
Ad esempio, avviare una sessione su Opus:
Impostare un modello predefinito per le nuove sessioni
ImpostareANTHROPIC_DEFAULT_MODEL=<alias|name> per scegliere il modello su cui le vostre sessioni si avviano per impostazione predefinita. Richiede Claude Code v2.1.236 o successiva.
Claude Code avvia una nuova sessione sul modello della variabile solo quando nessuno di questi seleziona un modello:
- Il flag
--model ANTHROPIC_MODEL- Un valore
modelin qualsiasi file di impostazioni, inclusa la scelta che salvate con/model - Un modello predefinito dell’organizzazione
/model ha la precedenza sulla variabile anche ai prossimi avvii. Con ANTHROPIC_MODEL impostato invece, Claude Code ritorna al modello della variabile al prossimo avvio, qualunque cosa abbiate salvato con /model.
Claude Code risolve anche l’opzione Predefinito al modello della variabile, a meno che non si applichi un modello predefinito dell’organizzazione. Quando l’opzione Predefinito si risolve al modello della variabile, la riga Predefinito nel selettore /model mostra l’etichetta Impostato da ANTHROPIC_DEFAULT_MODEL.
Claude Code ignora la variabile in questi casi, e l’opzione Predefinito si risolve come se non l’aveste impostata:
- L’avete impostata a
default,inherit,opusplan, ohaiku enforceAvailableModelsè attivo- Le restrizioni del modello della vostra organizzazione escludono il modello
- Il modello non è disponibile per il vostro account
claude --resume, --continue, o il selettore /resume si avvia su di esso anche. Claude Code non ripristina il modello salvato nella trascrizione di quella sessione. Altrimenti Claude Code non utilizza la variabile quando riprendete una sessione.
Una nuova sessione si avvia su un modello diverso da quello che avete scelto
Quando scegliete un modello con/model e la vostra prossima sessione si avvia su qualcos’altro, queste sono le cause solite:
- L’avete scelto per una sessione. Premere
snel selettore, avviare con--model, e eseguire/modelin modalità non interattiva si applicano tutti alla sessione corrente e lasciano il vostro valore predefinito salvato da solo. - Qualcosa con priorità più alta imposta il modello. Un valore
modelnelle impostazioni di progetto o gestite,ANTHROPIC_MODELnella vostra shell, o un modello predefinito dell’organizzazione che il vostro amministratore ha impostato per ignorare le scelte dell’utente si applica di nuovo ad ogni avvio. La vostra scelta/modelè ancora salvata; è superata. Quando le impostazioni di progetto o gestite impostano il modello, l’intestazione di avvio nomina il file. - Claude Code non poteva salvare la vostra scelta.
/modelscrivemodela~/.claude/settings.json. Se non potete scrivere su quel file, ad esempio perché un altro strumento lo genera o lo collega a una copia di sola lettura, il modello che avete scelto dura per la sessione e il prossimo avvio legge il valore vecchio. Impostaremodelnello strumento che genera il file, o rendere il file scrivibile. Consultare Una modifica che avete fatto in Claude Code viene persa nelle nuove sessioni. - Avete ripreso una sessione. Una sessione che riprendete con
claude --resumeo--continuesolitamente mantiene il modello che stava utilizzando piuttosto che il vostro valore predefinito attuale.
Limitare la selezione del modello
Gli amministratori aziendali possono utilizzareavailableModels nelle impostazioni gestite o di policy per limitare quali modelli gli utenti possono selezionare. Le voci corrispondono a una famiglia di modelli come sonnet, un prefisso di versione come claude-sonnet-4-5, o un ID modello completo come claude-sonnet-4-5-20250929. Un prefisso di versione corrisponde anche a ID modello successivi che lo estendono con un altro segmento, quindi claude-fable-5 consente sia Fable 5 che Fable 5.1, mentre claude-fable-5-1 consente solo Fable 5.1. Per bloccare un modello che l’elenco consente, o per fare in modo che ogni voce di ID modello consenta solo la versione che nomina, vedere Bloccare modelli o versioni specifici.
Sulle piattaforme che incorporano Claude Code e impostano CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST, la configurazione del modello dell’host ha la precedenza rispetto alle impostazioni del modello gestito, mentre un allowlist availableModels gestito rimane in vigore a meno che l’host non fornisca il proprio; Eccezioni alla precedenza delle impostazioni gestite indica quali chiavi e variabili l’host sostituisce.
Quando availableModels è impostato, l’allowlist si applica ovunque un utente possa specificare un modello:
- Modello della sessione principale:
/model, il flag--model, la variabile di ambienteANTHROPIC_MODEL, l’impostazionemodel,ANTHROPIC_DEFAULT_MODEL, e il modello ripristinato quando si riprende una sessione - Risoluzione alias: le variabili di ambiente
ANTHROPIC_DEFAULT_OPUS_MODEL,ANTHROPIC_DEFAULT_SONNET_MODEL,ANTHROPIC_DEFAULT_HAIKU_MODEL, eANTHROPIC_DEFAULT_FABLE_MODELnon possono reindirizzare un alias consentito a un modello al di fuori dell’elenco - Modalità veloce:
/fastrifiuta di attivare/disattivare quando comporterebbe un passaggio implicito a un modello Opus al di fuori dell’elenco, con il messaggio “is not in your organization’s allowed models” - Modelli di subagent e teammate: il campo
modelnel frontmatter di subagent, il parametromodeldello strumento Agent, i modelli teammate del team di agent,CLAUDE_CODE_SUBAGENT_MODEL, e, nella versione 2.1.197 e precedenti, il selezionatore di modelli nella procedura guidata/agents - Modelli di skill e comando: il frontmatter
modelin skills e commands - Modello Advisor: l’impostazione
advisorModelconfigurata e il flag--advisor - Modello di background agent: il modello selezionato nel dispatch picker
opus, sonnet, haiku, o fable, si risolve nel suo modello usuale quando l’allowlist consente quel modello. Quando l’allowlist blocca quel modello, Claude Code sostituisce la versione più recente della famiglia che l’allowlist consente e mostra un avviso che nomina sia i modelli richiesti che quelli sostituiti. Con ["sonnet", "claude-opus-4-6"], ad esempio, sia /model opus che --model opus selezionano Claude Opus 4.6, l’Opus più recente consentito. Prima della versione 2.1.205, un alias la cui versione più recente rilasciata era al di fuori dell’elenco veniva rifiutato o sostituito come qualsiasi altra selezione bloccata, anche quando l’elenco consentiva una versione precedente.
La sostituzione ha bisogno di una versione consentita su cui atterrare: quando l’allowlist non consente alcuna versione della famiglia dell’alias, l’alias segue il comportamento di rifiuto e sostituzione di seguito come qualsiasi altro valore bloccato.
Claude Code gestisce qualsiasi altra selezione bloccata in base a dove il modello è stato impostato:
-
/model: Claude Code rifiuta il passaggio con un errore -
Flag
--model,ANTHROPIC_MODEL, o l’impostazionemodel: Claude Code sostituisce il valore all’avvio con un avviso che nomina sia i modelli richiesti che quelli sostituiti, e la sessione inizia sul modello predefinito -
ANTHROPIC_DEFAULT_MODEL: Claude Code ignora la variabile - Override di subagent o teammate: Claude Code esegue il subagent o il teammate su un modello di fallback piuttosto che far fallire la richiesta. Vedere Scegliere un modello per il fallback del subagent e Specificare teammate e modelli per il fallback del teammate. Nelle sessioni interattive, Claude Code ti avverte quando sostituisce il modello di un subagent, da questo fallback o dalla sostituzione della versione più recente consentita di cui sopra, nominando i modelli richiesti e sostituiti; non segnala il fallback di un teammate. Dove opera la sostituzione della versione più recente consentita di cui sopra, un alias di famiglia bloccato la segue invece. Prima della versione 2.1.222, un alias ricadeva come qualsiasi altro valore bloccato su ogni provider
- Override di skill o comando: Claude Code ignora l’override, incluso un alias di famiglia bloccato, e lo skill o il comando viene eseguito sul modello della sessione. Uno skill o un comando che viene eseguito in un subagent segue il comportamento del subagent di cui sopra
-
Impostazione
advisorModel: l’advisor è disabilitato per la sessione -
Flag
--advisor: Claude Code esce con un errore all’avvio. In una sessione in background, avvia la sessione senza l’advisor invece di uscire
/model. Un ID modello completo nell’elenco che non ha una riga del selezionatore integrata, come una versione precedente che l’elenco fissa, appare nel selezionatore /model come sua propria riga etichettata, a meno che Claude Code non sostituisca le opzioni integrate con una lineup modelPicker. Prima della versione 2.1.199, tale ID era selezionabile solo digitando /model <id>.
I cambiamenti di modello che Claude Code effettua per tuo conto vengono controllati allo stesso modo:
- Catene di modelli di fallback: le voci al di fuori dell’allowlist vengono eliminate
- Aggiornamenti in Plan Mode: sull’API Anthropic e su Claude Platform on AWS, un aggiornamento come
opusplana un modello escluso utilizza la versione più recente consentita della famiglia di aggiornamento. Su provider con ID modello specifici del provider, e quando nessuna versione è consentita, l’aggiornamento viene saltato e la pianificazione continua sul modello della sessione - Fallback automatico del modello: un fallback il cui target è escluso non viene eseguito, quindi la richiesta contrassegnata termina con un rifiuto
- Classificatore Auto Mode: il valore predefinito Claude Sonnet 5 del classificatore si applica solo quando l’allowlist consente Sonnet 5. Quando è escluso, il classificatore viene eseguito sul modello della sessione, che l’allowlist già governa, o su un modello Opus quando la sessione viene eseguita su un modello Fable. Su provider diversi dall’API Anthropic, quel fallback Opus viene eseguito sul modello Opus predefinito del provider senza consultare l’allowlist. Richiede Claude Code v2.1.210 o successivo
- Modalità veloce: l’abilitazione della modalità veloce viene rifiutata quando il modello su cui la sessione verrebbe eseguita in seguito è al di fuori dell’allowlist
Copertura della superficie
Ogni superficie applica l’allowlist che riceve. Quale meccanismo di consegna raggiunge ogni superficie differisce:- Le sessioni cloud su Claude Code sul web, incluse quelle che avvii dall’app Desktop, vengono eseguite su VM gestite da Anthropic per impostazione predefinita: le impostazioni distribuite al tuo dispositivo non le raggiungono, quindi consegna l’allowlist tramite impostazioni gestite dal server. Le sessioni che la tua organizzazione instrada a un ambiente self-hosted vengono eseguite sul tuo calcolo e leggono anche il file di impostazioni gestite nell’immagine del runner. Come Claude Code combina le fonti gestite indica quando quel file si applica. Un cambio di modello a metà sessione in una sessione cloud viene rifiutato quando il modello richiesto è escluso dall’allowlist. Quando l’elenco
availableModelsnelle tue impostazioni gestite dal server è non vuoto, il server rifiuta la richiesta di un utente di avviare una sessione cloud su un modello che l’elenco esclude. - Cowork, la scheda agentic-work nell’app Claude Desktop, esegue le sue sessioni su Claude Code ma, per progettazione, non riceve impostazioni gestite dal server dalla console di amministrazione claude.ai. Un file di impostazioni gestite si applica alle sessioni Cowork quando è presente dove la sessione viene eseguita; le sessioni Cowork remote vengono eseguite su VM gestite da Anthropic, dove un file distribuito dal dispositivo non è presente.
- Le sessioni su provider di terze parti come Amazon Bedrock, Agent Platform di Google Cloud, Microsoft Foundry, e Claude Platform on AWS non ricevono impostazioni gestite dal server, quindi consegna l’allowlist tramite file MDM o impostazioni gestite lì.
- La consegna gestita dal server richiede anche che la sessione si autentichi con un login o chiave idonei. Le flotte che generano chiavi solo tramite uno script
apiKeyHelperdovrebbero consegnare l’allowlist tramite file MDM o impostazioni gestite. - La scheda Desktop Code ospita anche sessioni SSH, che leggono il file di impostazioni gestite dall’host remoto su cui vengono eseguite. Vedere Impostazioni gestite desktop.
- I selezionatori di modelli su claude.ai e nell’app Desktop nascondono o disattivano i modelli esclusi dall’allowlist della tua organizzazione. Lo stato del selezionatore è una comodità per gli utenti; non applica l’allowlist.
Comportamento del modello predefinito
Con la corrispondenza del prefisso predefinita,availableModels da solo lascia l’opzione Predefinito sul valore predefinito di runtime del sistema per l’account fino a quando non imposti anche enforceAvailableModels. Se quel valore predefinito è un modello che intendi limitare, imposta anche enforceAvailableModels, o blocca quel modello.
Con availableModels: [], le selezioni di modelli denominati vengono bloccate e enforceAvailableModels non ha alcun effetto.
Applicare l’allowlist per il modello Predefinito
ImpostaenforceAvailableModels: true insieme a un availableModels non vuoto nelle impostazioni gestite per estendere l’allowlist all’opzione Predefinito. Ciò richiede Claude Code v2.1.175 o successivo.
availableModels che nomina un modello consentito e disponibile, e la riga Predefinito del selezionatore /model mostra quel modello. Questo si applica ovunque il valore predefinito sia raggiunto: avvio della sessione, selezione di Predefinito in /model, la parola chiave "default" nelle catene di modelli di fallback, e il fallback utilizzato quando una selezione esclusa viene eliminata. Un modello registrato sul account di un membro viene controllato anche rispetto a availableModels; Setting your model descrive come l’opzione Predefinito lo tratta.
enforceAvailableModels rimappa l’opzione Predefinito solo quando availableModels è non vuoto. Quando availableModels è non vuoto ma nessuna voce si risolve in un modello consentito e disponibile, l’applicazione viene saltata con un avviso visibile solo sotto --debug. Mantieni almeno una voce garantita disponibile nell’elenco per evitare questo.
Distribuisci entrambe le chiavi insieme nella fonte gestita con il ranking più alto che consegni. Per impostazione predefinita Claude Code legge solo quella fonte, quindi una coppia posizionata in un file di impostazioni gestite viene ignorata quando la console di amministrazione consegna qualsiasi impostazione; secondo il merge opt-in in come Claude Code combina le fonti gestite, Claude Code ignora comunque una mappa modelOverrides da una fonte classificata al di sotto di quella che imposta availableModels.
Controllare il modello su cui gli utenti vengono eseguiti
L’impostazionemodel è una selezione iniziale, non un’applicazione. Imposta quale modello è attivo quando una sessione inizia, ma gli utenti possono comunque aprire /model e scegliere Predefinito, che si risolve nel valore predefinito di runtime del sistema indipendentemente da cosa sia impostato model, a meno che enforceAvailableModels o le chiavi che bloccano versioni specifiche non si applichino a esso.
Per controllare completamente l’esperienza del modello, combina queste impostazioni:
availableModels: limita quali modelli denominati gli utenti possono passare aenforceAvailableModels: estende l’allowlistavailableModelsall’opzione Predefinito, quindi Predefinito non può risolversi in un modello al di fuori dell’elencodeniedModelseavailableModelsMatch: blocca versioni specifiche che una voceavailableModelsaltrimenti consentirebbemodel: imposta la selezione del modello iniziale quando una sessione iniziaANTHROPIC_DEFAULT_SONNET_MODEL/ANTHROPIC_DEFAULT_OPUS_MODEL/ANTHROPIC_DEFAULT_HAIKU_MODEL/ANTHROPIC_DEFAULT_FABLE_MODEL: controllano a cosa si risolvono gli aliassonnet,opus,haiku, efable, e quale versione utilizza il valore predefinito del tipo di account
enforceAvailableModels o il blocco env, un utente che seleziona Predefinito nel selezionatore ottiene il valore predefinito di runtime piuttosto che la versione fissata in model. Le due impostazioni coprono ambiti diversi: enforceAvailableModels fa sì che Predefinito obbedisca all’allowlist, mentre il blocco env fissa quale versione un alias consentito come sonnet si risolve. Usa enforceAvailableModels da solo quando limitare le famiglie di modelli è sufficiente; aggiungi il blocco env quando hai anche bisogno di fissare una versione specifica.
Comportamento di merge
Quando le impostazioni gestite che Claude Code applica definisconoavailableModels, solo quell’elenco si applica, a parte una piattaforma host che fornisce il proprio: le voci nelle impostazioni utente, progetto o locale non possono estenderlo, e Claude Code non unisce mai availableModels tra fonti gestite nemmeno; come Claude Code combina le fonti gestite indica quale elenco della fonte si applica. Altrimenti, gli elenchi dalle impostazioni utente, progetto e locale vengono concatenati e deduplicati come altre impostazioni di array. Prima di Claude Code v2.1.175, le voci da ambiti di precedenza inferiore si univano nell’elenco gestito invece di essere sostituite da esso.
All’interno dell’elenco effettivo, una voce che nomina un modello specifico in una famiglia, sia un prefisso di versione che un ID modello completo, disabilita la voce wildcard della famiglia: ["sonnet", "claude-sonnet-4-5"] consente solo le versioni di Sonnet 4.5, non ogni modello Sonnet.
ID modello Mantle
Quando l’endpoint Amazon Bedrock Mantle è abilitato, le voci inavailableModels che iniziano con anthropic. vengono aggiunte al selezionatore /model come opzioni personalizzate e instradate all’endpoint Mantle. Questa è un’eccezione alla corrispondenza dell’alias descritta in Fissare modelli per distribuzioni di terze parti. L’impostazione limita comunque il selezionatore alle voci elencate, e un ID Mantle incorpora un nome di famiglia, quindi conta come una voce specifica e disabilita il wildcard della famiglia: insieme a qualsiasi ID Mantle, elenca i prefissi di versione o gli ID completi che desideri mantenere selezionabili. Vedere Comportamento di merge.
Bloccare modelli o versioni specifici
Una voceavailableModels come claude-opus-5 consente anche rilasci successivi che la estendono, come Opus 5.5, non appena Claude Code li supporta. Due impostazioni gestite ti permettono di trattenere un rilascio, e entrambe richiedono Claude Code v2.1.283 o successivo:
deniedModels: elenca i modelli da bloccare. Un modello elencato viene bloccato anche quandoavailableModelslo consente, e la chiave funziona anche senza alcun allowlist. Un rilascio che nessuna voce blocca rimane consentitoavailableModelsMatch: impostalo su"exact"in modo che ogni ID modello inavailableModelsconsenta solo la versione che nomina. Una versione più recente di un ID modello elencato rimane quindi bloccata fino a quando non la aggiungi all’elenco
requiredMinimumVersion per impedire a quelle versioni di avviarsi.
Questo esempio consente modelli Opus e Sonnet e blocca Opus 5.5 in ogni ortografia, inclusi ID datati e specifici del provider:
deniedModels lo nomini o che un elenco "exact" lo ometta, viene trattato come una selezione bloccata ovunque l’allowlist si applica. È nascosto dal selezionatore /model, e /model <name> lo rifiuta. Se nomini un ID modello bloccato con --model, ANTHROPIC_MODEL, o l’impostazione model, Claude Code lo elimina all’avvio e risolve l’opzione Predefinito invece. Se un hook o una richiesta in background nomina un modello che deniedModels blocca, come il campo model di un hook di agent, quella richiesta viene eseguita sul modello della sessione invece.
L’opzione Predefinito segue entrambe le chiavi anche, indipendentemente dal fatto che tu imposti enforceAvailableModels. Se lo imposti con un availableModels non vuoto, un valore predefinito bloccato conta come un modello al di fuori dell’allowlist. Altrimenti, un’opzione Predefinito che si risolverebbe in un modello bloccato scende in questo ordine:
- La versione più recente consentita della stessa famiglia
- Il modello più recente consentito di ogni famiglia di costo inferiore a turno: Sonnet, poi Haiku
- La prima voce
availableModelsche nomina un modello consentito
"exact" influisce sull’opzione Predefinito solo quando l’elenco availableModels gestito nomina almeno un modello o una famiglia.
Claude Code legge entrambe le chiavi solo dalle impostazioni gestite. Se imposti una di esse nelle impostazioni utente, progetto o locale o con --settings, Claude Code la ignora con un avviso.
Restrizioni del modello dell’organizzazione
Gli amministratori dell’organizzazione sui piani Claude Enterprise limitano quali modelli i membri possono eseguire disabilitando i singoli modelli nella console di amministrazione claude.ai. Questa restrizione viene consegnata con i diritti dell’account quando Claude Code si autentica, separata da qualsiasi elencoavailableModels nelle impostazioni, e il server applica la stessa restrizione indipendentemente quando una sessione viene creata. Richiede Claude Code v2.1.187 o successivo.
La restrizione si applica quando un membro accede o utilizza la propria chiave API. Le credenziali con ambito organizzativo, come le chiavi di servizio dell’organizzazione, non sono legate a un utente, quindi la restrizione non si applica a loro.
La Claude Console non ha controllo di restrizione del modello. Le organizzazioni senza un piano Claude Enterprise, incluse quelle i cui membri si autenticano tramite l’API Anthropic, limitano i modelli con availableModels nelle impostazioni gestite, aggiungendo enforceAvailableModels per coprire l’opzione Predefinito. Copertura della superficie indica come ogni superficie riceve e applica queste impostazioni.
Un modello limitato è nascosto dal selezionatore /model. Selezionarlo per nome con --model, la variabile di ambiente ANTHROPIC_MODEL, o l’impostazione model mostra l’avviso Model "<name>" is restricted by your organization's settings. Using <model> instead. e la sessione inizia su un modello consentito. Digitare /model <name> per un modello limitato viene rifiutato con Model '<name>' is restricted by your organization's settings. Run /model to choose a different model. e la sessione mantiene il suo modello attuale.
Un alias di famiglia di modelli come opus si risolve nel suo modello usuale quando l’organizzazione lo consente. Quando l’organizzazione limita quel modello, Claude Code sostituisce la versione più recente della famiglia che l’organizzazione consente, con lo stesso avviso di sostituzione. /model <alias> viene rifiutato solo quando ogni versione della sua famiglia è limitata; un alias impostato con --model, ANTHROPIC_MODEL, o l’impostazione model viene comunque sostituito all’avvio in quel caso. Prima della versione 2.1.205, un alias di famiglia veniva sostituito o rifiutato in base alla sua versione più recente rilasciata da sola, anche quando una versione precedente era consentita.
Le restrizioni si applicano a livello di organizzazione o per ruolo:
- Disabilitare un modello a livello di organizzazione lo rimuove per ogni membro.
- L’accesso a livello di ruolo concede modelli diversi a diversi ruoli personalizzati, e un membro che detiene diversi ruoli può utilizzare qualsiasi modello che uno dei suoi ruoli concede.
- I modelli Haiku sono sempre disponibili e non possono essere disabilitati, quindi ogni membro mantiene almeno un modello utilizzabile.
- Un cambio di accesso ha effetto su nuove richieste entro circa un minuto; il selezionatore
/modello riflette la prossima volta che una sessione inizia.
availableModels e non limitato dall’organizzazione. Le restrizioni dell’organizzazione raggiungono le sessioni sull’API Anthropic e sui distribuzioni LLM gateway solo; su qualsiasi altro provider, utilizza availableModels invece.
Modello predefinito dell’organizzazione
Gli amministratori dell’organizzazione nei piani Claude Enterprise possono impostare un modello predefinito per i membri di Claude Code dall’admin console di claude.ai, per l’intera organizzazione o per ruolo personalizzato. Quando ne viene impostato uno, l’opzione Predefinito si risolve in quel modello. Richiede Claude Code v2.1.196 o versione successiva. La riga Predefinito nel selettore/model mostra il nome del modello predefinito dell’organizzazione con l’etichetta Org default. L’etichetta recita Org default indipendentemente dal fatto che l’amministratore abbia impostato il modello predefinito per l’intera organizzazione o per il vostro ruolo. Un modello predefinito del ruolo copre i membri di quel ruolo personalizzato e ha la precedenza sul modello predefinito a livello di organizzazione; quando diversi vostri ruoli impostano modelli predefiniti diversi, si applica il modello più capace.
Il modello predefinito dell’organizzazione è un punto di partenza, non una restrizione. Queste selezioni hanno la precedenza su di esso:
- il flag
--modele la variabile di ambienteANTHROPIC_MODEL - un valore
modelnelle impostazioni gestite o fornito tramite--settings - un valore
modelnelle vostre impostazioni utente, progetto o locali, incluso un modello che salvate con/model
model nelle impostazioni utente, progetto e locali, quindi un modello che salvate con /model si applica per la sessione corrente e il modello predefinito dell’organizzazione ritorna al prossimo avvio. Quando la vostra selezione differisce, /model mostra Your organization's default (<model>) applies on restart. Il flag --model, ANTHROPIC_MODEL, le impostazioni gestite e --settings hanno ancora la precedenza anche con l’override attivato. L’override è disponibile per un set limitato di organizzazioni; chiedete al vostro team di account Anthropic sulla disponibilità.
Per limitare quali modelli i membri possono selezionare, utilizzate restrizioni del modello dell’organizzazione o availableModels invece.
Claude Code legge il modello predefinito dell’organizzazione una sola volta all’avvio, quindi un modello predefinito che l’amministratore cambia durante la sessione ha effetto al prossimo avvio.
Quando il modello predefinito dell’organizzazione non ignora la selezione dell’utente, il primo avvio interattivo dopo che l’amministratore lo cambia cancella la chiave model dalle vostre impostazioni utente una sola volta, in modo che il nuovo modello predefinito si applichi. Non cambia nient’altro nel file, e un modello che salvate con /model dopo quel lancio viene mantenuto.
Il modello predefinito dell’organizzazione passa attraverso questi controlli di restrizione prima di essere adottato:
- Con la corrispondenza del prefisso predefinito,
availableModelsda solo non si applica al modello predefinito dell’organizzazione, quindi un modello predefinito dell’organizzazione al di fuori della lista di autorizzazione si applica comunque. QuandoenforceAvailableModelsè anche impostato, un modello predefinito dell’organizzazione al di fuori della lista di autorizzazione viene rimappato alla prima voce della lista di autorizzazione come pure - un modello predefinito dell’organizzazione che restrizioni del modello dell’organizzazione negano per il vostro account viene sostituito dal modello più recente consentito nella sua famiglia, o da una famiglia a costo inferiore quando ogni versione di essa è limitata
- per un modello predefinito dell’organizzazione che
deniedModelso un elenco"exact"blocca, vedere Bloccare modelli o versioni specifiche - un modello predefinito dell’organizzazione che non è disponibile per il vostro account affatto viene saltato, e l’opzione Predefinito si risolve come farebbe senza un modello predefinito dell’organizzazione
/model mantiene una riga separata per quella famiglia usuale, in modo che possiate comunque passare ad essa per una sessione. Dalla v2.1.196 alla v2.1.198 quella riga manca dal selettore.
Il modello predefinito dell’organizzazione raggiunge solo le sessioni autenticate con l’API Anthropic. Per impostare un modello predefinito in qualsiasi altro luogo, incluse le distribuzioni LLM gateway, utilizzate la chiave model nelle impostazioni gestite invece.
Limiti di sforzo dell’organizzazione
La vostra organizzazione può limitare il livello di sforzo in due modi. Su un piano Claude Enterprise, gli amministratori dell’organizzazione impostano limiti di sforzo per ruolo, descritti di seguito. Su qualsiasi piano e qualsiasi provider, inclusi Amazon Bedrock, Google Cloud’s Agent Platform e Microsoft Foundry, l’impostazione gestitamaxEffortLevel limita lo sforzo sul client. Quando entrambi si applicano a un modello, si applica il limite inferiore.
Gli amministratori dell’organizzazione nei piani Claude Enterprise possono impostare un livello di sforzo massimo per modello per ogni ruolo personalizzato, insieme alle restrizioni del modello a livello di organizzazione. I livelli superiori al limite non vengono offerti nel selettore /effort, e denominare un livello superiore con --effort o /effort viene eseguito al limite. Nelle sessioni interattive e nelle esecuzioni in testo semplice --print, un avviso nomina i livelli richiesti e applicati; con output json o stream-json o negli agenti in background, il limite si applica silenziosamente. I limiti sono per modello, quindi il cambio di modelli può modificare quali livelli sono disponibili. Quando diversi vostri ruoli concedono lo stesso modello, si applica il limite meno restrittivo. Richiede Claude Code v2.1.195 o successivo.
I limiti di sforzo vengono forniti insieme alle restrizioni del modello dell’organizzazione e raggiungono le stesse sessioni.
Comportamento speciale del modello
Impostazione del modello default
Il comportamento di default dipende dal tipo di account:
- Pro, Max, Team, Enterprise e Anthropic API: predefinito su Opus 5.5
- Claude Platform su AWS, Amazon Bedrock e Google Cloud’s Agent Platform: predefinito su Opus 5.5
- Microsoft Foundry: predefinito su Sonnet 4.5
default si risolveva in Sonnet 5 su Pro e Team Standard, e in Opus 5 su Max, Team Premium, Enterprise, Anthropic API, Claude Platform su AWS, Amazon Bedrock e Google Cloud’s Agent Platform da v2.1.219. Prima della v2.1.219, default si risolveva in Opus 4.8 su Anthropic API, Max, Team Premium e Enterprise con pagamento a consumo da v2.1.154, e su Claude Platform su AWS, Amazon Bedrock e Google Cloud’s Agent Platform da v2.1.207. Prima della v2.1.207, default si risolveva in Opus 4.7 su Claude Platform su AWS e in Sonnet 4.5 su Amazon Bedrock e Google Cloud’s Agent Platform.
Quando un amministratore ha impostato un modello predefinito dell’organizzazione, default si risolve in quel modello invece del valore predefinito del tipo di account sopra indicato. Richiede Claude Code v2.1.196 o successiva. default può anche risolversi nel modello impostato con ANTHROPIC_DEFAULT_MODEL, secondo le condizioni elencate nella relativa sezione, o nel modello registrato sul tuo account.
Quando nulla è registrato sul tuo account, le impostazioni gestite applicano l’elenco consentito per il modello predefinito, e il valore predefinito del tipo di account non è in availableModels, default si risolve nel valore predefinito applicato invece del valore predefinito del tipo di account sopra indicato. Quando entrambi si applicano, il valore predefinito dell’organizzazione sostituisce prima il valore predefinito del tipo di account e l’applicazione si applica quindi ad esso: un valore predefinito dell’organizzazione nell’elenco consentito viene mantenuto, mentre uno al di fuori dell’elenco si risolve nel valore predefinito applicato.
I modelli Fable non sono il valore predefinito del tipo di account su nessun piano o provider. Sceglierne uno con /model lo salva come modello selezionato nelle impostazioni utente, in modo che le sessioni successive inizino su di esso. Per il cambio una tantum che Claude Code apporta a una selezione Fable 5 salvata nella v2.1.257, vedere Lavorare con Fable.
Impostazione del modello opusplan
L’alias del modello opusplan fornisce un approccio ibrido automatizzato:
- In Plan Mode: utilizza
opusper il ragionamento complesso e le decisioni architettoniche - In modalità esecuzione: passa automaticamente a
sonnetper la generazione del codice e l’implementazione
opus, e la fase di esecuzione utilizza la stessa finestra di sonnet. Quando opus e sonnet si risolvono in modelli che vengono eseguiti con la finestra di contesto 1M per impostazione predefinita, come i modelli attuali su Anthropic API, entrambe le fasi vengono eseguite con essa. Per richiedere il contesto 1M per entrambe le fasi dove non lo fanno, imposta il modello su opusplan[1m], ad esempio con /model opusplan[1m]. Impostarlo con /model richiede Claude Code v2.1.265 o successiva; nelle versioni precedenti, usa il flag --model o l’impostazione model.
Quando availableModels esclude l’Opus più recente ma consente una versione precedente, ad esempio ["sonnet", "claude-opus-4-6"], opusplan utilizza l’Opus più recente consentito per la pianificazione e rimane su Sonnet solo quando ogni Opus è escluso. Una sessione Haiku che normalmente si aggiornerebbe a Sonnet in Plan Mode utilizza allo stesso modo il Sonnet più recente consentito e rimane su Haiku solo quando ogni Sonnet è escluso. Prima della v2.1.205, Plan Mode rimase sul modello della sessione ogni volta che la versione più recente della famiglia di aggiornamento era esclusa, anche quando l’elenco consentito ne consentiva una precedente.
La sostituzione di una versione precedente consentita si applica su Anthropic API e Claude Platform su AWS. Su Amazon Bedrock, Google Cloud’s Agent Platform, Microsoft Foundry e Mantle, i cui deployment utilizzano ID modello specifici del provider, Plan Mode rimane sul modello della sessione ogni volta che il modello di aggiornamento è escluso.
Per un approccio ibrido in cui Claude decide a metà attività quando consultare un secondo modello piuttosto che passare al confine del piano, vedere lo strumento advisor.
Catene di modelli di fallback
Quando il modello primario è sovraccarico, non disponibile o restituisce un altro errore del server non ripetibile, Claude Code può passare a un modello di fallback invece di non riuscire nella richiesta. Gli errori di autenticazione, fatturazione, limite di velocità, dimensione della richiesta e trasporto, e un rifiuto dalla verifica della politica della tua organizzazione, non attivano mai un passaggio; questi seguono il loro normale retry e gestione degli errori. Configura uno o più modelli di fallback e Claude Code li prova in ordine, mostrando un avviso quando passa. Il passaggio dura solo per il turno corrente, quindi il tuo prossimo messaggio prova prima il modello primario di nuovo. Claude Code limita le catene a tre modelli dopo la rimozione dei duplicati e ignora le voci extra. Imposta una catena per una sessione con il flag--fallback-model, che accetta un elenco separato da virgole:
fallbackModel in settings come array:
--fallback-model ha la precedenza sull’impostazione fallbackModel. Ogni voce accetta un nome di modello o un alias, e "default" si espande al modello predefinito.
Claude Code non conferma la catena all’avvio e /status non la visualizza. L’avviso mostrato quando si verifica un passaggio è il primo segno visibile che un fallback è configurato.
Quando una richiesta fallisce, Claude Code prova ogni voce in ordine finché una non l’accetta. Una voce che non può essere raggiunta nemmeno, come un modello ritirato bloccato nelle impostazioni, fallisce alla successiva nello stesso modo. Claude Code rimuove due tipi di voce prima di quel percorso:
- Al di fuori dell’elenco consentito: Claude Code elimina qualsiasi voce non consentita da
availableModelsquando legge la catena. - Finestra di contesto più piccola durante la compattazione: la catena copre anche la compattazione, ma Claude Code non farà fallback a un modello con una finestra di contesto più piccola di quella del primario, poiché il riassunto lì taglierebbe prima parte della conversazione. Se ogni fallback è più piccolo, la compattazione mostra l’errore originale e puoi riprovare.
Fallback automatico del modello
Questa sezione copre il fallback basato sul contenuto dai modelli Fable, Opus 5.5, Sonnet 5.5 e Opus 5. Per il fallback basato sulla disponibilità quando un modello è sovraccarico o non disponibile, vedere Catene di modelli di fallback. I modelli Fable, Opus 5.5, Sonnet 5.5 e Opus 5 vengono eseguiti con classificatori di sicurezza, che il più delle volte contrassegnano il contenuto di sicurezza informatica e biologia. Quando un classificatore contrassegna una richiesta e la categoria contrassegnata ha un modello di fallback, Claude Code riesegue la richiesta su quel modello e mostra un avviso nella trascrizione. Per queste due categorie, il modello di fallback dipende da quale modello ha rifiutato:- Fable 5.1, Fable 5 e Opus 5.5: le richieste contrassegnate per biologia vengono rieseguite su Opus 5, e le richieste contrassegnate per sicurezza informatica vengono rieseguite su Opus 4.8.
- Sonnet 5.5: le richieste contrassegnate per sicurezza informatica vengono rieseguite su Sonnet 5. Le richieste contrassegnate per biologia terminano con un rifiuto, perché Sonnet 5.5 non ha un modello di fallback biologico.
- Opus 5: le richieste contrassegnate per sicurezza informatica vengono rieseguite su Opus 4.8. Le richieste contrassegnate per biologia terminano con un rifiuto, perché Opus 5 esegue i propri classificatori di biologia senza modello di fallback.
/model.
Il fallback basato sulla categoria richiede Claude Code v2.1.219 o successiva. Prima della v2.1.219, ogni richiesta Fable 5 contrassegnata veniva rieseguita sul modello Opus predefinito del tuo provider, e Opus 5 non era una fonte di fallback.
Il modello di fallback viene controllato rispetto a availableModels. Quando è bloccato, non si verifica alcun fallback. Il rifiuto viene mostrato come un errore normale e il modello della sessione rimane invariato.
Verificare cosa ha attivato il fallback
Il fallback può attivarsi alla prima richiesta di una sessione, prima di inviare qualcosa di insolito, perché la prima richiesta contiene il contesto dell’area di lavoro come il contenuto di CLAUDE.md e lo stato di git. Un repository che contiene materiale di sicurezza o biologia può attivare il classificatore solo su quel contesto. Per verificare se le personalizzazioni sono il trigger, avvia una sessione conclaude --safe-mode, che disabilita le personalizzazioni come CLAUDE.md, skills, server MCP e hooks. Lo stato di git e i nomi delle directory non sono personalizzazioni e sono ancora inclusi.
Chiedere prima di passare
Per decidere cosa accade ogni volta che una richiesta viene contrassegnata, piuttosto che passare automaticamente, esegui/config e disattiva Cambia modelli quando un messaggio viene contrassegnato, oppure imposta switchModelsOnFlag su false nel tuo file di impostazioni. Una richiesta contrassegnata mette quindi in pausa la sessione con due opzioni: passare al modello di fallback o modificare il prompt e riprovare sul modello corrente.
Alcuni casi si comportano diversamente:
- Quando la categoria contrassegnata non ha un modello di fallback, come un flag di biologia su Opus 5 o Sonnet 5.5, Claude Code non mostra il prompt e la richiesta termina con il rifiuto.
- Se entrambi i modelli contrassegnano la stessa richiesta, puoi modificare il prompt e riprovare, o avviare una nuova sessione.
- Su sessioni mobili Claude Code sul web, la modifica e il retry non sono supportati. Cambia modelli o continua la sessione da un browser desktop o dall’app desktop.
- In modalità non interattiva e integrazioni SDK che non possono mostrare il prompt, una richiesta contrassegnata termina il turno con un rifiuto.
- Quando il target di fallback è bloccato da
availableModels, Claude Code non mostra il prompt. La richiesta contrassegnata termina con il rifiuto, come il fallback automatico quando il target è bloccato.
Abilitare il fallback su Bedrock, Agent Platform e Foundry
Su Amazon Bedrock, Google Cloud’s Agent Platform e Microsoft Foundry, gli ID modello sono specifici del provider, quindi il fallback automatico funziona solo quando Claude Code può identificare entrambi i modelli coinvolti:- Claude Code deve riconoscere il modello corrente come fonte di fallback. Fable 5.1 e Fable 5 vengono riconosciuti quando l’ID modello contiene
claude-fable-5, corrisponde al valore diANTHROPIC_DEFAULT_FABLE_MODELo è mappato conmodelOverrides. Opus 5.5, Sonnet 5.5 e Opus 5 vengono riconosciuti dal loro ID modello del provider o da un mappingmodelOverrides. - Un target Opus deve risolversi nel tuo deployment, indipendentemente da quale modello ha rifiutato: imposta
ANTHROPIC_DEFAULT_OPUS_MODEL, o mantieni una voce Opus 4.8 nell’elenco dei modelli del provider. Senza uno, il fallback rimane disattivato per ogni modello sorgente, incluso Sonnet 5.5, e le richieste contrassegnate terminano con un rifiuto. - Il modello di fallback della categoria contrassegnata deve risolversi nel tuo deployment. Da un modello Fable, Opus 5.5 o Opus 5, se imposti
ANTHROPIC_DEFAULT_OPUS_MODEL, le richieste contrassegnate vengono rieseguite su quel modello per ogni categoria che ha un fallback; un flag di biologia su Opus 5 termina comunque con un rifiuto. Se non lo imposti, le richieste contrassegnate per sicurezza informatica vengono rieseguite sulla voce Opus 4.8, e le richieste contrassegnate per biologia da un modello Fable o Opus 5.5 su una voce Opus 5. Da Sonnet 5.5, le richieste contrassegnate per sicurezza informatica vengono rieseguite sul modello che imposti inANTHROPIC_DEFAULT_SONNET_MODEL, o su una voce Sonnet 5 nell’elenco dei modelli del provider se non lo imposti.
/model e riprovare. Per rendere entrambi i modelli identificabili, imposta i pin per il tuo modello sorgente:
- Modelli Fable: imposta
ANTHROPIC_DEFAULT_FABLE_MODELsul tuo ID modello Fable in modo che Claude Code lo riconosca come fonte di fallback. - Ogni modello sorgente: imposta
ANTHROPIC_DEFAULT_OPUS_MODELsu un ID modello Opus per attivare il fallback e fornire alle categorie contrassegnate un target. Un pin che nomina un modello al di fuori della famiglia Opus, o il modello che ha rifiutato, lascia il rifiuto in piedi. - Sonnet 5.5: oltre al pin Opus, imposta
ANTHROPIC_DEFAULT_SONNET_MODELo mantieni una voce Sonnet 5 nell’elenco dei modelli del provider per fornire il modello su cui la richiesta viene rieseguita. Un pin Sonnet che nomina un modello al di fuori della famiglia Sonnet, o Sonnet 5.5 stesso, lascia il rifiuto in piedi.
Ricerca sulla sicurezza e carichi di lavoro biologici
I carichi di lavoro in sicurezza offensiva o biologia, inclusi test di penetrazione, esercizi Capture the Flag (CTF) e basi di codice adiacenti alla biologia, attivano il fallback frequentemente, spesso alla prima richiesta. Per un lavoro biologico sostanziale su Fable 5.1, Fable 5 o Opus 5.5, Claude Code sposta la sessione a Opus 5 alla prima richiesta contrassegnata, e le successive richieste contrassegnate per biologia terminano in rifiuti lì, perché Opus 5 non ha fallback biologico. Su Opus 5 e Sonnet 5.5, ricevi quei rifiuti dalla prima richiesta contrassegnata. Questo è il routing previsto per questi domini, non un flag dell’account. Se la tua organizzazione ha bisogno di capacità di classe Fable per questo lavoro, chiedi al tuo team di account Anthropic informazioni sui programmi di accesso affidabile.Regola il livello di sforzo
I livelli di sforzo controllano il ragionamento adattivo, che consente al modello di decidere se e quanto pensare ad ogni passo in base alla complessità dell’attività. Lo sforzo inferiore è più veloce e più economico per attività semplici e circoscritte, mentre lo sforzo superiore fornisce un ragionamento più profondo per problemi complessi. I livelli di sforzo disponibili dipendono dal modello. I modelli non elencati qui non supportano lo sforzo:
Se imposti un livello che il modello attivo non supporta, Claude Code fallback al livello supportato più alto pari o inferiore a quello impostato. Ad esempio,
xhigh viene eseguito come high su Opus 4.6. La tua organizzazione o le tue stesse impostazioni possono anche limitare i livelli che un modello offre; vedere Limiti di sforzo dell’organizzazione.
Claude Code risolve il livello di sforzo della sessione in questo ordine, prendendo il primo che si applica:
- Una scelta esplicita: la variabile di ambiente
CLAUDE_CODE_EFFORT_LEVEL, l’avvio con--effort, o/effortnella sessione (un/effortnon interattivo ha effetto più ristretto) - Le tue impostazioni: il livello che hai salvato per il modello o una chiave
effortLevel, con la precedenza tra loro e tra i file di impostazioni indicata inmodelSettings - Lo sforzo predefinito del modello:
highsu ogni modello che supporta lo sforzo, tranne che Opus 5.5 e Sonnet 5.5 predefinito amedium, Opus 4.7 predefinito axhighe, quando la tua organizzazione imposta un livello di sforzo predefinito per il suo modello predefinito dell’organizzazione, quel livello è il predefinito quando esegui quel modello
medium a meno che una delle fonti sopra non imposti un livello per esso, e un effortLevel di livello superiore nel tuo file di impostazioni utente non conta per Opus 5.5. Quella chiave è la forma più vecchia che /effort ha scritto prima che Claude Code salvasse i livelli per modello: continua ad applicarsi dove si applicava prima, su Opus 5, Fable 5.1 e modelli precedenti, mentre Opus 5.5 e i modelli rilasciati dopo di esso iniziano al loro predefinito fino a quando non scegli un livello per loro con /effort o il selettore /model. Un effortLevel di livello superiore nelle impostazioni di progetto, locale o gestite, o uno passato con --settings, si applica a ogni modello.
Quando imposti low, medium, high o xhigh in una sessione interattiva sulla tua macchina, scegli quanto dura selezionando come lo confermi:
Enternel cursore/efforto nel selettore/model, o un livello digitato dopo/effort: salva il livello come predefinito e applicalo nelle sessioni successivesnel cursore/efforto nel selettore/model: applica il livello solo a questa sessione. Richiede Claude Code v2.1.257 o successiva
modelSettings nelle tue impostazioni utente, quindi ogni modello mantiene il suo livello salvato.
max è il livello di ragionamento più profondo. A meno che non lo imposti tramite la variabile di ambiente CLAUDE_CODE_EFFORT_LEVEL, Claude Code applica max solo alla sessione corrente.
Un livello che scegli dal controllo dello sforzo su un telefono o browser connesso tramite Remote Control si applica solo a quella sessione.
/effort in un’esecuzione -p, Claude Code lo applica solo a quella sessione e non lo salva come predefinito.
Il cursore /effort ha anche un’opzione Ultracode. Ultracode è un’impostazione di Claude Code piuttosto che un livello di sforzo del modello: con essa attivata, Claude orchestra flussi di lavoro dinamici per attività sostanziali, a qualsiasi livello di sforzo la sessione viene eseguita. Per dove può essere impostato in modo persistente, vedere l’impostazione ultracode.
Attivare o disattivare ultracode con /effort o l’impostazione ultracode lascia il livello di sforzo invariato. Il flag --effort ultracode e il valore Agent SDK effortLevel: "ultracode" lo attivano e impostano anche il livello a xhigh. Scegliere un livello nel cursore /effort o nel selettore /model lascia ultracode come era.
Puoi attivare ultracode attraverso uno dei seguenti:
/effort: esegui/effort ultracodeper attivarlo per la sessione corrente o/effort ultracode offper disattivarlo. Nel cursore/effort, premiTabper capovolgere l’opzione Ultracode, quindiEnterper applicarla- Flag
--effort: avvia conclaude --effort ultracode, che avvia la sessione a sforzoxhighcon ultracode attivato - Impostazione
ultracode: imposta"ultracode": truein un file di impostazioni, con--settings, o in una richiesta di controllo Agent SDK. Una richiestaapplyFlagSettings()accetta ancheeffortLevel: "ultracode", che lo attiva e imposta il livello di sforzo axhigh
/effort ultracode off, il cursore toggle e mantenere ultracode attivato a livelli di sforzo diversi da xhigh richiedono Claude Code v2.1.284 o successiva. Prima della v2.1.284, attivare ultracode impostava la sessione a sforzo xhigh, scegliere un altro livello lo disattivava, e un limite di sforzo inferiore a xhigh lo rendeva non disponibile.
Passare ultracode al flag --effort o al valore Agent SDK effortLevel richiede Claude Code v2.1.203 o successiva. Prima della v2.1.203, --effort ultracode stampava Unknown --effort value 'ultracode' e la sessione iniziava allo sforzo predefinito.
L’impostazione effortLevel persistente e la variabile di ambiente CLAUDE_CODE_EFFORT_LEVEL non accettano ultracode. Se CLAUDE_CODE_EFFORT_LEVEL o un limite di sforzo imposta il livello della sessione, ultracode rimane attivato a quel livello.
Ultracode non è disponibile quando:
- I flussi di lavoro sono disattivati
- Il modello non supporta lo sforzo
xhigh
--effort ultracode avvia la sessione con ultracode disattivato, al livello di sforzo più alto che il modello e qualsiasi limite consentono, fino a xhigh.
Scegli un livello di sforzo
Ogni livello scambia la spesa di token rispetto alla capacità. Il predefinito si adatta alla maggior parte dei compiti di codifica; regola quando desideri un equilibrio diverso.
Nei test su Opus 5.5 e Fable 5.1, Claude a un livello superiore ha testato più casi limite e ha verificato più del suo lavoro prima di rispondere. Ha anche fatto più scelte da solo. A un livello inferiore, Claude ha restituito un punto di partenza più velocemente, che si adatta al lavoro dove rivedi ogni risultato e guidi il passo successivo. Per vedere gli stessi compiti eseguiti a ogni livello, leggi Using Claude Code: Spending your effort sul blog.
La scala dello sforzo è calibrata per modello, quindi lo stesso nome di livello non rappresenta lo stesso valore sottostante tra i modelli.
Opus 5.5 predefinito a
medium, un livello sotto il predefinito di Opus 5 di high. Nei test di Anthropic, Opus 5.5 a medium corrisponde o supera Opus 5 a high su valutazioni di codifica e lavoro di conoscenza. A un dato livello, Opus 5.5 tende a pensare più per turno rispetto a Opus 5. Quando passi da Opus 5 a Opus 5.5, inizia a medium piuttosto che portare il livello che hai usato su Opus 5. Per testare i livelli rispetto al tuo lavoro, vedere Calibra lo sforzo nella guida al prompting di Opus 5.5.
Usa ultrathink per il ragionamento profondo una tantum
Includiultrathink in qualsiasi punto del tuo prompt per richiedere un ragionamento più profondo su quel turno senza modificare l’impostazione dello sforzo della sessione. Claude Code riconosce la parola chiave e aggiunge un’istruzione nel contesto. Il livello di sforzo inviato all’API rimane invariato. Claude Code passa altre frasi come “think”, “think hard” e “think more” come testo di prompt ordinario e non le riconosce come parole chiave.
Imposta il livello di sforzo
Puoi modificare lo sforzo attraverso uno dei seguenti:/effort: esegui/effortsenza argomenti per aprire un cursore interattivo,/effortseguito da un nome di livello per impostarlo direttamente, o/effort autoper cancellare il tuo livello salvato per il modello attivo. Puoi eseguirlo mentre Claude sta lavorando, e una volta confermato l’avviso della cache, se Claude Code ne mostra uno, Claude Code applica il nuovo livello alla richiesta successiva nel turno- In
/model: usa i tasti freccia sinistra/destra per regolare il cursore dello sforzo quando selezioni un modello - Flag
--effort: passa un nome di livello per impostarlo per una singola sessione quando avvii Claude Code - Variabile di ambiente: imposta
CLAUDE_CODE_EFFORT_LEVELsu un nome di livello oauto - Impostazioni: imposta un livello per modello in
modelSettings, o impostaeffortLevelsulow,medium,highoxhighcome predefinito per i modelli senza uno.maxnon è accettato in nessuna delle due chiavi, eultracodeha la sua propria chiaveultracode - Da un dispositivo connesso: in una sessione Remote Control, scegli un livello dal controllo dello sforzo sul tuo telefono o nel tuo browser. Il livello si applica solo alla sessione corrente. Richiede Claude Code v2.1.234 o successiva
- Frontmatter di skill e subagente: imposta
effortin un file markdown skill o subagente per sostituire il livello di sforzo quando quella skill o subagente viene eseguito
maxEffortLevel o limite di sforzo dell’organizzazione limita comunque il livello a cui la skill o il subagente viene eseguito.
Se imposti effortLevel nelle impostazioni gestite, Claude Code lo applica al passo delle impostazioni dell’ordine di risoluzione dello sforzo, e gli utenti possono comunque modificare il livello con /effort o --effort. Per mantenere gli utenti a o sotto un livello, imposta maxEffortLevel.
Il cursore dello sforzo appare in /model quando è selezionato un modello supportato. Il livello di sforzo corrente è anche mostrato nell’intestazione della sessione accanto al nome del modello, ad esempio “con sforzo basso”, in modo che tu possa confermare quale impostazione è attiva senza aprire /model. Il piè di pagina mostra anche brevemente il livello di sforzo all’avvio e quando cambia.
Ragionamento adattivo e budget di pensiero fissi
Il ragionamento adattivo rende il pensiero opzionale ad ogni passo, quindi Claude può rispondere più velocemente ai prompt di routine e riservare il pensiero più profondo ai passi che ne traggono beneficio. Se desideri che Claude pensi più o meno spesso di quanto il livello corrente produce, puoi dirlo direttamente nel tuo prompt o inCLAUDE.md; il modello risponde a quella guida entro la sua impostazione di sforzo.
I modelli Fable, Sonnet 5 e successivi, e Opus 4.7 e successivi utilizzano sempre il ragionamento adattivo. La modalità di budget di pensiero fisso e CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING non si applicano a loro.
Su Opus 4.6 e Sonnet 4.6, puoi impostare CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1 per tornare al precedente budget di pensiero fisso controllato da MAX_THINKING_TOKENS. Vedere variabili di ambiente.
Extended thinking
Extended thinking è il ragionamento che Claude emette prima di rispondere. Sui modelli che supportano il ragionamento adattivo, il livello di sforzo è il controllo primario per quanto pensiero accade; le impostazioni di seguito attivano o disattivano il pensiero e controllano come viene visualizzato. Con il pensiero disattivato su Anthropic API, Claude Code invia sforzohigh invece di un livello superiore ai modelli che sa non accettano quella combinazione, come Opus 5.
Non puoi disattivare il pensiero sui modelli Opus 5.5, Sonnet 5.5 o Fable. L’attivazione/disattivazione della sessione,
alwaysThinkingEnabled e MAX_THINKING_TOKENS=0 non hanno effetto lì, e il modello decide per passo quanto pensare in base al livello di sforzo.
Claude Code comprime l’output di pensiero per impostazione predefinita. Premi Ctrl+O per attivare/disattivare la modalità dettagliata e vedi il ragionamento come testo grigio in corsivo. Le sessioni interattive su Anthropic API ricevono blocchi di pensiero redatti per impostazione predefinita, quindi imposta showThinkingSummaries: true nelle impostazioni se desideri i riassunti completi disponibili quando espandi. Ti viene addebitato per tutti i token di pensiero generati, anche quando compressi o redatti.
Extended context
Fable 5.1, Fable 5, Sonnet 5 e successivi, Opus 4.6 e successivi, e Sonnet 4.6 supportano una finestra di contesto di 1 milione di token per sessioni lunghe con basi di codice di grandi dimensioni. Su Anthropic API, Fable 5.1, Fable 5, Sonnet 5 e successivi, e Opus 4.7 e successivi vengono eseguiti con la finestra 1M su ogni piano, incluso Pro. Non selezioni una variante[1m] o attivi crediti di utilizzo per la finestra 1M su questi modelli. L’utilizzo di Fable stesso può fatturare ai crediti di utilizzo su alcuni piani; vedere Fable e crediti di utilizzo.
Opus 4.6 e Sonnet 4.6 raggiungono 1M solo attraverso la loro variante [1m], e l’accesso a quella variante dipende dal tuo piano. Su piani Max, Team ed Enterprise, inclusi sia i posti Team Standard che Team Premium, Opus 4.6 con contesto 1M è incluso nel tuo abbonamento. Sonnet 4.6 con contesto 1M richiede crediti di utilizzo su ogni piano di abbonamento, incluso Max.
Claude Code controlla questi requisiti del piano solo quando si connette direttamente a Anthropic API. Se punti
ANTHROPIC_BASE_URL a un gateway LLM e il tuo accesso salvato a claude.ai rimane la credenziale attiva, Claude Code non controlla i crediti di utilizzo del tuo piano. Le opzioni [1m] rimangono disponibili in /model, e il gateway decide se la richiesta ha successo. Prima della v2.1.229, Claude Code rifiutava /model sonnet[1m] in quella configurazione quando non poteva confermare i crediti di utilizzo sull’account.
Per disattivare il contesto 1M, imposta CLAUDE_CODE_DISABLE_1M_CONTEXT=1. Claude Code rimuove le varianti di modello 1M dal selettore di modelli. Su modelli con una finestra 1M nativa, come Sonnet 5 e i modelli Fable, tratta anche il modello come avente una finestra di contesto di 200K:
- Con la compattazione automatica attivata, le sessioni si compattano al confine 200K attraverso la compattazione automatica. Impostare la finestra di compattazione automatica sopra 200K non solleva il mantenimento, perché Claude Code limita quella finestra alla finestra di contesto del modello.
- Con la compattazione automatica disattivata, le sessioni si fermano al confine 200K con l’errore di limite di contesto invece di compattarsi.
/model nelle versioni più recenti di Claude Code. Se non la vedi, prova a riavviare la tua sessione.
Puoi anche usare il suffisso [1m] con alias di modello o nomi di modello completi:
Finestra di contesto di Sonnet 5.5 e Sonnet 5
Su Anthropic API, Sonnet 5.5 e Sonnet 5 vengono sempre eseguiti con la finestra di contesto 1M. Non c’è variante 200K, nessun suffisso[1m] da selezionare e nessun credito di utilizzo richiesto su nessun piano. Le sessioni si compattano automaticamente prima che la finestra si riempia, a circa 967K token per impostazione predefinita; imposta CLAUDE_CODE_AUTO_COMPACT_WINDOW per scegliere una soglia diversa.
Due configurazioni limitano la finestra a 200K:
- Gateway LLM: quando
ANTHROPIC_BASE_URLpunta a un gateway, Claude Code non può verificare il supporto 1M. Per usare la finestra completa, seleziona Sonnet 5.5 (1M context) nel selettore di modelli, che mappa asonnet[1m], o esegui/model claude-sonnet-5[1m]per Sonnet 5. CLAUDE_CODE_DISABLE_1M_CONTEXT=1: mantiene le sessioni su ogni modello con una finestra 1M nativa a una finestra 200K; vedere Extended context per come il mantenimento viene applicato. Utile per i deployment che devono limitare il contesto.
Finestra di contesto e auto-compattazione
La finestra auto-compact è il livello di riempimento della finestra di contesto prima che Claude Code compatti la conversazione. Per informazioni su cosa la compattazione mantiene e scarta per ogni meccanismo, vedere What survives compaction.Impostare la finestra auto-compact
È possibile impostare la finestra auto-compact in tre posizioni:- Per questa sessione e quelle successive: eseguire
/autocompactcon un valore, come/autocompact 500k. Claude Code lo salva nelle impostazioni utente comeautoCompactWindowe lo applica alla sessione corrente; se un ambito di impostazioni con priorità più alta, come le impostazioni gestite, imposta la chiave, il comando salva il valore ma la sessione mantiene la finestra di tale ambito, e il comando lo comunica. Eseguire/autocompact autoper tornare alla finestra ottimizzata per il modello. - Per un singolo avvio: passare
--autocompactall’avvio di Claude Code. Il flag sostituisce l’impostazione salvata per tale avvio senza modificarla, eclaude --autocompact autoesegue la sessione alla finestra ottimizzata anche se l’impostazione salvata ha un valore. A differenza di/autocompact, il flag non è prevenuto da un ambito di impostazioni con priorità più alta, come le impostazioni gestite. - In script e ambienti cloud: impostare
CLAUDE_CODE_AUTO_COMPACT_WINDOW. Mentre è impostato, ha precedenza sul comando, sul flag e sull’impostazione, e/autocompactsegnala l’override invece di modificare la finestra.
- Un conteggio di token semplice, come
200000 - Un suffisso
koM, come500ko1M - Un numero semplice da 100 a 1000, che significa migliaia, quindi
200imposta 200.000
Soglie auto-compact predefinite
Se non si imposta una finestra auto-compact, Claude Code compatta quando la conversazione raggiunge il limite di contesto del modello, tranne in queste sessioni:- Le sessioni cloud si compattano mentre la conversazione si avvicina al limite del modello
- Sonnet 4.6 e Opus 4.6 senza contesto esteso si compattano al limite di 200K, così come Opus 4.8 e versioni successive quando vengono eseguiti con una finestra di contesto di 200K, come su Amazon Bedrock, Google Cloud’s Agent Platform e Microsoft Foundry
- Quando si imposta
CLAUDE_CODE_DISABLE_1M_CONTEXT=1, i modelli con una finestra nativa di 1M, come Sonnet 5 e i modelli Fable, si compattano al limite di 200K - I modelli in esecuzione con una finestra nativa di 1M, come Sonnet 5, i modelli Fable e Opus 4.7 e versioni successive su Anthropic API, si compattano prima che la finestra si riempia, a circa 967K token per impostazione predefinita. Su Amazon Bedrock, Google Cloud’s Agent Platform e Microsoft Foundry, Pin models for third-party deployments indica quali modelli vengono eseguiti con quella finestra; per le configurazioni che assegnano a Sonnet 5.5 e Sonnet 5 200K, vedere Sonnet 5.5 and Sonnet 5 context window
- Le sessioni su un ID modello che Claude Code non riconosce, come un alias LLM gateway, si compattano alla finestra di contesto che Claude Code assume per l’ID; vedere Correct the window for a gateway or custom model ID
Correggere la finestra per un gateway o un ID modello personalizzato
Su un LLM gateway o un’altra distribuzione personalizzata, Claude Code può assumere una finestra di contesto per l’ID modello che differisce dalla finestra reale del modello, indipendentemente dal fatto che risolva l’ID a un modello Claude o meno. ImpostareCLAUDE_CODE_MAX_CONTEXT_TOKENS alla finestra che Claude Code dovrebbe assumere invece.
Il modo in cui la variabile si applica dipende dall’ID. Claude Code tratta un ID come un provider o un’ortografia personalizzata quando non inizia con claude-, in qualsiasi maiuscola/minuscola, o quando porta un suffisso che Claude Code rimuove durante la lettura dell’ID, come la data @YYYYMMDD utilizzata su Google Cloud’s Agent Platform. Prima della v2.1.259, Claude Code non contava un suffisso rimosso, quindi un ID claude- non riconosciuto con un suffisso di data era trattato come un nome claude- semplice.
Un provider non riconosciuto o un’ortografia personalizzata, la stessa ortografia con [1m] e ogni altro ID sono tre casi separati:
-
Se Claude Code non può risolvere un provider o un’ortografia personalizzata a un modello che riconosce e l’ID non contiene
[1m], la variabile si applica direttamente e la compattazione proattiva continua alla finestra dichiarata. -
Se Claude Code non può risolvere un provider o un’ortografia personalizzata a un modello che riconosce e l’ID contiene
[1m], in qualsiasi maiuscola/minuscola, Claude Code assume una finestra di 1M per esso e la variabile non si applica da sola. Per correggere la finestra mantenendo la compattazione proattiva, impostare ancheCLAUDE_CODE_DISABLE_1M_CONTEXT=1. Con quella variabile impostata, Claude Code dimensiona l’ID come la stessa ortografia senza[1m], quindiCLAUDE_CODE_MAX_CONTEXT_TOKENSsi applica quando si applicherebbe a tale ortografia senza tag. Con una finestra dichiarata superiore a 200K, Claude Code mostra quindi un avviso di avvio che il limite di 200K non è applicato. L’avviso è previsto in questa configurazione. -
Se l’ID si risolve a un modello che Claude Code riconosce, o l’ID è un nome
claude-semplice senza suffisso per Claude Code da rimuovere, in qualsiasi maiuscola/minuscola, la variabile ha effetto solo quando si imposta ancheDISABLE_COMPACT, che disabilita tutta la compattazione. Ad esempio, un ID che contiene un nome di modello Claude che Claude Code conosce, comeanthropic/claude-opus-4-8,us.anthropic.claude-…-v1:0, o il datatoclaude-sonnet-4-5@20250929, si risolve a quel modello. Questo include gli ID che contengono anche[1m]: Claude Code risolveclaude-opus-4-8[1m]a Opus 4.8 anche conCLAUDE_CODE_DISABLE_1M_CONTEXTimpostato.
CLAUDE_CODE_DISABLE_UNKNOWN_MODEL_WINDOW_ENFORCEMENT=1 per fare in modo che Claude Code si compatti solo dopo che l’API rifiuta la conversazione con un errore di lunghezza eccessiva che Claude Code riconosce. Claude Code non esegue quel recupero quando un gateway riscrive l’errore con una formulazione che Claude Code non riconosce.
Verifica del modello corrente
È possibile vedere quale modello stai utilizzando attualmente in due posizioni:- Nella riga di stato, se ne hai una configurata
- In
/status, che visualizza anche le informazioni del tuo account
Aggiungere un’opzione di modello personalizzato
UtilizzareANTHROPIC_CUSTOM_MODEL_OPTION per aggiungere una singola voce personalizzata al selettore /model senza sostituire gli alias incorporati. Questo è utile per testare ID di modello che Claude Code non elenca per impostazione predefinita. Per le distribuzioni di gateway LLM, Claude Code può popolare il selettore dall’endpoint /v1/models del gateway quando CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY=1 è impostato, quindi questa variabile è necessaria solo quando la scoperta è disabilitata o non restituisce il modello desiderato. Vedere gateway model discovery.
Per elencare invece diversi modelli, nel vostro ordine e con etichette che scegliete, impostare modelPicker. La sua voce specifica quali righe il selettore mantiene quando questo lineup sostituisce quello incorporato.
Questo esempio imposta tutte e tre le variabili per rendere selezionabile una distribuzione Opus instradata tramite gateway. Claude Code legge le variabili di ambiente all’avvio, quindi eseguire gli export prima di lanciare claude, o riavviare una sessione esistente per applicarle:
ANTHROPIC_CUSTOM_MODEL_OPTION_NAME e ANTHROPIC_CUSTOM_MODEL_OPTION_DESCRIPTION sono facoltativi:
- Se omettete il nome, la voce mostra il nome del modello quando Claude Code riconosce l’ID, e l’ID del modello altrimenti.
- Se omettete la descrizione, Claude Code utilizza
Custom model (<model-id>).
modelPicker che aggiungete viene dopo di essa.
Claude Code salta la convalida per l’ID del modello impostato in ANTHROPIC_CUSTOM_MODEL_OPTION, quindi è possibile utilizzare qualsiasi stringa che l’endpoint API accetta.
Quando availableModels è impostato, includere l’ID del modello personalizzato anche nell’elenco di autorizzazione. Altrimenti Claude Code filtra la voce personalizzata dal selettore e rifiuta una selezione --model di essa come qualsiasi altro modello escluso.
Un ID personalizzato che incorpora un nome di famiglia, come my-gateway/claude-opus-5-5, conta come una voce specifica per quella famiglia e disabilita il suo wildcard, quindi elencare anche le versioni che intendete mantenere selezionabili. Vedere Comportamento di unione.
Variabili di ambiente
Utilizzare le seguenti variabili di ambiente per controllare i nomi dei modelli a cui gli alias si mappano. Ogni valore deve essere un nome di modello completo, o l’identificatore equivalente per il provider API. Per scegliere il modello su cui iniziano le sessioni, impostareANTHROPIC_DEFAULT_MODEL, che questa tabella omette.
Su provider di terze parti, Personalizzare la visualizzazione e le capacità del modello fissato descrive cosa mostra la riga di un modello fissato nel selettore
/model.
Nota: ANTHROPIC_SMALL_FAST_MODEL è deprecato a favore di ANTHROPIC_DEFAULT_HAIKU_MODEL.
Fissare i modelli per distribuzioni di terze parti
Quando si distribuisce Claude Code tramite Amazon Bedrock, Google Cloud’s Agent Platform, Microsoft Foundry, o Claude Platform on AWS, fissare le versioni dei modelli prima di distribuire agli utenti. Senza fissaggio, Claude Code utilizza alias di modelli comefable, opus, sonnet e haiku che si risolvono in un ID di modello predefinito incorporato per ogni provider. Tale impostazione predefinita può rimanere indietro rispetto alla versione più recente di Anthropic, e il modello a cui punta potrebbe non essere ancora abilitato nell’account di un utente. Quando l’impostazione predefinita non è disponibile, gli utenti Amazon Bedrock e Google Cloud’s Agent Platform vedono un avviso e la sessione ricade nella versione precedente del modello predefinito, o nel modello Sonnet predefinito quando l’impostazione predefinita è un modello Opus e nessuna versione di Opus è disponibile. Gli utenti Microsoft Foundry vedono errori invece, perché Microsoft Foundry non ha alcun controllo di avvio equivalente.
Su Amazon Bedrock e Google Cloud’s Agent Platform, un utente che avvia la sessione su una versione specifica di Sonnet oppure Opus, ad esempio con --model, ANTHROPIC_MODEL, o l’impostazione model, fissa quella versione come impostazione predefinita della sessione per l’alias corrispondente: il controllo di avvio salta l’impostazione predefinita incorporata che sostituisce e non mostra alcun avviso di fallback. Prima della v2.1.211, il controllo veniva eseguito e poteva mostrare un avviso anche quando un modello di sessione era configurato esplicitamente.
Utilizzare le seguenti variabili di ambiente con ID di modello specifici della versione per il provider:
Applicare lo stesso modello per
ANTHROPIC_DEFAULT_FABLE_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL e ANTHROPIC_DEFAULT_HAIKU_MODEL. Per gli ID di modello attuali e legacy su tutti i provider, vedere Panoramica dei modelli. Per aggiornare gli utenti a una nuova versione del modello, aggiornare queste variabili di ambiente e ridistribuire.
Per abilitare il contesto esteso per un modello fissato, aggiungere [1m] all’ID del modello in ANTHROPIC_DEFAULT_OPUS_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL, o ANTHROPIC_DEFAULT_FABLE_MODEL:
[1m], la finestra di contesto 1M si applica a tutto l’utilizzo dell’alias fissato, inclusa la fase Opus in modalità piano di opusplan e subagents il cui frontmatter model nomina l’alias.
- Claude Code rimuove il suffisso prima di inviare l’ID del modello al provider.
- Aggiungere
[1m]solo quando il modello sottostante supporta il contesto 1M. - Il suffisso viene letto per variabile, non per modello. Su Amazon Bedrock, Google Cloud’s Agent Platform e Microsoft Foundry, un ID di modello senza
[1m]in una variabile utilizza il contesto 200K anche se un’altra variabile imposta lo stesso modello con il suffisso. Sonnet 5 viene sempre eseguito con la finestra 1M su questi provider e non ha mai bisogno del suffisso.
Un elenco di autorizzazione
availableModels fornito tramite MDM o un file di impostazioni gestite si applica comunque quando si utilizzano provider di terze parti; le impostazioni gestite dal server non vengono fornite lì.Il filtraggio corrisponde a un alias di modello come opus, a un prefisso di versione come claude-opus-4-8, o all’ID di modello completo in forma di provider. I prefissi specifici del provider come us.anthropic. non vengono rimossi, quindi per consentire un modello specifico, elencare il suo ID completo in forma di provider, o mapparlo tramite modelOverrides. Per un modello fissato, quell’ID è il valore impostato nella sua variabile ANTHROPIC_DEFAULT_*_MODEL. Qualsiasi suffisso [1m] viene rimosso sia dalla voce dell’elenco di autorizzazione che dal modello richiesto prima della corrispondenza.Personalizzare la visualizzazione e le capacità del modello fissato
Quando si fissa un modello su un provider di terze parti, la sua riga nel selettore/model mostra il nome del modello per impostazione predefinita se Claude Code riconosce l’ID fissato, e l’ID grezzo altrimenti:
- Riconosciuto: l’ID esatto di un modello che Claude Code conosce, come il suo ID API Anthropic o la forma del provider o del gateway, con o senza il suffisso
[1m]. Fissareus.anthropic.claude-sonnet-4-5-20250929-v1:0e la riga leggeSonnet 4.5. - Non riconosciuto: qualsiasi altro ID, come un ARN di profilo di inferenza dell’applicazione o una versione del modello che Claude Code non conosce, a meno che una voce
modelOverridesnon mappi un modello a quella stringa esatta. Su Microsoft Foundry, i nomi di distribuzione sono definiti dall’utente, quindi Claude Code non riconosce mai un ID fissato lì, mappato o meno, e la riga mostra il nome di distribuzione per impostazione predefinita.
_NAME e _DESCRIPTION hanno effetto anche quando ANTHROPIC_BASE_URL punta a un gateway LLM. Non hanno effetto quando si effettua la connessione direttamente a api.anthropic.com.
Gli stessi suffissi
_NAME, _DESCRIPTION e _SUPPORTED_CAPABILITIES sono disponibili per ANTHROPIC_DEFAULT_SONNET_MODEL, ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_FABLE_MODEL e ANTHROPIC_CUSTOM_MODEL_OPTION.
Claude Code abilita funzionalità come livelli di sforzo e extended thinking abbinando l’ID del modello rispetto a modelli noti. Gli ID specifici del provider come ARN Amazon Bedrock o nomi di distribuzione personalizzati spesso non corrispondono a questi modelli, lasciando le funzionalità supportate disabilitate. Impostare _SUPPORTED_CAPABILITIES per dire a Claude Code quali funzionalità il modello effettivamente supporta:
Quando
_SUPPORTED_CAPABILITIES è impostato, Claude Code abilita le capacità elencate e disabilita quelle non elencate per il modello fissato corrispondente. Quando la variabile non è impostata, Claude Code ricade sulla rilevazione incorporata basata sull’ID del modello.
Questo esempio fissa Opus a un ARN di modello personalizzato Amazon Bedrock, imposta un nome amichevole e dichiara le sue capacità:
Eseguire l’override degli ID di modello per versione
Su piattaforme che incorporano Claude Code e impostanoCLAUDE_CODE_PROVIDER_MANAGED_BY_HOST, la configurazione del modello dell’host ha la precedenza sulle impostazioni del modello gestite, mentre un elenco di autorizzazione availableModels gestito rimane in vigore a meno che l’host non fornisca il proprio; Eccezioni alla precedenza delle impostazioni gestite dice quali chiavi e variabili l’host sostituisce.
Le variabili di ambiente a livello di famiglia sopra configurano un ID di modello per alias di famiglia. Se è necessario mappare diverse versioni all’interno della stessa famiglia a ID di provider distinti, utilizzare invece l’impostazione modelOverrides.
modelOverrides mappa i singoli ID di modello Anthropic alle stringhe specifiche del provider che Claude Code invia all’API del provider. Quando un utente seleziona un modello mappato nel selettore /model, Claude Code utilizza il valore configurato invece del valore predefinito incorporato.
Questo consente agli amministratori aziendali di instradare ogni versione del modello a un ARN di profilo di inferenza Amazon Bedrock specifico, a un nome di versione Google Cloud’s Agent Platform o a un nome di distribuzione Microsoft Foundry per governance, allocazione dei costi o instradamento regionale.
Impostare modelOverrides nel file delle impostazioni:
[claude-code:unrecognized_model] per un ID come un alias di gateway, aggiungere una voce con quell’ID come suo valore.
Gli override sostituiscono gli ID di modello incorporati che supportano ogni voce nel selettore /model. Su Amazon Bedrock, le voci modelOverrides hanno la precedenza su qualsiasi profilo di inferenza che Claude Code scopre automaticamente all’avvio. Claude Code passa i valori che sono già nativi del provider, come ARN di profilo di inferenza Amazon Bedrock o nomi di distribuzione Microsoft Foundry, al provider così come sono.
Gli override si applicano anche quando si passa un ID di modello Anthropic direttamente tramite --model, la variabile di ambiente ANTHROPIC_MODEL, o una variabile di ambiente ANTHROPIC_DEFAULT_*_MODEL. Su Amazon Bedrock, Google Cloud’s Agent Platform e Mantle, un ID di modello Anthropic senza voce modelOverrides si risolve nello stesso ID specifico del provider della riga del selettore /model per quella versione, quando il provider supporta quella versione. Mantle supporta un sottoinsieme di versioni. Per un ID di modello Anthropic al di fuori di quel sottoinsieme, Claude Code invia l’ID grezzo a Mantle senza mapparlo, a meno che una voce modelOverrides lo copra. Prima della v2.1.200, --model e i valori delle variabili di ambiente raggiungevano il provider così come erano senza passare attraverso la mappa di override.
modelOverrides funziona insieme a availableModels. L’elenco di autorizzazione viene valutato rispetto all’ID di modello Anthropic, non al valore di override, quindi una voce come "opus" in availableModels continua a corrispondere anche quando le versioni di Opus sono mappate a ARN. Quando enforceAvailableModels è impostato nelle impostazioni gestite, il Default applicato si risolve tramite modelOverrides dalle impostazioni gestite solo. Il mapping di un amministratore, come una versione fissata a un ARN di profilo di inferenza, viene rispettato nel Default applicato. Gli override dalle impostazioni utente o progetto non lo influenzano.
Quando availableModels è impostato nelle impostazioni gestite, solo modelOverrides dalle impostazioni gestite si applicano a un ID di modello Anthropic passato direttamente tramite --model o le variabili di ambiente sopra. Claude Code ignora gli override nelle impostazioni utente o progetto per quegli ID, e non risolve mai un ID che l’elenco gestito esclude tramite modelOverrides da alcuna fonte di impostazioni. Questa restrizione di fonte gestita richiede Claude Code v2.1.200 o successivo. Vedere Limitare la selezione del modello per come vengono gestiti gli ID bloccati.
Configurazione della prompt caching
Claude Code utilizza automaticamente la prompt caching per ottimizzare le prestazioni e ridurre i costi. È possibile disabilitare la prompt caching globalmente o per livelli di modello specifici:
Per scegliere il TTL della cache per la conversazione principale e per i subagents separatamente, vedere scegliere il TTL da soli. Per cosa attiva un cache miss, vedere Come Claude Code utilizza la prompt caching.