Home›Approfondimenti›Claude Fable 5.1: Prezzi, Benchmark e Rischi di Migrazione
technology·Di NewzBits Editorial·10 min di lettura·
Claude Fable 5.1: Prezzi, Benchmark e Rischi di Migrazione
Claude Fable 5.1 di Anthropic riduce i costi di cache del 75%, supera Opus 5 nei benchmark agentici e introduce tre modifiche breaking per gli utenti delle API di Fable 5.
Anthropic ha rilasciato Claude Fable 5.1 il 1° settembre 2026, insieme a Claude Mythos 5.1. I due condividono un unico modello sottostante con diversi sistemi di protezione: Fable 5.1 è disponibile per tutti, mentre Mythos 5.1 è limitato a programmi di accesso attendibile, con protezioni progettate per la cybersecurity e le scienze della vita. Per gli sviluppatori, in sintesi: i prezzi per token rimangono invariati rispetto a Fable 5, le letture della cache sono diminuite del 75% e tre modifiche breaking colpiranno le migrazioni non preparate.
Cosa è successo
Anthropic ha annunciato Claude Fable 5.1 e Claude Mythos 5.1 il 1° settembre 2026. Fable 5.1 è generalmente disponibile sotto l'ID modello claude-fable-5-1 sulla Claude API, Amazon Bedrock (anthropic.claude-fable-5-1), Google Cloud (claude-fable-5-1), Microsoft Foundry (claude-fable-5-1) e Claude Platform su AWS (claude-fable-5-1), oltre ai marketplace e per gli utenti Pro, Max, Team ed Enterprise. Mythos 5.1 (claude-mythos-5-1) è limitato ai partecipanti del Project Glasswing.
I numeri principali, tutti attribuiti ad Anthropic:
Contesto di 1M di token e output massimo di 128K, con l'intera finestra di 1M fatturata secondo i prezzi standard per token
$10/MTok in input, $50/MTok in output — invariati rispetto a Fable 5
Letture della cache a $0,25/MTok, il 75% in meno rispetto a Fable 5
Stima del 25% in meno rispetto a Fable 5 per i carichi di lavoro tipici fatturati per token poiché le letture della cache sono più economiche; per i lavori altamente agentici spesso fino a circa il 45% in meno
Adaptive thinking sempre attivo; sforzo predefinito (default effort) alto
I valori predefiniti all'interno delle interfacce di Anthropic differiscono: sforzo "High" in Claude Code, "Medium" in Claude Cowork e su Claude.ai.
Perché è importante
La documentazione del modello è insolitamente diretta su chi dovrebbe acquistarlo. Secondo Anthropic: per la maggior parte dei carichi di lavoro, iniziare con Claude Opus 5. Utilizzare Fable 5.1 quando le valutazioni su Opus 5, anche con un impegno maggiore, risultano ancora insufficienti. Fable 5.1 costa $10/$50 per MTok rispetto ai $5/$25 di Opus 5, e Anthropic valuta la sua latenza come più lenta rispetto a quella moderata di Opus 5. Il premio di prezzo acquista un ragionamento più sofisticato e capacità agentiche a lungo termine.
La notizia principale riguarda i costi. Le letture della cache su Fable 5.1 e Mythos 5.1 costano il 2,5% del prezzo di input base, rispetto al 10% degli altri modelli Claude. Ecco perché Anthropic stima che i carichi di lavoro tipici fatturati per token siano inferiori di circa il 25% rispetto a Fable 5, e i lavori altamente agentici spesso fino a circa il 45% in meno. I loop agentici ad alta intensità di cache, in cui ogni passaggio rilegge il contesto, sono i punti in cui i risparmi si accumulano.
Nei benchmark con i safeguard di produzione abilitati, Fable 5.1 registra numeri più alti rispetto a Opus 5 ovunque Anthropic abbia riportato entrambi: 55,8% contro 52,3% su Terminal-Bench 4.0, 73,4% contro 70,0% su CursorBench 3.2.0, 31,4% contro 26,9% su AutomationBench e 77,9% contro 75,4% su OSWorld 2.0 partial. Il margine più ampio è Terminal-Bench-Science 0.1 (52,6% contro 29,0%); il più stretto è Humanity's Last Exam con strumenti (65,0% contro 63,6%). Il divario maggiore si riscontra nella ricerca scientifica agentica.
I safeguard determinano ciò che è possibile costruire. I safeguard possono instradare automaticamente molte query relative a cyber-sicurezza e biologia verso modelli meno capaci. Agli utenti non vengono addebitati i prezzi di Fable per le richieste reindirizzate, ma tali richieste non vengono nemmeno elaborate da Fable. Fable 5.1 può scoprire vulnerabilità del software, ma non può sviluppare exploit.
I dettagli
Fondamentali del modello. Secondo la panoramica ufficiale: rilasciato il 1° settembre 2026; cutoff della conoscenza giugno 2026; contesto di 1M di token; output massimo di 128K token; input di testo e immagini, output di testo; thinking adattivo sempre attivo; effort predefinito alto; latenza moderatamente più lenta rispetto a Opus 5, mentre Sonnet 5 è l'opzione veloce; fallback verso Opus 4.8 e Opus 5; ritiro non prima del 1° settembre 2027.
Prezzi. Input $10/MTok, output $50/MTok. Lettura cache $0.25/MTok. Scritture cache: $12.50/MTok per 5 minuti e $20/MTok per 1 ora. La Batch API è scontata del 50% — $5 di input e $25 di output per MTok. L'inferenza solo USA è prezzata a 1.1x su input e output. Il resto della gamma, per confronto: Opus 5 a $5/$25, Sonnet 5 a $2/$10 e Haiku 4.5 a $1/$5 con 200K di contesto e 64K di output massimo.
Effort e nuova superficie API. I livelli di effort sono low, medium, high, xhigh e max; il thinking è adattivo, sempre attivo e guidato dall'effort. Vengono rilasciate tre beta contemporaneamente: effort per messaggio (mid-conversation-output-config-2026-07-01), messaggi di sistema con ambito di turno (mid-conversation-system-clear-at-2026-08-21) e aggiornamenti della visualizzazione dei progressi (thinking-display-updates-2026-08-18). È nuova anche la provenienza dei contenuti: un watermark testuale statistico, più C2PA sui media supportati tramite la Files API.
Errori nell'uso forzato di tool.tool_choice di tipo any o tool ora restituisce un errore 400. auto e none rimangono invariati. Motivo: il thinking è sempre attivo e i tool forzati salterebbero la fase di thinking.
Interoperabilità del thinking a senso unico. Fable 5.1 può leggere i blocchi di thinking dei modelli precedenti; i modelli precedenti non possono leggere quelli di Fable 5.1. Le pipeline che passano blocchi di thinking tra modelli si interrompono in una direzione.
L'editing di turni precedenti invalida il thinking. L'editing del prompt di sistema, dei tool o di messaggi precedenti invalida i blocchi di thinking. Il controllo è applicato agli account creati il 31 agosto 2026 o successivamente; gli account più vecchi vi sono soggetti solo quando è impostato prefix_mismatch_behavior. Mythos 5.1 non esegue questo controllo.
Cambiamenti di comportamento rispetto a Fable 5. Chiamate parallele ai tool più variabili; meno aggiornamenti sui progressi; risposte dalla memoria più frequenti con effort basso; prosa più densa; meno formattazione da chat; citazioni non contrassegnate nei riassunti; riscritture dell'intero file per piccole modifiche.
Cosa non è cambiato. Il tipo di thinking abilitato/disabilitato restituisce ancora un errore 400; la visualizzazione è omessa per impostazione predefinita; nessun prefilling; temperature/top_p/top_k non predefiniti restituiscono ancora un errore 400; minimo di cache di 512 token. Il tokenizer è invariato rispetto a Fable 5 — quello di Opus 4.7 — che produce circa il 30% di token in più rispetto ai modelli precedenti, quindi i budget di token portati dai modelli pre-Fable 5 non saranno così ampi come suggerito dal conteggio dei caratteri.
Gestione dei dati. Le fonti lo formulano in modo diverso, quindi ecco entrambe le versioni, precise. La pagina prodotto di Fable di Anthropic descrive una conservazione predefinita dei dati di 30 giorni per il monitoraggio della sicurezza. I documenti sulle novità elencano Fable 5.1 tra i Modelli Coperti con conservazione dei dati di 30 giorni e dichiarano che non è disponibile con conservazione zero dei dati (ZDR) a meno che non sia espressamente autorizzato da Anthropic. L'annuncio aggiunge il collegamento: fino a quando Enterprise Frontier Safeguards (EFS) non sarà disponibile, i clienti idonei potranno utilizzare Fable 5.1 con conservazione zero dei dati. EFS memorizza i dati su infrastruttura cloud controllata dal cliente, con la revisione umana gestita per impostazione predefinita dal cliente, e sarà implementato a fasi a partire dalla fine di quest'autunno.
Benchmark. Punteggi con safeguard di produzione abilitati, secondo Anthropic:
Benchmark
Fable 5.1
Mythos 5.1
Opus 5
Fable 5
GPT-5.6 Sol
Terminal-Bench 4.0
55.8%
60.9%
52.3%
42.0%
37.3%
Terminal-Bench-Science 0.1
52.6%
—
29.0%
24.7%
22.4%
GDPval-AA v2
1853
—
1824
1723
1711
OSWorld 2.0 (parziale)
77.9%
—
75.4%
72.9%
—
OSWorld 2.0 (strict)
41.7%
—
39.6%
36.1%
—
Humanity's Last Exam (senza tool)
60.9%
—
56.6%
57.8%
—
Humanity's Last Exam (con tool)
65.0%
—
63.6%
63.8%
—
AutomationBench
31.4%
—
26.9%
17.1%
19.6%
CursorBench 3.2.0
73.4%
—
70.0%
70.5%
67.2%
Avvertenze segnalate da Anthropic: Terminal-Bench-Science 0.1 presenta un errore standard di ±3,5–4,5 punti, e i numeri della classifica pubblica differiscono — Opus 5 al 30,0% e Fable 5 al 21,4%, contro il setup di Anthropic al 29,0% e 24,7%, entro il margine di rumore. OSWorld 2.0 non ha punteggi dei concorrenti perché il rilascio dei task di agosto 2026 non è comparabile con i numeri precedenti di OSWorld 2.0. Le prestazioni multilingue sono in linea con Fable 5. I miglioramenti si concentrano su effort più elevati in sessioni agentiche di coding lunghe, lavoro su documenti/fogli di calcolo/slide, ricerca, vision, contesto lungo e computer use. Mythos 5.1 ha ottenuto un punteggio ancora più alto in Terminal-Bench 4.0, pari al 60,9%.
Cosa monitorare
Rollout di EFS. Le fasi inizieranno più avanti in autunno. Finché EFS non raggiungerà un determinato account, i clienti idonei potranno eseguire Fable 5.1 con zero ritenzione dei dati.
Accesso a Mythos 5.1. Un programma di accesso alla biologia con il governo degli Stati Uniti copre Mythos 5.1; l'iscrizione per gli scienziati è prevista a breve. Il Cyber Verification Program includerà Mythos nel prossimo futuro; i cyber-difensori possono fare domanda.
Salvaguardie informatiche. Anthropic afferma che le sue più recenti salvaguardie per la cybersecurity bloccano il 60% in meno di falsi positivi rispetto a prima. Fable 5.1 può scoprire vulnerabilità software ma non sviluppare exploit: pianificate gli strumenti di sicurezza di conseguenza.
Rerouting. Molte query relative a cyber e biologia potrebbero essere reindirizzate automaticamente a modelli meno capaci, senza l'applicazione dei prezzi di Fable per le richieste reindirizzate. Considerate questo aspetto nella progettazione delle evaluation: una suite superata non prova che Fable abbia risposto a ogni richiesta.
Ciclo di vita. Il ritiro non avverrà prima del 1° settembre 2027. Anthropic ha inoltre pubblicato una system card per Fable 5.1 e Mythos 5.1.
FAQ
Chi dovrebbe usare Fable 5.1 invece di Opus 5?
Le linee guida di Anthropic: iniziare con Opus 5 per la maggior parte dei carichi di lavoro; passare a Fable 5.1 quando le valutazioni su Opus 5, anche con uno sforzo maggiore, risultano ancora insufficienti. Fable 5.1 è rivolto a ragionamenti impegnativi e lavori agentici a lungo termine: codifica agentica in sessioni lunghe, ricerca multi-step, lavoro su documenti/fogli di calcolo/slide e computer use. I compromessi sono reali: il prezzo per token è raddoppiato ($10/$50 rispetto a $5/$25 per MTok) e la latenza è più elevata. Le pipeline agentiche che fanno un uso intensivo della cache sono i casi in cui il costo totale può comunque diminuire, poiché le letture della cache a $0,25/MTok sono più economiche del 75% rispetto a quelle di Fable 5.
Quanto costa effettivamente Fable 5.1?
Prezzo di listino: $10/MTok in input e $50/MTok in output — invariato rispetto a Fable 5. Le letture della cache costano $0,25/MTok, che rappresenta il 2,5% del prezzo di input di base rispetto al 10% degli altri modelli Claude. Le scritture della cache costano $12,50/MTok per 5 minuti e $20/MTok per 1 ora. La Batch API è scontata del 50%: $5 in input e $25 in output per MTok. L'inferenza solo negli USA è fatturata a 1,1x su input e output. Per contesto: Opus 5 costa $5/$25, Sonnet 5 $2/$10 e Haiku 4.5 $1/$5 con un contesto di 200K e un output massimo di 64K.
Cosa si rompe se si chiama già Fable 5?
Tre modifiche breaking. Primo, l'uso forzato degli strumenti: un tool_choice di tipo any o tool restituisce un errore 400 (auto e none rimangono invariati), poiché il thinking è sempre attivo e gli strumenti forzati lo salterebbero. Secondo, i modelli precedenti non possono leggere i blocchi di thinking di Fable 5.1, sebbene Fable 5.1 possa leggere i blocchi dei modelli precedenti. Terzo, la modifica del system prompt, degli strumenti o dei messaggi precedenti invalida i blocchi di thinking — obbligatorio per gli account creati in data 31 agosto 2026 o successivamente, e per gli account più vecchi solo quando prefix_mismatch_behavior è impostato (Mythos 5.1 salta il controllo). Aspettatevi anche cambiamenti nel comportamento: chiamate a strumenti parallele più variabili, meno aggiornamenti di progresso, prosa più densa, meno formattazione da chat, citazioni non contrassegnate nei riassunti, riscritture dell'intero file per piccole modifiche e più risposte basate sulla memoria a basso sforzo. Invariati: i tipi di thinking abilitati/disabilitati restituiscono ancora 400, nessun prefilling, temperature/top_p/top_k non predefiniti restituiscono ancora 400, il minimo di cache di 512 token e lo stesso tokenizer di Fable 5.