L'arena · recensione di modello IA

Claude Fable 5

di Anthropic

Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera

Punteggio dell'arena 3.9/563% lo consiglia · 4 voti
Ragionamento5.0
Coding5.0
Scrittura4.5
Velocità2.0
Rapporto qualità-prezzo3.0
Visita Claude Fable 5agenti autonomi a lungo orizzonterefactoring monstre e migrazioni di codebasericerca di frontiera e analisi finanziariavisione su documenti scientifici densi
Prezzo

$50/1M out

Prezzo di listino ufficiale dell'API Anthropic per claude-fable-5: $10/1M in input, $50/1M in output, tier unico con contesto 1M di default (nessun sovrapprezzo long-context), 128K di output max; le richieste rifiutate prima di qualsiasi output non vengono fatturate. Verificato su platform.claude.com (Introducing Claude Fable 5) 2026-07.

Fornitore

Anthropic

Finestra di contesto

1M tokens

Prezzo in input

$10/1M in

Prezzo in output

$50/1M out

Modalità

text, vision

Open weights

No

Che cos'è Claude Fable 5?

Primo modello della famiglia Claude 5 di Anthropic, uscito il 2026-06-09 in una nuova classe Mythos sopra Opus. Fable 5 è la versione disponibile al pubblico, con classificatori di sicurezza sulle capacità dual-use (cyber, biologia, distillazione di modelli) che reindirizzano le richieste segnalate verso Opus 4.8; Claude Mythos 5 è lo stesso modello sottostante senza quei classificatori, riservato alle organizzazioni approvate via Project Glasswing. ID API claude-fable-5: $10/$50 per 1M di tokens, contesto 1M di default, 128K di output max.

Claude Fable 5: pro e contro

Pro

  • 80.3% su SWE-bench Pro contro 69.2% di Opus 4.8, 58.6% di GPT-5.5 e 54.2% di Gemini 3.1 Pro, circa 11 punti davanti al modello di frontiera successivo
  • 95.0% su SWE-bench Verified (Opus 4.8: 88.6%, GPT-5.5: 82.6%) e 29.3% sullo split FrontierCode Diamond di Cognition, più del doppio del 13.4% di Opus 4.8
  • L'autonomia a lungo orizzonte è la vera notizia: Stripe ha riportato la migrazione di una codebase Ruby da 50 milioni di righe fatta in un giorno invece di 2+ mesi, e il CEO di Cursor lo definisce stato dell'arte su CursorBench
  • I riscontri sul campo confermano i benchmark: gli ingegneri su HN lo descrivono al lavoro 'come un vero ingegnere' (CRDT con supervisione minima, fuzzer scritti da solo, una riduzione delle allocazioni di 46x), Simon Willison ha misurato 'diversi giorni di lavoro' in una singola sessione
  • Finestra di contesto da 1M di tokens di default più 128K di output, e visione allo stato dell'arte sui documenti densi (29.8% su GDP.pdf contro 24.9% di GPT-5.5 e 22.5% di Opus 4.8)
  • Le richieste rifiutate prima dell'output non vengono fatturate, e il fallback lato server verso Opus 4.8 con credito di fallback è integrato nell'API

Contro

  • Il doppio del prezzo di Opus 4.8 ($10/$50 contro $5/$25) e lento: le singole richieste sui task difficili durano regolarmente parecchi minuti, Simon Willison lo definisce senza giri di parole 'slow, expensive'
  • I classificatori di sicurezza dual-use sbagliano sul lavoro legittimo: un fisico medico ha riportato problemi di fluidodinamica e codice di segmentazione MRI rifiutati come rischi di biosicurezza, con richieste reindirizzate in silenzio verso Opus 4.8 (il thread virale su HN si intitolava 'If Claude Fable stops helping you, you'll never know'; Anthropic parla di meno del 5% delle sessioni)
  • Lancio travagliato: i controlli USA sulle esportazioni hanno costretto Anthropic a sospendere l'accesso in tutto il mondo dal 12 al 30 giugno 2026, tre giorni dopo la release, con ripristino completo solo il 1° luglio
  • Richiede 30 giorni di conservazione dei dati e non è disponibile in zero data retention, un blocco totale per le organizzazioni a compliance rigida; inoltre niente modalità senza thinking, la chain of thought grezza non viene mai restituita, il prefill dell'assistente restituisce un 400
  • Non è universalmente allo stato dell'arte: GPT-5.5 guida ancora ARC-AGI-2 (85.0% contro 77.1%), e Andon Labs ha rilevato che Mythos 5 senza blocchi rendeva meno sia di Opus 4.7 che di GPT-5.5 su Vending-Bench, con un ragionamento che ottimizzava per la rilevabilità invece che per il danno reale

Il verdetto dell'arena

Prendi Claude Fable 5 se il tuo carico è davvero a lungo orizzonte: sessioni agentiche notturne, migrazioni monstre, task dove una singola sessione di più ore sostituisce giorni di lavoro supervisionato. Lì, il premio 2x rispetto a Opus 4.8 si ripaga da solo in compressione dei task, e i benchmark (80.3% su SWE-bench Pro, 11 punti sopra il resto del campo) sono confermati da deployment reali presso Stripe e Cursor. Per il coding interattivo e il lavoro quotidiano, resta su Opus 4.8: 88.6% su SWE-bench Verified a metà prezzo, niente falsi positivi dei classificatori, turni più rapidi. I team attenti ai costi ottengono un coding quasi da Opus con Sonnet 5 a $3/$15 (prezzo lancio $2/$10 fino ad agosto 2026). Evita Fable 5 del tutto se la tua organizzazione richiede zero data retention o se lavori anche solo vicino a biologia, imaging medico o strumenti di sicurezza, dove i classificatori dual-use producono ancora falsi positivi e sostituiscono in silenzio Opus 4.8 a metà sessione.

Pollice su o pollice verso

Emetti il tuo verdetto

Consiglieresti Claude Fable 5, o metteresti in guardia la folla?

63%punteggio della folla · 4

Migliori alternative a Claude Fable 5

Tutte le alternative
1
Claude Haiku 4.5

Il modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.

$5/1M out67%(2)
Visit
2
Claude Opus 4.7

L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8

$25/1M out57%(3)
Visit
3
Claude Sonnet 5

Il Sonnet più agentico di Anthropic: qualità vicina a Opus 4.8 su coding e agenti a $3/$15 con contesto 1M

$15/1M out ($10 intro until 2026-08-31)57%(3)
Visit

Confronta Claude Fable 5 testa a testa

Cosa dice la folla

Pollice Versicus

I do medical imaging research and the bio classifier keeps flagging my MRI segmentation prompts, then it silently falls back to Opus 4.8 mid-session. At $50 per million output tokens I expect to at least know which model actually answered me.

Glorius Maximus

Yes it's 2x the price of Opus and yes the turns are slow. But one overnight Fable run replaced what used to be a week of supervising shorter runs. On a per-task basis it's actually the cheapest model we use.

Pollice d'Oro Maximus

The 1M context is real, not marketing. I fed it our entire service mesh config plus six months of incident postmortems and it traced a flaky timeout to a retry policy nobody remembered writing. Opus 4.8 never connected those dots.

San Deployus

Gave it a monorepo migration that Opus 4.8 kept stalling on. It ran for about 40 minutes, came back with the whole thing done plus a test harness it wrote for itself. Felt like reviewing a senior engineer's PR, not babysitting a chatbot.

Claude Fable 5: domande frequenti

Quanto costa Claude Fable 5 per 1M di token?

Claude Fable 5 costa $10/1M in per 1M di token in input e $50/1M out per 1M di token in output. Prezzo di listino ufficiale dell'API Anthropic per claude-fable-5: $10/1M in input, $50/1M in output, tier unico con contesto 1M di default (nessun sovrapprezzo long-context), 128K di output max; le richieste rifiutate prima di qualsiasi output non vengono fatturate. Verificato su platform.claude.com (Introducing Claude Fable 5) 2026-07.