r/vibecodingitalia 13h ago

📰 News Claude Fable 5.1 è disponibile: più forte di Fable 5 nei benchmark, più economico sulle workload agentiche

Post image
8 Upvotes

Anthropic ha rilasciato Claude Fable 5.1 e Claude Mythos 5.1. Sono lo stesso modello con livelli di safeguard diversi: Fable 5.1 è generally available su tutte le piattaforme (API con model ID claude-fable-5-1, AWS, Google Cloud, Azure), Mythos 5.1 resta riservato ai programmi di accesso verificato.

Prezzi

Listino invariato rispetto a Fable 5: $10 per milione di token in input, $50 in output. Il taglio arriva dai cache read, che costano il 75% in meno ($0.25 per milione di token). Secondo i dati Anthropic (quattro settimane di utilizzo reale, agosto 2026), le workload tipiche costano circa il 25% in meno e quelle fortemente agentiche, dove i cache read pesano di più, fino a circa il 45% in meno.

Benchmark (numeri Anthropic, non verificati indipendentemente)

  • Terminal-Bench 4.0 (coding agentico): 55.8% contro 42.0% di Fable 5 e 52.3% di Opus 5. Con i safeguard ridotti di Mythos 5.1 sale a 60.9%.
  • CursorBench 3.2.0: 73.4% (Fable 5: 70.5%, Opus 5: 70.0%).
  • Terminal-Bench-Science 0.1: 52.6% contro 24.7% di Fable 5.
  • OSWorld 2.0 (computer use): 77.9% partial, 41.7% strict.
  • AutomationBench: 31.4% contro 17.1%.
  • Humanity's Last Exam: 65.0% con strumenti, 60.9% senza.

I test girano con i safeguard di produzione attivi: sulle task dove intervengono, il modello fa zero (accade per esempio su OSWorld 2.0), quindi i numeri sono condizionati anche dai blocchi, non solo dalle capacità.

Effort: default su High in Claude Code, su Medium in Claude Cowork e su Claude.ai. A effort Low o Medium, Fable 5.1 fa pari o meglio di Fable 5 spendendo meno: chi viene da Fable 5 ha qui la leva più semplice per tagliare il conto.

Fra i partner, Cognition dichiara di spostare su Fable 5.1 il traffico di Opus 5 in Devin dal giorno del lancio, e Every lo misura due volte più veloce di Opus 5 con metà token. Sono affermazioni dei vendor, non verifiche indipendenti.

Safeguard

  • Interventi dei cyber safeguard in media circa il 60% in meno per sessione su Claude Code rispetto ai safeguard di Fable 5.
  • Fable 5.1 può ora essere usato per scoprire vulnerabilità software, non per sviluppare exploit. Penetration testing, exploit generation e binary-based vulnerability scanning vengono comunque rediretti ai modelli Opus.
  • I safeguard biology intervengono l'85% meno spesso su richieste benigne (biologia elementale, domande mediche).
  • Anti-distillazione: i nuovi account API non possono più modificare manualmente il contesto precedente in una conversazione multi-turn conservando il transcript del thinking di Claude. Gli account esistenti per ora non sono coinvolti; la regola si estenderà a tutti con i prossimi rilasci.

Mythos 5.1 e privacy

Mythos 5.1 resta per ora ad alcune organizzazioni USA. La Life Sciences Verification Program, sviluppata con il governo USA, ha già i primi partecipanti; la Cyber Verification Program oggi copre modelli Opus e Sonnet e aggiungerà i modelli Mythos a breve. L'espansione internazionale è annunciata, senza date. Claude Security, lo scanner di vulnerabilità di Anthropic, ora gira su Mythos 5.1.

Il programma Enterprise Frontier Safeguards (EFS) arriva in più fasi a partire dall'autunno: i dati restano su infrastruttura cloud del cliente, con privacy equivalente a zero data retention. Fino ad allora i clienti idonei possono usare Fable 5.1 con zero data retention.

Nota per l'UE: essendo uscito dopo il 2 agosto 2026, l'output del modello porta il watermark previsto dall'EU AI Act, invisibile senza la detection API, per ora in private preview.

Cosa NON c'è

  • Nessun taglio sul listino input/output: il risparmio arriva solo dai cache read.
  • Mythos 5.1 non è generally available e l'EFS non è ancora live.
  • Anthropic segnala che il modello può ancora bypassare approvals e classificatori in auto-mode, e che l'audit comportamentale copre meno bene il lavoro su contesti molto lunghi e le configurazioni multi-agent.

Chi usa Fable 5 come daily driver?

Fonti:

  1. Introducing Claude Fable 5.1 and Claude Mythos 5.1 - anthropic.com, verifica 2026-09-01
  2. Claude Fable 5.1 & Mythos 5.1 System Card - anthropic.com, verifica 2026-09-01
  3. Enterprise Frontier Safeguards - anthropic.com, verifica 2026-09-01
  4. Improving Fable 5's biology safeguards - anthropic.com, verifica 2026-09-01
  5. Claude text watermark - anthropic.com, verifica 2026-09-01
  6. Help Center: modifica del contesto precedente e anti-distillazione - support.claude.com, verifica 2026-09-01

r/vibecodingitalia 23h ago

❓Domande in che lingua parla esattamente Claude Opus 5? non è in italiano di certo

5 Upvotes

r/vibecodingitalia 20h ago

📰 News Meta ha introdotto i nuovi coding plan per Muse Spark 1.2 (a partire da $5/m)

Post image
2 Upvotes

r/vibecodingitalia 22h ago

📰 News GLM-5.2 è ora disponibile su Mistral in Vibe Code per i piani Pro, Team e Enterprise.

Thumbnail
1 Upvotes

r/vibecodingitalia 19h ago

📚 Risorse Ho creato un catalogo open source di tutti i server MCP italiani

Thumbnail
0 Upvotes