Le due versioni sono allineate blocco per blocco, nell’ordine del testo: titolo, l’essenziale, poi paragrafo per paragrafo. Quando la traduzione ha fuso o diviso un paragrafo, la casella corrispondente resta vuota — non accostiamo mai due passaggi a occhio.
Im Terminal-Bench-Science, einem Test für komplexe wissenschaftliche Arbeitsabläufe, springt Claude Fable 5.1 von 24,7 auf 52,6 Prozent. Anthropic hat das Modell gemeinsam mit Claude Mythos 5.1 veröffentlicht; Fable 5.1 ist allgemein verfügbar und soll vor allem lang laufende Agentenaufgaben, Programmieraufgaben und Wissensarbeit besser bewältigen.
In Terminal-Bench-Science, un test per flussi di lavoro scientifici complessi, Claude Fable 5.1 passa dal 24,7% al 52,6%. Anthropic ha pubblicato il modello insieme a Claude Mythos 5.1; Fable 5.1 è ora disponibile a tutti e dovrebbe gestire meglio soprattutto le attività agentiche di lunga durata, i compiti di programmazione e i lavori basati sulla conoscenza.
Der Zuwachs zeigt sich auch in anderen Prüfungen. Bei Terminal-Bench 4.0, das agentische Programmieraufgaben in einer Terminal-Umgebung prüft, steigt Fable 5.1 von 42,0 auf 55,8 Prozent. AutomationBench simuliert mehrstufige Büroaufgaben über verschiedene Anwendungen hinweg und verzeichnet einen Anstieg von 17,1 auf 31,4 Prozent. Artificial Analysis misst bei maximaler Denkleistung 66 Punkte im Intelligence Index – mehr als Fable 5 mit 62, Opus 5 mit 63 und GPT-5.6 Sol mit 61 Punkten. Bei anderer agentischer Wissensarbeit liegt Fable 5.1 allerdings praktisch gleichauf mit Opus 5.
La crescita emerge anche in altre valutazioni. In Terminal-Bench 4.0, che esamina attività di programmazione agentica in un ambiente terminale, Fable 5.1 sale dal 42,0% al 55,8%. AutomationBench simula attività d'ufficio articolate in più fasi e distribuite su diverse applicazioni, registrando un aumento dal 17,1% al 31,4%. Artificial Analysis assegna al modello, con la massima potenza di ragionamento, 66 punti nell'Intelligence Index: più di Fable 5, a quota 62, Opus 5, a 63, e GPT-5.6 Sol, a 61 punti. Negli altri test sui lavori agentici basati sulla conoscenza, tuttavia, Fable 5.1 è praticamente alla pari con Opus 5.
Für Entwickler bleibt die Rechenzeit ein harter Kostenfaktor. Die regulären Preise der Programmierschnittstelle (API) ändern sich nicht: 10 Dollar pro Million Eingabe-Token und 50 Dollar pro Million Ausgabe-Token. Günstiger werden Cache Reads, also das erneute Abrufen bereits verarbeiteter Inhalte: Sie fallen von 1 auf 0,25 Dollar pro Million Token. Anthropic schätzt dadurch rund 25 Prozent niedrigere Gesamtkosten bei typischen und bis zu etwa 45 Prozent niedrigere Kosten bei stark agentischen Arbeitslasten. Artificial Analysis stellt jedoch fest, dass Fable 5.1 rund 1,7-mal so viele Ausgabe-Token wie Fable 5 erzeugt; eine Aufgabe kostete dadurch im Schnitt 3,76 Dollar.
Per gli sviluppatori, il tempo di calcolo resta un fattore di costo rilevante. I prezzi ordinari dell'interfaccia di programmazione (API) non cambiano: 10 dollari per milione di token in input e 50 dollari per milione di token in output. Diventano più economici i Cache Reads, cioè il recupero di contenuti già elaborati: il costo scende da 1 a 0,25 dollari per milione di token. Anthropic stima una riduzione dei costi complessivi di circa il 25% nei carichi di lavoro tipici e fino a circa il 45% in quelli fortemente agentici. Artificial Analysis rileva però che Fable 5.1 genera circa 1,7 volte più token in output rispetto a Fable 5; di conseguenza, un'attività è costata in media 3,76 dollari.
Anthropic hat außerdem die Schutzmechanismen für Cyberaufgaben präziser gefasst. Fable 5.1 darf Schwachstellen in Quellcode identifizieren, während Penetrationstests, die Erzeugung von Exploits und das Scannen binärer Schwachstellen weiterhin eingeschränkt bleiben. In Claude Code greifen die Schutzmaßnahmen laut Anthropic im Schnitt rund 60 Prozent seltener ein als bei Fable 5. Mythos 5.1 ist nur für geprüfte Nutzer und Organisationen zugänglich und verfügt über weniger strikte Schutzmechanismen; beide neuen Modelle tragen erstmals ein Text-Wasserzeichen.
Anthropic ha inoltre definito con maggiore precisione i meccanismi di protezione per le attività di cybersicurezza. Fable 5.1 può identificare vulnerabilità nel codice sorgente, mentre i test di penetrazione, la generazione di exploit e la scansione delle vulnerabilità binarie restano soggetti a restrizioni. Secondo Anthropic, in Claude Code le misure di protezione intervengono in media circa il 60% meno spesso rispetto a Fable 5. Mythos 5.1 è accessibile solo a utenti e organizzazioni verificati e dispone di meccanismi di protezione meno rigidi; entrambi i nuovi modelli presentano per la prima volta una filigrana testuale.
Konkret bekommen Teams mit langen, mehrstufigen Programmier- oder Wissensaufgaben ein allgemein verfügbares Modell, das in mehreren Agenten-Benchmarks deutlich zulegt. Der Preis dafür ist nicht automatisch niedriger: Die günstigeren Cache-Zugriffe helfen vor allem bei wiederverwendetem Kontext, während ein höherer Ausgabe-Tokenverbrauch den Vorteil schmälern kann. Für die meisten Anwendungen empfiehlt Anthropic weiterhin Opus 5; Anthropic empfiehlt Fable 5.1 vor allem für besonders anspruchsvolle und langwierige Aufgaben.
In concreto, i team impegnati in attività di programmazione o di elaborazione della conoscenza lunghe e articolate in più fasi ricevono un modello disponibile a tutti, che migliora nettamente in diversi benchmark sugli agenti. Il prezzo, però, non è automaticamente più basso: gli accessi alla cache più economici aiutano soprattutto quando si riutilizza il contesto, mentre un consumo maggiore di token in output può ridurre il vantaggio. Per la maggior parte degli impieghi Anthropic continua a raccomandare Opus 5; Fable 5.1 è indicato soprattutto per le attività particolarmente impegnative e di lunga durata.