As duas versões estão alinhadas bloco a bloco, pela ordem do texto: título, o essencial e depois parágrafo a parágrafo. Quando a tradução fundiu ou dividiu um parágrafo, a casa correspondente fica vazia — nunca aproximamos duas passagens a olho.
Im Terminal-Bench-Science, einem Test für komplexe wissenschaftliche Arbeitsabläufe, springt Claude Fable 5.1 von 24,7 auf 52,6 Prozent. Anthropic hat das Modell gemeinsam mit Claude Mythos 5.1 veröffentlicht; Fable 5.1 ist allgemein verfügbar und soll vor allem lang laufende Agentenaufgaben, Programmieraufgaben und Wissensarbeit besser bewältigen.
No Terminal-Bench-Science, um teste para fluxos de trabalho científicos complexos, o Claude Fable 5.1 passa de 24,7 para 52,6 %. A Anthropic publicou o modelo juntamente com o Claude Mythos 5.1; o Fable 5.1 está geralmente disponível e pretende sobretudo lidar melhor com tarefas agentivas de longa duração, tarefas de programação e trabalho de conhecimento.
Der Zuwachs zeigt sich auch in anderen Prüfungen. Bei Terminal-Bench 4.0, das agentische Programmieraufgaben in einer Terminal-Umgebung prüft, steigt Fable 5.1 von 42,0 auf 55,8 Prozent. AutomationBench simuliert mehrstufige Büroaufgaben über verschiedene Anwendungen hinweg und verzeichnet einen Anstieg von 17,1 auf 31,4 Prozent. Artificial Analysis misst bei maximaler Denkleistung 66 Punkte im Intelligence Index – mehr als Fable 5 mit 62, Opus 5 mit 63 und GPT-5.6 Sol mit 61 Punkten. Bei anderer agentischer Wissensarbeit liegt Fable 5.1 allerdings praktisch gleichauf mit Opus 5.
O aumento também se verifica noutros testes. No Terminal-Bench 4.0, que avalia tarefas de programação agentivas num ambiente de terminal, o Fable 5.1 sobe de 42,0 para 55,8 %. O AutomationBench simula tarefas de escritório em várias etapas, realizadas em diferentes aplicações, e regista uma subida de 17,1 para 31,4 %. Com a capacidade máxima de raciocínio, a Artificial Analysis mede 66 pontos no Intelligence Index — mais do que os 62 do Fable 5, os 63 do Opus 5 e os 61 do GPT-5.6 Sol. Noutro teste de trabalho de conhecimento agentivo, porém, o Fable 5.1 fica praticamente ao mesmo nível do Opus 5.
Für Entwickler bleibt die Rechenzeit ein harter Kostenfaktor. Die regulären Preise der Programmierschnittstelle (API) ändern sich nicht: 10 Dollar pro Million Eingabe-Token und 50 Dollar pro Million Ausgabe-Token. Günstiger werden Cache Reads, also das erneute Abrufen bereits verarbeiteter Inhalte: Sie fallen von 1 auf 0,25 Dollar pro Million Token. Anthropic schätzt dadurch rund 25 Prozent niedrigere Gesamtkosten bei typischen und bis zu etwa 45 Prozent niedrigere Kosten bei stark agentischen Arbeitslasten. Artificial Analysis stellt jedoch fest, dass Fable 5.1 rund 1,7-mal so viele Ausgabe-Token wie Fable 5 erzeugt; eine Aufgabe kostete dadurch im Schnitt 3,76 Dollar.
Para os programadores, o tempo de computação continua a ser um fator de custo importante. Os preços normais da interface de programação (API) não mudam: 10 dólares por milhão de tokens de entrada e 50 dólares por milhão de tokens de saída. Os Cache Reads, isto é, a recuperação de conteúdos já processados, ficam mais baratos: descem de 1 para 0,25 dólares por milhão de tokens. A Anthropic estima que isso reduza os custos totais em cerca de 25 % nas cargas de trabalho típicas e em até aproximadamente 45 % nas cargas de trabalho fortemente agentivas. A Artificial Analysis observa, contudo, que o Fable 5.1 gera cerca de 1,7 vezes mais tokens de saída do que o Fable 5; por isso, uma tarefa custou, em média, 3,76 dólares.
Anthropic hat außerdem die Schutzmechanismen für Cyberaufgaben präziser gefasst. Fable 5.1 darf Schwachstellen in Quellcode identifizieren, während Penetrationstests, die Erzeugung von Exploits und das Scannen binärer Schwachstellen weiterhin eingeschränkt bleiben. In Claude Code greifen die Schutzmaßnahmen laut Anthropic im Schnitt rund 60 Prozent seltener ein als bei Fable 5. Mythos 5.1 ist nur für geprüfte Nutzer und Organisationen zugänglich und verfügt über weniger strikte Schutzmechanismen; beide neuen Modelle tragen erstmals ein Text-Wasserzeichen.
A Anthropic também definiu com maior precisão os mecanismos de proteção para tarefas de cibersegurança. O Fable 5.1 pode identificar vulnerabilidades no código-fonte, enquanto os testes de penetração, a criação de exploits e a análise de vulnerabilidades binárias continuam limitados. No Claude Code, as medidas de proteção são acionadas, segundo a Anthropic, em média cerca de 60 % menos vezes do que no Fable 5. O Mythos 5.1 só está acessível a utilizadores e organizações validados e dispõe de mecanismos de proteção menos rigorosos; ambos os novos modelos incluem pela primeira vez uma marca de água textual.
Konkret bekommen Teams mit langen, mehrstufigen Programmier- oder Wissensaufgaben ein allgemein verfügbares Modell, das in mehreren Agenten-Benchmarks deutlich zulegt. Der Preis dafür ist nicht automatisch niedriger: Die günstigeren Cache-Zugriffe helfen vor allem bei wiederverwendetem Kontext, während ein höherer Ausgabe-Tokenverbrauch den Vorteil schmälern kann. Für die meisten Anwendungen empfiehlt Anthropic weiterhin Opus 5; Anthropic empfiehlt Fable 5.1 vor allem für besonders anspruchsvolle und langwierige Aufgaben.
Concretamente, as equipas com tarefas de programação ou de conhecimento longas e compostas por várias etapas passam a dispor de um modelo geralmente disponível que obtém ganhos significativos em vários benchmarks de agentes. O preço disso não é automaticamente mais baixo: os acessos a Cache mais baratos ajudam sobretudo quando o contexto é reutilizado, enquanto um maior consumo de tokens de saída pode reduzir a vantagem. Para a maioria das aplicações, a Anthropic continua a recomendar o Opus 5; recomenda o Fable 5.1 sobretudo para tarefas especialmente exigentes e demoradas.