Anthropic veröffentlicht Claude Fable 5 und Mythos 5 – die bisher stärksten Modelle, Mythos-Level mit Sicherheitsleitplanken

Anthropic bringt die Mythos-Level-Modelle Fable 5 (Universalversion mit Sicherheitsleitplanke) und Mythos 5 (Cyber-Defense-Version) auf den Markt. Stripe kann die Arbeit von zwei Monaten an einem Tag erledigen, was die Arzneimittelentwicklung um das Zehnfache beschleunigt und kostet 10 bis 50 US-Dollar pro Million Token.

Anthropic veröffentlicht Claude Fable 5 und Mythos 5: Das bisher leistungsstärkste Modell tritt in die Mythos-Ära ein

⚠️ UPDATE: Anthropic gab am 12. Juni 2026 bekannt, dass es als Reaktion auf eine Exportkontrollrichtlinie der US-Regierung jeglichen Zugriff auf Claude Fable 5 und Claude Mythos 5 sperrt. Beamte sagen, dass die Dienste so schnell wie möglich wiederhergestellt werden.

Anthropic kündigt die Einführung des Claude Fable 5 an – ein Modell auf Mythos-Niveau, das für den breiten Einsatz mit Sicherheitsgeländer nachgerüstet wurde. Die Fähigkeiten von Fable 5 übertreffen jedes zuvor vom Unternehmen öffentlich veröffentlichte Modell und erreichen in vielen Bereichen wie Softwareentwicklung, Wissensarbeit, visuelle Erkennung, wissenschaftliche Forschung usw. ein branchenführendes Niveau. Je komplexer die Aufgabe und je länger der Zyklus, desto offensichtlicher ist der Vorsprung.

Die Veröffentlichung eines so leistungsstarken Modells birgt Risiken. Ohne Sicherheitsmaßnahmen können die Fähigkeiten von Fable 5 in Bereichen wie der Netzwerksicherheit böswillig ausgenutzt werden, was zu ernsthaften Schäden führen kann. Daher hat Anthropic das Modell mit Sicherheitsleitplanken ausgestattet: Anfragen zu bestimmten Themen werden vom nächststärkeren Modell, Claude Opus 4.8, beantwortet. Um eine möglichst schnelle und sichere Freigabe zu gewährleisten, sind diese Sicherheitsleitplanken konservativ konfiguriert – manchmal blockieren sie harmlose Anfragen, werden aber im Durchschnitt in weniger als 5 % der Sitzungen ausgelöst.

Anthropic richtete sich an eine kleine Gruppe von Netzwerkverteidigern und Infrastrukturanbietern und veröffentlichte gleichzeitig Claude Mythos 5. Dieses Modell basiert auf demselben zugrunde liegenden Modell wie Fable 5, jedoch mit entfernten Sicherheitsbeschränkungen in einigen Bereichen. Mythos 5 wird zunächst im Rahmen des Project Glasswing bereitgestellt und in Zusammenarbeit mit der US-Regierung vorangetrieben.

Preise: 10 $ pro Million Input-Tokens, 50 $ pro Million Output-Tokens – weniger als die Hälfte des Preises von Claude Mythos Preview.

Fähigkeitsbewertung

Fable 5 und konkurrierende Modell-Benchmark-Vergleichstabelle

Softwareentwicklung

Laut Stripe-Feedback hat Fable 5 Monate an Projekten in Tage komprimiert. Auf einer Ruby-Codebasis mit 50 Millionen Zeilen schloss dieses Modell eine vollständige Codebasismigration an einem Tag ab, während die gleiche Arbeit von einem menschlichen Team mehr als zwei Monate gedauert hätte. In der FrontierCode-Bewertung von Cognition erzielte das Fable 5 selbst bei mittleren Leistungseinstellungen die höchste Punktzahl aller Frontier-Modelle.

Stripe verwendet Fable 5 für das Falldiagramm der Codemigration

Wissensarbeit

Im Finanz-Benchmark von Hebbia für fortgeschrittene Argumentationsfähigkeiten erreichte Fable 5 die höchste Punktzahl unter allen Modellen, mit erheblichen Verbesserungen bei der Dokumentenbegründung, der Diagramminterpretation und der Problemlösung. IMC stellte fest, dass Fable 5 bei der Bewertung der Transaktionsanalyse durchweg nahezu perfekte Ergebnisse erzielte.

Sehvermögen

Fable 5 erreicht bei visuellen Aufgaben ein neues branchenführendes Niveau. Das Modell kann präzise Zahlen aus detaillierten wissenschaftlichen Diagrammen extrahieren und den Quellcode einer Webanwendung aus nur einem Screenshot rekonstruieren. Im Pokémon FireRed-Spiel konnte Fable 5 das Level nur mit visuellen Hinweisen abschließen – während das Vorgängermodell von Claude komplexe Hilfsmittel erforderte.

Erinnerung und langer Kontext

Fable 5 ist in der Lage, bei langwierigen Aufgaben mit Millionen von Token konzentriert zu bleiben. In Slay the Spire ermöglichte der persistente Dateispeicher eine dreimal bessere Leistung von Fable 5 als Opus 4.8; Außerdem war die Wahrscheinlichkeit, dass das Modell das Endlevel des Spiels erreichte, dreimal höher.

Arzneimitteldesign

Mit Mythos 5 beschleunigten die hauseigenen Experten für Proteindesign von Anthropic mehrere Aspekte des Arzneimitteldesignprozesses um etwa das 10-fache. Mit Hilfe von Protein-Design-Tools (ohne menschliches Eingreifen) verfügt Mythos 5 über Fähigkeiten, die denen erfahrener menschlicher Bediener entsprechen oder diese übertreffen. Neun der 14 Proteinziele erwiesen sich als vielversprechende Kandidaten für die Arzneimittelentwicklung.

Ergebnisdiagramm des Proteinkomplexdesigns von Mythos 5

Neue Hypothesen in der Molekularbiologie

Mythos 5 ist das erste Modell, das konsequent neue, glaubwürdige wissenschaftliche Hypothesen generiert. In Blindvergleichen gaben die Wissenschaftler in etwa 80 Prozent der Fälle der molekularbiologischen Hypothese von Mythos den Vorzug. Eine der Hypothesen – über einen neuen Mechanismus im E. coli-Protein – wurde durch eine Forschungsarbeit eines unabhängigen Labors bestätigt.

Originalforschung in der Genomik

Mythos 5 hat die neuartige Genomforschung in etwas mehr als einer Woche autonom abgeschlossen. Das Modell sammelte Einzelzelldaten aus Millionen von Zellen von 138 Tierarten und war darauf ausgelegt, ein benutzerdefiniertes Modell für maschinelles Lernen zu trainieren. Unter ausschließlicher menschlicher Anleitung übertraf das trainierte Modell ein kürzlich in Science veröffentlichtes Modell um den Faktor 100. Die Veröffentlichung der Ergebnisse ist für die kommenden Monate geplant.

Fable 5 Sicherheitsschutz

Das Mythos-Level-Modell birgt erhebliche Risiken zur Funktionserweiterung für böswillige Akteure. Fable 5 ist mit einem Safety Classifier System ausgestattet – einem unabhängigen KI-System zur Erkennung potenziellen Missbrauchs. Wenn der Klassifikator ausgelöst wird, wird die Anfrage von Claude Opus 4.8 bearbeitet. Über 95 % der Fable 5-Sitzungen erfordern kein Rollback.

Abdeckt drei Hauptbereiche:

  1. Cyber-Sicherheit: Verhindern Sie die Ausnutzung von Sicherheitslücken und automatisierte Hacking-Angriffe. Externe Tests ergaben, dass der Sicherheitsschutz von Fable 5 der stärkste aller getesteten Modelle war – es wurden keine schädlichen Anfragen erfolgreich ausgeführt.
Tabelle mit den Ergebnissen der Fable 5-Sicherheitsklassifizierungsbewertung
  1. Biologie und Chemie: Blockieren Sie risikoreiche biologische Forschungsanfragen. Mythos 5 demonstriert die Fähigkeit, die Eigenschaften viraler Hüllproteine ​​über spezielle Protein-Sprachmodelle hinaus vorherzusagen – und verdeutlicht damit die Risiken einer doppelten Verwendung.

  2. Destillationsschutz: Verhindern Sie die groß angelegte Entnahme von Modellfähigkeiten in autoritären Ländern, um konkurrierende Modelle zu trainieren.

Verfügbarkeit und Preise

  • Fabel 5: Heute online, 10 $/50 $ pro Million Token
  • Mythos 5: Nur Glasswing-Partner
  • Abonnementplan: bis zum 22. Juni kostenlos enthalten, danach sind Punkte erforderlich
  • API-Name: „claude-fable-5“.

Die Veröffentlichung von Fable 5 und Mythos 5 markiert eine neue Phase in der KI-Branche. Anthropic hat ein klares Modellschichtsystem etabliert – Haiku → Sonnet → Opus → Mythos/Fable – Mythos als neue Ebene über Opus bedeutet, dass die KI-Fähigkeiten eine kritische Schwelle überschritten haben und ausreichen, um erhebliche Leistungsverbesserungen in Hochrisikobereichen wie Cybersicherheit und biologischer Forschung zu bewirken.

Nur drei Tage nach der Freilassung erließ die US-Regierung eine Exportkontrollrichtlinie, die den Zugang sperrte. Dies ist das erste Mal, dass die US-Regierung direkt in die öffentliche Verfügbarkeit eines KI-Modells eingreift und damit signalisiert, dass hochmoderne KI-Modelle zu geopolitischen Verhandlungsmasse geworden sind. Für Chinas KI-Industrie bedeutet dies, dass Modelle auf Mythos-Niveau und darüber möglicherweise weiterhin Exportbeschränkungen unterliegen und der Druck auf inländische große Modelle, die Obergrenze ihrer Fähigkeiten einzuholen, weiter zunehmen wird.

Die tatsächlich gemessenen Daten von Fable 5 sind beeindruckend: Stripe kann zwei Monate Arbeit an einem Tag erledigen, den Arzneimittelentwicklungsprozess um das Zehnfache beschleunigen und das „Science“-Papier mit einem Modellmaßstab von 1:100 übertreffen – das sind keine inkrementellen Verbesserungen, sondern ein Sprung im Leistungsniveau. Anthropic demonstrierte auch doppelte Innovationen in Bezug auf „Fähigkeit“ und „Sicherheit“: Das Sicherheitsklassifizierungssystem könnte zu einer Standardkonfiguration künftiger Spitzenmodelle und nicht mehr zu einer Option werden.

Wichtige Anweisungen, die es wert sind, weiterverfolgt zu werden:

  1. Wann wird der Zugriff auf Fable 5 wiederhergestellt – spezifische Bedingungen und Zeitpläne für Exportkontrollen
  2. Fortschritt des Anwendungskanals für biologische Forschung des Mythos 5 Trusted Access-Programms
  3. Wie OpenAI/Google auf Fähigkeitsstandards auf Mythos-Ebene reagiert
  4. Nachfolgende Optimierungsdaten der Falsch-Positiv-Rate des Sicherheitsklassifikators
  5. Verfügbarkeit auf dem chinesischen Markt – die tatsächlichen Auswirkungen der Exportkontrollen auf inländische Claude-Benutzer

Referenz:

Urheberrecht: Inhaltquelle Anthropische offizielle Ankündigung . Diese Plattform hat den Inhalt für Informationszwecke und Lernaustausch zusammengestellt. Bei Urheberrechtsbedenken kontaktieren Sie uns bitte.

Bewertungen

  • Bewertungen werden geladen...