Anthropic veröffentlicht Claude Fable 5: Das erste Universalmodell der Mythos-Klasse mit Sicherheitsgeländer
Anthropic veröffentlicht die Mythos-Klassenmodelle Claude Fable 5 (universelle Version mit Sicherheitsgeländer) und Mythos 5 (uneingeschränkte Cyber-Defense-Version). Bei einem Preis von 10 $/50 $/Million Token kann Stripe die Arbeit von zwei Monaten an einem Tag erledigen, und das Medikamentendesign von Evozyne beschleunigt sich um das Zehnfache.
Anthropic veröffentlicht offiziell das bisher leistungsstärkste Claude-Modell: Claude Fable 5 ist das erste Mythos-Level-Modell (mit Sicherheitsleitplanken), das für allgemeine Benutzer zugänglich ist. Es erreicht SOTA bei fast allen Testbenchmarks in den Bereichen Software-Engineering, Wissensarbeit, Vision, wissenschaftliche Forschung usw. Je komplexer und länger die Aufgabe, desto offensichtlicher der Vorsprung. Claude Mythos 5 ist eine Version ohne Sicherheitsbarrieren und steht Cyber-Verteidigungsorganisationen nur über Project Glasswing zur Verfügung. Gleichzeitig wurde eine aktualisierte Version des Sicherheitsklassifikators eingeführt, die offiziellen Tests zufolge 95 % der Gefahrenvektoren eliminierte. Preis 10 $/50 $ pro Million Token.
Online-Bewertung (Chatbot Arena): Fable 5 belegt in allen Kategorien den ersten Platz, vor dem zweiten Platz 70 ELO – entspricht dem Abstand von GPT-5.4 zu GPT-5.5. Die Gewinnquote beträgt bis zu 86 %, die Gewinnquote bei Unentschieden und Spielen liegt bei 96 %. Die Programmierfähigkeit ELO erreicht 1794, die Punktzahl für die Programmierstilaufgabe liegt bei 96,8.
Preise: Geben Sie 10 $/Million Token ein, geben Sie 50 $/Million Token aus.
Design der Sicherheitsleitplanke
Die Fähigkeiten des Mythos-Level-Modells sind mit Risiken verbunden – die Fähigkeiten von Fable 5 in Bereichen wie der Cybersicherheit könnten für böswillige Zwecke ausgenutzt werden. Daher hat Anthropic Guard-Klassifikatoren (Guard Classifiers) für Fable 5 bereitgestellt und Abfragen für bestimmte Kategorien werden von Claude Opus 4.8 verarbeitet. Diese Sicherheitsleitplanken sind konservativ ausgelegt und werden im Durchschnitt in weniger als 5 % der Sitzungen ausgelöst.
Aktualisierter Sicherheitsklassifizierer
Während eine Erfolgsquote von mehr als 92 % der harmlosen Eingabeaufforderungen aufrechterhalten wird, kann der neue Klassifikator 95 % der schädlichen Vektoren in den offiziellen Testdaten eliminieren, was eine deutliche Verbesserung gegenüber dem vorherigen Wert von 60 % darstellt. Das AI Security Institute (AISI) hat unabhängig davon beurteilt, dass es ausreichend robust ist.
Mythos 5 + Projekt Glasswing
Mythos 5, das die gleiche Grundlage wie Fable 5 hat, aber die Sicherheitsbarrieren entfernt, ist nur für eine Handvoll Cyber-Verteidigungsorganisationen und Infrastrukturanbieter über das Project Glasswing-Partnerschaftsprogramm verfügbar. Anthropic wird in Partnerschaft mit der US-Regierung eingesetzt.
Praktische Anwendungsfälle
- Streifen: Zwei Monate traditioneller Arbeit an einem Tag abgeschlossen (zum ersten Mal wurde ein interner Sicherheitsalarm aufgrund „übermäßiger Fähigkeiten“ ausgelöst)
- Evozyne Drug Design: Entwerfen Sie neue Proteine zehnmal schneller
Der Claude Fable 5 ist Anthropics bisher radikalste Modellveröffentlichung. Funktionen auf Mythos-Ebene bieten universellen Zugriff auf die Außenwelt durch einen „Sicherheitsklassifikator“-Downgrade-Mechanismus, während die uneingeschränkte Version auf Netzwerkverteidigungsszenarien beschränkt wird – diese „Fähigkeitsklassifizierung“-Strategie stellt ein neues Paradigma für den Einsatz modernster KI dar. Die tatsächlichen Fälle, in denen Stripe die Arbeit von zwei Monaten an einem Tag abschließt und die Arzneimittelentwicklung von Evozyne um das Zehnfache beschleunigt wird, veranschaulichen, dass sich die Fähigkeiten von KI in der Unternehmensprogrammierung und Arzneimittelentwicklung schnell dem „Ersatzniveau“ nähern.
Derzeit bilden DeepSeek V4 Pro, GPT-5.5 und Claude Fable 5 einen dreiteiligen Wettbewerb in Bezug auf Programmierfähigkeiten, aber der Gesamtvorsprung von Fable 5 im Gesamtbenchmark zeigt, dass Anthropic auf Mythos-Ebene einen erheblichen Vorteil erzielt hat.
Anweisungen, die es wert sind, weiterverfolgt zu werden:
- Tatsächliche Leistung von Guard-Klassifizierern: Akzeptanz einer Auslöserate von 5 % in realen Produktionsszenarien
- Erweiterungen für Project Glasswing: Wird der Zugriff auf Mythos 5 erweitert?
- Auswirkungen der Exportkontrolle: Die tatsächlichen Auswirkungen der Exportkontrollen der US-Regierung auf den weltweiten Zugang zur Claude-Modellfamilie
Bewertungen