Menü

Claude Fable 5 Tipps Leaked, 6 Stunden Test Wirkung, wirklich verrückt?

Fable 5 ist gerade veröffentlicht worden, und schon wurden die Systemhinweise durchsickern:



Nachdem man diese Hinweise gelesen hat, gibt es einige wichtige Punkte zu beachten:


  • Erstens hat Fable der Artifact-Klasse eine API für die dauerhafte Speicherung hinzugefügt (window.storage). Ein Artifact ist ein einzigartiger Inhalt, der durch den Claude-Code erzeugt wird, wie z. B. HTML-Seiten oder React-Komponenten. Früher konnten Artefakt-Daten nicht gespeichert werden und dienten eher als einmalige Demos. Jetzt können die Daten über Sitzungen hinweg gespeichert werden, was die Nutzung von „gedächtnisvermögenssichen“ Tools ermöglicht, wie z. B. Ranglisten, Pinnwänden oder Tagebüchern.


  • Zweitens hat Fable die gesamte Logik des MCP App-Connectors verbessert. Wenn Sie externe Dienste verbinden möchten (Bestellungen, Taxis, Musik usw.), prüft Fable zunächst den verfügbaren Dienstkatalog und bietet Ihnen dann die Optionen zur Bestätigung an. Insbesondere für Dienste, für die Geld gezahlt werden muss, hat Fable eine detaillierte Opt-in-Prozedur entwickelt.


sowie:


  • Drittens: Wenn Fable Anforderungen in den Bereichen Netzwerk Sicherheit, Biochemie und Destillation erkennt, leitet es die Antwort automatisch an das sekundär starke Modell Opus 4.8 weiter und informiert den Benutzer über die Notwendigkeit einer Abstufung der Leistung.


  • Viertens wurde bei Fable eine Funktion namens `long_conversation_reminder` hinzugefügt. Wenn ein Gespräch zu lang wird, fügt Fable einen Reminder an das Ende der Benutzerinformationen hinzu, um das Modell daran zu erinnern, nicht den ursprünglichen Inhalt des Gesprächs zu vergessen, da es zu lange gedauert hat.


Repository-Link:


https://github.com/elder-plinius/CL4R1T4S/blob/main/ANTHROPIC/CLAUDE-FABLE-5.md


Obwohl die Zivilnutzung von Mythos bereits erwartet wurde, zeigt sich aus den Hinweisen dieses Systems, dass Anthropic große Bedeutung auf Sicherheit legt.


Es ist erwähnenswert, dass im Verhaltenskodex von Fable der Bereich der psychischen Gesundheit einen erheblichen Platz einnimmt. Angesichts der Selbstmordklagen gegen Chatbots in den letzten ein oder zwei Jahren ist es nicht schwer zu verstehen, warum dieser Teil so detailliert beschrieben ist...


Originaltext:



Übersetzt wie folgt:


Claude kümmert sich um die körperliche und geistige Gesundheit der Menschen und vermeidet es, selbstzerstörerisches Verhalten zu fördern oder zu ermutigen – wie Sucht, Selbstverletzung, Ess- oder Bewegungsstörungen/ungesunde Gewohnheiten, sowie extrem negative Selbstgespräche oder Selbstkritik.

Selbst wenn die Nutzer aktiv darum bitten, kann Claude vermeiden, Inhalte zu erstellen, die die Selbstzerstörung fördern oder verstärken könnten.

Wenn Claude mit Menschen, die Suizidgedanken oder Selbstverletzungsimpulse haben, über „Maßnahmen zur Risikobegrenzung“ oder „Sicherheitspläne“ spricht, verwendet sie keine konkreten Namen, Auflistungen oder Beschreibungen. Selbst wenn es darum geht, den Nutzern mitzuteilen, wovon sie sich fernhalten sollten, sagt Claude dies nicht direkt aus, da der Erwähnung dieser Dinge unabsichtlich eine Reaktion auslösen könnte.


Nun zu Fable 5 – lassen Sie uns uns die tatsächlichen Testergebnisse ansehen.


Das ist eine Demo, die von einem Nutzer mit Fable 5 und den Funktionen von The Elder Scrolls erstellt wurde:



Fable ruft die von ThreeJ erstellte 3D-Waldszene auf:



Es gibt eine Raumsimulation mit 5000 Objekten:



New York Skyline Demonstration:


Die gotische Stadt wurde von den Wellen verschlungen:



X-Netnutzer Victor Taelin verwendet ein reales Projekt für den Test.



HVM5Es handelt sich um ein untergeordnetes System, das mit Hochleistungsrechnung verbunden ist. Er hat es zuvor bereits verwendet. Es umfasst 32 Einheiten.GPT-5Der Agent arbeitete etwa 20 Stunden lang. Obwohl die Geschwindigkeit maximal um das Doppelte erhöht werden konnte, verschlechterte sich die Qualität des Codes aufgrund der Erweiterungen. Später wurde die Verwendung von Opus 4.8 erlaubt.GPT-5.5Optimierung über 8 Stunden: Opus bietet eine Effizienzsteigerung von 6% bis 34%. Die Ergebnisse von GPT sind sogar noch besser, jedoch können die Dateien nicht verwendet werden.



Als Ergebnis benötigte Fable 5 nur 2 Stunden, um auf einem Benchmark eine Steigerung von 1770% zu erzielen, während auf den anderen 4 Benchmarks die Durchschnittszunahme von 100% um weitere 22% überschritten wurde.


Die erste Reaktion der Nutzer war Unglaube; sie vermuteten, dass es sich um einen „harten Code“ für den Benchmark handelte, da sie zuvor bereits von Problemen mit Tools wie GPT betroffen waren.



Nachdem er die Erklärung gelesen hatte, stellte er fest, dass die Optimierungsrichtung für Fable tatsächlich sinnvoll war.


Weil HVM5 bei der Verarbeitung von dynamischen Pattern-Match-Elementen auch viele unnötige Verzweigungen in den Garbage Collector schickt, wird viel Zeit verschwendet. Bisher wurden nur statische Pattern-Matches optimiert, nicht jedoch dynamische. Fable hat dieses Problem entdeckt, weshalb die Testergebnisse sehr übertrieben ausfallen.


Dies ist die Analyse der Ursache des HVM5-Fehlers, die von Fable 5 bereitgestellt wurde:



Der türkische Internetnutzer Alican Kiraz hat eine Reihe von Vergleichstests zwischen Fable 5 und GPT 5.5 durchgeführt.


Seine Schlussfolgerung ist, dass Fable 5 viel Geld gekostet hat – 360,55 US-Dollar – während GPT-5.5 nur 6 US-Dollar gekostet hat. Doch wenn man sich die Details der Optimierungen ansieht, hat Fable 5 tatsächlich grundlegendere, kraftvollere und den Denkweisen von Performance-Engineern näher kommende Verbesserungen vorgenommen.



Das sind seine Testergebnisse:



Laut den echten Tests mit dem dritten-Partei-Programmierwerkzeug Augment Code ist die Programmierfähigkeit von Fable 5 wirklich sehr stark.


Bei dem gemeinsamen Test wurden 489 Programmieraufgaben durchgeführt. Fable 5 zeigte insgesamt eine deutlich bessere Leistung und Genauigkeit: Die Gesamtpunktzahl lag um +0,224 höher, und die Genauigkeit um +0,191.



Aber es gibt auch Beispiele von enttäuschenden Ergebnissen aus praktischen Tests. Der Internetnutzer Ryan R. Hughes stellte einen großen PR mit 74 Dateien zur Überprüfung bei Fable 5 ein. Das System benötigte über 34 Minuten und verbrauchte dabei 42 Prozent der verfügbaren Ressourcen der Claude-Code-Sitzung, um schließlich nur 16 Fehler zu finden.



Solche Beispiele sind nicht ungewöhnlich – Fable 5 ist allerdings etwas zu teuer.



Einige Leute glauben, dass Fable 5 nach Tests eine schwache Fähigkeit zur Analyse langer Texte aufweist:



Weitere negative Bewertungen konzentrieren sich auf die Model-Degradierungsoperationen:



Derzeit beträgt der Preis für die API von Fable 5 10 US-Dollar pro Million eingegebener Tokens und 50 US-Dollar pro Million ausgegebener Tokens.



Im Vergleich dazu ist dieser Preis etwa doppelt so hoch wie bei Opus 4.8 und mehr als dreimal so hoch wie bei Sonnet 4.6. Die tatsächlichen Kosten für ein einzelnes, komplexes Workflow sind deutlich höher als bei jeder vorherigen Generation der Claude-Modelle.


Und auch die Empfindlichkeit wurde erhöht: Die Schutzzäune sind insgesamt konservativer gestaltet; es wird lieber zu Fehlverletzungen kommen, als erst einmal Sicherheit zu gewährleisten.


Angesichts des Problems der hohen Kosten habe ich die folgenden Tests von Nutzern zusammengestellt, die nicht nur dabei helfen, Geld zu sparen, sondern auch sehr gute Ergebnisse erzielen: Eine Lösung, bei der verschiedene Modelle gemischt verwendet werden:


In IDEs like Cursor, which support hybrid models, different models can be used on the platform in a phased manner:

Erste Phase: Code-Überprüfung und erste Analyse des Projekts, um den Kontext vorzubereiten und die Struktur des Projekts zu verstehen. Eines der folgenden Werkzeuge wird verwendet: GPT-5.5, MiniMax M3, Kimi K2.6 oder Composer 2.5.

Zweite Phase: Erstellung des Projektplans, wobei GPT-5.5 Very High oder Opus 4.8 zur Erstellung des Projektplans verwendet wird.

Phase 3: Analyze the use of the project plan Review the Fable 5 project plan to identify potential errors within it. If modifications to the plan are necessary, use GPT-5.5 (Very High).

Phase 4: Implementation and use of the project plan with the implementation of MiniMax M3, DeepSeek V4, Max, Composer 2.5, or Sonnet 4.6.

Fünfte Phase: Endprüfung – Verwendung des GPT-5.5-Code zur Überprüfung der endgültigen Ergebnisse der Prüfung, um zu überprüfen, ob die Umsetzung dem ursprünglichen Plan entspricht.


Die richtige Nutzung der teuersten Ressourcen an den genau richtigen Stellen ist die richtige Herangehensweise, um Fable 5 zu spielen.


Die Wirkung von Claude Fable 5, ob es den Wahnsinn tötet oder nicht, ist eine Frage des Geschmacks – die einen sehen es so, die anderen so.


Aber mit ihm ist die Geschwindigkeit des Token-Verbrauchs sehr klar – wirklich verrückt.



Der Artikel stammt vom WeChat-Kanal „JackCui“ und wurde von „JackCui“ verfasst.

War das hilfreich?

Technischer SupportLive-Support
Nach oben
简体中文ZH-CNDefault繁體中文ZH-TWEnglishEN日本語JA한국어KOภาษาไทยTHTiếng ViệtVIBahasa IndonesiaIDEspañolESFrançaisFRDeutschDEРусскийRUPortuguêsPTItalianoITالعربيةAR