GPT-6 Astra oder Claude Fable 5.1: Welches zuerst testen?
Wann sich Astra oder Fable für einen ersten Test anbietet: Kontext- und Cache-Kosten, Grenzen öffentlicher Benchmarks und Prüfungen an eigenen Aufgaben.
Inhalt

Für komplexe Sitzungen mit Werkzeugen, besonders wenn Sie während der Ausführung eingreifen möchten, sollten Sie zuerst GPT-6 Astra ausprobieren. Bei wiederholt genutztem, umfangreichem Kontext und sehr langen Eingaben, deren Kosten ins Gewicht fallen, beginnen Sie mit Claude Fable 5.1. Für Programmieraufgaben nehmen Sie einige Aufgaben aus Ihrem eigenen Repository: Prüfen Sie beide Modelle mit denselben Tests und vergleichen Sie den nötigen manuellen Korrekturaufwand.
Am 5. September 2026 sind beide Modelle im BetterToken-Katalog aufgeführt. Mit Ihrem eigenen Konto und API Key können Sie sie an Ihre Werkzeuge anbinden und ihre Ergebnisse an denselben Aufgaben vergleichen. Das Dashboard zeigt Modell, Anfragestatus, Eingabe-, Ausgabe- und Cache-Tokens sowie die jeweiligen Kosten. So können Sie die von Ihnen geprüfte Ergebnisqualität zu den Anfragekosten in Beziehung setzen.
BetterToken-Konto erstellen und beide Modelle an eigenen Aufgaben vergleichen
Für Astra sprechen zunächst die von OpenAI beschriebenen asynchronen Werkzeugaufrufe und Mid-turn Steering: die Möglichkeit, laufende Arbeit neu auszurichten. Das sind Fähigkeiten laut OpenAI; ihre Unterstützung im gewählten Werkzeug und bei der Anbindung über BetterToken muss separat geprüft werden. Fables Vorteil bei wiederverwendetem, großem Kontext lässt sich leichter an den Preisen ablesen: Cache-Lesezugriffe kosten weniger, und die unten erklärte Astra-Preiserhöhung oberhalb von 272K Eingabe-Tokens entfällt.
Wo sich die Kosten unterscheiden
OpenAI und Anthropic nennen dieselben Basistarife: $10 pro Million Eingabe-Tokens und $50 pro Million Ausgabe-Tokens. Unterschiede entstehen bei wiederverwendetem Kontext und sehr langen Eingaben. Die Tabelle enthält Anbieterpreise vom 5. September 2026; die aktuellen Kosten für Aufrufe über BetterToken stehen auf dessen Preisseite.
| Merkmal | GPT-6 Astra — OpenAI | Claude Fable 5.1 — Anthropic |
|---|---|---|
| Kontext / maximale Ausgabe | 1.050.000 / 128.000 Tokens | 1.000.000 / 128.000 Tokens |
| Normale Eingabe, pro 1M Tokens | $10 | $10 |
| Ausgabe, pro 1M Tokens | $50 | $50 |
| Cache schreiben, pro 1M Tokens | $12.50 | $12.50 für 5 Minuten; $20 für 1 Stunde |
| Cache lesen, pro 1M Tokens | $1 | $0.25 |
| Lange Eingabe | Über 272K Eingabe-Tokens: 2x für sämtliche Eingabe-/Cache-Kosten der Anfrage, 1.5x für die Ausgabe | Standardpreis für Kontext bis 1M |
Spezifikationen und Tarife stammen aus den Dokumentationen zu GPT-6 Astra und Claude Fable 5.1. Die Anthropic-Dokumentation zum Kontextfenster bestätigt den Standardpreis für Fable bis 1M.
Überschreitet eine Astra-Anfrage 272K Eingabe-Tokens, gilt der Aufschlag für die gesamte Anfrage: Eingabe und Cache werden mit 2 multipliziert, Ausgabe mit 1.5. Auch die ersten 272K Eingabe-Tokens sind betroffen. Beim Laden eines großen Repositorys oder Dokumentbestands kann das die Entscheidung ändern, selbst wenn die Antworten ähnlich gut sind.
Ein Beispiel mit Anbieterpreisen: Die erste Anfrage schreibt ein gemeinsames Präfix von 100K Tokens in den Cache; neun weitere Anfragen lesen es vollständig daraus. Insgesamt entstehen 50K Ausgabe-Tokens. Für Fable nehmen wir eine Cache-Schreibdauer von 5 Minuten an, wobei jeder Lesezugriff vor Ablauf erfolgt. Die Astra-Anfragen bleiben unter 272K Eingabe-Tokens.
Astra: 0.1 × $12.50 + 0.9 × $1.00 + 0.05 × $50 = $4.65
Fable: 0.1 × $12.50 + 0.9 × $0.25 + 0.05 × $50 = $3.975 ≈ $3.98
Berechnet sind nur das gemeinsame Präfix und die Ausgabe-Tokens. Neue Eingaben und Wiederholungsversuche kosten zusätzlich. Fables Ersparnis hängt von der tatsächlichen Cache-Nutzung ab: Ein geändertes Präfix oder eine abgelaufene TTL, also Speicherdauer, erfordert einen neuen Schreibvorgang. Eine Stunde kostet mehr als fünf Minuten; wählen Sie passend zu den Abständen zwischen Ihren Anfragen.
Was öffentliche Tests zeigen
OpenAI veröffentlichte Astra am 3. September 2026, Anthropic Fable 5.1 am 1. September. Zum Prüfzeitpunkt wird der direkte Astra-Zugang bei OpenAI schrittweise freigeschaltet. Fable ist über die Claude API und die von Anthropic aufgeführten Cloud-Plattformen verfügbar. Das sind die direkten Zugangsbedingungen der Anbieter; BetterToken führt bereits beide Modelle.
OpenAIs veröffentlichter Vergleich enthält diese Ergebnisse:
| Test | GPT-6 Astra | Claude Fable 5.1 | Quelle der Ergebnisse |
|---|---|---|---|
| AutomationBench | 41.4 | 31.4 | OpenAI |
| Terminal-Bench 4.0 | 57.9 | 55.8 | OpenAI |
| DeepSWE | 74.1 | 67.4 | OpenAI |
| Humanity’s Last Exam with tools | 57.2 | 65.0 | OpenAI |
Die Ergebnisse sprechen dafür, Astra bei Aufgaben mit Werkzeugen zuerst zu testen. OpenAIs Fußnoten nennen jedoch Unterschiede bei Einstellungen und Harness, also der Testumgebung, die Werkzeuge, Kontext und Wiederholungsversuche steuert.
Der unabhängige Anbieter Artificial Analysis bewertet Astra im Intelligence Index mit ungefähr 61 Punkten und Fable 5.1 mit 66. Fables 66 Punkte wurden mit max effort und dem standardmäßig aktivierten serverseitigen Fallback von Anthropic erzielt. Rund 4% der Ausgabe-Tokens im Test stammten von Opus 4.8/5. Es handelt sich daher um ein Systemergebnis, nicht um den isolierten Modellwert. Im Coding Agent Index erreichen sie 67 beziehungsweise 70. Dort läuft Astra in Codex, Fable in Claude Code: Gemessen wird die Kombination aus Modell und Werkzeug. Für Ihr Repository ist eine konkrete Fehlerkorrektur oder Änderung mit denselben Abnahmetests aussagekräftiger. Für diesen Artikel haben wir keinen eigenen kostenpflichtigen A/B-Durchlauf dieser Modelle durchgeführt.
Modelle über BetterToken vergleichen
Verwenden Sie die genaue Model ID und die passende API-Key-Gruppe. Am 5. September 2026 nennt der strukturierte BetterToken-Katalog folgende Angaben:
| Modell | Model ID | API-Key-Gruppe | Protokoll |
|---|---|---|---|
| GPT-6 Astra | gpt-6-astra | GPT | OpenAI-compatible |
| Claude Fable 5.1 | claude-fable-5-1 | Claude | Anthropic-compatible oder OpenAI-compatible, je nach Werkzeug |
Erstellen Sie die benötigten API Keys in Ihrem Konto. Nutzen Sie die jeweilige Anleitung zur Anbindung von Codex oder Anbindung von Claude Code. Base URL, Authentifizierung und Protokoll richten sich nach dem Werkzeug; eine einzige Konfiguration deckt nicht alle Fälle ab.
Wenn Ihre Anwendung einen Werkzeugaufruf erzwingt, prüfen Sie tool_choice. Laut Anthropic-Dokumentation gibt Fable 5.1 bei any oder einem bestimmten tool den Fehler 400 zurück. Unterstützt werden auto und none. Diese Bedingung beeinflusst die Anbindung einer Anwendung, die zwingend ein bestimmtes Werkzeug aufrufen muss.
Wählen Sie einige echte Aufgaben: einen bekannten Fehler beheben, eine kleine Änderung mit Tests umsetzen oder eine Frage anhand von Dokumenten beantworten. Geben Sie beiden Modellen dieselben Ausgangsmaterialien und Abnahmekriterien. Prüfen Sie Ergebnis, manuelle Korrekturen, Zeitbedarf und Anfragekosten. Bei unterschiedlichen Werkzeugen halten Sie deren Namen und Versionen fest; wiederholen Sie die Aufgabe, wenn die Ergebnisse stark schwanken.
Wählen Sie das Modell, das Ihre Aufgaben zu vertretbaren Kosten und innerhalb Ihrer Grenzen für Zeit und manuelle Arbeit erledigt. Weniger Nacharbeit senkt ebenfalls die Kosten des fertigen Ergebnisses.