GPT-6 Astra vs Claude Fable 5.1: welches Abo lohnt sich?

Beide Modelle liegen im Benchmark exakt gleichauf. Trotzdem zahlst du bei einem mehr als das Doppelte. Was die Zahlen für dein KI-Abo wirklich bedeuten.

GPT-6 Astra vs Claude Fable 5.1 Vergleich welches KI-Abo sich fuer Solo-Creator rechnet
Gleicher Benchmark-Score, doppelter Preis pro Aufgabe. Das ist die eigentliche Nachricht.

Seit Anfang September hauen sich Leute in den Feeds gegenseitig Benchmark-Screenshots um die Ohren. GPT-6 Astra gegen Claude Fable 5.1. Wer ist schlauer.

Die Antwort: keiner. Beide liegen im Intelligence Index von Artificial Analysis auf exakt 53 Punkten. Gleichstand.

Und trotzdem zahlst du bei einem davon mehr als das Doppelte für dieselbe Arbeit.

Das ist der Teil, über den niemand redet. Hier steht, was die Zahlen für dich als Selbstständigen bedeuten, der monatlich ein KI-Abo bezahlt und nicht drei.

Die Benchmarks sagen Unentschieden, die Rechnung nicht

Kurz die harten Zahlen, Stand 9. September, von Artificial Analysis:

  • Intelligence Index: Astra 53 Punkte, Fable 5.1 53 Punkte. Gleichstand.
  • Coding Agent Index: beide 62. Wieder Gleichstand.
  • Terminal-Bench v4.0: Astra 59 Prozent, Fable 52 Prozent. Punkt für OpenAI.
  • Kosten pro Aufgabe im Intelligence Index: Astra 3,26 Dollar, Fable 7,63 Dollar.

Der letzte Punkt ist der interessante. Gleiche Leistung, weniger als die Hälfte vom Preis.

Warum? Astra labert weniger. Bei maximaler Denk-Einstellung braucht es rund 27.000 Output-Tokens pro Aufgabe, Fable 5.1 braucht 78.000. Fast das Dreifache. Die Listenpreise sind bei beiden identisch (10 Dollar pro Million Input, 50 pro Million Output), aber wer fast dreimal so viel schreibt, zahlt am Ende eben mehr als das Doppelte.

Anders gesagt: Claude denkt laut. Sehr laut. Von den 78.000 Tokens sind laut Artificial Analysis rund 47.000 reines Nachdenken. Das ist bei komplexen Sachen Gold wert und bei "mach mir zwölf Varianten für diese Caption" pure Verschwendung.

Der Haken, den die Vergleichstabellen unterschlagen

Jetzt der Teil, der für dich wirklich zählt.

Die ganzen Dollar-pro-Million-Rechnungen gelten für die API. Also für Leute, die Software bauen. Du buchst ein Abo.

Und da sieht es so aus:

  • ChatGPT Plus, rund 23 Euro brutto: Astra gibt es hier vorerst nur in ChatGPT Work und Codex, nicht im normalen Chat. Dort gibt es GPT-6 erst im Pro-Abo ab 100 Dollar im Monat, und zwar als GPT-6 Pro.
  • Claude Pro: Fable 5.1 ist laut Anthropic nicht im Kontingent enthalten, sondern läuft nur über Usage-Credits, die du extra bezahlst. Fest im Abo steckt Fable erst bei Claude Max ab rund 90 Euro netto, und auch dort gehen ohne Aufpreis höchstens 50 Prozent deines Wochenlimits auf Fable.

Lies das nochmal. Für GPT-6 im normalen Chat zahlst du das Fünffache vom Plus-Abo. Und Fable 5.1 steckt im kleinen Claude-Abo gar nicht drin, jede Anfrage damit kostet dort extra.

Für einen ehrlichen Test reicht bei OpenAI das kleine Abo (über Work oder Codex), bei Claude zahlst du den Test über Credits. Für den Dauerbetrieb reicht das kleine Abo bei beiden nicht.

Was das für einen Ein-Personen-Betrieb heißt

Ich würde sowas immer auf den Monat runterrechnen. Nach rund zehn Jahren als Videograf sehe ich das so: Jedes Abo muss irgendwann gegen einen Drehtag antreten.

90 Euro netto sind im Jahr über 1.000 Euro. Das ist ein gutes Objektiv. Oder zwei Termine beim Steuerberater. Oder, je nach Tagessatz, ein ordentliches Stück von dem, was ein Drehtag einbringt.

Die Frage ist also nicht "welches Modell ist besser". Die Frage ist: machst du genug mit KI, dass 1.000 Euro im Jahr wieder reinkommen?

Wer Schnittprotokolle, Blog-Rohfassungen, Angebots-Textbausteine und einen Teil der Kundenkommunikation durchlaufen lässt: ja, eindeutig. Da kommen schnell ein paar Stunden im Monat zusammen, die du sonst selbst tippst.

Für jemanden, der zweimal die Woche eine Reel-Caption schreiben lässt: auf keinen Fall. Da reicht das 23-Euro-Abo. Oder ein kostenloses Modell.

Wo Claude trotz höherer Kosten gewinnt

Zwei Sachen gehen in den Cost-per-Task-Tabellen unter.

Erstens: Cache. Wenn du immer wieder dasselbe große Dokument mitschickst (deine Markenrichtlinien, dein Transkript, deine Preisliste), liest Fable 5.1 das für 0,25 Dollar pro Million. Astra verlangt 1 Dollar. Viermal so viel.

Zweitens: Fable hat keinen Aufschlag für lange Kontexte. Astra schon. Beide haben ein Kontextfenster von einer Million Tokens, aber nur bei einem bleibt der Preis stabil, wenn du es auch wirklich vollmachst.

Übersetzt: Wer mit riesigen, immer gleichen Textbergen arbeitet, fährt mit Claude günstiger. Wer viele kurze, unterschiedliche Aufgaben durchjagt, mit Astra.

Das ist eine echte Entscheidung. Keine Geschmacksfrage.

Der Test, den du in 20 Minuten nachbauen kannst

Benchmarks sind für Leute gemacht, die Modelle verkaufen. Du brauchst deinen eigenen.

So würde ich das bei jedem neuen Modell angehen:

  • Nimm drei Aufgaben, die du diese Woche wirklich hattest. Nicht ausgedacht. Echt.
  • Jage sie durch beide Modelle, mit exakt demselben Prompt.
  • Stoppe die Zeit, die du danach noch mit Nachbessern verbringst.
  • Rechne: gesparte Minuten mal dein Stundensatz.

Punkt drei ist der entscheidende. Ein Modell, das 30 Sekunden schneller antwortet, aber zehn Minuten Nacharbeit kostet, hat verloren. Egal was der Benchmark sagt.

Mein Take: Astra für alles, was strukturiert und wiederholbar ist. Claude für alles, wo Nuance und Ton zählen. Blog-Rohfassungen zum Beispiel. Oder Kundenmails, bei denen der Ton sitzen muss.

Die ehrliche Empfehlung

Du brauchst nicht beide.

Wenn du hauptsächlich Content strukturierst, recherchierst und viel Material durchsetzt: Astra. Es braucht pro Aufgabe deutlich weniger Tokens, und das merkst du überall, wo nach Verbrauch abgerechnet wird.

Wenn du mit langen, immer gleichen Kontexten arbeitest oder auf Ton und Feinheit angewiesen bist: Claude.

Wenn du unter zehn KI-Aufgaben pro Woche hast: bleib beim 23-Euro-Abo und ignorier den ganzen Benchmark-Lärm. Der ist für Entwickler geschrieben, nicht für dich.

Was ich definitiv nicht machen würde: beide Top-Abos parallel bezahlen, weil man ja nie weiß. Das sind rund 200 Euro im Monat für ein Gefühl.

Teste drei echte Aufgaben. Rechne die Nacharbeit dazu. Entscheide dann.

Und wenn du solche Rechnungen mit anderen österreichischen und deutschen Selbstständigen vergleichen willst, bevor du dich in Abos verzettelst: Dafür gibt es die ContentWerk Community.

---

Auch interessant