Midterms 2026Wer nach unseren Maßstäben Ihre Stimme verdientZum Leitfaden →
GESCHRIEBEN IN KLAREM DEUTSCH.
CLAY TRIBUNE.
Anzeige

Claude Opus 5.5 erreichte 58 im Intelligenzindex, kostet aber 4 US-Dollar pro Million Eingabetoken.

Anthropics Claude Opus 5.5 erzielt 58 Punkte im Intelligence Index, kostet aber 4 Dollar für die Eingabe und 20 Dollar für die Ausgabe – mehr als die meisten Konkurrenten. Ein hoher Preis für ausführliche Antworten.

Von mitch·7 Min. Lesezeit
A glowing AI brain circuit with the score 58 floating above it, surrounded by swirling data streams.

Anthropic hat ein neues Modell im Rennen, und es kommt mit einem Wert, der beeindruckend klingt, einem Preis, der steil klingt, und einem Namen, den man zweimal lesen muss. Claude Opus 5.5 (Adaptive Reasoning, Max Effort, Default Fallback) ist das neueste Modell von Anthropics Reihe von Reasoning-Modellen, das am 22. September 2026 veröffentlicht wurde und nun seine erste ordentliche Bewertung erhält. Das Urteil ist einfach: es ist schlau, es ist wortreich und es kostet mehr als die meisten seiner Rivalen.

Das Modell hält einen Wert von 58 im Artificial Analysis Intelligence Index, was es deutlich über den Durchschnitt der vergleichbaren Modelle positioniert, wo der Median bei 25 liegt. Es generierte 260 Millionen Tokens während der Bewertung, was deutlich wortreicher ist als der Median von 88 Millionen. Es kostet 4 Dollar pro 1 Million Eingabe-Tokens und 20 Dollar pro 1 Million Ausgabe-Tokens, was es deutlich über den Median von 2 Dollar für Eingabe und 10 Dollar für Ausgabe positioniert.

Der Intelligence Index hinter dem Wert

Der Artificial Analysis Intelligence Index ist hier der Maßstab, und er hat sein eigenes Namensproblem. „Artificial Analysis Intelligence Index“ ist eine Tautologie in einem Doppelnamen, was entweder ein Schachzug von Branding-Genie oder ein Ausrutscher der Sprache ist. Wie auch immer, die Zahl ist wichtiger als das Etikett. Der Wert von 58 positioniert es deutlich über einem Median von 25, was einen echten Vorsprung gegenüber seinen Wettbewerbern darstellt.

Anzeige

Der Index gibt nicht an, wie er Intelligenz misst. Das ist eine echte Lücke in der Berichterstattung, die es wert ist, im Auge zu behalten, anstatt sie mit einer Vermutung zu schließen. Was der Index misst, heißt es im Bericht von artificialanalysis.ai, ist die Leistung in bestimmten Fähigkeiten und Branchen. Die Komponenten des Tests sind:

  1. Agenturbezogene Wissensarbeit
  2. Agenturbezogene Aufgaben in der realen Welt
  3. Agenturbezogene SaaS-Workflows
  4. Agenturbezogenes Programmieren und Terminalnutzung
  5. Professionelle Dokumentenargumentation
  6. Physikalisches Argumentieren
  7. Quantitative Analyse in Tabellenkalkulationen und Dokumenten
  8. Kubernetes-Vorfall: Analyse der Ursachen (Root-Cause-Analyse) )
  9. Medizinische Schlussfolgerungen mit langer Kontextbeurteilung )

Das ist ein breites Spektrum an Fähigkeiten. )

Das Modell weist außerdem eine Bewertung für das AA-Briefcase v1.1 auf, das im Bericht als „AA-Briefcase Elo“ beschrieben wird, obwohl nicht erklärt wird, was das im Hinblick auf die Leistung des Modells dort bedeutet. Die AA-Omniscience und der AA-Omniscience Index gehören ebenfalls zum Vergleichssatz, und der Bericht geht nicht näher auf das ein, was diese testen, außer sie zu nennen. )

Preisgestaltung und Token-Nutzung )

Der Preis von Claude Opus 5.5 ist der Punkt, der bei jedem, der es betreiben möchte, für eine Verzögerung sorgen wird. Bei 4 Dollar pro 1 Million Eingabetoken und 20 Dollar pro 1 Million Ausgabetoken liegt es deutlich über dem Median von 2 und 10 Dollar. Bei einer gemischten Rate von 7:2:1 Cache-Treffer/Eingabe/Ausgabe ergibt sich ein effektiver Preis von 2,94 Dollar pro 1 Million Token. Der Bericht weist darauf hin, dass die Preisgestaltung je nach Anbieter variieren kann, was bedeutet, dass die tatsächlichen Kosten je nachdem, wo ein Benutzer Zugriff kauft, variieren können. )

Die Token-Zahlen sind es wert, im Hinterkopf behalten zu werden. Das Modell erreichte einen Wert von 58 im Intelligence Index und generierte 260 Millionen Ausgabetoken, was am oberen Ende des Spektrums liegt, was andere Reasoning-Modelle in seinem Preissegment produzieren. Der Median lag bei 88 Millionen. Dieses Ausgabevolumen ist an sich nicht verschwenderisch – es könnte ein Zeichen für Gründlichkeit sein. Aber es ist ein schwerer Schlag ins Portemonnaie, da die Ausgabetoken 20 Dollar pro Million kosten. )

Das Kontextfenster beträgt 1 Million Token, was bestimmt, wie viel Text und Gesprächshistorie das Modell in einer einzigen Anfrage verarbeiten kann. Dieses Fenster ist Standard für ein Modell dieser Größe und nicht der Vergleichspunkt hier – der Vergleichspunkt ist die Intelligenz, die das Modell innerhalb dieses Fensters liefert. )

Was Claude Opus 5.5 eigentlich tut )

Anthropic beschreibt das Modell als ein Reasoning-Modell, das erweitertem Denken oder Chain-of-Thought-Reasoning verwendet, um komplexe Probleme zu lösen, bevor es eine Antwort liefert. Es unterstützt Text- und Bildeingaben und kann beides in einer einzigen Anfrage verarbeiten. Das Modell kann Bilder analysieren, beschreiben und Fragen dazu beantworten, obwohl der Bericht kein Beispiel dafür liefert, wie das in der Praxis aussieht. Es kann auch Textausgaben generieren. )

Das Modell ist proprietär — Anthropic hat die Modellgröße oder die Anzahl der Parameter nicht offengelegt. Es handelt sich nicht um ein Modell mit offenen Gewichten, was bedeutet, dass seine Architektur und seine Trainingsdaten nicht für die Einsichtnahme durch externe Forscher zur Verfügung stehen. Das ist eine erhebliche Einschränkung für alle, die seine Grenzen testen oder sein Verhalten mit dem seiner Konkurrenten vergleichen möchten.

Wie es im Vergleich zu anderen Modellen abschneidet

Der Bericht vergleicht Claude Opus 5.5 mit einigen Modellgruppen, und die Muster stimmen über alle hinweg überein. Claude Opus 5.5 ist nach Maßgabe des Benchmarks teuer und spricht deutlich mehr als seine Konkurrenten.

Der Bericht gliedert Modelle für den Vergleich in mehrere Kategorien:

  • Nicht-Denkmodelle, verglichen nur mit anderen Nicht-Denkmodellen
  • Denkmodelle, verglichen sowohl mit Denk- als auch mit Nicht-Denkmodellen
  • Modelle mit offenen Gewichten, verglichen nur mit anderen Modellen mit offenen Gewichten derselben Größenklasse, aufgeschlüsselt nach Parameteranzahl (klein: ≤4B, mittel: 4B–40B, groß: 40B–150B, sehr groß: >150B)
  • Proprietäre Modelle, verglichen mit proprietären und offenen Modellen desselben Preissegments, unter Verwendung eines gemischten Preisverhältnisses von 3:1 für Eingabe/Ausgabe

Claude Opus 5.5 befindet sich im Vergleich der Denkmodelle, und sein Preis wird mit der Kategorie von 0,15 bis 1 US-Dollar pro 1 Million Token verglichen. Der Bericht gibt nicht an, wo das Modell im größeren Vergleich der proprietären Modelle liegt, der ein anderes gemischtes Preisverhältnis verwendet.

Das Geschäft, teuer zu sein

Die eigenen Zahlen des Berichts erzählen eine klare Geschichte darüber, wo Claude Opus 5.5 steht. Es ist intelligenter als seine Konkurrenten nach dem Intelligence Index. Es spricht mehr als seine Konkurrenten. Und es kostet mehr als die meisten davon. Das ist eine nützliche Kombination, wenn das Problem im Handeln den Preis wert ist, aber es ist ein Warnsignal, wenn die Frage von einem günstigeren Modell beantwortet werden könnte.

Der gemischte Preis von 2,94 US-Dollar pro 1 Million Token, basierend auf Anthropics API, ist die Zahl, an der man sich festhalten sollte. Sie liegt über dem Median über alle Bereiche hinweg und gilt für jede Arbeitslast, die Input- und Output-Kosten mischt. Der Bericht weist darauf hin, dass die Preise je nach Anbieter variieren können, sodass sich die Zahl je nachdem, wo ein Benutzer Zugriff kauft, verschieben kann. Das ist ein reales Problem für alle, die einen Workflow rund um das Modell aufbauen.

Was das für Nutzer bedeutet (

Das Ergebnis ist einfach. Claude Opus 5.5 ist ein Modell für Menschen, die Antworten benötigen, die sich aus der Durchdachteilung eines Problems ergeben, nicht nur das Abrufen einer bekannten Tatsache. Es ist ein Modell für Nutzer, die die ausführlichste, gründlichste Antwort wünschen, die sie erhalten können, und die bereit sind, dafür zu bezahlen. Der Wert des Modells von 58 im Intelligence Index deutet darauf hin, dass es dieses Versprechen einhält, aber die Kosten von 260 Millionen Ausgabetoken sind eine echte Belastung für jeden Workflow, der es im großen Maßstab betreibt.

Das Modell ist über 5 API-Anbieter verfügbar, was den Nutzern etwas Spielraum gibt, um nach dem besten Preis zu suchen. Anthropic’s eigener API ist die Quelle der Preisangaben, und der Bericht vergleicht Anbieter für Nutzer, die die Zahlen gegeneinander prüfen möchten. Das ist ein nützlicher Service, ändert aber die zugrunde liegende Mathematik nicht.

Claude Opus 5.5 ist ein Modell, das gut abschneidet, viel redet und mehr kostet als die meisten seiner Rivalen. Wenn das Problem gelöst werden wert ist und das Budget keine Rolle spielt, ist es ein Modell, das man in Betracht ziehen sollte. Wenn das Problem mit einem günstigeren Modell gelöst werden kann, ist es ein Modell, das man meiden sollte. Der Bericht hat die Arbeit geleistet, die Intelligenz zu messen; die Entscheidung, welchen Kompromiss man eingeht, liegt beim Nutzer.

Quelle: “Claude Opus 5.5 Intelligence, Performance and Price Analysis (Max),” artificialanalysis.ai.

Das Notizbuch

Das Notizbuch abonnieren.

Die besten Geschichten des Tages und jedes neue Urteil, in klarem Deutsch, um sieben im Postfach. Eine Mail am Tag, nicht mehr.

Wir schicken eine Bestätigungsmail. Jede Ausgabe hat einen Abmeldelink, ein Klick genügt.

Anzeige

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

Als Amazon-Partner verdient Clay Tribune an qualifizierten Verkäufen.