studio raoulsoftware innovation, architecture & development
← Blog
KI in der Praxis · 25. September 2026

Das leistungsstärkste KI-Modell kostet jetzt 40 % weniger. Was das verändert.

Anthropics Flaggschiff Claude Opus 5.5 ist jetzt rund 40 % günstiger — mit 60 % Rabatt auf Cache-Reads. Das verändert die Wirtschaftlichkeit von KI-Agenten im produktiven Einsatz.

Auf einen Blick
$4
Preis pro Million Input-Token
–40%
günstiger als Opus 5 auf typischen Workloads
–60%
Preissenkung bei Cache-Reads
66,4%
Score auf Terminal-Bench 4.0

Das leistungsstärkste KI-Modell auf dem Markt ist gerade deutlich günstiger geworden. Am 22. September hat Anthropic Claude Opus 5.5 veröffentlicht — zu Preisen, die auf typischen Workloads rund 40 % günstiger als die Vorgängerversion sind. Ein Million Input-Token kostet jetzt 4 Dollar statt 5, Output-Token kosten 20 Dollar statt 25.

Am stärksten fällt der Preis für Cache-Reads: minus 60 %, von 0,50 auf 0,20 Dollar pro Million Token. Ein Cache-Read fällt an, wenn ein KI-Modell denselben Text oder dieselben Anweisungen mehrfach liest. Lange Agenten-Aufgaben — Vertragsprüfungen, Code-Analysen, Verarbeitung umfangreicher Berichte — tun das ständig. Dieser Rückgang um 60 % macht dokumentenintensive KI-Workflows deutlich günstiger.

Anthropic gibt an, dass Opus 5.5 bei den meisten Aufgaben genauso gut abschneidet wie ihr bestes Forschungsmodell. Bei Terminal-Bench 4.0, einem Standard-Test für Coding-Agenten, erzielt es 66,4 %. Der günstigere Preis bedeutet keinen Leistungsverlust — das Modell ist billiger und genauso leistungsfähig.

Es gibt jedoch einen echten Haken. Anthropic hat vier Dinge an der API geändert, die älteren Opus-5-Code zum Absturz bringen. Außerdem hängt die versprochene Ersparnis davon ab, wie das Effort-Level des Modells eingestellt ist — ein Parameter, der sich mit diesem Release geändert hat. Testet unbedingt auf eurem echten Workload, bevor ihr migriert.

Wenn ihr KI-Workflows habt, die bisher zu teuer waren, lohnt es sich jetzt, die Kalkulation neu aufzumachen. Der Rückgang bei Cache-Reads ist besonders relevant für alles, was lange Dokumente wiederholt verarbeitet — Rechtsprüfungen, Code-Analysen, Support-Pipelines. Eine konkrete Maßnahme: Berechnet euren Verbrauch des letzten Monats mit dem neuen Pricing. Dann testet die Migration in einer Staging-Umgebung.

Quellen
← Die meisten Unternehmen wissen nicht, wie viele KI-Agenten sie betreiben← Fast ein Drittel jeder Mission geht für menschliche Operatoren drauf. Ein Startup hat damit abgeschlossen.
Das leistungsstärkste KI-Modell kostet jetzt 40 % weniger. Was das verändert.