Wenn eine KI eine Aufgabe günstiger erledigt, klingt das erst einmal gut. Interessant wird es im Unternehmen an einer anderen Stelle: Muss danach auch weniger nachgebessert werden? Genau daran würden wir Claude Opus 5.5 messen. Anthropic hat das Modell am 22. September 2026 vorgestellt und stellt effizientere Arbeit in den Mittelpunkt.
Was ist an diesem Release neu, und für welche betrieblichen Aufgaben lohnt sich ein genauerer Blick? Wir ordnen die Ankündigung ein. Einen eigenen Vergleichstest mit Opus 5.5 haben wir für diesen Artikel nicht durchgeführt.
Was sich mit Opus 5.5 ändern soll
Anthropic nennt Verbesserungen bei umfangreichen Programmieraufgaben, Wissensarbeit und der Verständlichkeit der Antworten. In den eigenen Auswertungen sollen typische Aufgaben mit Standardeinstellungen rund 40 Prozent weniger kosten als mit Opus 5. Das beschreibt die Kosten der untersuchten Abläufe, keine pauschale Senkung sämtlicher Tarifpreise.
Auch bei der Kommunikation setzt der Anbieter an: wichtige Informationen früher nennen, weniger Fachjargon verwenden und vorgegebene Schreibregeln besser einhalten. Bei Prompt Injection berichtet Anthropic über stärkere Abwehr in seinen Tests. Solche Angriffe verstecken fremde Anweisungen beispielsweise in Webseiten, die ein Agent während seiner Arbeit liest.
Das Modell wird laut Ankündigung auch über AWS, Google Cloud und Microsoft Azure angeboten. Die Modell-ID auf der Claude Platform ist claude-opus-5-5. Zugang und Konditionen müssen zum jeweiligen Konto passen. Quelle: Anthropics Release-Ankündigung zu Opus 5.5.
Diese Angaben stammen vom Hersteller. Sie machen den Release prüfenswert, ersetzen aber keinen Vergleich an den Aufgaben des eigenen Betriebs.
Wo der Release im Mittelstand interessant wird
Für ein Unternehmen mit eigener Software ist zunächst die Entwicklungsarbeit naheliegend. Als überschaubaren Versuch würden wir eine bekannte, bereits gelöste Aufgabe wählen: einen Fehler in einem Datenexport finden, einen vorhandenen Test ergänzen oder eine kleine Funktion anpassen. Damit liegt ein fachlicher Maßstab vor. Das Team kann beurteilen, ob Opus 5.5 die Anforderungen richtig verstanden hat und ob seine Änderungen tatsächlich funktionieren.
Dabei sollte auch die Erklärung zum Ergebnis bewertet werden. Kann eine Entwicklerin schnell erkennen, was geändert wurde und warum? Sind verbleibende Unsicherheiten sichtbar? Eine lange Antwort kann vollständig sein und trotzdem unnötig viel Prüfzeit kosten. Für die Zusammenarbeit ist eine präzise Übergabe wertvoll.
Wer keine Software entwickelt, kann einen Vergleich an einer wiederkehrenden Dokumentenaufgabe aufbauen. Ein fiktives Beispiel wäre die Vorbereitung einer internen Projektübersicht aus freigegebenen Notizen. Das gewünschte Ergebnis enthält den aktuellen Stand, offene Entscheidungen und die jeweiligen Quellenstellen. Fehlende Angaben sollen als offen erscheinen. Die KI darf sie nicht durch plausible Vermutungen ersetzen.
In beiden Fällen würden wir Opus 5.5 zunächst parallel zum bisherigen Verfahren testen. Für den ersten Vergleich genügen anonymisierte oder eigens erstellte Unterlagen. Vertrauliche Kundendaten gehören erst in einen Arbeitsablauf, dessen Zugänge und Datenverarbeitung das Unternehmen geklärt hat.
Was die Kostenangabe für einen Betrieb bedeutet
Die Herstellerzahl ist ein Ausgangspunkt für eine Frage: Wie teuer ist bei uns ein brauchbares Ergebnis? Dazu gehören neben den Modellkosten auch die Vorbereitung und die menschliche Prüfung. Ein günstiger Durchlauf hilft wenig, wenn anschließend zwanzig Minuten lang Zahlen oder Änderungen kontrolliert werden müssen, die das bisherige Verfahren richtig geliefert hat.
Für einen kleinen Vergleich würden wir dieselben Aufgaben mit Opus 5.5 und dem bisher verwendeten Modell bearbeiten lassen. Der Auftrag, die bereitgestellten Informationen und die erlaubten Werkzeuge bleiben gleich. Zu jeder Aufgabe hält das Team fest, ob das Ergebnis verwendbar war, welche Fehler auftraten und wie viel Nacharbeit nötig wurde. Die tatsächlich angefallenen Kosten kommen dazu.
Das klingt unspektakulär, liefert aber eine brauchbare Entscheidungsgrundlage. Schon wenige sorgfältig ausgewählte Fälle können zeigen, wo ein größerer Test sinnvoll ist. Sie reichen noch nicht, um einen gesamten Unternehmensprozess ohne Aufsicht umzustellen.
Sollte man jetzt wechseln?
Für Teams, die bereits mit Claude arbeiten und regelmäßig an aufwendigen Aufgaben scheitern oder viel Nacharbeit haben, ist Opus 5.5 ein konkreter Anlass zum Vergleichen. Ein bestehender, gut funktionierender Ablauf muss dagegen nicht allein wegen eines neuen Modellnamens sofort umgebaut werden.
Unsere Empfehlung wäre, zuerst die wiederkehrende Aufgabe mit dem größten Prüfaufwand auszuwählen. Wenn Opus 5.5 dort verlässlich bessere Ergebnisse liefert, lässt sich der Einsatz schrittweise erweitern. Neue Schreibrechte oder automatische Freigaben sind dabei separate Entscheidungen. Ein Modellwechsel erteilt sie nicht automatisch.
Bei der KI-Beratung kann genau diese Auswahl der erste Schritt sein: Welcher Vergleich beantwortet eine echte betriebliche Frage? Für die Einbindung in vorhandene Programme kommt anschließend die individuelle KI-Softwareentwicklung hinzu.
Für uns liegt der interessante Punkt dieses Releases in der Aussicht auf weniger Aufwand pro verwendbarem Ergebnis. Ob Opus 5.5 das im eigenen Unternehmen einlöst, lässt sich am besten an einer Aufgabe entscheiden, deren Qualität das Team selbst beurteilen kann.
Quelle
Anthropic: Claude Opus 5.5, veröffentlicht am 22. September 2026. Anbieterangaben wurden am 28. September 2026 erneut geprüft. Anwendungsvorschläge und Bewertung im Artikel sind unsere redaktionelle Einordnung, keine Ergebnisse eines eigenen Produkttests.
Titelbild: KI-generierte Illustration auf Basis des freigegebenen Porträts von Nikolas Gottschol.

:quality(78))
:quality(78))
:quality(78))
:quality(78))
