Claude Opus 5.5 gilt als eines der stärksten Modelle für Programmieraufgaben – doch offenbar hat Anthropic auch am Schreibstil gearbeitet. Die Analyse von Arena, einem Werkzeug zum Benchmarking von KI-Modellen, legt nahe, dass sich die Textausgabe des Modells systematisch verändert hat.

Arena untersuchte dafür Antworten aus der Text Arena mit hohem Schlussfolgerungsaufwand aus den Monaten August und September 2026. Von zwölf erfassten Schreibmaßen bewegten sich zehn in eine Richtung, die Arena als Verbesserung einstuft. Konkret heißt das: weniger der offensichtlichen Muster, an denen sich maschinell erzeugte Texte erkennen lassen, kürzere Sätze und eine einfachere Wortwahl als bei Opus 5.

Der auffälligste Einzelwert betrifft den Gedankenstrich. Während Opus 5 im Schnitt 15,2 Gedankenstriche pro 1.000 Wörter verwendete, sind es bei Opus 5.5 nur noch 0,8 – ein Rückgang um etwa 95 Prozent. Damit verschwindet ausgerechnet jenes Satzzeichen weitgehend aus den Ausgaben, das zuletzt als eines der deutlichsten Indizien für KI-generierte Inhalte galt.

Anzeige

Auch der Strichpunkt wird deutlich seltener eingesetzt: Seine Häufigkeit fiel laut Arena von 6,10 auf 1,64 pro 1.000 Wörter. Bei der Satzlänge zeigt sich das gleiche Bild in kleinerem Maßstab – ein Satz umfasst bei Opus 5.5 im Durchschnitt 10,03 Wörter, bei Opus 5 waren es noch 12,14.

Einen Nachteil hat die Umstellung allerdings: Opus 5.5 ist wortreicher geworden. Die durchschnittliche Antwort wuchs von 453 auf 481 Wörter an. Im Vergleich der untersuchten Modelle ist Opus 5.5 damit dasjenige, das die längsten Texte produziert – kürzere Sätze, aber insgesamt mehr davon.

Dass ein Anbieter gezielt am Schreibverhalten seines Modells schraubt, ist derzeit ungewöhnlich. Die Aufmerksamkeit der Branche lag zuletzt überwiegend auf Programmierfähigkeiten. Die praktische Folge für Leserinnen und Leser dürfte vor allem eine sein: Im Netz werden künftig deutlich weniger Gedankenstriche auftauchen.