Anthropics neues KI-Modell Opus 5.5 hat sich in einem unabhängigen KI-Benchmark an die Spitze gesetzt. Dafür sind die Kosten aber auch weiterhin hoch.
Nachdem Anthropic Claude Opus 5.5 freigegeben hat, hat sich das Flaggschiff-Modell in dieser Woche an die Spitze eines bekannten unabhängigen KI-Benchmarks gesetzt. Den betreibt Artificial Analysis unter dem Namen Intelligence Index und dort steht das KI-Modell inzwischen auf Platz eins. Der Index fasst die Ergebnisse zehn verschiedener Tests zusammen, zum Beispiel zum Programmieren und Wissensfragen. Das heißt aber nicht, dass Opus 5.5 für alle Aufgaben immer die beste Wahl ist.
Beim Programmieren mal deutlich, mal knapp(Bild: Artifical Analysis)
Die Zusammenfassung von Artificial Analysis zeigt: Wer primär Leistung benötigt, sollte Anthropics neues Flaggschiff ausprobieren. Wer aber auf die Kosten achten muss und trotzdem vergleichbare Ergebnisse möchte, sollte sich demnach Astra ansehen. Das leistungsfähigste Sprachmodell von OpenAI wurde erst Anfang des Monats freigegeben. So sind laut der Analyse zwar die Token bei Opus deutlich günstiger als bei Astra, letzteres benötigt aber viel weniger davon. Anthropics älteres Modell Fable 5.1 liegt bei der Performance hinter Opus und kostet pro Token mehr.
Für die Analyse wurden die drei Modelle in ihrer höchsten Leistungsstufe getestet. Claude Opus 5.5 erzielt dabei 58 Punkte. OpenAIs GPT-6 Astra und Claude Fable 5.1 erreichten jeweils 53. Die Detailauswertung zeigt, dass Opus und Astra mit jeweils rund 60 Prozent bei einem Test für Aufgaben an der Kommandozeile beinahe gleichauf liegen. Wenn es um wissenschaftliches Programmieren geht, liegt Opus mit 11 Prozentpunkten klar vor Astra, aber auch nur 4 Prozentpunkte höher als Fable.
(Bild: Artifical Analysis)
(mho)
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Wasserzeichen für KI-Texte: Anthropic weitet Anwendung aus | 0 | 19.17 | 25-09-2026 |
| 2 | Defenders call out OpenAI defense pledge, Astra release timing | 0 | 7.95 | 04-09-2026 |
| 3 | Claude возглавил чарт App Store на фоне отказа стартапа от сотрудничества с властями США | 0 | 7.23 | 02-03-2026 |
| 4 | KI: OpenAI pausiert KI-Training nach neuem Zwischenfall | 0 | 16.41 | 26-09-2026 |
| 5 | OpenAI приостановил обучение своих самых эффективных моделей, пишут СМИ | 0 | 6.21 | 27-09-2026 |
| 6 | Kimi, MiniMax Code и ZCode в OpenResearch: форк за один вечер вместе с Claude Opus 5.5 | 0 | 6.96 | 25-09-2026 |
| 7 | KI-Angst wächst: OpenAI-Chef sagt Börsengang für 2026 ab | 0 | 21.49 | 13-09-2026 |
| 8 | Axios узнал о приостановке обучения моделей OpenAI из-за проблем с безопасностью | 0 | 13.88 | 27-09-2026 |
| 9 | OpenAI приостановила обучение некоторых нейросетей из-за проблем с безопасностью | -1 | 8.55 | 27-09-2026 |