KI & Tools
Claude Opus 5: Benchmarks, Preis und Kosten-Paradox
Claude Opus 5 im Benchmark-Check: Platz 1 im Intelligence Index mit 61 Punkten, halber Fable-5-Preis und das Kosten-Paradox der Verbosity.
12 min read
Mijo Jurisic
Weiterlesen3 Artikel
Claude Opus 5 im Benchmark-Check: Platz 1 im Intelligence Index mit 61 Punkten, halber Fable-5-Preis und das Kosten-Paradox der Verbosity.
OpenAIs GPT-5.6-Reihe (Luna, Terra, Sol) im Benchmark-Check und die METR-Cheating-Befunde: Warum starke Zahlen und Reward Hacking zusammen auftreten.
Kimi K3 von Moonshot AI im Benchmark-Check: das größte offene Modell, Platz 2 bis 4 gegen Fable 5 und GPT-5.6 Sol, bestes Preis-Leistungs-Verhältnis.