
Anthropics Claude Opus 5 erreicht 30,2 Prozent auf dem ARC-AGI-3-Benchmark, fast viermal so viel wie der bisherige Bestwert von 7,8 Prozent (GPT-5.6 Sol). Laut den Benchmark-Machern formulierte das Modell erstmals eigenständig Spiegelungsgleichungen, ein bisher bei keinem Modell beobachtetes Verhalten, das auf deutlich stärkeres logisches Denken hindeutet.
Der Artikel Claude Opus 5 vervierfacht den Bestwert im härtesten KI-Logik-Benchmark erschien zuerst auf The Decoder.
