Arena AI -mallivertailu: Anthropic vahva, Kiinan mallit kiriävät
Arena-alustan uudessa AI-mallien vertailussa Anthropicin mallit dominoivat kokonaislistaa. Kiinalainen Kimi-K3-Max säilyttää vahvan asemansa eri listoilla.

Arena-alustan (arena.ai) elokuun 10.–16. päivän viikon AI-suurmallien sokkotestitulokset osoittavat Anthropicin mallien vahvaa menestystä. Yhtiön useat uudet Claude-opus-4-sarjan mallit valtasivat vertailun kokonaislistan viisi kärkisijaa.
Kiinalainen Kimi-K3-Max nousi kokonaislistalla kaksi sijaa ja on nyt 12. sijalla. Se säilyttää myös toisen sijan etupään kehitystyöhön keskittyvällä listalla. Alibaba Cloudin Qwen3.8-Max pääsi ensimmäistä kertaa älyagenttilistan kymmenen parhaan joukkoon.
Kiinalaiset mallit sijoittuvat yleisesti ottaen listan keski- ja yläosaan. Erityisesti etupään kehityksen kaltaisilla erikoisaloilla ne osoittavat merkkejä kirimään kiinni johtavia ulkomaisia malleja. Vertailu perustuu Arena-alustan käyttäjääänestyksiin, jotka heijastavat subjektiivista käyttäjäkokemusta.
Kokonaislistan kärjessä Anthropicin Claude-fable-5 oli ensimmäinen 1506 pisteellä. Uudet Claude-opus-4-sarjan mallit sijoittuivat välittömästi sen taakse. Googlen Gemini-3.7-flash-high nousi ensimmäisellä listallemenollaan jaetulle 9. sijalle.
Koodausmallien listalla Anthropicin mallit myös menestyivät. Kimi-K3-Max oli kuudes, ja se oli edelleen korkeimmalle sijoittunut kiinalainen malli tällä listalla. Alibaba Cloudin mallit sijoittuivat myös listan ylempään keskikastiin.