📣 Lähetä tiedotteenne meille
Sivusto päivittyy 15 minuutin välein
Teknologia

Arena AI -mallivertailu: Anthropic vahva, Kiinan mallit kiriävät

Arena-alustan uudessa AI-mallien vertailussa Anthropicin mallit dominoivat kokonaislistaa. Kiinalainen Kimi-K3-Max säilyttää vahvan asemansa eri listoilla.

17. elokuuta 2026
Arena AI -mallivertailu: Anthropic vahva, Kiinan mallit kiriävät
Kuva on AI:lla tehty kuvituskuva

Arena-alustan (arena.ai) elokuun 10.–16. päivän viikon AI-suurmallien sokkotestitulokset osoittavat Anthropicin mallien vahvaa menestystä. Yhtiön useat uudet Claude-opus-4-sarjan mallit valtasivat vertailun kokonaislistan viisi kärkisijaa.

Kiinalainen Kimi-K3-Max nousi kokonaislistalla kaksi sijaa ja on nyt 12. sijalla. Se säilyttää myös toisen sijan etupään kehitystyöhön keskittyvällä listalla. Alibaba Cloudin Qwen3.8-Max pääsi ensimmäistä kertaa älyagenttilistan kymmenen parhaan joukkoon.

Kiinalaiset mallit sijoittuvat yleisesti ottaen listan keski- ja yläosaan. Erityisesti etupään kehityksen kaltaisilla erikoisaloilla ne osoittavat merkkejä kirimään kiinni johtavia ulkomaisia malleja. Vertailu perustuu Arena-alustan käyttäjääänestyksiin, jotka heijastavat subjektiivista käyttäjäkokemusta.

Kokonaislistan kärjessä Anthropicin Claude-fable-5 oli ensimmäinen 1506 pisteellä. Uudet Claude-opus-4-sarjan mallit sijoittuivat välittömästi sen taakse. Googlen Gemini-3.7-flash-high nousi ensimmäisellä listallemenollaan jaetulle 9. sijalle.

Koodausmallien listalla Anthropicin mallit myös menestyivät. Kimi-K3-Max oli kuudes, ja se oli edelleen korkeimmalle sijoittunut kiinalainen malli tällä listalla. Alibaba Cloudin mallit sijoittuivat myös listan ylempään keskikastiin.

Alkuperäinen lähde: ithome.com