📣 Lähetä tiedotteenne meille
Sivusto päivittyy 15 minuutin välein
Teknologia

Alibaba Qwen3.8-Max kilpailee GPT-5.6:ta vastaan agenttisessa laskennassa

Kiinalainen teknologiayhtiö Alibaba on julkaissut uuden suuren kielimallin, Qwen3.8-Maxin. Malli väittää päihittävänsä kilpailijat agenttisessa laskennassa, kuten OSWorld-vertailussa.

3. elokuuta 2026
Alibaba Qwen3.8-Max kilpailee GPT-5.6:ta vastaan agenttisessa laskennassa

Alibaban tekoälytutkimusryhmä on esitellyt uuden lippulaivamallinsa, Qwen3.8-Maxin. Kyseessä on 2,4 biljoonan parametrin multimodaalinen suurten kielimallien (LLM) malli, joka keskittyy autonomiseen ohjelmistokehitykseen ja pitkäkestoisiin yritystason tehtäviin.

Yhtiön julkaisemien vertailutulosten mukaan Qwen3.8-Max ylittää useita nykyisiä kilpailevia malleja agenttisen laskennan ydintehtävissä. Erityisesti OSWorld-vertailussa Qwen3.8-Max saavutti 86,1 pistettä, mikä on enemmän kuin GPT-5.6 Sol Maxin (83,2) ja Fable 5:n (85,0) pisteet. Malli sai myös korkeimmat pisteet PaperBenchissä ja kilpaili vahvasti muilla ohjelmistokehityksen, tutkimuksen toistettavuuden ja multimodaalisen päättelyn osa-alueilla.

Julkaisu voi merkitä strategista muutosta Alibaballe, sillä yhtiö aikoo julkaista avoimet painot Qwen3.8-Maxille ja Qwen3.8-27B:lle ensi viikolla. Jos mallit julkaistaan sallivalla lisenssillä, se mahdollistaisi niiden itseisännöinnin yritysympäristöissä, mikä voisi merkittävästi vaikuttaa niiden käyttöönottoon.

Tarkkaa lisenssiehtoa ei ole vielä paljastettu, joten on mahdollista, että kyseessä on rajoittavampi kustomoitu lisenssi, kuten kilpailevan kiinalaisyhtiö Moonshot AI:n Kimi K3 -mallissa. Tämä voisi rajoittaa mallin laajamittaista hyödyntämistä.

Malli pyrkii yhdistämään useita vahvuuksia yritystason automaatioon. Alibaba kuvaa mallia autonomiseksi työtoveriksi, joka kykenee suorittamaan useita päiviä kestäviä projekteja. Sen väitetään voivan itsenäisesti toteuttaa yli kymmenen päivän ohjelmistokehitysprojekteja, toistaa tuhansien koodirivien tutkimuspaperteja ja hyödyntää multimodaalista palautetta suunnitelmien jatkuvaan tarkentamiseen. Nämä esittelyt ovat yhtiön tuottamia, eikä niitä ole vielä laajasti todennettu riippumattomasti, mutta ne heijastavat alan trendiä kohti malleja, jotka suorittavat kokonaisia työnkulkuja yksittäisten pyyntöjen sijaan.

Alkuperäinen lähde: venturebeat.com