Alibaba avasi suuren kielimallin Qwen3.8-2.4T-A95B painot
Alibaba on julkaissut Qwen3.8-2.4T-A95B-kielimallin painot avoimesti. Malli tukee alkuperäisesti 262 144 tokenin kontekstia ja sen parametreja voi laajentaa.

Kiinalainen teknologiayritys Alibaba on julkaissut Qwen3.8-2.4T-A95B -tekoälymallin painot avoimesti ModelScope-yhteisönsä kautta. Tämä on ensimmäinen kerta, kun Qwen-Max-tason mallin painot ovat saatavilla julkisesti.
Malli sisältää 2,4 biljoonaa parametria ja aktivoi 95 miljardia parametria jokaiselle tokenille. Erityisen huomionarvoista on mallin kyky käsitellä jopa 262 144 tokenin kontekstia, ja sitä voidaan laajentaa jopa yli miljoonaan tokeniin. Tämä mahdollistaa huomattavasti pidempien tekstien ja keskustelujen ymmärtämisen ja käsittelyn.
Qwen3.8 on suunniteltu parantamaan erityisesti ohjelmointia, toimistotehtäviä, tieteellistä tutkimusta ja pitkäkestoisia Agent-tehtäviä. Alibaban pilviversio, Qwen3.8-Max, perustuu tähän avoimeen painomalliin ja sisältää lisäominaisuuksia tuotantoympäristöihin.
Alustavissa arvioinneissa malli on osoittanut kilpailukykyä verrattuna muihin suuriin kielimalleihin, kuten GPT-4 ja Opus. Se saavutti vahvoja tuloksia useissa testeissä, jotka mittasivat sen suorituskykyä ohjelmointitehtävissä, yleisessä keskustelussa, ammatillisissa työkaluissa ja pitkän aikavälin kontekstin ymmärtämisessä. Mallin arkkitehtuuri hyödyntää Mixture-of-Experts (MoE) -tekniikkaa, jossa jokaisessa kerroksessa on 512 asiantuntijaa, ja jokaiselle tokenille valitaan 10 asiantuntijaa.