agorumin testi: Fable 5 on merkittävä hyppy pitkissä ja monimutkaisissa tehtävissä
agorumin ALBERT | AI -alustalla tehdyssä käytännön testissä uusi Fable 5 -tekolymalli osoittautui selvästi paremmaksi kuin Opus 4.8 pitkissä ja monimutkaisissa tehtävissä.

Software-yritys agorum® Software GmbH on testannut Anthropicin uutta Fable 5 -tekolymallia omalla ALBERT | AI -alustallaan, joka on integroitu heidän agorum core pro -ratkaisuunsa. Testissä verrattiin Fable 5:tä edeltävään Opus 4.8 -malliin, ja tulokset osoittivat Fable 5:n olevan merkittävä edistysaskel erityisesti pitkiä ja monimutkaisia tehtäviä vaativissa sovelluksissa.
Fable 5 kuuluu Anthropicin uuteen Mythos-luokkaan ja se tarjoaa selvästi parempaa suorituskykyä tehtävissä, jotka vaativat pitkää keskittymiskykyä, useiden tietojen yhdistämistä tai autonomista toimintaa tuntien ajan. Agorumin mukaan malli toimi testissä suoraan "out-of-the-box" ilman erillisiä säätöjä.
Konkreettisia esimerkkejä Fable 5:n ylivoimasta olivat ohjelmistokehitys, jossa malli suoritti järjestelmätason migraation suuressa koodikannassa päivässä, työn, johon tiimiltä olisi mennyt kaksi kuukautta. Myös talousanalyysissä ja juridisten asiakirjojen tarkastuksessa Fable 5 ylitti Opus 4.8:n merkittävästi, saavuttaen uusia ennätyksiä alan standarditesteissä.
Tekoälyn "muistin" osalta Fable 5 pystyy ylläpitämään keskittymistä miljoonien tokenien yli ja parantamaan tuloksiaan oman muistiinsa perustuen. Tämä tekee siitä soveltuvan esimerkiksi autonomisille agenteille, jotka suorittavat monipäiväisiä tehtäviä.
Vaikka Fable 5 tarjoaa merkittäviä etuja pitkissä ja monimutkaisissa tehtävissä, agorum huomauttaa, että se ei ole aina paras valinta. Monissa perinteisissä keskisuurten yritysten arjen tehtävissä puolta halvemmalla saatavilla oleva Opus 4.8 riittää edelleen täysin. Päätös mallien välillä onkin agorumin mukaan enemmän taloudellinen kuin tekninen kysymys.