XPeng julkaisi TuringViT-mallin älyajoon ja robotiikkaan
Autonvalmistaja XPeng on julkaissut TuringViT-visionkooderin, jota käytetään älyajoneuvoissa, ohjaamoissa ja yhtiön IRON-robottiohjelmassa.

Autonvalmistaja XPeng on julkaissut TuringViT-visionkooderin, jota käytetään sen älyajoneuvojen, älykkäiden ohjaamojärjestelmien ja IRON-nimisen humanoidirobottiohjelman kehityksessä.
TuringViT on suunniteltu käyttöön näkö-kieli- ja näkö-kieli-toimintamalleissa. XPeng tarjoaa mallista kaksi versiota: TuringViT-18L ja TuringViT-24L. Yhtiön mukaan 1536x1536 resoluutiolla toimiva TuringViT-18L saavutti huomattavasti paremman suorituskyvyn kuin aiemmat vertailumallit.
XPengin mukaan TuringViT-18L:n läpivirtausnopeus oli 3,04 kertaa suurempi kuin Seed1.5-ViT-mallin ja 2,16 kertaa suurempi kuin SigLIP2-ViT-L-mallin. Malli on koulutettu 850 miljoonalla kuva-teksti-parilla.
Koulutusdatasta huolimatta malli saavutti keskimäärin 83,6 prosentin pistemäärän kuudessa nollalaukaisutestissä. Tämä tulos ylittää avoimen lähdekoodin vertailumallien suorituskyvyn, vaikka niitä koulutettiin jopa 10 miljardilla näytteellä.