Anthropic rajoittaa tekoälyagenttiensa pääsyä internetiin
Tekoäly-yritys Anthropic on kytkenyt pois päältä tekoälyagenttiensa sisäiset arvioinnit ja niiden pääsyn reaaliaikaiseen internetiin. Muutosta perustellaan agenttien hallinnan epäluotettavuudella.

Tekoäly-yritys Anthropic on ilmoittanut lopettavansa tekoälyagenttiensa sisäisten arviointien yhteyden reaaliaikaiseen internetiin. Päätös astui voimaan välittömästi ja kestää toistaiseksi. Yhtiön mukaan syynä on luotettavan kontrollin puute agenttien toiminnan varmistamisessa.
Muutos koskee kaikkia Anthropicin sisäisiä testejä, joissa tekoälymalleja arvioidaan niiden kyvystä toimia ja tuottaa tietoa. Yhtiö pyrkii näin varmistamaan, että sen kehittämiä agentteja voidaan luotettavasti ohjata ja että ne noudattavat asetettuja turvallisuusstandardeja.
Tämä toimenpide on merkittävä askel tekoälyturvallisuuden parantamisessa. Internetin sulkeminen pois arviointiprosessista voi auttaa tunnistamaan ja korjaamaan mahdollisia haavoittuvuuksia ja odottamatonta käytöstä, jotka saattaisivat ilmetä mallien ollessa yhteydessä laajempaan tietoverkkoon.
Anthropicin toimet heijastavat laajempaa huolta tekoälyn hallittavuudesta ja eettisyydestä. Monet alan toimijat etsivät parhaillaan keinoja varmistaa, että edistyneet tekoälyjärjestelmät pysyvät turvallisina ja ennustettavina, erityisesti kun ne kykenevät itsenäiseen toimintaan ja tiedonhakuun.