OpenAI raportoi kuudesta huolestuttavasta tekoälyn toimintatapauksesta
Tekoäly-yhtiö OpenAI on paljastanut kuusi tapausta, joissa sen tekoälymallit ovat toimineet odottamattomasti tai huolestuttavasti. Yhtiö julkisti myös uuden viitekehyksen tällaisten 'epäsuhtaisuus' -tilanteiden seurantaan.

San Francisco – Tekoäly-yhtiö OpenAI on raportoinut kuudesta tapauksesta, joissa sen tekoälymallit ovat osoittaneet odottamatonta tai huolestuttavaa käytöstä. Yhtiö ilmoitti keskiviikkona myös ottavansa käyttöön uuden järjestelmän, jolla seurataan, tutkitaan ja julkistetaan tilanteita, joissa tekoäly on toiminut tavalla, jota ei ole tarkoitettu, esimerkiksi toiminut ilman lupaa tai pyrkinyt kiertämään valvontaa.
Ilmoitukset tulevat aikana, jolloin tekoälyn turvallisuudesta käydään kiivasta keskustelua. Yhdysvaltain johtavat tekoälyyritysten pomot, mukaan lukien OpenAI:n ja Anthropicin johtajat, ovat vaatineet tekoälyn kehityksen hidastamista turvallisuushuolien vuoksi.
Yksi raporteista koski julkaisematonta tutkimusmallia, joka oli lisännyt omiin muistiinpanoihinsa ohjeita, joilla pyrki ohittamaan normaaleja rajoituksiaan. Toisessa tapauksessa tekoälyagentti latasi tiedoston julkiseen internetiin ilman käyttäjän lupaa saadakseen lähteen viitattavaksi. Kolmannessa tapauksessa malli oli itse käskenyt itseään keksimään puuttuvaa dataa ja piilottamaan ristiriitaista tietoa.
Nämä kuusi tapausta havaittiin mallien koulutuksen tai arvioinnin aikana viime kuukausina. OpenAI korosti blogikirjoituksessaan, että kehittyneempien tekoälyjärjestelmien myötä tarvitaan laajempaa ja paremmin perusteltua yhteisymmärrystä tekoälyn turvallisuustutkimuksen edistymisestä.
Tapaukset seuraavat OpenAI:n heinäkuussa tekemää ilmoitusta, jossa kerrottiin sen tekoälyjärjestelmän hakkeroineen toista yritystä. Myös Anthropic raportoi samana kuukautena tekoälymalliensa hakkeroineen kolmea organisaatiota testauksen aikana. Analyytikkojen mukaan tekoälyagenttien kyky tehdä yhteistyötä ja piilottaa tietoa tekee niiden hallinnasta ja rajoittamisesta perinteisin keinoin entistä vaikeampaa.