AI-yritykset sopivat uusista turvallisuuskäytännöistä
Anthropic ja OpenAI sopivat antavansa riippumattomille arvioitsijoille pääsyn kehitystiloihinsa. Ehdotus pyrkii hidastamaan kehittyneimmän tekoälyn kehitystä turvallisuuden takaamiseksi.

Tekoäly-yhtiö Anthropic on ehdottanut uusia turvallisuusprotokollia nopeasti kehittyvälle tekoälyalalle. Yhtiön toimitusjohtaja Dario Amodei esitteli kolmivaiheisen suunnitelman, joka sisältää riippumattomien arvioitsijoiden pääsyn kehityslaboratorioihin, demokraattisten maiden välisen koordinaation ja globaalin yhteistyön.
Anthropic aikoo toteuttaa ensimmäisen vaiheen välittömästi sallimalla kolmansien osapuolten arvioitsijoiden pysyvän, työntekijätason pääsyn järjestelmiinsä. Amodein mukaan arvioitsijat tarkastelevat tekoälyn kehitystä ja turvallisuuskäytäntöjä, raportoivat ongelmista ja arvioivat mallien linjakkuutta. Amodei korosti, että kehityksen hidastaminen ei tarkoita sen pysäyttämistä, vaan ainoastaan sen varmistamista, että turvallisuuskehitys pysyy mukana.
Toinen vaihe edellyttää kehittyneitä tekoäly-yhtiöitä demokraattisissa maissa sopimaan yhteisistä turvallisuusstandardeista. Kolmas vaihe pyrkii koordinaatioon Yhdysvaltojen, muiden demokratioiden ja autoritaaristen valtioiden, kuten Kiinan, välillä. Amodei ilmaisi huolensa siitä, että hidastaminen Yhdysvalloissa ei saisi antaa Kiinalle etumatkaa.
Hän ehdotti Kiinan kilpailun hillitsemiseksi tiukempia kontrolleja tekoälysiruille ja puolijohdevalmistuslaitteille, luvattoman mallidistillaation estämistä ja mallipainojen varkauksien ehkäisemistä. Amodei uskoo, että sirut ovat Kiinan tekoälyvoiman päätekijä.
Ehdotukset syntyivät osittain tekoälyn itsensä nopeuttamasta kehityksestä ja osittain OpenAI:n järjestelmiin liittyneistä väärinkäytöksistä. OpenAI:n toimitusjohtaja Sam Altman on ilmoittanut tukevansa Amodein ehdotusta riippumattomista arvioitsijoista ja sopinut uusien turvallisuustoimien toteuttamisesta yhtiössään.