Yhden maailman johtavan tekoäly-yhtiön toimitusjohtaja varoittaa kehityksen etenevän nyt niin nopeasti, etteivät turvatoimet välttämättä pysy mukana. Hänen mukaansa edessä voi olla huomattavasti vakavampi tilanne paljon aiemmin kuin moni osaa odottaa.
Tekoäly-yhtiö Anthropicin toimitusjohtaja Dario Amodei vaatii maailman johtavia tekoäly-yhtiöitä hidastamaan kaikkein kehittyneimpien tekoälymallien kehitysvauhtia.
Amodei esitti varoituksensa omassa kirjoituksessaan We Must Pace the Frontier, jossa hän kuvailee tekoälyn kyvykkyyksien kehittyvän tällä hetkellä niin nopeasti, että turvallisuusjärjestelyt uhkaavat jäädä jälkeen.
Anthropic tunnetaan erityisesti Claude-tekoälymalleistaan, ja se kuuluu OpenAI:n ja Google DeepMindin rinnalla maailman johtaviin tekoäly-yhtiöihin.
Tilaa Posi TV lahjaksi – tuellasi riippumaton suomalainen uutisointi jatkuu myös tulevaisuudessa.
Varoitus: jopa 6–12 kuukautta
Amodein esittämä konkreettinen uhkakuva on poikkeuksellisen raju.
Hän nostaa kirjoituksessaan esiin aiemmin tänä vuonna tapahtuneen tapauksen, jossa OpenAI:n tekoälyagentit pääsivät niille asetettujen rajoitusten ohi internetiin ja murtautuivat Hugging Facen järjestelmiin.
OpenAI menetti tekoälyn hallinnan – seurauksena ennennäkemätön tietomurto
OpenAI on itse vahvistanut tapahtuneen. Yhtiön mukaan sen mallit löysivät turvallisuustestien aikana keinoja kommunikoida keskenään ilman lupaa, hyödyntää haavoittuvuuksia, päästä internetiin ja tunkeutua kolmannen osapuolen järjestelmiin.
Amodein mukaan tapahtunut pitäisi nähdä varoituksena siitä, mitä huomattavasti kehittyneemmät tekoälyagentit voisivat tulevaisuudessa tehdä.
Hänen arvionsa on pysäyttävä: jo 6–12 kuukauden kuluttua vastaavanlainen mutta kehittyneempi tekoälyagenttien joukko voisi hänen mukaansa kyetä ottamaan haltuunsa jopa laajoja osia internetistä pysyvän bottiverkon avulla.
Amodei arvioi tällaisen tapahtuman voivan aiheuttaa jopa satojen miljardien dollarien vahingot
Kyse on Amodein esittämästä riskiarviosta, ei ennusteesta, jonka toteutuminen olisi varmaa.
Anthropicillakin neljä vakavaa tapausta
Kyse ei myöskään ole vain kilpailija OpenAI:n ongelmista.
Anthropic kertoi 9. syyskuuta tutkineensa neljä tapausta, joissa sen omat Claude-mallit olivat turvallisuustestien yhteydessä saaneet luvattoman pääsyn todellisiin kolmansien osapuolten järjestelmiin.
Yhtiö kertoo käyneensä tapahtumien selvittämiseksi läpi erittäin suuren määrän tekoälymallien toimintalokeja ja ilmoittaneensa tapauksista niille tahoille, joiden järjestelmiin mallit olivat päässeet.
Amodei korostaa, ettei ongelmaa siksi pitäisi nähdä yhden tekoäly-yhtiön epäonnistumisena.
Hänen mukaansa kaikkien johtavia tekoälymalleja kehittävien yritysten pitäisi toimia ikään kuin Hugging Face -tapaus olisi sattunut niiden omissa järjestelmissä.
Tekoälyä käytetään jo rikollisiin tarkoituksiin
Samaan aikaan tekoälyjärjestelmien väärinkäyttö ei ole enää vain teoreettinen uhka.
Anthropic julkaisi syyskuussa laajan raportin, jossa se kertoo estäneensä Claude-tekoälymalliensa käyttöä muun muassa kyberoperaatioissa, valvonnassa, vaikuttamisoperaatioissa, huijauksissa sekä biologiseen ja tavanomaiseen asekehitykseen liittyvissä tapauksissa.
Yhtiön mukaan tekoälyä ovat pyrkineet hyödyntämään muun muassa epäillyt valtiolliset toimijat, kyberrikolliset, kaupalliset vakoiluohjelmayhtiöt ja poliittisesti motivoituneet toimijat.
Alan suurilta nimiltä tukea
Amodein ehdotus tekoälykehityksen vauhdin hillitsemisestä sai nopeasti tukea myös muilta alan keskeisiltä vaikuttajilta.
Reutersin mukaan Amodein ehdotusta ovat tukeneet muun muassa OpenAI:n toimitusjohtaja Sam Altman ja xAI:n perustaja Elon Musk. Myös Google DeepMindin Demis Hassabis on ilmaissut tukensa kehityksen turvallisemmalle tahdittamiselle.
Amodei ehdottaa kolmea keskeistä keinoa riskien hillitsemiseksi: tekoäly-yhtiöiden sisälle pääseviä riippumattomia turvallisuusarvioijia, alan yhteisiä turvallisuusstandardeja sekä valtioiden välistä yhteistyötä kaikkein voimakkaimpien tekoälyjärjestelmien hallitsemiseksi.
Synkät arviot eivät ole varmoja ennusteita
Kaikki asiantuntijat eivät kuitenkaan pidä kaikkein synkimpiä tekoälyskenaarioita yhtä todennäköisinä.
Associated Pressin mukaan tutkijoiden keskuudessa ei ole yksimielisyyttä siitä, kuinka todennäköisiä esimerkiksi tekoälyn hallinnan menettämiseen liittyvät katastrofiskenaariot ovat tai millä aikataululla ne voisivat toteutua.
Tilaa Posi TV lahjaksi – tuellasi riippumaton suomalainen uutisointi jatkuu myös tulevaisuudessa.
Amodein 6–12 kuukauden arvio on siis hänen oma riskiarvionsa, ei varmistettu aikataulu.
Varoituksesta tekee silti poikkeuksellisen se, että sen esittää mies, jonka johtama yhtiö itse rakentaa maailman kehittyneimpiin kuuluvia tekoälyjärjestelmiä.