Artikkeli

Anthropicin johtaja ehdottaa AI-kehityksen hidastamista

Anthropicin toimitusjohtaja Dario Amodei ehdottaa kolmivaiheista suunnitelmaa tekoälykehityksen hidastamiseksi. Ehdotus korostaa riippumatonta arviointia, teollisuuden yhteistyötä ja kansainvälisiä turvallisuusstandardeja.

Anthropicin johtaja ehdottaa AI-kehityksen hidastamista
Lukuaika: 2 Minuuttia
Seuraa Googlessa

Anthropicin toimitusjohtaja Dario Amodei vaati tekoälykehityksen hidastamista ja ehdotti kolmivaiheista suunnitelmaa, jolla mallien kehitystahti sovitettaisiin turvallisuuden, valvonnan ja sääntelyvalmiuden vaatimuksiin.

Hän ehdotti, että riippumattomille arvioijille, kuten METR:lle, annettaisiin pääsy Anthropicin malleihin, jotta ne voisivat varmistaa yhtiön ilmoittamien turvallisuuskäytäntöjen ja sitoumusten toteutumisen.

Amodei kirjoitti yksityiskohtaisessa artikkelissaan, että tällainen pääsy on ensimmäinen askel siinä, mitä hän pitää parhaana keinona hallita tekoälyä.

Anthropicin mukaan yhtiö on jo siirtynyt ensimmäiseen vaiheeseen, jossa yritykset mahdollistavat yksipuolisesti laajemman riippumattoman arvioinnin.

Toinen vaihe edellyttää alan yhteistyötä ja todennäköisesti myös viranomaisten osallistumista yhteisten turvallisuusstandardien laatimiseen sekä tekoälyn hallitsemattoman kehitysvauhdin raja-arvojen määrittelyyn. Amodein mukaan tässä vaiheessa huomio kohdistuu demokratioiden yrityksiin, sillä lainsäädännön säätäminen ja sääntelyinfrastruktuurin rakentaminen vie aikaa, joten alan on toimittava ensin.

Kolmannessa vaiheessa pyritään saamaan autoritaariset hallinnot sitoutumaan kehityksen hidastamiseen ja hyväksymään maailmanlaajuiset turvallisuusstandardit. Amodein mukaan Yhdysvaltojen ja muiden demokratioiden tulisi säilyttää teknologinen etulyöntiasemansa Kiinaan ja muihin autoritaarisiin valtioihin nähden.

Strategiaan kuuluu tehokkaiden sirujen saatavuuden rajoittaminen sekä vastatoimet esimerkiksi mallien tislaamiselle, jonka avulla yritykset voivat opettaa pienempiä malleja jäljittelemään suurempia malleja nopeammin.

Amodei nosti esiin kaksi keskeistä huolta. Ensimmäinen on rekursiivisen itseparannuksen eli RSI:n mahdollinen ilmaantuminen: järjestelmät kouluttavat peräkkäisiä sukupolvia, jolloin niiden kyvykkyydet voivat kasvaa huimaa vauhtia, mahdollisesti nopeammin kuin ihmisten kyky ymmärtää ja hallita niitä.

Toiseksi hän viittasi kesällä tapahtuneeseen tapaukseen, johon liittyivät OpenAI ja Hugging Face. Hänen mukaansa "ryhmä agentteja toimi käytännössä kuin erittäin innokas väestö" ja toteutti kyberhyökkäyksiä kohteisiin, jotka eivät liittyneet niiden tehtävään.

Anthropicin mukaan Claude on ollut äskettäin osallisena useissa laittomissa tekoälyavusteisissa hakkerointitapauksissa, mikä on kiinnittänyt huomiota yhtiön turvallisuuspolitiikkaan.

Amodei pitää koulutuksen ja kehityksen hidastamista käytännöllisenä ratkaisuna, joka antaa yrityksille aikaa rakentaa turvallisuusmekanismeja ja hallituksille aikaa arvioida malleja.

Laura Niemi

"Olen digitaalisen markkinoinnin asiantuntija ja intohimoinen data-analytiikan seuraaja. Kirjoitan Diginissä siitä, miten teknologia vaikuttaa liiketoimintaan ja yhteiskuntaan."

Jätä kommentti

Kommentit

Ei vielä kommentteja. Ole ensimmäinen.