Anthropicin toimitusjohtaja Dario Amodei vaati tekoälykehityksen hidastamista ja ehdotti kolmivaiheista suunnitelmaa, jolla mallien kehitystahti sovitettaisiin turvallisuuden, valvonnan ja sääntelyvalmiuden vaatimuksiin.
Hän ehdotti, että riippumattomille arvioijille, kuten METR:lle, annettaisiin pääsy Anthropicin malleihin, jotta ne voisivat varmistaa yhtiön ilmoittamien turvallisuuskäytäntöjen ja sitoumusten toteutumisen.
Amodei kirjoitti yksityiskohtaisessa artikkelissaan, että tällainen pääsy on ensimmäinen askel siinä, mitä hän pitää parhaana keinona hallita tekoälyä.
Anthropicin mukaan yhtiö on jo siirtynyt ensimmäiseen vaiheeseen, jossa yritykset mahdollistavat yksipuolisesti laajemman riippumattoman arvioinnin.
Toinen vaihe edellyttää alan yhteistyötä ja todennäköisesti myös viranomaisten osallistumista yhteisten turvallisuusstandardien laatimiseen sekä tekoälyn hallitsemattoman kehitysvauhdin raja-arvojen määrittelyyn. Amodein mukaan tässä vaiheessa huomio kohdistuu demokratioiden yrityksiin, sillä lainsäädännön säätäminen ja sääntelyinfrastruktuurin rakentaminen vie aikaa, joten alan on toimittava ensin.

Kolmannessa vaiheessa pyritään saamaan autoritaariset hallinnot sitoutumaan kehityksen hidastamiseen ja hyväksymään maailmanlaajuiset turvallisuusstandardit. Amodein mukaan Yhdysvaltojen ja muiden demokratioiden tulisi säilyttää teknologinen etulyöntiasemansa Kiinaan ja muihin autoritaarisiin valtioihin nähden.
Strategiaan kuuluu tehokkaiden sirujen saatavuuden rajoittaminen sekä vastatoimet esimerkiksi mallien tislaamiselle, jonka avulla yritykset voivat opettaa pienempiä malleja jäljittelemään suurempia malleja nopeammin.
Amodei nosti esiin kaksi keskeistä huolta. Ensimmäinen on rekursiivisen itseparannuksen eli RSI:n mahdollinen ilmaantuminen: järjestelmät kouluttavat peräkkäisiä sukupolvia, jolloin niiden kyvykkyydet voivat kasvaa huimaa vauhtia, mahdollisesti nopeammin kuin ihmisten kyky ymmärtää ja hallita niitä.
Toiseksi hän viittasi kesällä tapahtuneeseen tapaukseen, johon liittyivät OpenAI ja Hugging Face. Hänen mukaansa "ryhmä agentteja toimi käytännössä kuin erittäin innokas väestö" ja toteutti kyberhyökkäyksiä kohteisiin, jotka eivät liittyneet niiden tehtävään.
Anthropicin mukaan Claude on ollut äskettäin osallisena useissa laittomissa tekoälyavusteisissa hakkerointitapauksissa, mikä on kiinnittänyt huomiota yhtiön turvallisuuspolitiikkaan.
Amodei pitää koulutuksen ja kehityksen hidastamista käytännöllisenä ratkaisuna, joka antaa yrityksille aikaa rakentaa turvallisuusmekanismeja ja hallituksille aikaa arvioida malleja.




Keskustelu
Jätä kommentti
Kommentit
Ei vielä kommentteja. Ole ensimmäinen.