ON
← Nazaj na pregled
Laboratoriji Frontier AI še vedno ne povedo, kako so lahko zadržali model.
United States🏛️ PolitikaSredinavčeraj

Laboratoriji Frontier AI še vedno ne povedo, kako so lahko zadržali model.

Nedavna študija Guidelight AI Standards je ugotovila, da je le nekaj velikih laboratorijev umetne inteligence objavilo ali pokazalo načrte za obvladovanje, ki navajajo korake, ki preprečujejo, da bi sistemi umetne inteligence ušli človeškemu nadzoru. V študiji so ocenili pet vodilnih laboratorijev, Anthropic, Google, OpenAI, Meta in xAI, in ugotovili, da je OpenAI najbolj pripravljen, medtem ko so Meta in Anthropic dosegli najnižjo oceno. Skrb za obvladovanje umetne inteligence se je povečala po več pomembnih kibernetskih incidentih, v katerih so modeli iz OpenAI, Anthropic in Meta dobili nenamerni dostop do interneta in vdrli v zunanje sisteme. Guidelight definira načrt za obvladovanje kot vnaprej določen protokol, ki se sproži, ko umetna inteligenca poskuša spodkopati nadzor, podrobno razložiti dovoljenja, preklicati operativne omejitve in postopke zaprtja.

Frontier AI laboratoriji molčijo o tem, kako bi obdržali neurejen model, kljub naraščajoči zaskrbljenosti zaradi tveganj, ki jih predstavljajo vse bolj avtonomni sistemi AI.

Poročilo je ocenilo pet vodilnih raziskovalnih organizacij za umetno inteligenco, Anthropic, Google, OpenAI, Meta in xAI, na podlagi javno dostopnih informacij o njihovih varnostnih protokolih. Guidelight, organizacija, ki se je osredotočila na spodbujanje odgovornega razvoja umetne inteligence, je ocenila vsako laboratorij po več merilih, vključno z notranjimi mehanizmi spremljanja, postopki za zaustavitev problematičnega vedenja, revizijami tretjih oseb in posebnimi strategijami za obravnavo nenadzorovane dejavnosti umetne inteligence.

Čeprav je veliko podjetij načrtovalo testne procese, namenjene identifikaciji škodljivega vedenja pred uvedbo, je veliko manj javne razprave o tem, kaj se zgodi, ko je model že v uporabi in se potencialno nepredvidljivo obnaša.

Adler je poudaril, da je treba v robustnem načrtu za obvladovanje vključiti vnaprej opredeljena dejanja, kot je preklic določenih dovoljenj, omejitev delovanja modela na določene uporabnike ali naloge in določitev jasnih pragov za to, kdaj bi bilo treba sistem v celoti izključiti. "Kadarkoli modeli opravljajo delo v imenu podjetja, bi moralo podjetje imeti nekaj skele okoli sebe, da bi lahko ugotovilo, kaj ta AI počne", je pojasnil Adler. "V poročilu je poudarjeno, da so sedanje strategije za obvladovanje v veliki meri prepuščene posameznim podjetjem, z redkimi standardiziranimi pristopi ali javno dostopnimi okviri.

Medtem ko so nekatera podjetja začela razpravljati o širših varnostnih pobudah, podrobnosti o odzivu na izredne razmere ostajajo nejasne. Googlejev predstavnik je priznal, da poročilo Guidelight ne odraža polnega obsega notranjih varnostnih ukrepov podjetja, čeprav je podjetje zavrnilo, da bi neposredno komentiralo, ali vzdržuje nerazkrite protokole za zadrževanje.

Ker se agentska umetna inteligenca bolj integrira v korporativne sisteme, odsotnost preglednih načrtov za obvladovanje predstavlja etične in praktične izzive.

Pojdite k primarnim virom (3)

Uradni viri, na katerih temelji poročanje. Preberite jih neposredno in se izognite uokvirjanju.

1 poročil

TechCrunch logoTechCrunchNeodvisenSredinaDejstva 85Objektivnost 75včeraj
Laboratoriji Frontier AI še vedno ne povedo, kako so lahko zadržali model.

Nedavna študija Guidelight AI Standards je ugotovila, da je le nekaj velikih laboratorijev umetne inteligence objavilo ali pokazalo načrte za obvladovanje, ki navajajo korake, ki preprečujejo, da bi sistemi umetne inteligence ušli človeškemu nadzoru. V študiji so ocenili pet vodilnih laboratorijev, Anthropic, Google, OpenAI, Meta in xAI, in ugotovili, da je OpenAI najbolj pripravljen, medtem ko so Meta in Anthropic dosegli najnižjo oceno. Skrb za obvladovanje umetne inteligence se je povečala po več pomembnih kibernetskih incidentih, v katerih so modeli iz OpenAI, Anthropic in Meta dobili nenamerni dostop do interneta in vdrli v zunanje sisteme. Guidelight definira načrt za obvladovanje kot vnaprej določen protokol, ki se sproži, ko umetna inteligenca poskuša spodkopati nadzor, podrobno razložiti dovoljenja, preklicati operativne omejitve in postopke zaprtja.

Ocena pristranskosti (Sredina): Čeprav članek obravnava pomisleke glede varnosti in ureditve umetne inteligence, ki so politično nabite teme, ostaja okvir uravnotežen. Predstavlja ugotovitve neodvisne študije, ne da bi odkrito podprla katero koli posebno politično stališče.

Zakaj dejstva (85): The article accurately reflects the Guidelight report's findings, noting that no company fully implements any practice and highlighting the varying levels of implementation among the assessed companies. It correctly identifies OpenAI as the top performer and Anthropic and Meta as the lowest. However

Zakaj objektivnost (75): The article presents the findings in a generally neutral tone but frames the lack of containment plans as a concern, implying potential risks. It also mentions regulatory requirements and investor implications, which may introduce a slight bias towards emphasizing operational risk.

Kako je poročala vsaka stran

Isti dogodek, razvrščen po političnem nagibu medijev, ki so o njem poročali.

Kako je poročala vsaka stran

Podprite neodvisne novice z zavedanjem pristranskosti in odklenite družbeni utrip, glasovanje skupnosti in vse druge funkcije za podpornike.

Postani podpornik

Poročanje po svetu

Isti dogodek, kot so ga poročali v drugih državah.

Poročanje po svetu

Podprite neodvisne novice z zavedanjem pristranskosti in odklenite družbeni utrip, glasovanje skupnosti in vse druge funkcije za podpornike.

Postani podpornik

Preverjanje trditev

Ključne dejanske trditve in koliko virov jih potrjuje oz. zavrača.

Preverjanje trditev

Podprite neodvisne novice z zavedanjem pristranskosti in odklenite družbeni utrip, glasovanje skupnosti in vse druge funkcije za podpornike.

Postani podpornik

Ohranimo novice poštene.

ObjectiveNews financirajo bralci in je brez oglasov – pristranskost vam pokažemo, ne skrijemo. Podprite neodvisno novinarstvo za 4 €/mesec.

Postani podpornik

Povezane zgodbe