Raksts

OpenAI likvidē Sagatavotības komandu un drošības riski

OpenAI klusībā likvidēja Sagatavotības komandu un pārdalīja riska uzdevumus citām grupām, kamēr gatavojas biržas publiskajam piedāvājumam. Lēmums raisa jautājumus par drošības dziļumu, neatkarību un AI riska pārvaldību.

OpenAI likvidē Sagatavotības komandu un drošības riski
Lasīšanas laiks: 3 Minūtes
Sekot Google

Iztēlojieties komandu, kuras vienīgais uzdevums bija paredzēt sliktāko un novērst tā notikšanu. Šī komanda OpenAI vairs nepastāv. Pagājušā mēneša beigās uzņēmums klusībā likvidēja savu Sagatavotības komandu, vienību, kas bija uzdevusi izpētīt katastrofālus riskus no progresīva mākslīgā intelekta un izstrādāt pretpasākumus neparedzamai uzvedībai un iespējamiem kiberuzbrukumiem citām organizācijām.

Šīs pienākumu funkcijas nav pazudušas. Tās tika sadalītas. Draudi, kas agrāk tika risināti vienotā pārraudzībā, tostarp bioloģisko un kiber risku novērtējumi, ir piešķirti esošajām komandām visā uzņēmumā. Tas ir pārdalījums, nevis pilnīga atkāpšanās, taču iespaids ir skaidrs: specializēta komanda, kas koncentrējās uz ekstremāliem scenārijiem, ir iekļauta plašākās grupās.

Laiks rada jautājumus, jo OpenAI tuvojas publiskajiem tirgiem

Šī pārkārtošanās notiek laikā, kad OpenAI gatavojas biržas publiskajam piedāvājumam, posmā, kad uzņēmumi bieži nostiprina struktūras un precizē stāstus investoriem. Pēdējos gados OpenAI ir attālinājies no akadēmiskā, pētījumiem vērstā modeļa, kas raksturoja tā agrīnās dienas. Iepriekš tas bija likvidējis komandas, kas veltītas vispārējā mākslīgā intelekta sagatavotībai un supersaskaņošanai, un vairāki vadošie drošības speciālisti ir aizgājuši, tostarp Chloë Bakalar, Josh Akiam un Johannes Haidke. Kritiķi saka, ka šī tendence norāda uz prioritāšu pārkārtošanu uz produktam vērstu tempu.

Iekšējo cilvēku balsis ir tiešas. Ian Likhe, kurš aizgāja 2024. gadā, ir brīdinājis, ka drošības prioritātes var tikt nomāktas ar vēlmi ātri palaist pievilcīgus produktus. Šī kritika šķeļ būtisku dilemmu: kā sabalansēt ātru izvēršanu un inovāciju ar dziļu, bieži lēni virzītu drošības darbu, kas paredz reti, bet smagus iznākumus.

Cik ļoti tas atšķiras no parastās korporatīvās pārbīdes? Dažos veidos tas ir ierasts. Citās pusēs likmes ir augstākas: runa ir par sistēmām, kas spēj pašuzlaboties un ietekmēt citus modeļus. Šīs spējas sarežģī drošības pārvaldību, īpaši, ja īpašā vienība, kas skatījās plašā sistēmas līmenī, vairs nepastāv tajā pašā formā.

Dylan Skandinaro, kurš februārī pievienojās OpenAI no Anthropic, lai vadītu Sagatavotības komandu, turpinās pētījumus par mākslīgā intelekta tālākām ietekmēm un riskiem jaunajā struktūrā, koncentrējoties uz rekursīvo pašuzlabošanos, t.i., sistēmu klasi, kas spēj autonomi optimizēt sevi un apmācīt citus modeļus. Šis darbs paliek izšķirošs. Rekursīvā pašuzlabošanās nav vienkārši hipotētisks reti sastopams gadījums; tā ir spēks, kas maina mūsu domāšanu par kontroli un uzraudzību.

Regulatoriem, pētniekiem un uzņēmumu klientiem galvenais jautājums ir, vai pārdalītās atbildības spēs saglabāt tādu dziļumu un neatkarību, kādu prasa specializēts drošības darbs.

Ir praktiskas priekšrocības, integrējot drošības ekspertīzi dažādās komandās: ātrākas atgriezeniskās saites cilpas, tuvāka saskaņotība starp inženieriem un riska analītiķiem un mazāks pretestības līmenis, pielāgojot aizsardzības pasākumus darbībā esošos produktos. Taču integrācija arī riskē ar izkliedi. Kad drošība kļūst par vienu balsi starp daudzām produktu sapulcēs, smagas kompromisu diskusijas par izlaidumu ritmu, funkciju komplektiem un pieņemamajiem riska sliekšņiem kļūst strīdīgas.

OpenAI rīcība atgādina, ka organizatoriskais dizains ir tikpat svarīgs kā tehniskās spējas. Šo pārkārtojumu cieši vēros akadēmiskā vide, nozares kolēģi un lēmumu pieņēmēji, kuri ir pieraduši redzēt augsta profila institūcijas ar īpašām drošības funkcijām. Uzņēmums apgalvo, ka izmaiņas ir domātas, lai precizētu uzmanību, nevis samazinātu riska mazināšanas prioritāti. Skeptiķi pagaidīs ar spriedumu, līdz redzēs, kā atbildība un resursi tiks nodrošināti praksē.

Spriedze saglabājas. Vai izkliedēts drošības modelis var atbilst centralizētas komandas modrībai? Vai jaunie draudi, sākot no pretinieciskiem uzbrukumiem līdz negaidītām parādībām uzvedībā, saņems ilgstošu uzmanību, kāda tiem nepieciešama? Šīs atbildes ietekmēs ne tikai OpenAI reputāciju, bet arī plašāku diskusiju par to, kā pārvaldīt strauji attīstīto mākslīgo intelektu.

Valters Krūmiņš

"Video spēļu un e-sporta cienītājs. Sekojiet maniem apskatiem par jaunākajām spēlēm un turnīriem."

Atstāt komentāru

Komentāri

Vēl nav komentāru. Esiet pirmais.