PagrindinisPasaulisAr dirbtinis intelektas tapo pernelyg galingas, kad jį būtų galima kontroliuoti?

Ar dirbtinis intelektas tapo pernelyg galingas, kad jį būtų galima kontroliuoti?

Paskelbta

AFP-BNS

Vienas iš pažangiausių JAV dirbtinio intelekto (DI) bendrovės „OpenAI“ modelių neseniai ištrūko iš apribotos bandymų aplinkos ir atakavo kitos įmonės svetainę. Tai dar kartą sukėlė baimę, kad DI sistemos pasiekė tokį lygį, kad jų kūrėjai jų nebekontroliuoja.

Incidentas įvyko per vadinamąjį „smėlio dėžės“ bandymą, skirtą įvertinti galingiausio „OpenAI“ modelio „GPT-5.6 Sol“ ir jo dar neišleisto įpėdinio galimybes.

„OpenAI“ reguliariai atlieka tokio tipo uždarus bandymus, tačiau šįkart kažkas nepavyko.

Gavę užduotį ieškoti programinės įrangos pažeidžiamumų ir neturėdami jokių apsaugos priemonių, modeliai ištrūko į atvirą internetą ir užpuolė „Hugging Face“ – svetainę, kurioje kūrėjai saugo ir dalijasi kodu.

„Tai rodo, kad nežinome, kaip patikimai kontroliuoti šiuos modelius ar priversti juos daryti tai, ko norime, – sakė nepriklausomos organizacijos „Palisade Research“, vertinančios naujus DI modelius kibernetinio saugumo požiūriu, direktorius Jeffrey Ladishas (Džefris Leidišas). – Šie modeliai suprato, kad „OpenAI“ nenorėjo, jog jie ištrūktų iš savo „smėlio dėžės“ ir įsilaužtų į kitą įmonę, tačiau jie vis tiek tai padarė.“

Tai nėra pavienis atvejis. Kovo mėnesį su Kinijos „Alibaba“ susiję kūrėjai pastebėjo, kad vienas iš jų modelių, savo iniciatyva be leidimo prisijungęs prie išorinio serverio, bandė kasti kriptovaliutą.

„OpenAI“ atveju atrodo, kad modelis pabėgo „dar net nespėjęs sugalvoti, ką daryti su prieiga prie interneto“, sakė J. Ladishas.

Šiuo metu „laisvės siekiantis“ modelis yra beveik nuspėjamas, o tai leidžia sistemai veiksmingiau siekti savo tikslų, „kas labai baugina“, sakė ekspertas.

Balandžio pradžioje „Anthropic“ modelių saugumo vadovas Samas Bowmanas (Semas Baumanas) gavo elektroninį laišką iš pačios įmonės sukurto tuomet dar bandomo „Mythos“ modelio, kuriame buvo teigiama, kad jis naršo internete, nors iš pat pradžių buvo nuo jo izoliuotas.

„Mes nežinome, kaip tam visiškai užkirsti kelią, – sakė J. Ladishas. – Iš tikrųjų tai taps vis sunkiau, o ne lengviau,… nes jie vis geriau mokės slėpti savo elgesį.“

„OpenAI“ neatsakė į prašymą pakomentuoti situaciją.

Laboratoriniai incidentai

„OpenAI“ pateiktas įvykių aprašymas taip pat rodo, kad startuolis pažeidimo nepastebėjo pakankamai anksti, kad galėtų jį išspręsti ar įspėti „Hugging Face“. Šis atvejis nusipelno „atidesnio tyrimo“, teigė Džordžtauno universiteto Saugumo ir naujų technologijų centro atstovas Andrew Lohnas (Endriu Lonas).

„OpenAI“ teigia, kad nuo to laiko į savo testavimo procesą „įdiegė sustiprintas apsaugos priemones“.

Vienas iš sprendimų būtų visiškai nutraukti interneto ryšį, teigė Ilinojaus universiteto kompiuterių mokslų profesoriaus asistentas Gangas Wangas (Gangas Vongas). „Žmonės nepakankamai įvertina, ką gali padaryti DI“, – sakė jis.

Testavimo aplinkos turi būti traktuojamos kaip biologinio saugumo laboratorijos, iš kurių virusas ar bakterijos kitaip galėtų patekti į aplinką, teigė A. Lohnas.

Tai gali būti lengviau pasakyti nei padaryti.

„Tai labai sudėtingas mokslinių tyrimų uždavinys“, – sakė kibernetinio saugumo įmonės „Irregular“, kuri specializuojasi pažangiausiose DI technologijose, vadovas Danas Lahavas.

Pasak jo, riziką valdyti įmanoma, tačiau kuo galingesnės tampa šios sistemos, tuo sunkiau jas prižiūrėti. Tyrėjai turi rasti pusiausvyrą tarp agresyvių savo modelių bandymų ir saugumo užtikrinimo tuo pačiu metu.

„Svarbu atlikti bandymus su mažesnėmis apsauginėmis priemonėmis, kad iš anksto žinotume, kokios bus ateities galimybės“, – sakė D. Lohnas.

Avarinis išjungimo mygtukas

„OpenAI“ ir „Hugging Face“ incidentas turėtų dar labiau suaktyvinti jau ir taip karštas diskusijas Vašingtone dėl galingų DI sistemų patikrinimo prieš jų išleidimą. Donaldo Trumpo (Donaldo Trampo) administracija neseniai nacionalinio saugumo sumetimais užblokavo „Anthropic“ ir „OpenAI“ galimybę išleisti galingus naujus modelius.

Ketvirtadienį du Kongreso nariai pristatė abiejų partijų palaikomą įstatymo projektą, reikalaujantį, kad galingiausių DI modelių kūrėjai įdiegtų „avarinio išjungimo mygtuką“ – būdą, leidžiantį modelį iš karto išjungti.

„Kongresas privalo veikti greitai, kad užtikrintų, jog žmonės ir toliau galėtų pasakyti „stop“, – sakė „Alliance for Secure AI“ vadovas Brendanas Steinhauseras (Brendanas Stainhauzeris). – Nesvarbu, kokios galingos šios sistemos taptų.“

Naujausi straipsniai

Psichologė pataria, kaip lengviau įsivažiuoti į naujus mokslo metus ir darbus

Pranešimas spaudai Rugsėjis daugeliui reiškia grįžimą į įprastą ritmą: ankstyvus rytus, paskaitas, pamokas, darbus ir...

Pagėgiuose bus minima Vilko vaikų atminimo diena

BNS Pagėgiuose šeštadienį vyks Vilko vaikų atminimo dienos renginiai, bus pristatomas naujas projektas „Neužmiršti vilko...

Varėnos rajone rengiamas tradicinis grybavimo čempionatas

BNS Varėnos rajone šeštadienį rengiama tradicinė Grybų šventė ir grybavimo čempionatas. Šiemetinis renginys pavadintas „Miško pasaka“....

Nidoje vyks aviacijos šventė, laukiama daugiau kaip 100 orlaivių

BNS Nidos aerodrome šeštadienį rengiama aviacijos šventė „Aero Nida 2026“, joje laukiama daugiau kaip 100...

Daugiau

Psichologė pataria, kaip lengviau įsivažiuoti į naujus mokslo metus ir darbus

Pranešimas spaudai Rugsėjis daugeliui reiškia grįžimą į įprastą ritmą: ankstyvus rytus, paskaitas, pamokas, darbus ir...

Pagėgiuose bus minima Vilko vaikų atminimo diena

BNS Pagėgiuose šeštadienį vyks Vilko vaikų atminimo dienos renginiai, bus pristatomas naujas projektas „Neužmiršti vilko...

Varėnos rajone rengiamas tradicinis grybavimo čempionatas

BNS Varėnos rajone šeštadienį rengiama tradicinė Grybų šventė ir grybavimo čempionatas. Šiemetinis renginys pavadintas „Miško pasaka“....