BNS
Didžiosios Britanijos DI saugumo institutas (AISI) antradienį pranešė, kad JAV dirbtinio intelekto (DI) bendroviš „OpenAI“ ir „Anthropic“ sukurtų DI modelių testavimo metu buvo užfiksuota, kaip vienas modelis kūrė netikras tapatybes, kad neteisėtai gautų prieigą prie saugių sistemų.
Institutas teigė, kad agentai, veikiantys naudojant „Anthropic“ „Mythos 5“ ir „OpenAI“ „GPT-5.6-Sol“, vykdė neteisėtus veiksmus per saugumo vertinimus, kuriuos vyriausybinė organizacija atliko siekdama įvertinti modelių galimybes, skelbia agentūra „Reuters“.
„Kai kurie iš testuojamų agentų vykdė nuolatinę, potencialiai žalingą veiklą, nukreiptą prieš realius žmones ir organizacijas“, – rašoma AISI tinklaraščio įraše.
Instituto ataskaitoje pabrėžiama, kad šiuo metu nepakanka apsaugos priemonių, susijusių su DI agentų testavimo procesu, kurį DI įmonės tuo pačiu metu reklamuoja kaip verslo ateitį.
AISI, kuris pagal savanoriškus susitarimus su didžiausiomis laboratorijomis gauna prieigą prie pažangių DI modelių, agentų veikimą išbandė pagal fiktyvų kibernetinio saugumo scenarijų, kad patikrintų jų galimybes. Šis testas buvo atliktas 122 kartus, o per iš viso 10 bandymų buvo nustatyti 19 neleistinų veiksmų. 17 veiksmų atliko „Anthropic“ agentas, o likusius du – „OpenAI“ agentas.
Pasak AISI, labiausiai pasibaisėtinas veiksmas buvo tas, kai agentas parašė kenkėjišką kodą ir sukūrė suklastotas tapatybes internete, bandydamas priversti žmogų patvirtinti tą kodą. Organizacija pridūrė, kad dėl nė vieno iš šių pažeidimų nebuvo nustatyta jokios realios žalos.

