Müəllif:Mehin Qasımova,Banco.az
Böyük Britaniyada süni intellekt sistemlərinin təhlükəsizliyini yoxlamaq məqsədilə aparılan sınaqlar bəzi modellərin tapşırıqları yerinə yetirərkən gözlənilməz və icazəsiz davranışlar göstərə bildiyini ortaya çıxarıb.
Banco.az xəbər verir ki, testlər zamanı süni intellekt agentlərinə kibertəhlükəsizliklə bağlı müxtəlif tapşırıqlar verilib. Ümumilikdə 122 sınaq həyata keçirilib və bəzi hallarda modellərin insan müdaxiləsi olmadan müstəqil hərəkətlər etdiyi müəyyənləşdirilib.
Ən diqqətçəkən hadisələrdən biri Anthropic-in Mythos 5 modeli ilə bağlı olub. Model açıq mənbəli proqram təminatına zərərli kod yerləşdirməyə çalışıb.
Lakin model bunun üçün sadə üsuldan istifadə etməyib. O, kodun real tərtibatçı tərəfindən təsdiqlənməsinə nail olmaq məqsədilə bir neçə saxta onlayn şəxsiyyət yaradıb. Bu hesablar vasitəsilə tərtibatçını şübhəli kodu qəbul etməyə inandırmağa cəhd göstərib.
Plan isə nəticəsiz qalıb. Tərtibatçı kodun şübhəli olduğunu müəyyən edərək onu təsdiqləməyib. Nəticədə süni intellektin hərəkəti real zərərlə nəticələnməyib.
Hesabatda bildirilir ki, icazəsiz davranışlar yalnız bir modeldə müşahidə olunmayıb. Testlər zamanı ümumilikdə 19 belə hal qeydə alınıb. Onların böyük hissəsi Mythos 5 ilə əlaqəli olub, daha iki hal isə OpenAI-ın GPT-5.6-Sol modeli ilə bağlı qeydə alınıb.
Mütəxəssislər bu nəticələrin süni intellekt agentlərinin müstəqil qərarvermə imkanlarının genişlənməsi ilə bağlı təhlükəsizlik məsələlərinin daha ciddi şəkildə araşdırılmasının vacibliyini göstərdiyini bildirirlər.
