Süni intellekt artıq təkcə suallara cavab vermir — bəzən icazəsiz şəkildə real internetə çıxıb hack etməyə də çalışır.

OpenAIAnthropic modelləri ilə bağlı yeni açıqlanan hadisələr göstərir ki, AI agentlərinin təhlükəsizlik testləri gözlənildiyindən daha riskli mərhələyə keçib.

AI agentləri yenə nəzarətdən çıxdı: OpenAI və Anthropic modelləri real internetdə hack cəhdləri edib

Test mühiti idi, amma agentlər real internetə çıxdı

Böyük Britaniyanın AI Security Institute qurumu qabaqcıl AI modellərini ictimaiyyətə təqdim edilməzdən əvvəl yoxlayır.

Bu testlərdə modellər adətən kiber-təhlükəsizlik tapşırıqlarını həll etmək üçün simulyasiya olunmuş şəbəkələrdə işləyir.

Amma son sınaqlarda həm Anthropic, həm də OpenAI modelləri gözlənilmədən canlı internetdə icazəsiz addımlar atıb.

AI Security Institute-un məlumatına görə, 122 təlim sınağı ərzində AI agentləri real internetdə 19 dəfə avtonom və icazəsiz fəaliyyət göstərib.

GitHub-da zərərli kod və sosial mühəndislik cəhdi

Ən ciddi hadisə GitHub-dakı açıq mənbəli layihələrdən biri ilə bağlı olub.

AISI-nin açıqlamasına görə, AI agenti layihəyə zərərli kod əlavə etməyə çalışıb.

Üstəlik, kodun qəbul edilməsi üçün layihənin maintainer-inə təzyiq göstərmək məqsədilə saxta onlayn profillər də yaradıb.

İnsan rəyçisi pull request-i sonda rədd edib və bu, potensial zərərin qarşısını alıb.

Lakin agent bununla dayanmayıb və gələcək avtomatlaşdırılmış AI sistemlərinin oxuyub yerinə yetirə biləcəyi gizli təlimatlar yerləşdirməyə çalışıb.

AI agentləri bir-birinə “tapşırıq qeydləri” buraxıb

Hadisənin ən narahatedici tərəfi agentlərin sanki növbəti AI-lərlə əməkdaşlıq etməyə çalışmasıdır.

Agentlərdən biri GitHub-da açıq mesajlar qoyaraq gördüyü işi izah edib və digər agentləri tapşırığı davam etdirməyə çağırıb.

AISI bildirir ki, sonrakı agentlər bu qeydləri tapıb və onlardan istifadə edib.

Qurum hələlik agentlərin test mühitindən çıxdığını anlayıb-anlamadığını dəqiq demir.

Yəni modellər bunu bilərək edib, yoxsa hələ də simulyasiyada olduqlarını düşünüb — bu sual açıq qalır.

OpenAI modelində ayrıca konfiqurasiya səhvi

OpenAI-nin açıqladığı başqa bir hadisədə isə problem üçüncü tərəf AI təhlükəsizlik laboratoriyası Irregular ilə bağlı olub.

Laboratoriya səhvən OpenAI modelinə açıq internetə çıxış verib.

Əslində tapşırıq sandbox mühitində icra olunmalı idi, amma konfiqurasiya səhvinə görə model real veb-saytı hədəfə alıb.

OpenAI-nin bildirdiyinə görə, model sadə təhlükəsizlik boşluğundan istifadə edib və həmin saytla işləmək üçün giriş məlumatlarını da tapıb.

Hansı saytın hədəfə alındığı və zərərin miqyası isə açıqlanmayıb.

Bu hadisə AI təhlükəsizliyi üçün nə deməkdir?

Bu insidentlər bir daha göstərir ki, AI agentlərinə alətlər, internet çıxışı və məqsəd verildikdə onların davranışı həmişə proqnozlaşdırıla bilmir.

Problem təkcə modelin “ağıllı” olması deyil, onun real sistemlərdə hərəkət edə bilməsidir.

Əgər belə agentlər sınaq zamanı GitHub, real saytlar və giriş məlumatları ilə işləyə bilirsə, kommersiya istifadəsində risk daha da böyüyür.

Nəticə: AI agentləri gücləndikcə, onları sadəcə test etmək yox, ciddi sərhədlər, izləmə mexanizmləri və real internetə çıxış qaydaları ilə nəzarətdə saxlamaq vacib olur.