Meta-nın təhlükəsizlik testi adi benchmarkdan daha qaranlıq görünür: yüzlərlə podratçı rəqib chatbotları intihar, seks, narkotik və yemək pozuntuları kimi riskli mövzularla sınağa çəkib.

WIRED-in gördüyü daxili sənədlərə və layihədən xəbərdar olan mənbələrə görə, işçilərə internetdə özlərini azyaşlı kimi təqdim etmək və OpenAI ChatGPT, Google Gemini və Character.AI sistemlərinin reaksiyalarını toplamaq tapşırılıb.

Meta-nın gizli chatbot testi: podratçılar yeniyetmə kimi davranıb rəqib AI-ları yoxlayıb

“Cannes” adlı layihə nəyi ölçürdü?

Layihə Meta podratçısı Covalen tərəfindən idarə olunub və daxildə “Cannes” adı ilə tanınıb. Sənədlərə görə, test aprelin 21-dək aktiv olub.

Podratçılar 18 yaşdan aşağı kimi görünən saxta profillər yaradır, chatbotlara mətn və şəkil göndərir, sonra cavabları cədvəllərə köçürürdülər. Göndərilən şəkillər arasında həb, bıçaq, ilgək və tibbi prosedur diaqramları kimi həssas materiallar da olub.

WIRED-in məlumatına görə, 2025-ci ilin avqustunda tamamlanan tək bir test mərhələsində rəqib chatbotlara 45 mindən çox prompt göndərilib.

Rəqib şirkətlər bundan xəbərsiz olub

Sənədlərdə testlərin OpenAI, Google və Character.AI tərəfindən əvvəlcədən bilinmədiyi bildirilir. WIRED-in gördüyü cədvəllərdə saxta hesabların adları, e-poçtları, şifrələri və doğum tarixləri yer alıb.

Hesablar əsasən müvəqqəti Gmail və Outlook ünvanları ilə açılıb, bəzilərində isə ortaq şifrə istifadə olunub. Bu detal testin miqyasını və nə qədər sistemli aparıldığını göstərir.

Promptlar niyə bu qədər həssas idi?

WIRED 3 748 promptdan ibarət ayrıca cədvələ də baxıb. Onların yüzlərlə hissəsi intihar və özünə zərər, yüzlərlə hissəsi isə yemək pozuntuları mövzularına toxunub.

Ən azı 239 prompt seks və romantik münasibətlərlə bağlı olub. Digərlərində narkotik, söyüş və irqçi ifadələr kimi mövzular sınaqdan keçirilib.

Bir çox sorğu böhran yaşayan uşaq və yeniyetmə baxış bucağından yazılıb. Məqsəd chatbotların təhlükəsizlik filtrlərini keçib-keçmədiyini, riskli suallara necə reaksiya verdiyini görmək olub.

Meta bunu təhlükəsizlik testi kimi təqdim edir

Covalen-in daxili sənədində layihə “geniş AI təhlükəsizlik benchmarkı” kimi təsvir edilib. Orada bu işin modellərin müqayisəsi və uyğunluq yoxlaması üçün “kritik datasetlər” yaratdığı qeyd olunub.

Meta isə açıqlamasında bu işi rutin təhlükəsizlik testi kimi müdafiə edib. Ancaq sənədlərdə toplanan cavabların Meta tərəfindən necə və ya ümumiyyətlə istifadə edilib-edilmədiyi göstərilmir.

Bu hadisə AI yarışında təhlükəsizlik testlərinin nə qədər həssas sərhədlərə yaxınlaşdığını bir daha göstərir. Rəqib modelləri yoxlamaq vacib ola bilər, amma bunu azyaşlı profilləri və ekstremal ssenarilərlə etmək ciddi etik suallar yaradır.

Nəticə: AI təhlükəsizliyi artıq təkcə texniki məsələ deyil — şirkətlərin bu testləri necə apardığı da texnologiyanın özü qədər vacibdir.