AI dünyasında yeni qırmızı xətt çəkilir: modellər artıq təkcə kod yazmır, zəifliyi tapıb onu necə istismar etməyi də göstərə bilir. Anthropic-in son addımı isə bu sualı ortaya atır: belə güclü AI-ləri həqiqətən dayandırmaq mümkündürmü?
Ötən həftənin sonunda Anthropic ABŞ hökumətinin ixrac nəzarəti göstərişindən sonra Claude Fable 5 və Mythos 5 modellərini istifadədən çıxardı. Şirkət Ağ Ev ilə danışıqlar aparsa da, modelləri yenidən aktivləşdirmək üçün hələ razılıq əldə etməyib.

Mythos 5 niyə bu qədər narahatlıq yaratdı?
Anthropic aprel ayında Mythos modelini təqdim edəndə onun kibertəhlükəsizlikdə güclü imkanlara sahib olduğunu açıq demişdi. Model proqram təminatındakı boşluqları tapmaqda müdafiəçilərə kömək edə bilər, amma eyni biliklər hücumçuların əlində təhlükəli alətə çevrilə bilər.
Şirkət də bunu gizlətmir: qabaqcıl AI modelləri çox vaxt “dual-use”, yəni həm faydalı, həm də zərərli məqsədlər üçün istifadə oluna bilən texnologiyalardır. Kibertəhlükəsizlik mütəxəssisi üçün faydalı olan sorğu, pis niyyətli şəxs üçün hücum planına çevrilə bilər.
Project Glasswing və məhdud buraxılış planı
Bu risklərə görə Anthropic əvvəlcə Mythos Preview versiyasını yalnız seçilmiş iştirakçılardan ibarət Project Glasswing işçi qrupuna təqdim etmişdi. Daha sonra Mythos 5 də eyni qrupa özəl şəkildə açıldı.
Claude Fable 5 isə geniş ictimaiyyət üçün buraxılmışdı, lakin biologiya və kibertəhlükəsizliklə bağlı həssas cavablara xüsusi məhdudiyyətlər qoyulmuşdu. Problem ondadır ki, ABŞ administrasiyası bu qoruyucu baryerlərin sıradan çıxarıla biləcəyindən şübhələnir.
Qadağa problemi həll edir, yoxsa sadəcə gecikdirir?
Trump administrasiyası Fable 5-in qoruma mexanizmlərinin deaktiv edilə biləcəyini və bunun Mythos 5 səviyyəsində imkanlara yol aça biləcəyini düşünür. Buna görə də hər iki model milli təhlükəsizlik riski kimi qiymətləndirilib.
Lakin ekspertlərə görə məsələ təkcə Anthropic deyil. Bazarda bu imkanlara yaxınlaşan və ya artıq oxşar səviyyəyə çatan başqa şirkətlər və açıq çəkili model hazırlayan komandalar da var.
“Əsl mesaj budur: bu məsələ nə təkcə model, nə də təkcə Anthropic haqqındadır. Biz 6, 12, 24 ay içində bu imkanların geniş yayıldığı dünyaya indidən hazırlaşmalıyıq.”
TPO Group-un kibertəhlükəsizlik rəhbəri Tarah Wheeler də oxşar fikirdədir. Onun sözlərinə görə, yalnız Anthropic-in bu səviyyəyə çatdığını düşünmək çox dar baxışdır, çünki rəqiblər də eyni imkanları inkişaf etdirə və sadəcə tənzimləmə mühitini izləyə bilərlər.
AI təhlükəsizliyində yeni dövr başlayır
Bu hadisə AI sənayesində vacib bir dönüş nöqtəsini göstərir. Artıq sual “belə modellər yaranacaqmı?” deyil, “onlar necə idarə olunacaq?” sualıdır.
OpenAI kimi digər oyunçular da kibertəhlükəsizlik yönümlü modelləri məhdud şəkildə sınaqdan keçirir. Yəni yarış təkcə məhsul buraxmaq uğrunda deyil, həm də təhlükəli imkanları nəzarətdə saxlamaq uğrundadır.
Nəticə: Anthropic böhranı göstərdi ki, güclü AI modellərini tam dayandırmaq çətin olacaq; əsas məsələ onları vaxtında, şəffaf və ağıllı qaydalarla idarə etməyi bacarmaqdır.