Anthropic yeni Claude Fable 5 modelini açdı, amma bu dəfə güc qədər məhdudiyyətlər də diqqət çəkir. Şirkət açıq şəkildə deyir: bəzi suallar var ki, ən ağıllı AI belə onlara cavab verməməlidir.
Fable 5 Anthropic-in ilk “Mythos-class” modeli kimi təqdim olunur və şirkətə görə əvvəlki Claude Opus modellərini ümumi imkanlarda geridə qoyur. Amma kiberhücumlar, biologiya və kimya kimi riskli sahələrdə modelin davranışı xüsusi qoruma qatları ilə məhdudlaşdırılıb.

Fable 5 güclüdür, amma hər suala açıq deyil
Anthropic bildirir ki, Fable 5 texniki olaraq Mythos 5 ilə eyni əsas model üzərində işləyir. Fərq ondadır ki, Mythos 5 yalnız Project Glasswing çərçivəsində etibarlı sayılan kiçik bir “cyberdefender” qrupuna açılır.
İctimaiyyətə təqdim olunan Fable 5 isə daha ehtiyatlı davranır. Əgər istifadəçi təhlükəli hesab olunan mövzularda sual verərsə, sistem bu sorğunu əvvəlki Claude Opus 4.8 modelinə yönləndirir və istifadəçiyə bunun baş verdiyini bildirir.
Kiberhücum, bio-risk və kimya: qırmızı xətt haradan keçir?
Anthropic-in əsas narahatlığı odur ki, belə modellər pis niyyətli şəxslərin bacarıqlarını “yüksəldə” bilər. Xüsusilə kiberhücumların planlaşdırılması, zərərli bioloji məlumatlar və təhlükəli kimyəvi proseslər şirkətin diqqət mərkəzindədir.
Anthropic testlərdə yanlış bloklamaların bütün sessiyaların 5 faizindən azında baş verdiyini, amma təhlükəli istifadənin qarşısını almaq üçün bu sərtliyin vacib olduğunu bildirir.
Şirkət etiraf edir ki, bu yanaşma bəzən zərərsiz sualların da bloklanmasına səbəb ola bilər. Yəni adi istifadəçi bəzən əsəbiləşə bilər, amma Anthropic bunu daha böyük risklərin qarşısını almaq üçün qəbul edilən qiymət kimi görür.
Jailbreak testləri: Fable 5-i aldatmaq nə qədər çətindir?
Fable 5-in qoruma sistemi mövzu əsaslı klassifikatorlar üzərində qurulub. Bu sistem həm qadağan olunmuş sorğuları, həm də modeli “jailbreak” etməyə yönələn cəhdləri aşkar etməyə çalışır.
Anthropic-in məlumatına görə, 1000 saatdan çox red-team testi və bug bounty proqramı zamanı xarici komandalar Fable 5 üçün universal jailbreak tapa bilməyiblər. Şirkət həmçinin deyir ki, yeni model avtomatlaşdırılmış jailbreak hücumlarına əvvəlki Claude Opus modellərindən daha yaxşı müqavimət göstərib.
“Agentic hacking” niyə bu qədər qorxudur?
Anthropic-in ən çox çəkindiyi məqamlardan biri Mythos 5-in “agentic hacking” bacarığıdır. Bu, AI modelinin çoxmərhələli kiberhücumları daha müstəqil və ardıcıl şəkildə icra edə bilməsi deməkdir.
Bununla belə, Böyük Britaniyanın AI Security Institute qurumunun son testləri maraqlı nəticə göstərib. Mythos Preview Capture the Flag tapşırıqlarında OpenAI GPT-5.5 ilə oxşar performans nümayiş etdirib, yəni bu bacarıq təkcə Anthropic modelinə xas “inqilabi sıçrayış” kimi görünmür.
AI yarışında yeni mərhələ: daha güclü model, daha sərt nəzarət
Fable 5-in təqdimatı süni intellekt bazarında yeni trendi göstərir: şirkətlər təkcə daha ağıllı model yaratmaqla kifayətlənmir, həm də onun harada dayanmalı olduğunu müəyyən etməyə çalışır. Bu, AI təhlükəsizliyi mövzusunu artıq laboratoriyadan çıxarıb gündəlik məhsul dizaynının mərkəzinə gətirir.
İstifadəçilər üçün bu, bəzən “niyə cavab vermir?” sualı yaradacaq. Amma təhlükəsizlik baxımından baxanda, Anthropic-in mesajı aydındır: daha güclü AI daha məsuliyyətli filtr tələb edir.
Nəticə: Claude Fable 5 AI modellərinin gələcəyinin təkcə daha ağıllı olmaqdan yox, həm də təhlükəli bilikləri nə vaxt susdurmağı bacarmaqdan keçdiyini göstərir.