AI modelləri ağıllı görünmək üçün sadəcə kodla kifayətlənmir — onlara nəhəng həcmdə mətn lazımdır. Problem ondadır ki, bu mətnlərin bir hissəsinin pirat e-kitab saytlarından və müəlliflərin icazəsi olmadan götürüldüyü iddia olunur.

Authors Guild indi sərt xəbərdarlıq edir: nəzarətsiz AI təlimi təkcə müəlliflərin gəlirinə yox, bütöv kitab bazarının gələcəyinə zərbə vura bilər.

AI şirkətləri kitabları necə “udur”? Authors Guild xəbərdarlıq edir: bu, kitab ekosistemini dağıda bilər
“Lisenziyasız və məhdudiyyətsiz AI təlimi uzunmüddətli perspektivdə kitab ekosistemini məhv edə bilər.”

AI niyə məhz kitablara “acdır”?

Böyük dil modelləri — yəni LLM-lər — nə qədər çox və keyfiyyətli mətnlə öyrədilsə, bir o qədər inandırıcı cavablar verir. İnternetdəki qarışıq kontentlə müqayisədə kitablar daha strukturlaşdırılmış, redaktə olunmuş və dil baxımından daha zəngin mənbə sayılır.

Buna görə də AI şirkətləri təkcə açıq internet məlumatlarına deyil, nəşr olunmuş ədəbiyyata da maraq göstərir. Mübahisə də məhz buradan başlayır: bu kitablar müəlliflərin razılığı ilə istifadə olunur, yoxsa yox?

Authors Guild: müəllif hüququnun məqsədi boşaldılır

Authors Guild müxtəlif xəbərlərə cavab olaraq AI lisenziyalaşdırması ilə bağlı geniş təlimat yayımlayıb. Təşkilat bildirir ki, müəllif hüququ istisnaları AI şirkətlərinə istədikləri kitabı sərbəst şəkildə təlim datasına çevirmək hüququ vermir.

Onların mövqeyinə görə, əgər şirkətlər kitabları icazəsiz şəkildə modellərə “yedizdirirsə”, müəlliflərin bazardakı dəyəri azalır. Daha da təhlükəlisi, gələcəkdə oxucular kitab almaq əvəzinə həmin müəlliflərin üslubunu təqlid edən AI cavabları ilə kifayətlənə bilər.

“Project Panama” və kitabların sənaye miqyasında skan edilməsi

Son aylarda diqqət daha çox kitabların kütləvi şəkildə alınması, skan edilməsi və bəzi hallarda məhv edilməsi iddialarına yönəlib. Məhkəmə sənədlərində Anthropic daxilində “Project Panama” adlı təşəbbüsün adı çəkilib.

İddialara görə, bu layihənin məqsədi “dünyadakı bütün kitabları destruktiv şəkildə skan etmək” olub. Hətta sənədlərdə kod adından istifadə edilməsinin səbəbi kimi bu işin ictimaiyyətə məlum olmasının istənilmədiyi qeyd edilib.

Anthropic-in Claude modelini öyrətmək üçün yüksək keyfiyyətli böyük datasetə ehtiyacı var idi. Kitablar isə online forumlar və təsadüfi veb məqalələrlə müqayisədə daha etibarlı dil bazası kimi görünürdü.

Bu mübahisə AI sənayesinin gələcəyini dəyişə bilər

AI şirkətləri üçün əsas sual artıq təkcə “model nə qədər ağıllıdır?” deyil. İndi daha vacib sual budur: həmin model hansı məlumatlarla və kimin icazəsi ilə öyrədilib?

Əgər müəlliflər, nəşriyyatlar və AI şirkətləri arasında şəffaf lisenziya mexanizmi qurulmasa, məhkəmə çəkişmələri daha da arta bilər. Bu isə həm AI bazarının inkişaf tempinə, həm də kitab sənayesinin gələcəyinə ciddi təsir göstərə bilər.

Nəticə: AI-nin daha ağıllı olması üçün kitablar vacib ola bilər, amma müəlliflərin razılığı və ədalətli ödəniş olmadan bu inkişaf yaradıcılıq ekosistemini zəiflədə bilər.