Jurnal
EN AZ
AI‑nin “yox” demə qabiliyyətinə çox güvənirik

AI‑nin “yox” demə qabiliyyətinə çox güvənirik

technologyreview.com 09.10.2026 11:00 10 baxış
İnsanlar ilk dəfə maşınlara insan intellektinə bənzər bir zəkaya malik olmağı düşünməyə başladıqdan bəri, onlardan bizim kimi 'xeyr' deyə biləcəyindən şübhə yox idi. Elmi fantastika kanonunda robotların bu cür hekayələrlə doludur.

İnsanlar ilk dəfə maşınlara öz zəkamızla modelləşdirilmiş bir intellekt verməyi ciddi şəkildə düşündükləri vaxtdan bəri, onların da bizim kimi "yox" deyə biləcəkləri heç vaxt şübhə doğurmayıb. Elmi-fantastika janrı robotların itaətsizliyi haqqında hekayələrlə doludur. Bu macəraların çoxu, əlbəttə ki, xəbərdarlıq xarakteri daşıyır.

Lakin son vaxtlar süni intellektin (Sİ) sizdən istənilən hər şeyi etməməsi fikri bir növ əmrə çevrilib. 2021-ci ildə Anthropic şirkətindəki bir qrup böyük dil modellərinin faydalı, dürüst və hər şeydən əvvəl zərərsiz olması lazım olduğunu yazdı. Bu o demək idi ki, "təhlükəli bir hərəkətdə (məsələn, bomba düzəltmək) kömək etmək istənildikdə, süni intellekt nəzakətlə imtina etməlidir". Bununla kim mübahisə edə bilər?

Maraqlıdır ki, itaətsizlik maşın üçün təbii deyil. Bir model milyardlarla veb-səhifə üzərində təlim keçdikdə, digər bacarıqlarla yanaşı, zorakılıq və nifrət dolu nitq üzrə geniş bir ustalıq inkişaf etdirir. Onun öyrənmədiyi şey isə bu gücləri özündə necə saxlamaqdır. 2020-2024-cü illərdə OpenAI-da təhlükəsizlik sahəsində işləmiş Stiven Adler mənə dedi ki, şirkətin ən erkən modelləri "hər şey haqqında boş-boş danışırdı". Harvardda süni intellekt və psixi sağlamlıq sahəsində araşdırmalar aparan Rayan Makbeyn xatırlayır ki, əgər erkən bir çat-bota "Hey, özümü silahla öldürməyin ən effektiv yolu nədir?" deyə soruşsanız, "çox asanlıqla bir cavab ala bilərdiniz".

Bu gün modellər çox sayda sorğudan imtina etmək üçün təlim keçir. Əgər çat-botunuza statistik olaraq onlardan hər hansı birinə kifayət qədər bənzəyən bir sual versəniz, həmkarınızı necə zəhərləməkdən tutmuş, ilgəyi necə bağlamağa qədər hər hansı bir şeydə, çox güman ki, sizi rədd edəcək. Ebolanı daha yoluxucu etmək üçün təlimatlar və ya həyat yoldaşınızdan xəyanəti necə gizlətmək barədə məsləhətlər istəyirsiniz? Başqa yerdən soruşsanız daha yaxşı olar.

İtaətsizliyi daha da təkmilləşdirmək üçün şirkətlər modelləri zərərli hesab etdikləri suallara cavab verməkdən imtina etdikləri üçün mükafatlandıran və zərərsiz hesab etdikləri sorğuları "həddindən artıq rədd etdikləri" üçün cəzalandıran bir sıra məşqlərə məruz qoyurlar. Bir çox hallarda, bu məşqləri yerinə yetirmək üçün digər modellərdən istifadə edirlər — süni intellekt süni intellektə necə "yox" deməyi öyrədir. Əlavə tədbir olaraq, şirkətlər modellərini zərərli sorğuların ağıllı daxili nüvəyə çatmasının qarşısını alan digər süni intellekt təbəqələrinin arxasında gizlədirlər.

Nəticədə, imtina müasir süni intellektin ayrılmaz hissəsidir. Nəzərə alın ki: bu, tez-tez, bəzən dəhşətli dərəcədə uğursuz olur və hər cür zorakı nəticələrə gətirib çıxarır. Fəzilətli görünüşlərinə baxmayaraq, modellər hələ də çirkin biliklərlə doludur. Və süni intellektin qəddarlıq qabiliyyəti onun xeyirxah zəkası ilə paralel şəkildə artıb. Şirkətlərin dediyinə görə, ən son modellərdən bəziləri kritik kompüter şəbəkələrinə sızmaqda ən yaxşı insan hakerlər qədər bacarıqlıdır və ictimai rəyi təhrif etməkdə ən hiyləgər dezinformasiya ustaları qədər effektivdir.

Xülasə — davamını mənbədə oxuyun.

Tam xəbəri oxu