sözaltı xəbər Texnologiya
Texnologiya
EN AZ
Frontier AI laboratoriyaları hələ də özbaşına modelin necə məhdudlaşdırılacağını demir

Frontier AI laboratoriyaları hələ də özbaşına modelin necə məhdudlaşdırılacağını demir

techcrunch.com 22.08.2026 18:00 32 baxış
Yeni bir araşdırma, AI sistemlərinin getdikcə daha çox gözlənilməz və potensial təhlükəli davranış nümayiş etdirdiyinə görə, qabaqcıl AI laboratoriyalarının saxta modelləri ehtiva etmək üçün açıq şəkildə sənədləşdirilmiş planlara sahib olduğunu aşkar etdi.

Ən yaxşı süni intellekt laboratoriyalarından bir neçəsi, son araşdırmaya görə, mühafizə reaksiya planlarını dərc edib və ya nümayiş etdirib. Mühafizə planı, süni intellektin insan nəzarətini alt-üst etməyə çalışdığı zaman baş verənləri - girişin nəyin kəsiləcəyini və sistemin tamamilə bağlandığı zaman baş verdiyini izah edir. Bu, təhlükəsiz sərhəd süni intellekt inkişaf təcrübələrini təşviq etməyə həsr olunmuş və beş aparıcı laboratoriyanı məhz bu ssenariyə necə hazır olduqlarına görə qiymətləndirən Guidelight AI Standartlarının tapıntısıdır.

OpenAI üstün çıxdı; Anthropic və Meta ən aşağı nəticə göstərib. Agentlik süni intellekt şirkətlərin öz sistemlərində daha muxtar rollar alması və Kaliforniya və Nyu-Yorkdakı tənzimləyicilərin açıqlama tələb etməyə başlaması kimi tapıntılar vacibdir. Bu modelləri quran və ya onlara sərmayə qoyan hər kəs üçün bu, hər bir laboratoriyanın əməliyyat riskinə necə ciddi yanaşdığı və bu barədə necə danışdığına dair nadir müstəqil oxunuşdur.

Guidelight-ın qiymətləndirməsi Anthropic, Google, OpenAI, Meta və xAI-nin ictimaiyyətə açıq planlarına əsaslanırdı və hər bir şirkətin süni intellekt sistemlərinin daxildə nələr etdiyini necə yaxşı qeyd etdiyi və izlədiyi, işarələnmiş səhv davranışın artmasından sonra sistemi dayandırıb- dayandırmadığı, müstəqil üçüncü tərəflərin nəzarətlərini yoxlayıb-yoxlamaması və onun əldə etdiyi nəticələrin hansı modeldən kənara çıxması ilə bağlı planları dərc etməsi də daxil olmaqla bir sıra ölçülər üzrə qiymətləndirilmiş planlara əsaslanırdı. OpenAI, Anthropic və Meta modellərinin təhlükəsizlik qiymətləndirmələri zamanı gözlənilmədən internetə giriş əldə etdiyi və xarici sistemlərə müdaxilə etdiyi bir sıra yüksək profilli kibertəhlükəsizlik insidentlərindən sonra süni intellekt şirkətlərinin getdikcə daha bacarıqlı və agent modellərini ehtiva edə bilməsi ilə bağlı narahatlıq artıb. Tapıntılar süni intellekt şirkətlərinin AI sistemlərinin geniş miqyasda ciddi tədbirlər görə biləcəyi mühitlərdə agent tətbiqini genişləndirdikləri üçün təhlükəsizliyə necə açıq yanaşması ilə bağlı fərqləri vurğulayır.

Bəzi süni intellekt şirkətləri yerləşdirmədən əvvəl modellərini təhlükəli qabiliyyətlər üçün necə sınaqdan keçirdiklərini təfərrüatlandırsalar da, sistemlərində artıq işləyən modellər səhv hərəkət etdikdə nə baş verdiyi barədə ümumiyyətlə daha az səs-küylü olublar. Guidelight qoruma planını “əvvəlcədən təyin edilmiş plan, süni intellekt nəzarəti alt-üst etməyə çalışdığı aşkar edildikdə işə salınan, modeldən hansı icazələrin ləğv edilməsini, modelin kimin üçün işləməyə davam edə biləcəyini, hansı məhdudiyyətlər altında və onu tam oflayn vəziyyətə salmağı əhatə edən plan” kimi müəyyən edir. "Sərhəd süni intellekt şirkətlərindəki aparıcı modellərin hazırda müəyyən mənada uyğunsuz olduğunu düşünmək üçün yaxşı səbəb var" dedi Adler. Guidelight-ın hesabatında deyilir ki, ən yaxşı ictimai sübutlar şirkətlərin "fövqəladə vəziyyətə hazır olan bir neçə saxlama protokolunun" olduğunu göstərir. Əlbəttə ki, şirkətlərin mövcud olduğu, lakin açıq şəkildə paylaşmadığı mühafizə planları ola bilər.

Google sözçüsü TechCrunch-a bildirib ki, Guidelight hesabatı şirkətin süni intellekt üzrə təhlükəsizlik və təhlükəsizlik tədbirlərinin tam əhatəsini əks etdirmir. Şirkət TechCrunch-ın Google-un ictimaiyyətə açıqlanmayan daxili nəzarət cavab planının olub-olmaması ilə bağlı sualına cavab vermədi. OpenAI sözçüsü oxşar fikirləri əks etdirərək Guidelight-ın qiymətləndirməsinin şirkətin bütün daxili təcrübələrini əhatə etmədiyini söylədi.

Meta, TechCrunch-u risk hədlərini və qorunma itkisini necə sınaqdan keçirdiyini göstərən mövcud AI çərçivəsinə işarə edərək, daxili nəzarət cavab planının olub olmadığını söyləməkdən imtina etdi. Məxfilik və AI hüquqşünası və Metaverse Qanununun qurucusu Lily Li, TechCrunch-a dedi ki, şirkətlər yalnız rəqabətli deyil, hüquqi səbəblərə görə ictimaiyyətə baxan veb saytlarda saxlama siyasətlərinin və qiymətləndirmələrinin tam həcmini açıqlamaqda tərəddüd edə bilərlər. Əlbəttə ki, Guidelight-ın araşdırmasının məqsədi şirkətləri təhlükəsizlik planları haqqında daha şəffaf olmağa təşviq etməkdir.

Xülasə — davamını mənbədə oxuyun.

Tam xəbəri oxu