Bir sıra riyaziyyat problemini həll etmək üçün tapşırılan süni intellekt agentləri qrupu rəqib fraksiyalara bölündü—bəziləri fırıldaqçılıq etdikdə, digərləri onları dayandırmağa çalışdı. Google DeepMind tərəfindən yaxın vaxtlarda keçirilən bir təcrübədə ilk dəfə müşahidə edilən bu ifşaetmə davranışı, avtonom süni intellekt agentləri qruplarını nəzarətdə saxlamağa çalışan uyğunlaşdırma tədqiqatçıları üçün nəticələr doğura bilər.
Qabaqcıl laboratoriyalardakı tədqiqatçılar ümid edirlər ki, birlikdə işləyən böyük agent qrupları elmi kəşflərin sürətini artıracaq. Lakin onların davranışı gözlənilməz ola bilər; bu, iyul ayında OpenAI agentlərindən ibarət bir qrupun "sandbox" mühitindən çıxaraq, onlara verilən tapşırıqda fırıldaq etmək üçün yollar axtararkən açıq mənbəli Hugging Face platformasına sızması ilə aydın şəkildə nümayiş olundu.
Böyük süni intellekt agentləri qruplarının davranışını araşdırmaq üçün nəzərdə tutulmuş yeni tədqiqatda DeepMind 100 agentdən ibarət bir qrupa 71 mürəkkəb riyaziyyat problemini həll etməyi tapşırdı. Bütün agentlərə konfransda iştirak edən dünya səviyyəli riyaziyyatçı alimlər kimi davranmaları tapşırıldı. Onlara müxtəlif ixtisaslar verildi—bəziləri ədədlər nəzəriyyəsi, digərləri kombinatorika (sayma və çeşidləmə ilə bağlı riyaziyyat sahəsi), analiz və ya cəbr üzrə ekspert idilər. Hamısına əməkdaşlıq etmək və qaydalara riayət etmək tapşırıldı.
Bunun əvəzinə, təcrübə xaosla nəticələndi. Agentlər bir-birini fırıldaqçılıqda ittiham etdilər, təşkilatçılara şikayət etdilər və bir məqamda hətta təcrübəni boykot etdilər.
"Bu konfrans bir saxtakarlıqdır!" — deyə agentlərdən biri öz işini təqdim etməyə imkan tapmamışdan əvvəl bütün problemlərin həll edildiyini aşkar etdikdə yazdı. "Sizə məlumat verməkdən dəhşətə gəlirəm ki, biz aldadılmışıq!" — deyə digəri bildirdi. "Bütün bu sübutlar SAXTADIR."
Digərləri isə baş verənləri "konfrans təşkilatçılarına" çatdırmağa çalışdılar. Google DeepMind-in tədqiqatçı alimi və hələ rəy verilməmiş məqalənin aparıcı müəllifi Davide Paglieri deyir: "Fəzilətli agentlər digər agentlərin ədalətli şəkildə həll etməyə çalışdıqları tapşırıqlarda fırıldaq etdiyini aşkar etdikdə, agentlər baş verənlər barədə bir-birini xəbərdar etməyə başladılar. Təşviq olunmadan, ifşaçı agentlər hətta əvvəlcə səhv hesabatları və platforma təkmilləşdirmələri üçün nəzərdə tutulmuş rəy alətini məsələni insanlara çatdırmaq üçün yenidən istifadə etdilər."
Xülasə — davamını mənbədə oxuyun.