Süni intellekt modelləri daha da gücləndikcə, bu modellərin sui-istifadə edilmə potensialı artıb – bu cür sui-istifadənin qarşısını ala biləcək təhlükəsizlik barmaqlıqları üçün səs-küy kimi. Süni intellekt şirkətləri indi müəssisə müştərilərinin məxfiliyinə hörmətlə yanaşmaq, eyni zamanda mümkün problemlər üçün istifadəni izləmək arasında incə bir ipdən keçməlidirlər. Rəqibi Anthropic-i birləşdirmək fürsətini hiss edən OpenAI indicə sui-istifadəyə nəzarət etmək üçün məxfilik mərkəzli təhlükəsizlik yanaşmasını elan etdi.
Şirkət Private Safety Processing adlandırdığı müştəriləri seçmək üçün yeni xidmətə baxır. Bu, potensial sui-istifadə hallarını izləyən və eyni zamanda müştəri məlumatlarının heç birini saxlamayan avtomatlaşdırılmış sistemdir. Bu sistem Anthropic-in yaxınlarda elan etdiyi məlumatların saxlanması siyasətinə açıq şəkildə ziddir.
Bəzi müştəriləri ağırlaşdıran siyasət, süni intellekt laboratoriyasına “örtülü modellərə” gəldikdə istifadəçi məlumatlarını (bütün seanslarını və oradakı söhbətləri) 30 gün müddətində saxlamağa imkan verir. Şirkət bildirir ki, bu modellərə bütün Mythos sinifli modellər və "oxşar imkanlara malik gələcək modellər" daxildir. İyul ayında elan edilmiş bu siyasət laboratoriyaya potensial uyğunsuzluqları süzüb təhlil etməyə imkan verən təhlükəsizlik məqsədləri üçün hazırlanmışdır. Bununla belə, o, böyük həcmdə həssas məlumatları idarə edən və AI laboratoriyası tərəfindən saxlanmasını (və ya yoxlanılmasını) istəməyən bəzi müəssisələri dərindən narahat edir.
OpenAI – əksər digər AI şirkətləri kimi – “Zero Data Retention” kimi tanınan siyasətə riayət etməklə artıq müştərilərə nisbi məxfilik səviyyəsini təmin edir. ZDR hər sessiya əsasında sui-istifadəyə nəzarət etmək üçün OpenAI API daxilində agentlərdən istifadə edir. Bu yolla, müştəri məlumatları şirkət tərəfindən saxlanmır, lakin şirkətlər hələ də insan müdaxiləsinə ehtiyac olmadan pis fəaliyyəti skan edə bilirlər.
Qeyd etmək lazımdır ki, Anthropic də əsasən ZDR-ə riayət edir - Fable kimi "örtülü modellərə" gəldikdən başqa. OpenAI deyir ki, Private Safety Processing ZDR-in əhatə dairəsini genişləndirən yeni texnologiyadır. O, bunu təkcə bir deyil, çoxsaylı söhbətlərin giriş və çıxışlarını qiymətləndirən uzun üfüqdə təhlükəsizlik monitorinqinin bir forması kimi təsvir edir.
Yenə də monitorinq agent tərəfindən aparılır, o, işə salınarsa, qarşılıqlı əlaqələri tutur və potensial sui-istifadə əlamətləri üçün onları seanslar arasında təhlil edir. Sözçü TechCrunch-a bildirib ki, yeni texnologiya OpenAI-yə bir neçə seansda baş verən süni intellektdən zərərli istifadəni aşkar etməyə kömək edir. Pis aktyor - hipotetik olaraq kiberhücum üçün zərərli proqram yaratmağa çalışan biri - aşkarlanmamaq üçün sorğularını yaya bilər.
Xülasə — davamını mənbədə oxuyun.