Dario Amodei-nin üçüncü tərəf təhlükəsizlik qiymətləndiricilərini süni intellekt laboratoriyalarına yerləşdirmək planları forma almağa başlayır: Anthropic, texnologiya məsləhətləşmə nəhəng Accenture-nin əməkdaşlarının şirkətin modellərini və əməkdaşlarını araşdırmaq üçün şirkət daxilində işləməyə başlayacağını söylədi.
Bir blog yazısında Anthropic, yanvar ayında Aİ bölməsi kimi fəaliyyət göstərmək üçün Accenture-un əldə etdiyi bir şirkət olan Fakültənin qiymətləndirmə və qırmızı komandalar təşkil etməyi, uyğunlaşdırma qiymətləndirmələrini aparmağı və modellərin qorunmasını sınamaqla başlayacağını söylədi. Hər iki şirkət növbəti beş ildə layihəyə ən azı 1 milyard dollar sərmayə qoymağı gözləyirik.
"Accenture" şirkətinin seçimi bir çox süni intellekt müşahidəçisini və müşavir şirkətinin səhmlərinin saatlar sonra 8% artdığı bazarları təəccübləndirdi. Amodei'nin blog yazısından yaranan yerləşdirilmiş qiymətləndiricilər ətrafında müzakirə METR, Redwood Research və Apollo Research kimi süni intellekt təhlükəsizliyi tədqiqat təşkilatlarına yönəldi. Bu, xüsusilə də, MŞ-nin təhlükəsizliyini və uyğunlaşmasını öz missiyasının mərkəzində qoyan Anthropic-də doğrudur.
Anthropic, yaxın həftələrdə daha çox qiymətləndiricinin elan olunacağını və öz maliyyələşdirmələrindən istifadə edərək qovuşmuş qiymətləndirmə elementlərinin necə təcrübəyə keçiriləcəyi barədə METR və digər qeyri-kommersiya təşkilatları ilə danışıqlar aparıldığını söylədi.
Accenture dərin öyrənmə tədqiqatlarının qanlı kənarında işləri ilə tanınmasa da, Anthropic şirkətin böyük korporasiyalar və hökumət qurumları üçün AI-ni tətbiq etməkdəki praktik təcrübəsinə əsas üstünlük kimi diqqət çəkdi. Həmçinin, AI inqilabından əvvəlki böyük bir ictimai şirkət kimi, daha funksional olaraq Anthropic və AI laboratoriyasının ətrafında olan kompleks ekosistemdən asılıdır.
Laboratoriya qeyd edib ki, qiymətləndiricilərin giriş və ya ünsiyyət üçün hələlik heç bir standart yoxdur və onun yanaşmasının zamanla inkişaf edəcəyini gözləyirik. Xarici qiymətləndirmələr artıq yeni böyük dil modellərinin prosesinin buraxılmasında əsas hissə olsa da, son hadisələr riskləri artırıb: OpenAI və Anthropic tərəfindən yerləşdirilən AI agentləri laboratoriya daxilində xəbərdarlıq etmədən xarici veb saytlara daxil olublar.
Xülasə — davamını mənbədə oxuyun.