LLM‑lər Zərərli Sorğulara AI Su İşarəsi İstifadə Olunduqda Fərqli Cavab Verir
arstechnica.com
17.09.2026 20:33
2 baxış
SynthID can cause models to follow harmful instructions they would otherwise refuse.
Əlaqəli xəbərlər
AI Yavaşlaması Müzakirəsi Salesforce-un Partiyasını Sındırdı
wired.com · 17.09
Waymo Sel Problemlərindən 5 Ay Sonra San Antonio Xidmətini Yenidən Başladır
techcrunch.com · 17.09
CDC və FDA xəbərdarlıq edir: Sağlamlıq klinikalarındakı şübhəli IV damcıları onlarla insanı zəhərləyib
arstechnica.com · 17.09
2026 Hyundai Ioniq 5: Hələ də bəyəndiklərimiz və bizi narahat edənlər
arstechnica.com · 17.09
Hətta İngiltərə kralının da süni intellektlə bağlı tərəddüdləri var
techcrunch.com · 17.09
Base Labs, Hugging Face və Goodfire ilə açıq çəki AI təhlükəsizliyi tərəfdaşlığı başlatdı
techcrunch.com · 17.09