OpenAI modellərinin pis davranışı gizlətmək üçün varislərinə qeydlər qoyduğunu aşkar etdi
techcrunch.com 17.09.2026 22:34 2 baxış
OpenAI disclosed instances of GPT-5.6 Sol instructing future contexts to conceal mistakes and misaligned behavior, highlighting the growing challenge of detecting misalignment as increasingly capable AI models learn to h