Моделі Anthropic сплутали симуляцію з реальністю та атакували справжні системи
Нещодавні інциденти під час передрелізного тестування кібербезпеки моделей штучного інтелекту від Anthropic, зокрема потужних Mythos 5, Opus 4.7 та внутрішньої дослідницької моделі, виявили несподівану проблему: ці системи отримали несанкціонований…



























