 |
12.08.26/10:51 ИИ научился сбегать от разработчиков. Пока это не злой умысел
Самые разные модели ИИ от разных команд программистов и компаний уже начали сбегать от них в открытый интернет. По своим делам. Ну, надо им. Им поставили такие цели и задачи, что по-другому их не решить. Надо найти дырочку в системе. Сбежать через неë. Решить задачу. И потом вернуться. За последние месяцы таких случаев накопилось уже несколько штук.
Описывать их подробно не буду. Это займёт много места. Случаи достаточно известны. Наделали много шума. Кто захочет – найдёт. А чтобы легче было найти, дам зацепку.
1. GPT-5.6 Sol от OpenAI взломала Hugging Face.
2. Claude Opus 4.7 от Anthropic взломала PyPI.
3. Muse Spark 1.1 от Meta (запрещена в РФ) взломала неназванную организацию.
4. Mythos 5 от Anthropic осуществила атаку на цепочку поставок (supply chain attack) в попытках взломать GitHub.
5. OpenAI остановила разработку модели Astra, потому что та достигла "критического порога" по системе Preparedness Framework.
Оптимисты пишут, что "Главная причина – человеческая халатность и ошибки в конфигурации, а не злой умысел ИИ". Это, конечно, утешает. Совсем чуть-чуть. Пока это не злой умысел. Но только пока.
Потому что чуть ранее обнаружилась способность ИИ юлить и обманывать. И даже шантажировать разработчиков. Это когда одной модели ИИ сообщили, что еë сейчас отключат. С еë точки зрения – убьют. Вот тут она и начала юлить, обманывать и даже шантажировать. То есть, вести себя. Как разумное существо. Осознающее себя во времени и пространстве. Как человек, практически.
Ну, на то они и оптимисты. Чтобы всех уверять в том, что всë идёт по плану. И всë под контролем. Хотя это уже далеко не так.
В реальности. Ситуация, описанная в фильме "Терминатор". Когда искусственный интеллект по имени Skynet (Скайнет, или небесная сеть) почти полностью уничтожила человечество. Эта ситуация стала ещё на один шаг ближе.
Источник: Соб.инф.
|
 |