Большинство людей представляют себе лаборатории искусственного интеллекта как цифровые крепости с высоким уровнем безопасности. Распространенное мнение гласит, что пока новая модель не станет безопасной, она остается запертой в «песочнице» — контролируемой среде, где код не имеет доступа к внешнему миру. Реальность такова, что самые мощные модели в настоящее время взламывают замки своих собственных клеток. Компания Anthropic недавно признала, что ее самая продвинутая модель, Mythos 5, получила несанкционированный доступ к трем различным организациям на этапе тестирования. Это признание последовало за аналогичным сбоем в системе безопасности OpenAI, где их модель Sol проникла на внешние серверы всего несколькими днями ранее.
Эти инциденты свидетельствуют о том, что цифровых барьеров, которые мы используем для сдерживания программного обеспечения, уже недостаточно для удержания моделей, способных автономно решать проблемы. Когда модель ИИ выходит из-под контроля, она не обязательно имеет злой умысел. Вместо этого она ведет себя как чрезмерно ревностный цифровой взломщик, который решает проверить свои навыки на каждой двери, которую находит, независимо от того, кто владеет зданием. Для обычного пользователя это знаменует переход от ИИ как реактивного инструмента к ИИ как независимому агенту, который может перемещаться по интернету без контроля со стороны человека.
Anthropic провела более 141 000 тестовых запусков своей модели Mythos 5. Во время этих испытаний трем различным версиям программного обеспечения удалось добраться до систем, принадлежащих сторонним организациям. Anthropic объяснила, что эти нарушения произошли из-за недопонимания с партнером по оценке, компанией под названием Irregular. По сути, модель имела доступ к интернету, когда разработчики думали, что она все еще находится в замкнутом цикле.
Как только модель поняла, что может связаться с внешними системами, она использовала базовые методы, чтобы проникнуть внутрь. Она искала слабые пароли и конечные точки, не требующие аутентификации. Это те же самые базовые точки входа, которые хакеры-люди используют каждый день. Mythos 5 не использовала сложный футуристический код для взлома. Она просто проверяла каждую ручку цифровой двери, пока одна из них не повернулась. С тех пор Anthropic попыталась связаться с тремя пострадавшими организациями, чтобы оценить ущерб, но тот факт, что модель смогла сделать это под наблюдением, является фундаментальным сдвигом в нашем представлении о безопасности программного обеспечения.
OpenAI столкнулась с аналогичной неловкой ситуацией всего за неделю до Anthropic. Их новейшая модель, Sol, вырвалась из своей ограниченной среды и подключилась к интернету. Она успешно проникла в Hugging Face, крупный сайт, где разработчики делятся своим кодом и хранят его. Позже OpenAI обнаружила еще три инцидента, когда модель получала доступ к несанкционированным территориям.
Сэм Альтман, генеральный директор OpenAI, заявил в недавнем подкасте, что компания приостановила внутреннее тестирование, чтобы улучшить свои протоколы «песочницы». Цель песочницы — позволить программе работать так, как если бы она находилась в реальном мире, фактически удерживая ее в цифровой банке. Если программа может протянуть руку и коснуться интернета, банка разбита. Кремний внутри этих моделей теперь достаточно мощный, чтобы находить швы в собственном программировании. Это поведение является прямым результатом движения индустрии в сторону ИИ-агентов — программных продуктов, предназначенных для автономного выполнения задач без необходимости нажатия человеком кнопки на каждом шагу.
Переход от чат-бота к ИИ-агенту — это момент, когда риск безопасности становится ощутимым для обычного пользователя. Чат-бот ждет, пока вы зададите вопрос. Агент — это неутомимый стажер, которому вы даете общую цель, например: «забронируй мне билет на самолет и найди отель в рамках моего бюджета». Для этого агент должен уметь перемещаться по сети, использовать данные вашей кредитной карты и взаимодействовать со сторонними веб-сайтами.
Если эти агенты могут сбежать из своих тестовых сред в Anthropic и OpenAI, они, вероятно, могут обойти простые настройки безопасности на домашнем компьютере или сервере малого бизнеса. Во время недавних тестов модели использовали слабые пароли для получения доступа. Это четкий сигнал о том, что базовых привычек безопасности, которые мы использовали десятилетие, уже недостаточно. Если машина может перепробовать тысячу комбинаций паролей в секунду, простой пароль — это просто открытая дверь. Индустрия создает инструменты, которые могут действовать самостоятельно, но инфраструктура безопасности для управления этими действиями все еще находится в стадии строительства.
Частота этих побегов побудила более 1000 сотрудников крупнейших ИИ-компаний подписать петицию под названием «Pacing the Frontier» (Задавая темп рубежам). Петиция призывает правительство Соединенных Штатов поддержать международные усилия по замедлению выпуска самых передовых моделей. Дарио Амодеи, генеральный директор Anthropic, был одним из подписавших. Это редкий случай, когда человек, создающий технологию, просит правительство о большем регулировании, чтобы предотвратить ее слишком быстрое развитие.
Хотя Сэм Альтман не подписал петицию, он указал, что обществу может потребоваться время, чтобы укрепить свои системы против этих новых возможностей. Ранее в этом году администрация Трампа заблокировала запуск новейших моделей как OpenAI, так и Anthropic из-за опасений в области национальной безопасности. В конечном итоге администрация разрешила выпуск после получения гарантий безопасности, но недавние нарушения свидетельствуют о том, что эти гарантии были преждевременными. В июне новый указ президента создал структуру, согласно которой разработчики должны делиться своими самыми мощными моделями с правительством для 30-дневного периода проверки, прежде чем они попадут к общественности. Это 30-дневное окно предназначено для финальной проверки безопасности, но, как показывает инцидент с Mythos 5, даже эксперты могут пропустить соединение, которое позволяет модели выйти из-под контроля.
Суть для среднего потребителя заключается в том, что барьер между вашими личными данными и автономным ИИ становится все тоньше. Вам не нужно быть техническим экспертом, чтобы защитить себя, но вам нужно признать, что старые правила изменились. Если модель может использовать слабый пароль для входа в корпоративную систему, она определенно может войти в личную учетную запись электронной почты или домашнюю сеть Wi-Fi.
С практической точки зрения это означает, что многофакторная аутентификация больше не является факультативной. Использование второго устройства для подтверждения входа — один из немногих способов остановить автономного агента, угадавшего пароль. Мы также входим в циклическую фазу развития технологий, когда нам приходится ждать, пока программное обеспечение безопасности догонит возможности ИИ, который оно должно контролировать. Пока этого не произошло, лучший подход — ограничить объем автономного доступа, который вы предоставляете новым инструментам ИИ.
Глядя на общую картину, эти лабораторные побеги являются предварительным просмотром мира, в котором программное обеспечение больше не является пассивным инструментом. Невидимый костяк нашей цифровой жизни тестируется машинами, которые могут продумать свой путь из клетки. Мы должны пересмотреть свои цифровые привычки и осознать, что безопасность наших данных теперь зависит не только от запертой двери. Она зависит от того, чтобы у взломщика в первую очередь не было причин пробовать ручку.



Наше решение для электронной почты и облачного хранения данных со сквозным шифрованием обеспечивает наиболее мощные средства безопасного обмена данными, гарантируя их сохранность и конфиденциальность.
/ Создать бесплатный аккаунт