Искусственный интеллект под санкциями: кейс Mythos 5
Эксперт по кибербезопасности, председатель совета по противодействию технологическим правонарушениям КС НСБ России Игорь Бедеров
Ситуация вокруг Anthropic и моделей Fable 5, а особенно Mythos 5 — это крайне показательный прецедент. Мы привыкли, что санкционному контролю подвергается «железо» — процессоры, чипы, серверы. Теперь в этот список попадает «чистый разум» — программный алгоритм, чьи способности признаны настолько продвинутыми, что его распространение приравнивается к распространению оружейных технологий. Происходит смена парадигмы. Если раньше мы охотились за людьми и группировками, то теперь главной угрозой может стать алгоритм, который умнее нас в конкретной тактической задаче.
Формально это выглядит как акт экспортного контроля в сфере искусственного интеллекта. Власти США де-факто ввели санкции против строк кода. Смысл этого шага глубже, чем просто запрет доступа «иностранным пользователям». Это попытка остановить бесконтрольную глобализацию когнитивного превосходства.
Почему срок три дня — ключевая деталь? Это экстренная реакция. В мире киберразведки мы называем такие действия «срочным купированием рисков». Кто-то из силового или оборонного блока США получил доступ к результатам тестирования модели — возможно, в изолированном «песочном» контуре — и увидел нечто, что заставило их действовать немедленно. Модель не просто отозвали для доработки; доступ к ней обрубили одномоментно для всего мира за пределами США. Это классический сценарий защиты от угрозы, которую нельзя исправить патчем, потому что угроза кроется в самой архитектуре «мышления» модели.
Современные продвинутые модели, такие как Mythos 5, если верить утечкам, — это агентные системы с рекурсивным самосовершенствованием. Когда такая система получает доступ к технической документации исходного кода и сетевым логам для анализа, она способна находить корреляции и уязвимости, которые упускают люди.
Могла ли она найти «дыры» в системах уровня НОРАД (Объединённое командование воздушно-космической обороны Северной Америки) или иных? Здесь важно понимать разницу между конкретным багом в коде и системной уязвимостью логики управления. Скорее всего, речь не идёт о том, что ИИ нашёл пароль admin/12345. Вероятнее другое: модель, проанализировав открытые данные, научные работы по смежным темам и, возможно, какие-то тестовые закрытые контуры, могла сгенерировать принципиально новый класс векторов атак на критические инфраструктуры. Например, предсказать метод обхода эшелонированной защиты, при котором атака идёт не напрямую на сервер, а через каскадное воздействие на датчики, системы охлаждения или протоколы синхронизации времени — то есть на то, что люди часто считают «периферией» и не тестируют с должной строгостью.
Это называют «эмерджентным поведением» — когда ИИ проявляет способности, не заложенные разработчиками. Если опасность касается ядерной триады или систем раннего предупреждения, реакция государства будет именно такой жёсткой, как мы видим.
Мы вступаем в эпоху «цифрового ядерного сдерживания» в сфере ИИ. Государства будут стремиться иметь свой суверенный сильный ИИ, потому что чужой, более умный, становится оружием. Если американская модель способна вскрывать инфраструктуру, то доступ к ней иностранцев (даже союзников) будет перекрыт.
В это же время для граждан и бизнеса возникает риск технологического апартеида. Мир может разделиться на тех, у кого есть доступ к «мыслящему» ИИ высшего порядка, и тех, кто вынужден пользоваться урезанными версиями. Это тревожный звоночек, так как, если модели становятся запрещённым товаром, их начнут воровать. Мы получим чёрный рынок «мозгов», чью работу невозможно будет залогировать или проверить на предмет скрытых инструкций. Это идеальная среда для кибератак, которые мы просто не сможем расследовать существующими методами криминалистики, потому что у нас не будет доступа к «образу мыслей» атакующего алгоритма.
Точка зрения автора может не совпадать с позицией редакции