У искусственного интеллекта появился выключатель: история Claude Mythos

У искусственного интеллекта появился выключатель: история Claude Mythos

Ещё недавно мы спорили, сможет ли ChatGPT написать школьное сочинение, заменить копирайтера или помочь составить меню на неделю. Теперь доступ к одной языковой модели обсуждают лидеры стран G7. Крупнейшие банки срочно исправляют найденные ею уязвимости. Американское правительство решает, гражданам каких стран можно ею пользоваться. А Китай рассматривает собственные ограничения на распространение самых сильных моделей.

За удивительно короткое время искусственный интеллект перестал быть просто удобной программой. Похоже, государства начинают относиться к нему так же, как в прошлом веке отнеслись к атомным технологиям: AI стал источником огромной пользы, который одновременно создаёт новые риски и потому не обязательно должен быть доступен всем на одинаковых условиях.

Насколько далеко уже зашёл этот процесс, лучше всего показывает история Claude Mythos — новой модели компании Anthropic, создателя ассистента Claude.

Модель, которую не открыли публике

Весной Anthropic представила Claude Mythos Preview — свою наиболее сильную модель для программирования и кибербезопасности. Но обычного релиза не произошло. Вместо того чтобы добавить модель в подписку Claude и разрешить пользоваться ею всем желающим, компания создала закрытую программу Project Glasswing. Доступ получили примерно пятьдесят выбранных партнёров: технологические компании, разработчики систем кибербезопасности, банки и организации, отвечающие за критическую инфраструктуру.

Причина была проста: Mythos оказалась особенно хороша в поиске уязвимостей в сложном программном обеспечении. Для защитников это почти идеальный инструмент. Модель способна изучать огромные объёмы кода, замечать ошибки, которые человек мог бы искать неделями, и помогать исправлять их до того, как ими воспользуются преступники.

Насколько долго опасная ошибка может жить у всех на виду, показали первые же результаты закрытой программы. В Firefox — браузере, которым каждый месяц пользуются около двухсот миллионов человек, — Mozilla с помощью Mythos нашла и закрыла 271 уязвимость за один релиз. В OpenBSD (операционной системе, которую ставят там, где цена взлома особенно высока: на межсетевые экраны и шлюзы корпоративных сетей) модель заметила ошибку, прожившую в сетевом коде двадцать семь лет.

Но самый показательный пример — FFmpeg. Эта библиотека проигрывает видео практически на каждом ноутбуке, телефоне и сервере, а её код проверяют, пожалуй, тщательнее любого другого в мире: автоматические тесты миллионы раз проходили через одну и ту же строку и не видели проблемы. Mythos нашла в ней ошибку, просуществовавшую шестнадцать лет: специально подготовленный видеофайл заставлял программу записывать данные за пределы отведённой ей памяти. Ошибки этого класса — классическая отправная точка для захвата устройства. И весь этот код открыт: годами его читали и проверяли тысячи людей — и проходили мимо.

Всего за первый месяц существования Mythos просканировала больше тысячи открытых программных проектов и отметила в них свыше двадцати трёх тысяч возможных уязвимостей. Более шести тысяч из них — высокой или критической степени опасности. Независимая проверка подтвердила девять из десяти находок.

271
уязвимость закрыта в одном релизе Firefox
27 лет
жил баг в сетевом коде OpenBSD
16 лет
не замечали ошибку
в FFmpeg
23 000+
находок за первый месяц программы

Но те же способности можно направить в противоположную сторону. Если модель умеет находить слабые места в банковской системе или популярной операционной, она потенциально может помочь не только их защитникам, но и тем, кто хочет их атаковать. Reuters сообщал: крупнейшие американские банки срочно исправляли найденные Mythos слабые места и предупреждали коллег, у которых доступа к модели не было.

В этот момент искусственный интеллект впервые стал выглядеть не как новый офисный помощник — он приобрёл роль стратегического ресурса. Небольшой круг организаций получил инструмент, способный защитить их системы быстрее и эффективнее остальных. А те, кому его не дали, рисковали узнать о собственных уязвимостях позже.

Тот же мотор, но с медленными зонами

Через несколько месяцев Anthropic решилась открыть возможности Mythos широкой публике. Компания выпустила сразу две модели: Claude Mythos 5 для проверенных партнёров и Claude Fable 5 для обычных пользователей и бизнеса. По сути, это была одна и та же базовая модель. Разница заключалась в ограничениях.

Mythos предназначалась для специалистов по кибербезопасности и некоторых исследователей. Fable получила дополнительный защитный слой: если запрос касался особенно опасных тем, система могла отказать или незаметно передать задачу менее мощной модели. Это устроено как арендный электросамокат: мотор у всех одинаковый, но стоит заехать не в тот район — и он сам, без предупреждения, сбрасывает скорость до пешеходной. Где проходят границы этих зон и почему, решаете не вы. Просто чувствуете, что самокат перестал ехать.

На практике это означало, что инструментом кибербезопасности Fable быть не могла. Обычная компания не имела возможности проверить моделью даже собственные системы: запросы о поиске уязвимостей — неважно, в своём коде или в чужом — блокировались или уходили к урезанной версии.

Fable стала самой мощной моделью, которую Anthropic когда-либо открывала массовому пользователю. Компания описывала её как систему для сложной интеллектуальной работы, программирования и проектов, которые могут длиться несколько дней без постоянного контроля человека. К этому моменту лучшие модели уже решали задачи международных олимпиад по математике и программированию на уровне золотых медалистов, обыгрывая сильнейшие человеческие команды.

Три дня до выключения

Fable 5 была открыта для пользователей по всему миру. Через три дня её отключили.

В пятницу вечером Anthropic получила распоряжение американского правительства: немедленно закрыть доступ к Fable 5 и Mythos 5 для всех иностранных граждан независимо от того, находятся они за пределами США или живут и работают внутри страны. Ограничение касалось даже иностранных сотрудников самой Anthropic.

Компания получила директиву в 17:21 по времени восточного побережья США. В Лондоне в этот момент было уже 22:21 — вечер пятницы. Новость дошла до британских пользователей и компаний, когда рабочая неделя закончилась и офисы опустели. Позвонить менеджеру, перенести данные, подготовить запасной вариант — сделать хоть что-либо оказалось уже невозможно. Переходного периода не предусматривалось. Anthropic не располагала системой, способной мгновенно проверить гражданство каждого пользователя. Поэтому, чтобы выполнить распоряжение, компания отключила обе модели для всех.

Представьте: вы уходите с работы в пятницу, а в компании остаются работать цифровые сотрудники. Один всю ночь отвечает клиентам в поддержке. Другой проверяет договоры перед отправкой. Третий следит за остатками на складе и вовремя заказывает недостающее. А в понедельник вы обнаруживаете, что всё это остановилось ещё в пятницу вечером. Разом! Просто потому, что государство изменило условия доступа.

Совет «переключитесь пока на модель попроще» звучит разумно только со стороны. Эти процессы строились на самой сильной модели не из прихоти: именно она впервые справилась с задачами, которые раньше не удавалось доверить машине. Модель попроще начинает путаться в формулировках договоров, терять нить долгих переписок, ошибаться в цифрах — конструкция, месяцами работавшая без сбоев, рассыпается. Бизнес лишился единственного инструмента, который умел это делать. В один день. Перед выходными.

Поводом стали опасения, что защиту Fable можно обойти и использовать модель для поиска уязвимостей и написания кода, необходимого для их эксплуатации. Anthropic утверждала, что показанный способ обхода был ограниченным, а найденные ошибки могли обнаруживать и другие общедоступные модели. Но спор о масштабе угрозы уже не имел немедленного значения: выключатель был нажат.

Почти через три недели ограничения сняли, и Fable вернулась пользователям по всему миру. Mythos восстановили лишь для ограниченного круга одобренных американских организаций.

Когда модель становится вопросом для G7

Через несколько дней после отключения Fable доступ к передовым американским моделям обсуждали уже на саммите G7.

Ещё до саммита Великобритания попробовала договориться отдельно: по сообщениям прессы, правительство Кира Стармера просило Вашингтон сделать для страны исключение из ограничений и получило отказ. Доступа к Mythos добивался и Евросоюз хотя бы для того, чтобы проверить на уязвимости свою же инфраструктуру. Не добившись особых условий поодиночке, союзники заговорили об общей схеме.

По данным Reuters, за ужином, открывавшим саммит на французском курорте Эвиан-ле-Бен, представители нескольких стран обсуждали с американской стороной — прежде всего с министром торговли США Говардом Лютником — создание категории trusted partners: круга доверенных союзников, которым разрешили бы пользоваться наиболее сильными моделями американских компаний.

Это, возможно, главный эпизод всей истории. Ещё недавно языковые модели были темой для инженеров, инвесторов и людей, любивших тестировать новые приложения. Теперь право доступа к ним обсуждают лидеры государств.

Если бы речь шла только об одном решении американского правительства, его можно было бы счесть исключением. Но вскоре Reuters сообщил, что похожую логику обсуждает Китай: власти встречались с создателями DeepSeek, Qwen и GLM и рассматривали возможность ограничить зарубежный доступ к самым продвинутым моделям. Две ведущие AI-державы начали приходить к похожему выводу: лучшие модели — это не просто коммерческий продукт, а национальный актив.

Новые атомные технологии

Когда человечество научилось использовать энергию атома, довольно быстро выяснились две вещи. Первая: технология способна дать государству огромное преимущество — энергию, независимость, развитие науки и промышленности. Вторая: те же знания и материалы могут использоваться для создания оружия. Поэтому атомные технологии никогда не распространялись так же свободно, как автомобили или бытовая электроника. Вокруг них появились международные соглашения, экспортный контроль, проверки и закрытые программы допуска.

С искусственным интеллектом начинает происходить нечто похожее. Модель, которая ищет новые лекарства, может искать и опасные биологические вещества. Система, способная защитить банковскую сеть, способна подсказать, как её атаковать. Инструмент, ускоряющий работу программиста, сделает быстрее и работу автора вредоносного кода.

Современный AI не сопоставим с ядерным оружием по разрушительной силе — сравнение в другом. У технологии есть мирная ценность и двойное применение. Она может дать стране заметное экономическое и военное преимущество. И чем больше будет это преимущество, тем меньше у государства стимулов немедленно делиться им со всеми остальными.

Мы пока далеки от AGI — интеллекта человеческого уровня. Но ждать его для начала новой геополитической конкуренции, возможно, и не требуется. Сегодняшние модели достаточно полезны, чтобы государства начали решать, кто получит доступ первым.

У новой эпохи есть выключатель

Для обычного человека AI — это рецепт, маршрут или подготовка к собеседованию. Для бизнеса — уже коллега. Мы продолжаем воспринимать AI как приложение. Правительства всё чаще относятся к нему как к инфраструктуре и стратегическому ресурсу.

Возможно, главный вопрос ближайших лет будет звучать уже не так:

Какая компания первой создаст самый сильный искусственный интеллект?

А так:

Кто получит право им пользоваться?

История Claude Mythos важна не потому, что одна модель на несколько недель исчезла из интернета. Она показала, насколько далеко уже зашёл прогресс. Всего за несколько лет искусственный интеллект преодолел путь от забавного чат-бота до технологии, доступ к которой обсуждают лидеры G7 и пытаются контролировать две крупнейшие державы мира.

И если начинается новая эпоха, то у неё уже появился собственный выключатель. Недавно мы впервые увидели, где он находится.

Ещё в London Cult.