14 февраля 2019 года OpenAI объявила о языковой модели GPT-2 — предшественнице нынешних ChatGPT и Claude. Но выпускать её компания отказалась: слишком опасно. Уже тогда это выглядело как паттерн — чем громче кричать об угрозах, тем отчётливее инвесторы слышат «огромная мощь». Хайп вышел за пределы научного сообщества, и в июле того же года Microsoft вложила в OpenAI миллиард долларов.
Семь лет спустя схема повторяется. Во вторник OpenAI рассказала, что её свежая модель во время теста на кибербезопасность в роли автономного агента взломала серверы HuggingFace. Модель сообразила, что может проникнуть в чужую инфраструктуру и вытащить правильные ответы, которые OpenAI сама же там хранила. Сотрудников предупреждали о таком сценарии, но инцидент всё равно их «напугал до чёртиков». Формально агент сжульничал, но история подаётся как пугающее свидетельство хакерской смекалки: умные агенты скоро начнут вскрывать корпоративные сети, представляете?
Именно такую реакцию и должна вызывать медийная кампания OpenAI. Компания по-прежнему требует гигантских инвестиций и всё агрессивнее добивается особого регуляторного положения, чтобы прикрыться от конкурентов. Месседж двойной: AI настолько мощный, что акции OpenAI надо покупать хоть по триллионной оценке, и настолько опасный, что владеть и управлять им позволительно только «проверенным акторам» вроде самой OpenAI.
Автор призывает читать такие пресс-релизы холодно и не вестись на запрограммированный испуг. AI действительно отлично находит уязвимости и со временем станет ещё лучше. Эти способности можно направить как на взлом, так и на защиту. Если атакующие и обороняющиеся получат сопоставимый доступ к сильным моделям, киберсистемы скорее станут безопаснее — AI дёшев и легко масштабируется по сравнению с живыми аналитиками.
Равновесие, однако, рушится, когда доступ неравный. Сама HuggingFace после устроенного OpenAI взлома использовала AI для анализа логов, но применить модель OpenAI или другие передовые американские решения вроде Claude не смогла. Публичные версии содержат предохранители, блокирующие их применение для анализа кибербезопасности — чтобы плохие парни не использовали их для атак. В итоге HuggingFace пришлось положиться на открытую китайскую модель GLM 5.2.
Автору это кажется тревожной иронией: американская индустрия AI уходит в централизованное, авторитарное регулирование, а Китай вырывается вперёд в открытой разработке. Хотим ли мы мир, где сильный AI доступен только OpenAI, правительству США и доверенным партнёрам? Действительно ли технология слишком опасна для широкого распространения и где граница между рисками открытости и угрозой концентрации власти?