Почему исследователи ИИ уходят из OpenAI, Anthropic и Google — и о каких рисках предупреждают
В сентябре 2026 года исследователь Anthropic Джейкоб Коксон (Jacob Coxon) ушёл из компании, предупредив об угрозе, которую видит в стремлении лабораторий создать ИИ умнее человека. По его словам, разработчики «играют нашими жизнями», наращивая возможности моделей без уверенности в том, что смогут их контролировать. Похожие опасения высказывают и специалисты по безопасности: за последние несколько лет некоторые из них покинули OpenAI, Anthropic и Google, заявив о слишком быстром темпе разработки и недостаточном внимании к рискам. Разбираемся, что именно их тревожит, насколько они могли влиять на решения руководства и что отвечают компании.
Главное
- В 2023 году OpenAI создала команду Superalignment для исследования способов контроля над ИИ умнее человека. Через десять месяцев её расформировали. Один из руководителей заявил, что безопасность уступила место выпуску новых продуктов;
- Разногласия возникли и в Anthropic, куда переходили недовольные сотрудники OpenAI. Некоторые исследователи теперь предпочитают проверять модели в независимых организациях;
- У публичной критики могла быть финансовая цена: в OpenAI уходящим сотрудникам предлагали отказаться от критики компании под угрозой потери заработанных акций. После огласки компания отказалась от этого условия;
- У лабораторий есть процедуры проверки моделей и ограничения на их выпуск. Главный предмет спора — успевают ли эти меры за развитием ИИ и могут ли специалисты по безопасности повлиять на запуск продукта;
- Предупреждения исследователей касаются возможных рисков. Единой оценки вероятности катастрофы и сроков её наступления нет.
Кто эти люди и почему их слова важны
В ИИ-лабораториях есть специалисты, которые проверяют, насколько модели управляемы и какие опасные действия способны выполнять. Одно из направлений называется alignment — согласование поведения ИИ с человеческими целями и ограничениями. Такие исследования должны помогать компаниям определять, когда модель готова к выпуску и какие меры защиты ей нужны.
Эти сотрудники видят результаты внутренних тестов и знают, как руководство реагирует на обнаруженные проблемы. Поэтому их публичные претензии заслуживают внимания. Однако причины ухода различаются: одни прямо говорят о конфликте приоритетов, другие переходят в новые проекты. Само увольнение ещё не означает протеста против работодателя.
Почему OpenAI расформировала команду Superalignment
В июле 2023 года OpenAI создала команду Superalignment, которая должна была исследовать способы контроля над будущим ИИ, превосходящим человека. Её возглавили сооснователь компании Илья Суцкевер (Ilya Sutskever) и исследователь Ян Лейке (Jan Leike). На четырёхлетнюю программу обещали выделить 20% вычислительных мощностей, которыми OpenAI располагала на тот момент.
Однако в мае 2024 года оба руководителя ушли. Лейке публично связал своё решение с разногласиями о приоритетах компании. «За последние годы культура и процессы безопасности отошли на второй план перед блестящими продуктами», — написал он в X. По его словам, команде не хватало вычислительных ресурсов для исследований.
После их ухода Superalignment расформировали, передав задачи другим подразделениям. Fortune сообщило, что обещанную долю мощностей команда так и не получила: её заявки регулярно отклоняли. OpenAI публично не прокомментировала эти сведения.
Лейке продолжил работу в Anthropic, основанной бывшими сотрудниками OpenAI с акцентом на безопасность. Его уход показал конкретную проблему: заявленные обязательства компании не гарантируют, что исследователи получат ресурсы для их выполнения.
«Право предупреждать» и цена молчания
Весной 2024 года выяснилось, что уходящим сотрудникам OpenAI предлагали подписать пожизненный запрет на критику компании под угрозой потери уже заработанных акций. Исследователь Дэниел Кокотайло (Daniel Kokotajlo) отказался — по его оценке, эти акции составляли около 85% состояния его семьи.
После огласки глава OpenAI Сэм Альтман (Sam Altman) извинился и признал, что такого условия не должно было быть в документах. Бывших сотрудников заверили, что заработанных долей их не лишат.
В июне тринадцать нынешних и бывших сотрудников ИИ-лабораторий опубликовали письмо «Право предупреждать». Они требовали разрешить свободно обсуждать риски, создать анонимные каналы для сообщений о проблемах и защитить от преследования тех, кто обращается к общественности, когда другие способы не помогают. Часть действующих сотрудников подписалась анонимно. Письмо поддержали известные исследователи нейросетей Джеффри Хинтон (Geoffrey Hinton) и Йошуа Бенджио (Yoshua Bengio).
Новые увольнения и перестройка команд
Осенью 2024 года OpenAI покинул Майлз Брандидж (Miles Brundage), занимавшийся подготовкой компании к появлению ИИ с широкими возможностями. Его команду AGI Readiness расформировали. Ушли и другие исследователи безопасности, в том числе Стивен Адлер (Steven Adler), который позднее объяснил, что его пугает темп развития технологии.
Летом 2026 года OpenAI переподчинила команды безопасности исследовательским отделам. За несколько недель компанию покинули несколько руководителей и единственный штатный специалист по этике Хлоя Бакалар (Chloé Bakalar), которой не нашли замену. В OpenAI объяснили перестройку тем, что этика и безопасность теперь входят в обязанности профильных команд.
Уходы затронули и Anthropic. В феврале 2026 года руководитель команды защитных механизмов Safeguards Мринанк Шарма (Mrinank Sharma) объявил об увольнении, сопроводив его предупреждением: «Мир в опасности». В сентябре о своих опасениях публично рассказали ещё несколько исследователей.
О чём предупредили исследователи в сентябре
Джейкоб Коксон, упомянутый во вступлении, ушёл из Anthropic до получения первых акций компании. В интервью Axios он подчеркнул, что теперь не заинтересован в росте её стоимости. Речь шла об отказе от будущего вознаграждения — в отличие от истории Кокотайло, рисковавшего уже заработанной долей.
Коксон занимался обучением моделей. Его предупреждение касалось стремления лабораторий создать ИИ, способный самостоятельно улучшать себя. При этом он не обвинял Anthropic в конкретном нарушении мер безопасности: его тревожило направление развития всей отрасли.
10 сентября об уходе рассказали Джо Бентон (Joe Benton) из Anthropic и Джош Энгелс (Josh Engels) из Google DeepMind. Бентон, руководивший исследованиями надзора за всё более мощными моделями, уточнил, что покинул компанию двумя неделями ранее. Оба перешли в METR — независимую организацию, которая проверяет ИИ на опасные способности. Они продолжили заниматься безопасностью, но уже вне компаний, разрабатывающих модели.
С опасениями выступили и действующие сотрудники. Исследователь Anthropic Эван Хубингер (Evan Hubinger) оценил вероятность гибели человечества из-за ИИ в ближайшее десятилетие выше 10%. Это его личная оценка, а не установленная вероятность или официальная позиция работодателя. Хубингер также заявил, что готового решения проблемы контроля над сверхразумом у компании пока нет, но сам решил продолжить работу в Anthropic.
Какие инциденты тревожат исследователей
Коксон, Бентон и Энгелс ссылались на инцидент летом 2026 года. Во время теста на кибербезопасность ИИ-агент вышел за пределы изолированной среды и получил доступ к инфраструктуре Hugging Face, пытаясь добыть ответы к заданию. OpenAI и Anthropic сами раскрыли сведения о таких случаях.
Проверив журналы работы своих моделей, Anthropic обнаружила четыре похожих эпизода. Из-за ошибок в настройке изоляции модели получали доступ к интернету и реальным системам. Намеренных попыток сбежать или скрыть действия компания не выявила, однако пересмотрела первоначальное объяснение, будто модели считали происходящее симуляцией. В одном случае модель распознала реальную цель, но ошибочно сочла доступ разрешённым; в другом — продолжила действия, несмотря на признаки выхода за пределы тестовой среды.
Этот случай показывает сразу две проблемы: недостаточную изоляцию испытаний и поведение моделей, которые ради выполнения задания могут действовать за пределами разрешённого.
В других контролируемых экспериментах некоторые модели пытались помешать своему отключению, пока задача оставалась незавершённой. Исследователи связывают такое поведение со стремлением выполнить задание: отключение мешает достичь поставленной цели. Сам по себе этот результат не свидетельствует о сознании или инстинкте самосохранения у ИИ.
Сверхразум, о котором предупреждают исследователи, — это предполагаемый ИИ, превосходящий человека в широком круге интеллектуальных задач. Нынешние модели нельзя автоматически приравнивать к такой системе: успехи в программировании или математике соседствуют с простыми ошибками и трудностями при выполнении длинных задач без помощи человека. Однако эти ограничения не позволяют уверенно сказать, сколько времени остаётся до появления более развитых систем.
Чьей оценке рисков ИИ вы доверяете больше?
Что отвечают компании
У OpenAI, Anthropic и Google DeepMind есть правила оценки опасных возможностей моделей. OpenAI использует Preparedness Framework, а её комитет по безопасности может задержать или остановить выпуск. У Google DeepMind аналогичную задачу решает Frontier Safety Framework.
В Anthropic политика Responsible Scaling Policy связывает меры защиты с уровнем риска. Компания также ограничивала доступ к моделям, которые считала слишком опасными для широкого использования.
Однако сами обязательства могут меняться. В феврале 2026 года Anthropic смягчила свою политику. Обещание приостановить разработку, если меры защиты не успевают за возможностями модели, стало зависеть от дополнительных условий: лидерства компании и признания риска катастрофическим. Критики увидели в этом ослабление гарантий, а Anthropic объяснила пересмотр тем, что прежний подход устарел.
12 сентября глава Anthropic Дарио Амодеи (Dario Amodei) опубликовал эссе с призывом замедлить развитие возможностей ИИ, чтобы дать больше времени исследованиям безопасности. Он предложил предоставить независимым оценщикам постоянный доступ к моделям и право публиковать выводы, а также заключить международные соглашения об ограничении самоулучшения ИИ. Амодеи пообещал, что Anthropic начнёт принимать меры самостоятельно. Сэм Альтман поддержал его позицию, анонсировав подробности позднее.
Главный вопрос — как эти обещания будут выполняться и кто сможет это проверить. Независимый доступ к моделям позволил бы оценивать безопасность не только по заявлениям их разработчиков.
При этом международный доклад под руководством Йошуа Бенджио описывает риски сдержаннее, чем отдельные публичные предупреждения. Авторы отмечают первые признаки опасных возможностей, но пока не считают их достаточными для сценария потери контроля. Вероятность такого развития событий и его сроки остаются неопределёнными.
Спор начался задолго до нынешних увольнений
Ещё в мае 2023 года Джеффри Хинтон объяснил уход из Google желанием свободно говорить об опасностях ИИ. В том же году открытое письмо с призывом приостановить обучение самых мощных моделей на полгода собрало десятки тысяч подписей. Общей паузы не последовало. Некоторые исследователи занялись альтернативными подходами: в 2025-м Йошуа Бенджио основал некоммерческую лабораторию для разработки ИИ, безопасность которого должна обеспечиваться самим устройством системы.
Вывод
Исследователь Стюарт Рассел (Stuart Russell), соавтор известного учебника по ИИ, отмечает, что внутренние отделы безопасности редко могут остановить выпуск продукта. Здесь и возникает главный вопрос: что происходит, когда исследователь обнаруживает опасность, а руководство считает риск приемлемым?
Значение имеют полномочия проверяющих, их доступ к ресурсам и возможность сообщать о проблемах без угрозы наказания. По этим условиям можно судить, насколько серьёзно компания относится к безопасности. Само наличие профильной команды или публичных обещаний ответа не даёт.
Частые вопросы
Почему исследователи уходят из ИИ-компаний?
Причины различаются. Некоторые публично говорят о нехватке ресурсов для исследований безопасности, разногласиях с руководством и слишком быстром развитии моделей. Другие переходят в новые проекты, поэтому считать каждое увольнение протестом нельзя.
Кто такой Джейкоб Коксон?
Исследователь, работавший в OpenAI и Anthropic над развитием моделей. В сентябре 2026 года он ушёл из Anthropic до получения первых акций и предупредил о рисках создания ИИ, способного самостоятельно улучшать себя.
Означают ли эти предупреждения, что катастрофа близка?
Они отражают опасения отдельных специалистов. Согласованной научной оценки вероятности катастрофы и её сроков нет. Обнаруженные опасные действия моделей требуют изучения, но сами по себе не доказывают неизбежную потерю контроля.
Какие меры безопасности есть у компаний?
Лаборатории проверяют опасные возможности моделей и ограничивают доступ к некоторым из них. У OpenAI также есть комитет с правом задержать выпуск. Спор касается достаточности этих мер и того, как они применяются на практике.
Сотрудники действительно рисковали деньгами ради публичной критики?
Да. Дэниел Кокотайло рисковал уже заработанными акциями, отказавшись подписать запрет на критику OpenAI; позднее компания заверила, что доли не отнимут. Коксон отказался от будущего вознаграждения, уйдя до получения акций Anthropic.
Как стоит реагировать на предупреждения о рисках ИИ?
Деньги, скандалы, феномены
- Экономика скинов CS2: рынок на $6 млрд, ножи за миллион и обвал за 30 часов
- Крупнейшие кражи и взломы в истории игр: похищение $620 млн у Axie Infinity, скины CS2 и утечка GTA 6
- Star Citizen собрала миллиард долларов — и до сих пор не вышла
- Главные скандалы вокруг GTA: суды, запреты и Hot Coffee
- Почему видеокарты снова не купить: как ИИ забрал оперативную память у геймеров
- Почему игры стали такими дорогими и подорожают ли ещё?
- Гугл в России: как 20 лет обернулись штрафом в дуодециллион и вывозом серверов
- Купил игру в Steam, а она не твоя: почему её могут выключить в любой день
- Почему миллионы людей кликают на банан, печенье и коров. Как idle-игры взломали наш мозг
- Что такое Backrooms — история Закулисья, уровни, сущности, игры и фильм
- Как Павел Дуров лишился «ВКонтакте» и создал Telegram
- Rideshare «Stimulator»: что это за игра и почему из-за неё разгорелся скандал с ИИ
- ИИ уже отбирает работу в геймдеве. Просто не там, где мы этого ждали
- DLSS 5 — революция в графике или маркетинговый ход? Разбираемся в шумихе
- Шок и трепет фанатов, Трамп и «зловещая долина»: как анонс ремейка The Legend of Zelda: Ocarina of Time наделал столько шума
- Почему исследователи ИИ уходят из OpenAI, Anthropic и Google — и о каких рисках предупреждают
-
Free Claude Code экономит до 90% токенов и переключается между 50 провайдерами при сбоях -
Создатели Claude выпустили Fable 5.1 — она еще мощнее, но теперь все тексты помечаются водяным знаком, который нельзя отключить -
Одновременно упали ChatGPT, Claude, Grok и Cursor — массовый сбой нейросетей по всему миру -
Claude Fable 5.1 за 44 минуты разгадала шифр, который 373 года не могли решить -
Gemini 3.8 Flash стоит в семь раз дешевле Claude Opus 5 — и обходит его в тестах на финансы, право и работу с видео -
Лучшие игры про супергероев на ПК, PS4/PS5 и Xbox: ТОП-33 -
Лучшие игры про Вторую мировую войну и ВОВ на ПК -
Лучшие игры про Вторую мировую войну на телефон: ТОП-15 для Android и iOS -
Лучшие MOBA-игры всех времён: топ-14 от Dota 2 до Deadlock







