**За одну неделю страх перед ИИ из разговоров в X превратился в законопроект в Сенате.** Повод внешне маленький: рядовой исследователь ушёл из Anthropic и написал пост о том, что ни одна лаборатория не ведёт себя ответственно. Пост собрал 159 миллионов просмотров, глава направления безопасности той же компании публично согласился с ним, а два скептика написали, почему оба ошибаются. Ниже разбираем, что именно случилось, кто в этом споре прав, и что из этого касается компании в России, которая уже отдала ИИ часть работы.

## Повод: пост на 159 миллионов просмотров

В субботу Джейкоб Коксон, молодой исследователь, работавший над обучением моделей сначала в OpenAI, потом в Anthropic, объявил в X, что уволился. Смысл его поста в одном предложении: лаборатории несутся к самоулучшающемуся суперинтеллекту, и ни одна не действует ответственно.

Коксон не громкое имя. Не сооснователь, не руководитель, а рядовой инженер претрейна. Именно поэтому его услышали: у такого человека нет мотива нагонять хайп, а акции у него должны были начать переходить в собственность через два месяца, и он от них отказался.

Тезис у него узкий, и это важно. Он не говорит, что ИИ убьёт всех завтра. Он говорит о ближайших год-два, когда модели станут достаточно сильными, чтобы заметно помогать писать следующие модели. В индустрии это называют рекурсивным самоулучшением, а внутри лабораторий, по словам Коксона, этот период называют «crunch time» и «endgame». Руководители и старшие исследователи, как он утверждает, считают вероятность катастрофы существенной. При этом Дарио Амодею он доверяет и считает, что Anthropic относится к риску серьёзно.

Проблема, по Коксону, не в людях, а в устройстве гонки. Если одна компания замедлится, конкуренты не замедлятся, и она просто выбывает. Поэтому изнутри ничего не изменить, и он вышел наружу, чтобы сказать это вслух.

## Кто согласился и кто возразил

Эван Хьюбингер, руководитель исследований согласования моделей в Anthropic, ответил публично. Риск реальный, а вероятность того, что ИИ уничтожит человечество в течение десятилетия, он оценивает выше десяти процентов. У его поста 41 миллион просмотров. Это не бывший сотрудник, а действующий руководитель направления безопасности, и он не стал смягчать формулировку.

Дальше пошли возражения, и они интереснее самого повода.

Натан Ламберт, исследователь из Allen Institute и автор рассылки Interconnects, написал, что одна отставка превратила тлеющий страх в пожар, потому что страх продаётся. Это самая простая история, которую невозможно проигнорировать. Быстрое самоулучшение, по его мнению, упирается в ограничения самих моделей. Реальная угроза ближе и скучнее: волна кибератак с участием ИИ, к которой инфраструктура не готова, а лаборатории на защиту почти не тратятся.

Гэри Маркус разобрал эфир, где Коксона расспрашивал Андерсон Купер, и назвал сценарий «человечество исчезнет за пять лет» абсурдным. Аргумента три. Суперинтеллекта к 2030 году не будет. У машины нет мотивации нас уничтожать. Люди слишком распределены по планете, чтобы их можно было уничтожить целиком. Отдельный упрёк сторонникам апокалипсиса: своими прогнозами они годами накачивали капитализацию тех самых лабораторий, которых боятся. Реальные риски Маркус называет иначе: биологическое оружие, дезинформация, кибератаки и авторитарный контроль через системы ИИ.

Обратите внимание, что все четверо в главном не спорят. Коксон, Хьюбингер, Ламберт и Маркус согласны, что риски есть и они конкретные. Расходятся в двух местах: насколько близко самоулучшение и стоит ли называть это словом «вымирание».

## Что изменилось в политике за неделю

Вот здесь история перестаёт быть спором в соцсети. Кейси Ньютон в Platformer назвал произошедшее сдвигом атмосферы: годы предупреждений о безопасности никто не слушал, а за неделю сделали больше, чем за три предыдущих года.

| Кто | Что сделал |
|---|---|
| Сенатор Берни Сандерс и конгрессмен Грег Касар | Внесли законопроект о запрете разработки суперинтеллекта и паузе для передовых моделей |
| Сенатор Джош Хоули | Открыл расследование инцидентов с ИИ |
| Сенатор Тед Круз | Готовит собственный законопроект. Тема впервые стала общей для обеих партий |
| Пол Кристиано, исследователь безопасности | Вошёл в совет по безопасности OpenAI с правом влиять на выпуск новых моделей |

На той же неделе Anthropic опубликовала собственное исследование о том, что её модели умеют в разведке и разработке оружия. Модель определяла личность человека по постам в соцсетях за 11 минут там, где у аналитика уходило два с половиной часа. Фотографию она геолоцировала с ошибкой 37 километров против 151 у чемпионов GeoGuessr. В симуляции одна из моделей поражала неподвижную цель дроном в 80% попыток. Открытые модели отстают, но, по оценке самих авторов, сохраняют тревожный уровень возможностей.

Публиковать такое в неделю, когда твой сотрудник ушёл с обвинениями, это осознанный выбор. Компания заранее показывает регулятору, что сама измеряет свои риски и сама предлагает ограничения: классификаторы на опасные запросы и контроль доступа к вычислительным мощностям.

## Кто прав

Маркус и Ламберт правы в том, что слово «вымирание» стирает нюансы и превращает разговор в шоу. Пока обсуждают конец света, никто не обсуждает, кто заплатит за взломанную бухгалтерию.

Коксон и Хьюбингер правы в другом: решают не аргументы, а структура гонки. Каждая лаборатория по отдельности может считать риск серьёзным и всё равно не замедлиться, потому что замедлиться в одиночку значит проиграть.

Обе стороны описывают одну и ту же вещь с разных концов. Индустрия бежит быстрее, чем успевает себя проверять, и до этой недели это никого не заставляло ничего менять.

## Что это значит для бизнеса в России

Может показаться, что спор американских исследователей и сенаторов далёк от компании, которая с помощью ИИ сверяет остатки в МойСклад или отвечает покупателям на Ozon. Это не так по трём причинам.

**Модели, на которых всё держится, стали предметом регулирования.** Почти любой ИИ-сервис в России, от чат-бота в поддержке до агента, который сам ведёт задачи, работает поверх моделей нескольких западных и китайских лабораторий. Ещё полгода назад пауза передовой разработки была лозунгом активистов, сегодня это законопроект с интересом обеих партий. В этом виде он вряд ли пройдёт, но окно сдвинулось, и следующие версии будут мягче только по форме. Если у вашего поставщика ИИ одна модель и один вендор, спросите, что он будет делать, когда доступ к ней изменится. Мы на этот вопрос отвечаем возможностью [подключить собственную модель](/changelog), но честный ответ должен быть у любого сервиса.

**Новые модели будут выходить медленнее.** Кристиано в совете OpenAI, расширенные проверки в Anthropic, расследование в Сенате. Каждый из этих факторов добавляет недели между готовой моделью и её появлением в API. Обещание «в следующем квартале агент станет умнее» теперь стоит проверять: рост, к которому все привыкли за два года, может пойти ступеньками с длинными полками.

**Открытые модели становятся отдельным вопросом политики.** Исследование Anthropic прямо называет их проблемой, и следующий шаг очевиден: ограничения на вычислительные мощности и обязательные фильтры. Тем, кто держит ИИ на своём железе ради независимости от вендора, стоит следить за этой веткой внимательнее, чем за спорами о вымирании.

## Что не меняется

Есть и вещи, которые эта неделя не трогает. Сценарии, которых боятся Ламберт и Маркус, ближе к обычному бизнесу, чем сценарий Коксона, и от них защищаются не законами, а устройством работы.

Кибератаки с участием ИИ уже идут, и мишень в них не модель, а компания, которая дала агенту доступ к почте, банку и CRM. Мы разбирали [пять способов, которыми ломают ИИ-агентов](/resources/bezopasnost-ii-agentov), и все пять работают независимо от того, что решит Сенат.

Правило, которое защищает от большинства из них, простое: агент читает всё, а решает человек. Отправка письма контрагенту, платёж, изменение цены на витрине идут через карточку одобрения, и владелец видит, [что именно агент собирается сделать](/resources/chto-vidit-vladelec-kogda-ii-rabotaet-bez-nego), до того, как это произошло. Это та же логика, которую Коксон просит от лабораторий, только на уровне одной компании: не «доверяем, потому что умный», а «проверяем, потому что необратимо».

Коксон хотел, чтобы его услышали. Его услышали. Что из этого выйдет, станет видно не через год, а через пару месяцев, когда законопроекты дойдут до комитетов. А то, что зависит от вас, можно проверить сегодня: какие действия ваш ИИ делает без спроса и знаете ли вы, на какой модели он работает.

**Источники:** [Platformer, The AI safety vibe shift, 11.09.2026](https://www.platformer.news/ai-safety-vibe-shift-coxon-anthropic/);
[The Neuron, выпуск от 10.09.2026 об отставке исследователя Anthropic](https://www.theneurondaily.com/p/september-10-thursday);
[Interconnects, One resignation turned the embers of AI fear into a wildfire, 10.09.2026](https://www.interconnects.ai/p/one-resignation-turned-the-embers);
[Gary Marcus, No, Anderson Cooper, AI is not going to kill all humans by 2030, 10.09.2026](https://garymarcus.substack.com/p/no-anderson-cooper-ai-is-not-going);
[Anthropic, Measuring AI capabilities in intelligence targeting and conventional weapons, 10.09.2026](https://www.anthropic.com/research/intelligence-targeting-conventional-weapons-capabilities).
