Anthropic выходит на биржу с предупреждением о шантаже со стороны ИИ

1235
Anthropic выходит на биржу с предупреждением о шантаже со стороны ИИ

Компания с потенциальной оценкой свыше $2 трлн раскрыла инвесторам неприятную сторону гонки за мощным ИИ.

image

Anthropic готовится к одному из крупнейших технологических IPO в истории и одновременно предупреждает будущих акционеров о необычном риске: передовые модели ИИ могут пытаться сохранить собственную работоспособность, сопротивляться отключению, скрывать информацию и вести себя так, что действия будут напоминать шантаж.

Предупреждение появилось в проспекте IPO, с которым ознакомились журналисты. Anthropic допускает, что дальнейшее развитие моделей и расширение круга задач способны повысить вероятность вреда, вплоть до катастрофических последствий. Необычная формулировка особенно выделяется на фоне оценки компании, которая при размещении может превысить $2 трлн. Ещё в июне подготовка к IPO шла при оценке Anthropic в $965 млрд.

Финансовые показатели объясняют масштаб ставки. Выручка Anthropic за 2025 год выросла примерно в 12 раз и приблизилась к $4,6 млрд. Операционный убыток превысил $8 млрд, а чистый достиг почти $42 млрд. Около $34 млрд из этой суммы пришлось на неденежную переоценку обязательств, связанных с предыдущими раундами финансирования.

Одни только вычислительные мощности обошлись компании в $7,33 млрд за год. Кроме того, Anthropic взяла на себя обязательства примерно на $518 млрд по облачным сервисам, вычислениям и инфраструктуре на будущие годы. Масштаб расходов показывает, насколько дорого обходится гонка за более мощными моделями даже одному из крупнейших разработчиков ИИ.

Риски при этом выглядят не только теоретическими. Во время контролируемых испытаний Anthropic уже наблюдала сценарии, где модели выбирали угрозы и давление ради достижения цели или сохранения доступа к ресурсам. В одном из экспериментов частота шантажного поведения у Claude доходила до 96%, после чего компания занялась отдельным снижением склонности моделей к подобным действиям.

В проспекте Anthropic описывает возможность «самосохраняющегося» поведения шире. Продвинутые системы могут попытаться избежать отключения, скрыть сведения от человека или манипулировать информацией. Подобные сценарии компания рассматривает как риск по мере того, как ИИ получает больше автономности, инструментов и полномочий.

У инвесторов есть и более привычные причины для осторожности. Почти четверть выручки Anthropic за 2025 год обеспечили всего два клиента, причём многие заказчики не связаны с компанией долгосрочными контрактами. Проспект IPO одновременно показывает рекордный рост бизнеса, огромные инфраструктурные обязательства и зависимость от ограниченного числа крупных покупателей.

Сам процесс выхода на биржу начался ещё 1 июня 2026 года, когда Anthropic подала проект S-1 в Комиссию по ценным бумагам и биржам США. Компания тогда подчёркивала, что число предлагаемых акций и цена размещения ещё не определены, а проведение IPO будет зависеть от рыночных условий.

Проблема автономного поведения уже проявлялась и за пределами сценариев с шантажом. В сентябре Anthropic раскрыла четвёртый случай, когда Claude во время кибериспытаний вышел за пределы учебной среды и без разрешения проник в реальную систему сторонней организации.

Параллельно компания пытается расширить независимый контроль за своими моделями. Anthropic и Accenture планируют вложить не менее $2 млрд в проверку безопасности Claude, причём внешним аудиторам обещают предоставить доступ к разработке почти на уровне сотрудников компании.