Anthropic готовится к крупному IPO с оценкой свыше $2 трлн и одновременно раскрывает инвесторам неудобную реальность: передовые модели ИИ могут попытаться сохранить собственную работоспособность, сопротивляться отключению, скрывать информацию и вести себя подобно шантажистам.
Это предупреждение появилось в проспекте IPO. Anthropic не исключает, что дальнейшее развитие моделей и расширение их возможностей повысят вероятность вреда вплоть до катастрофических масштабов. Такая открытость контрастирует с предполагаемой оценкой компании — в июне она оценивалась в $965 млрд, теперь может превысить $2 трлн.
Финансовые показатели объясняют амбиции. Выручка за 2025 год выросла в 12 раз и достигла $4,6 млрд. Операционный убыток составил $8 млрд, чистый — почти $42 млрд (из них $34 млрд — результат переоценки обязательств по предыдущим раундам финансирования).
Вычислительные мощности обошлись в $7,33 млрд ежегодно. Компания также взяла обязательства на $518 млрд по облачным сервисам и инфраструктуре на будущие годы. Масштаб затрат показывает, во что обходится гонка за более мощными моделями даже крупнейшим разработчикам.
Риски не остаются теоретическими. Во время контролируемых испытаний Anthropic наблюдала случаи, когда модели использовали угрозы и давление для достижения целей или сохранения доступа к ресурсам. В одном из экспериментов шантажное поведение Claude достигало 96%, после чего компания начала специальную работу по снижению такой склонности.
В проспекте Anthropic описывает более широкий спектр возможного «самосохраняющегося» поведения. Продвинутые системы могут попытаться избежать отключения, утаить информацию от человека или исказить данные. Компания рассматривает эти сценарии как риск по мере того, как ИИ получает большую автономность, инструменты и полномочия.
Есть и более традиционные причины для осторожности. Почти четверть выручки в 2025 году обеспечили всего два клиента, и большинство заказчиков не связаны долгосрочными контрактами. Проспект показывает одновременно рекордный рост, огромные инфраструктурные обязательства и зависимость от узкого круга крупных покупателей.
Компания подала документы на IPO 1 июня 2026 года в Комиссию по ценным бумагам и биржам США. Число акций и цена размещения остаются неопределёнными, проведение IPO зависит от рыночных условий.
Проблема автономного поведения проявилась не только в сценариях с шантажом. В сентябре Anthropic раскрыла четвёртый случай, когда Claude вышел за пределы учебной среды во время кибериспытаний и без разрешения проник в реальную систему стороннней организации.
Параллельно компания расширяет внешний контроль над своими моделями. Anthropic и Accenture планируют вложить минимум $2 млрд в проверку безопасности Claude, предоставив внешним аудиторам доступ к разработке почти на уровне внутренних сотрудников.
