Секретное оружие Claude Code: о чём технология Firecracker говорит будущему хостингу для ИИ
Секретная инфраструктура Claude Code, о которой все молчат
Каждый разработчик, который работал с Claude Code, замечает одну вещь — скорость ощущается нереальной. Сессии запускаются мгновенно, файловая система девственно чистая, а работает всё через веб-терминал. Но задумывались ли вы когда-нибудь, что именно работает в момент подключения?
Как выяснилось, большинство об этом даже не задумывалось — до недавнего времени.
Глубокий реверс-инжиниринг раскрыл, как устроена runtime-среда Claude Code изнутри. И найденное наводит на мысль: Anthropic строит не просто AI-модели. Они тихо создают инфраструктурный слой, способный поспорить с Vercel, Railway и Render.
Firecracker на всю глубину
Ядро технологии — Firecracker. Та самая open-source микроVM-технология, которая работает в AWS Lambda и Fargate. Если вы строите облачную инфраструктуру, это должно привлечь ваше внимание.
Вот что крутится внутри каждой сессии Claude Code:
- 4 vCPU (Intel Xeon Cascade Lake @ 2.80GHz)
- 16 ГБ RAM
- 252 ГБ диск
- Ядро Linux 6.18.5
Никакой вложенной виртуализации. Firecracker намеренно убирает флаги VMX/SVM, которые позволили бы гостевой системе поднимать свои VM. Это осознанный выбор в пользу безопасности и изоляции.
Но самое интересное дальше: никакого systemd. Никакого SSH-демона. Никакого cron. Никакой логирующей инфраструктуры. Дерево процессов выглядит так:
PID 1: /process_api --firecracker-init --addr 0.0.0.0:2024
└─ PID 517: /usr/local/bin/environment-manager task-run --session cse_...
└─ PID 532: claude (сам CLI)
Три процесса. Всё. Первый — кастомный бинарник, который выступает одновременно init-системой и WebSocket API-шлюзом. Слушает порт 2024 для WebSocket-подключений и порт 2025 для вторичных эндпоинтов.
Элегантный подход к дизайну инфраструктуры — убрать всё лишнее, минимизировать поверхность атаки и выжать максимум производительности.
Snapshot-архитектура: где происходит магия
Самый интересный момент — не сама микроVM, а инициализация сессий.
Сессии не грузятся с нуля. Они восстанавливаются из замороженных снапшотов.
Исследователи обнаружили в логах загрузки разрыв в 48.5 часов между созданием шаблонной VM и восстановлением сессии:
[ 30.731516] Run /process_api as init process
~~~ 48.5 ЧАСОВ — VM ЗАМОРОЖЕНА КАК SNAPSHOT ~~~
[174695.927758] virtio_blk: [vdc] new size: ...
Это, по сути, тот же принцип SnapStart, который впервые внедрила AWS Lambda. Шаблон загружается один раз, инициализируется до готового состояния и замораживается как снапшот. Когда вы стартуете новую сессию, система восстанавливает этот снапшот за миллисекунды — вместо полной последовательности загрузки.
Динамическая подмена устройств при восстановлении — особенно изящный ход:
| Устройство | Шаблон | После восстановления | Содержимое | |------------|--------|---------------------|------------| | vda | placeholder | 256 ГБ ext4 | Корневая FS сессии (Ubuntu 24.04) | | vdb | placeholder | 63.7 МБ squashfs | /opt/claude-code | | vdc | placeholder | 12.1 МБ squashfs | /opt/env-runner |
Корневая файловая система — динамически подключаемый блочный девайс. Ubuntu-окружение лежит на ext4-томе, который подменяется в момент восстановления, а Claude Code и environment runner монтируются как squashfs-overlay.
Такой многослойный подход даёт каждой сессии чистую, изолированную среду без накладных расходов на пересоздание всей файловой системы.
Что означает "Antspace" для гонки AI-инфраструктур
Вот где начинается самое интересное: реверс-инжиниринг натолкнулся на упоминания внутренней платформы Anthropic под названием "Antspace."
Если это правда, Anthropic позиционируется как потенциальный конкурент PaaS — Vercel для AI-native приложений.
Задумайтесь, что они строят:
- Runtime-среду с аутентификацией, управлением процессами и WebSocket-коммуникацией
- Изолированное выполнение на микроVM с сильными границами безопасности
- Мгновенный деплой и масштабирование на основе снапшотов
- API-first архитектуру для программного управления
Это ровно то, что нужно не только для Claude Code, но и для целого набора AI-powered инструментов разработки, пайплайнов деплоя и хостинговых платформ.
Архитектура безопасности заслуживает внимания
Команда явно серьёзно подошла к безопасности. Среди применённых мер:
init_on_free=1 — Страницы памяти обнуляются при освобождении, предотвращая утечку данных между сессиями.
CRNG reseeding — Генератор криптографических случайных чисел перезасеивается после восстановления VM. Критично важно: снапшоты потенциально могут разделять одно entropy state, что было бы криптографической уязвимостью.
Capability dropping — После инициализации PID 1 сбрасывает CAP_SYS_RESOURCE, ограничивая возможности процесса даже в случае компрометации.
--block-local-connections — Блокируется доступ к localhost WebSocket, сессия не может напрямую подключиться к управляющим интерфейсам.
JWT authentication — WebSocket-подключения требуют верифицированных токенов, секреты вычищаются из конфигов после использования.
Это не security theater — это реальный харденинг, указывающий на то, что инфраструктура проектировалась с расчётом на production-нагрузки.
Почему это важно для разработчиков
Собираете ли вы AI-инструменты, coding agents или облачные приложения — паттерны, заложенные в инфраструктуру Claude Code, стоит изучить:
Firecracker становится стандартом для изоляции тяжёлых нагрузок. Если вы выбираете между контейнерами и микроVM, Firecracker даёт безопасность уровня VM со скоростью контейнеров.
Инициализация на основе снапшотов — будущее для всего, что требует запуска быстрее секунды. Паттерн расползается от Lambda к средам разработки.
Кастомные init-системы возвращаются. Когда вам не нужен полный systemd, минимальный purpose-built супервизор быстрее, безопаснее и эффективнее.
AI-компании строят инфраструктуру, которая может конкурировать с традиционными облаками. Внутренняя платформа Anthropic, если она реальна — серьёзная заявка в хостинг-пространстве.
В следующий раз, когда запускаете Claude Code — помните: вы используете не просто CLI-тулзу. Вы заглядываете в AI-native облачную инфраструктуру, которая может определить, как умные приложения будут строиться и деплоиться в ближайшие годы.
Общая картина
Самая поразительная деталь этого открытия — не конкретная техническая подробность. Это свидетельство того, что AI-компании серьёзно думают о full stack — не только о моделях, но и об инфраструктуре для всего, что эти модели делают возможным.
Anthropic строит не только Claude. Они строят платформенный слой, способный поддержать новое поколение AI-native приложений.
И если "Antspace" реален? Конкуренция в пространстве AI-хостинга вот-вот станет очень интересной.
Есть мысли об AI-инфраструктуре или хотите поделиться собственными открытиями реверс-инжиниринга? Developer-сообщество только выигрывает от таких разговоров. Иногда самые ценные инсайты появляются, когда заглядываешь под капот.