Первый раздел объясняет суть без вступления и рекламных обещаний.
Рабочие настройки сохраняют до изменения, а проверку проводят на копии.
Запишите исходное состояние, действие и итог, чтобы найти причину ошибки.
На VPS работают приложение, очередь и база; GPU не нужен.
Локальной модели нужна RAM или VRAM под веса и контекст.
Требует больше памяти, чем запуск готовой модели.
Диск, сеть и остановленные ресурсы считают вместе с GPU.
Источники: Ollama GPU support, Ollama FAQ.
Хостинг для AI-агента обычно означает VPS с постоянным процессом, очередью задач, базой и доступом к внешней модели. GPU нужен только при локальном inference. Для агента через API важнее стабильная сеть, контролируемые инструменты и возможность восстановить состояние после ошибки.
Из чего состоит агент на сервере
Минимальная схема включает приложение, очередь, хранилище состояния и журнал действий. Агент может обращаться к Git, почте, CRM или браузеру, поэтому каждый инструмент требует отдельного ключа и набора разрешений. Один главный токен превращает ошибку сценария в проблему всего аккаунта.
Какие ресурсы нужны
Для одного API-агента без браузера можно начать с 2 vCPU и 4 ГБ RAM. Playwright, несколько workers или локальная база поднимают пиковую память. Считайте процессы вместе: приложение, контейнеры, PostgreSQL, Redis, мониторинг и резервное копирование.
Если модель работает локально, переходите к руководству по GPU-серверу. Обычный VDS HostVDS или FirstVDS не заменит ускоритель.
Как хранить состояние и секреты
Ключи API передают через секреты окружения или отдельное хранилище, а не через репозиторий. Состояние задания храните так, чтобы повторный запуск не отправил письмо или платеж второй раз. Для важных действий нужен idempotency key и журнал результата.
Резервная копия базы должна восстанавливаться на чистом сервере. Snapshot одной машины удобен для отката, но не защищает от удаления аккаунта.
Как ограничить инструменты
Разрешайте только нужные домены, команды и каталоги. Production-доступ отделите от среды разработки. Действия с деньгами, публикацией и удалением требуют подтверждения человеком либо жестких лимитов.
Записывайте не скрытые рассуждения модели, а проверяемые события: входные данные, вызванный инструмент, код ответа и итог. Чувствительные данные маскируйте до записи в лог.
Какие VPS сравнить
| Провайдер | Стартовый вариант | Цена | Что проверить |
|---|---|---|---|
| HostVDS 1 | $0,99/мес. | Долю Burstable CPU и локацию | |
| Прогрев | От 299 ₽/мес. | RAM, backup и администрирование | |
| Cloud Server | От 900 ₽/мес. | RAM, backup и администрирование | |
| Cloud server | От 259 ₽/мес. | RAM, backup и администрирование |
Coding-agent и n8n используют ресурсы проекта, а не запускают облачную модель на VPS. Начинайте с памяти под сборку, контейнеры и базу.
Официальные источники: HostVDS, FirstVDS, Timeweb Cloud, Serverspace. Проверено 4 сентября 2026 года.
Для API-агента подойдут HostVDS, Timeweb Cloud, Selectel и Serverspace. Смотрите на API управления, snapshots, сеть, цену исходящего трафика и возможность быстро увеличить RAM. Для визуальных автоматизаций сравните отдельный материал о n8n.
Проверка перед постоянным запуском
Запустите агента на тестовых ключах. Имитируйте недоступность API, повтор задания, переполнение очереди и перезагрузку VPS. Проверьте бюджетные лимиты и аварийную остановку. Только после этого подключайте рабочие данные. Для coding-сценариев есть отдельные страницы про Codex и Claude Code.

