VPS с самостоятельным администрированием
Подключение n8n к inference API или своей LLM
Начните с одного явного запроса
Импортируйте workflows/ru/02-inference-request.json из архива. В нём Manual Trigger, небольшая Edit Fields и HTTP Request. Пример не публикует чат-бота, расписание или AI-агента. Именно нажатие Execute Workflow может привести к расходу платных токенов.
В Prompt and model замените REPLACE_WITH_CHAT_COMPLETIONS_MODEL_ID точным ID модели, доступной вашему аккаунту. Нужна текстовая Chat Completions-модель с поддержкой max_tokens; для семейств с другими параметрами запрос надо отдельно адаптировать. Первый prompt сделайте коротким и без чувствительных данных.
Настройте подключение
HTTP Request направлен на:
https://app.cloudcompute.ru/api/v1/chat/completions
Создайте в n8n credential типа Header Auth: имя заголовка Authorization, значение Bearer YOUR_API_KEY. Выберите его в HTTP Request. Ключ должен храниться в credential, а не в prompt, JSON экспортированного workflow или параметре URL. В архиве намеренно нет привязки к credential из чужой установки.
Тело создаётся как JSON-объект и затем сериализуется. Отправляется одно пользовательское сообщение, ограниченное 1 000 символами, max_tokens: 256 и stream: false. Это небольшие лимиты примера, а не точный денежный потолок. Символы не равны токенам, тарификация моделей различается, а несколько входных items могут породить несколько запросов.
У ноды timeout ожидания заголовков ответа 60 секунд; переходы по redirect и автоматические повторы отключены. У workflow также есть ограничение времени выполнения. Эти настройки уменьшают риск случайных повторов, но не отменяют уже принятый провайдером запрос и не гарантируют, что запрос с timeout был бесплатным.
Разделяйте ответ модели и сбой подключения
Запустите сценарий один раз и посмотрите JSON в HTTP-ноде. У совместимого текстового ответа обычно есть choices[0].message.content; проверьте реальную структуру до передачи выражения следующей ноде. Если возвращается usage, его можно сопоставить с расходом аккаунта. Зелёный статус ноды сам по себе не означает, что ответ соответствует бизнес-правилам.
| Ошибка | Что проверить до следующей платной попытки |
|---|---|
| 401/403 | Credential, права аккаунта и endpoint |
| Неизвестная модель или параметр | Точный ID и формат запроса |
| 429 | Лимит провайдера, баланс и допустимый порядок повтора |
| Timeout | Историю выполнения и расход у провайдера |
| Несколько неожиданных запросов | Число items и повторные ручные запуски |
Локальная модель — отдельное подключение
Доступный сервер vLLM или Ollama можно подключить после проверки API и аутентификации. localhost внутри n8n указывает на контейнер n8n, а не на хост и не на другой VPS. Используйте закрытый маршрут с аутентификацией. Не публикуйте незащищённый endpoint модели ради удобства подключения.
Self-hosted n8n не удерживает все prompts внутри вашего контура: при вызове удалённого API данные покидают VPS. Учитывайте это в доступе к истории выполнений и сроках хранения. До подключения расписания или production webhook добавьте долговременную дедупликацию, проверку ввода и правила расходования бюджета.
Официальные источники: HTTP Request node source at the pinned release.
Тарифы из текущего каталога
Сейчас не удалось загрузить планы. Смотрите актуальные тарифы на странице цен.