Быстрый старт
Быстрый старт
Инференс совместим с OpenAI API. Если у вас уже есть код или инструмент, работающий с OpenAI, достаточно поменять базовый адрес и ключ.
Базовый адрес и авторизация
- Базовый адрес (Base URL):
https://app.cloudcompute.ru/api/v1 - Авторизация: заголовок
Authorization: Bearer cc-...
Список доступных моделей и их идентификаторы — в каталоге на сайте, в разделе API-доступ панели управления или программно: GET https://app.cloudcompute.ru/api/v1/models.
Пример: curl
curl https://app.cloudcompute.ru/api/v1/chat/completions \
-H "Authorization: Bearer cc-..." \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-4o-mini",
"messages": [{"role": "user", "content": "Привет!"}]
}'
Пример: Python (OpenAI SDK)
from openai import OpenAI
client = OpenAI(
base_url="https://app.cloudcompute.ru/api/v1",
api_key="cc-...",
)
resp = client.chat.completions.create(
model="openai/gpt-4o-mini",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)
Потоковая передача (streaming)
Передайте "stream": true — ответ придёт частями (Server-Sent Events), как в OpenAI API:
stream = client.chat.completions.create(
model="openai/gpt-4o-mini",
messages=[{"role": "user", "content": "Напиши хайку про GPU"}],
stream=True,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")
OpenAI Responses API
Новые OpenAI-клиенты с responses.create используют тот же Base URL и ключ, путь /responses, поле input (не messages). Полная инструкция: OpenAI Responses.
curl https://app.cloudcompute.ru/api/v1/responses \
-H "Authorization: Bearer cc-..." \
-H "Content-Type: application/json" \
-d '{"model":"openai/gpt-4o-mini","input":"Привет!"}'
Подключение редактора
Любой редактор или расширение с поддержкой OpenAI-совместимого API (Cline, Continue.dev и др.) подключается так же: в настройках провайдера OpenAI укажите базовый адрес https://app.cloudcompute.ru/api/v1 и ваш ключ cc-....
Пошаговые инструкции для популярных инструментов: Интеграции (Open WebUI, Cline, Roo Code, LibreChat, AnythingLLM, LangChain).
Для Claude Code (Anthropic Messages API) укажите origin приложения как ANTHROPIC_BASE_URL — полная инструкция: Claude Code.
Claude Code / Anthropic
export ANTHROPIC_BASE_URL="https://app.cloudcompute.ru"
export ANTHROPIC_AUTH_TOKEN="cc-..."
export ANTHROPIC_API_KEY=""
export ANTHROPIC_DEFAULT_SONNET_MODEL="anthropic/claude-sonnet-4.6"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="anthropic/claude-haiku-4.5"
export ANTHROPIC_DEFAULT_OPUS_MODEL="anthropic/claude-opus-4.6"
claude
Подробности, проверочный curl и алиасы моделей: Claude Code.
Без кода — попробуйте AI-чат в браузере (нужен аккаунт) или Веб-чат в панели управления (/api-models/chat).
Веб-чат в панели и на сайте
- В панели: раздел Веб-чат (
/api-models/chat) — полноценный чат с историей, выбором модели и списанием с баланса. - На сайте: демо AI-чат — после входа перенаправляет в панель.
Модели с генерацией изображений
В каталоге inference есть модели с выходом изображения (не только текст). В веб-чате для них:
- вкладка «Изображения» с готовыми промптами-стартерами;
- ответ ассистента может содержать картинку (URL в сообщении), которую можно открыть или скачать.
Тот же формат ответа доступен через API (POST /api/v1/chat/completions) для моделей с image output — см. каталог моделей.