Быстрый старт

Быстрый старт

Инференс совместим с OpenAI API. Если у вас уже есть код или инструмент, работающий с OpenAI, достаточно поменять базовый адрес и ключ.

Базовый адрес и авторизация

  • Базовый адрес (Base URL): https://app.cloudcompute.ru/api/v1
  • Авторизация: заголовок Authorization: Bearer cc-...

Список доступных моделей и их идентификаторы — в каталоге на сайте, в разделе API-доступ панели управления или программно: GET https://app.cloudcompute.ru/api/v1/models.

Пример: curl

curl https://app.cloudcompute.ru/api/v1/chat/completions \
  -H "Authorization: Bearer cc-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-4o-mini",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'

Пример: Python (OpenAI SDK)

from openai import OpenAI

client = OpenAI(
    base_url="https://app.cloudcompute.ru/api/v1",
    api_key="cc-...",
)

resp = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)

Потоковая передача (streaming)

Передайте "stream": true — ответ придёт частями (Server-Sent Events), как в OpenAI API:

stream = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Напиши хайку про GPU"}],
    stream=True,
)
for chunk in stream:
    print(chunk.choices[0].delta.content or "", end="")

OpenAI Responses API

Новые OpenAI-клиенты с responses.create используют тот же Base URL и ключ, путь /responses, поле input (не messages). Полная инструкция: OpenAI Responses.

curl https://app.cloudcompute.ru/api/v1/responses \
  -H "Authorization: Bearer cc-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-4o-mini","input":"Привет!"}'

Подключение редактора

Любой редактор или расширение с поддержкой OpenAI-совместимого API (Cline, Continue.dev и др.) подключается так же: в настройках провайдера OpenAI укажите базовый адрес https://app.cloudcompute.ru/api/v1 и ваш ключ cc-....

Пошаговые инструкции для популярных инструментов: Интеграции (Open WebUI, Cline, Roo Code, LibreChat, AnythingLLM, LangChain).

Для Claude Code (Anthropic Messages API) укажите origin приложения как ANTHROPIC_BASE_URL — полная инструкция: Claude Code.

Claude Code / Anthropic

export ANTHROPIC_BASE_URL="https://app.cloudcompute.ru"
export ANTHROPIC_AUTH_TOKEN="cc-..."
export ANTHROPIC_API_KEY=""
export ANTHROPIC_DEFAULT_SONNET_MODEL="anthropic/claude-sonnet-4.6"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="anthropic/claude-haiku-4.5"
export ANTHROPIC_DEFAULT_OPUS_MODEL="anthropic/claude-opus-4.6"
claude

Подробности, проверочный curl и алиасы моделей: Claude Code.

Без кода — попробуйте AI-чат в браузере (нужен аккаунт) или Веб-чат в панели управления (/api-models/chat).

Веб-чат в панели и на сайте

  • В панели: раздел Веб-чат (/api-models/chat) — полноценный чат с историей, выбором модели и списанием с баланса.
  • На сайте: демо AI-чат — после входа перенаправляет в панель.

Модели с генерацией изображений

В каталоге inference есть модели с выходом изображения (не только текст). В веб-чате для них:

  • вкладка «Изображения» с готовыми промптами-стартерами;
  • ответ ассистента может содержать картинку (URL в сообщении), которую можно открыть или скачать.

Тот же формат ответа доступен через API (POST /api/v1/chat/completions) для моделей с image output — см. каталог моделей.