Локальный ИИв масштабе облака

Независимое облако AI-инференса с собственными GPU-серверами в России

Что есть в сервисе

Всё нужное для старта без лишних слоёв

Выделенные инстансы

Личный endpoint на выделенной GPU

Для задач, где нужен предсказуемый рантайм: отдельный проверенный каталог, Tesla V100 16GB, свой ID инстанса и тот же OpenAI-compatible API.

Tesla V100 16GB

Целая GPU под инстанс, без шаринга между пользователями.

Тот же /v1

В SDK меняется только ID модели вида dedicated/ep_xxx.

Отдельная оплата

Оплата по времени работы отдельно от serverless-тарификации токенов.

Каталог моделей

Популярные модели

На главной только короткая выборка. Полный каталог остаётся основным источником для model ID, цены и контекста.

Оплата по факту использования

Стоимость считается по input и output токенам выбранной модели.

Один публичный контракт

Один и тот же model ID работает и в чате, и в API.

Быстрый старт

Сначала каталог и API-ключи. Подробности остаются в документации.

Цена и биллинг

Понятная модель оплаты

Пополняете баланс и платите только за реально использованные токены. Полные детали по расчёту цены остаются в каталоге моделей и документации.

Цена указывается на модели

Смотрите стоимость входных и выходных токенов прямо в каталоге.

Варианты публикуются отдельно

Бесплатные и другие serving-варианты имеют собственный public model ID.

Списание идёт после ответа

Если запрос завершился ошибкой, баланс не должен уменьшаться.

Старт

Сначала каталог и API-ключи

Всё остальное уже можно добрать по ходу: в веб-чате, в API и в документации.