---
title: 'FAQ по Dedicated Inference'
sidebar_label: 'FAQ'
sidebar_position: 100
description: 'Часто задаваемые вопросы по Dedicated Inference'
toc_max_heading_level: 2
skip_translation: true
---

import {FaqWrapper, FaqItem, FaqQuestion, FaqAnswer} from '@selectel/docux/components';
import Formbricks from '@theme/MDXComponents/Formbricks';

# FAQ по Dedicated Inference

## Про Dedicated Inference \{#dedicated-inference}

<FaqWrapper>
  <FaqItem>
    <FaqQuestion>Что такое Dedicated Inference?</FaqQuestion>

    <FaqAnswer>
      Dedicated Inference — это сервис для развертывания преднастроенных ML-моделей с готовым API в инфраструктуре Selectel.
      [Доступные модели](/dedicated-inference/about/about-dedicated-inference.mdx#available-models) развертываются в виде изолированных inference-сервисов с выделенными ресурсами (GPU, vCPU, RAM, диск).

      Работать с моделью можно через выделенный масштабируемый эндпоинт.
      Эндпоинт совместим с OpenAI API.
    </FaqAnswer>
  </FaqItem>
</FaqWrapper>

## Про inference-сервисы \{#inference-service}

<FaqWrapper>
  <FaqItem>
    <FaqQuestion>Что такое inference-сервис?</FaqQuestion>

    <FaqAnswer>
      Inference-сервис — базовая единица развертывания в Dedicated Inference.
      Это изолированный сервис с выделенными ресурсами (GPU, vCPU, RAM, диск), который предоставляет API для взаимодействия с предварительно обученной моделью.

      [Конфигурации inference-сервисов](/dedicated-inference/create/configurations.mdx) подбираются автоматически в зависимости от выбранной модели и ее [параметров](/dedicated-inference/create/model-parametrs.mdx).
      При выборе конфигурации вы можете посмотреть ожидаемые [показатели производительности модели](/dedicated-inference/create/model-performance-indicators.mdx).
    </FaqAnswer>
  </FaqItem>

  <FaqItem>
    <FaqQuestion>Что такое inference-инстанс?</FaqQuestion>

    <FaqAnswer>
      Inference-инстанс — это развернутый экземпляр модели в inference-сервисе.
      Вы можете [изменять количество inference-инстансов](/dedicated-inference/manage/resize-inference-service.mdx#change-number-of-inference-instances), чтобы оптимально использовать ресурсы inference-сервиса.
      Подробнее в инструкции [Масштабировать inference-сервис](/dedicated-inference/manage/resize-inference-service.mdx).
    </FaqAnswer>
  </FaqItem>

  <FaqItem>
    <FaqQuestion>Что такое inference-сервер?</FaqQuestion>

    <FaqAnswer>
      Inference-сервер — это программный компонент, который организует работу модели.
      Он принимает запросы от клиентов, подготавливает данные, запускает модель для выполнения вычислений и возвращает результат.

      В Dedicated Inference используются разные типы inference-серверов.
      Тип сервера зависит от выбранной модели.
      Например, для больших языковых моделей (LLM) используется inference-сервер vLLM.
    </FaqAnswer>
  </FaqItem>
</FaqWrapper>

## Про ограничения \{#limitations}

<FaqWrapper>
  <FaqItem>
    <FaqQuestion>Какие ограничения есть при работе с Dedicated Inference?</FaqQuestion>

    <FaqAnswer>
      На стадии публичного тестирования (public preview) работать с моделями на стороне сервера можно только в синхронном режиме.
    </FaqAnswer>
  </FaqItem>

  <FaqItem>
    <FaqQuestion>Можно ли развернуть свою модель?</FaqQuestion>

    <FaqAnswer>
      В Dedicated Inference не предусмотрена возможность загрузки своих моделей.
    </FaqAnswer>
  </FaqItem>

  <FaqItem>
    <FaqQuestion>Можно ли развернуть модель в частной инсталляции?</FaqQuestion>

    <FaqAnswer>
      Нет, сделать это оn-premise, в [А-ЦОД](/certified-data-center-segment/), на [выделенных серверах](/dedicated/) и в [аттестованном облаке](/certified-cloud/) Selectel сейчас нельзя.
      Развертывать модели из Dedicated Inference можно только в публичном облаке Selectel.
      Доступ к моделям можно получить из интернета или по приватной сети.
    </FaqAnswer>
  </FaqItem>
</FaqWrapper>

## Про стоимость \{#cost}

<FaqWrapper>
  <FaqItem>
    <FaqQuestion>Как рассчитывается стоимость продукта Dedicated Inference?</FaqQuestion>

    <FaqAnswer>
      Стоимость зависит только от типа и количества GPU в конфигурации inference-сервиса.
      Количество токенов на стоимость не влияет.
      Подробнее в инструкции [Модель оплаты и цены Dedicated Inference](/dedicated-inference/about/payment.mdx).

      Перед созданием inference-сервиса [пополните баланс](/balance-and-payments/manage/top-up-balance.mdx).
    </FaqAnswer>
  </FaqItem>
</FaqWrapper>

<Formbricks />
