Перейти к основному содержимому

Справочник метрик

В этой инструкции описаны метрики по продуктам, которые собираются сервисом.

Список продуктов, которые поддерживают метрики, будет пополняться.

Выделенные серверы

Пространство имен (namespace) выделенных серверов – dedicated.

Мониторинг поддерживают серверы с KVM-консолью, которая доступна для каждого выделенного сервера, кроме серверов линейки Chipcore и серверов в выделенной стойке — подробнее на странице Серверы в выделенной стойке на selectel.ru.

Набор IPMI метрик может отличаться в зависимости от модели сервера.

В каждой метрике передается timestamp — время сбора метрики. Конвертировать значение можно с помощью онлайн-сервисов, например на сайте unixtimestamp.com.

Имя метрики
Тип, единица измерения
ОписаниеЛейблы
ipmi_bmc_info
Gauge, UNIT
Метаданные BMC (Baseboard Management Controller) — прошивка, производитель и другое. Значение метрики всегда равно 1
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • bmc_url — адрес BMC;
  • firmware_revision — версия прошивки BMC;
  • manufacturer_id — ID производителя (вендора);
  • system_firmware_version — версия системной прошивки (BIOS, UEFI)
up
Gauge, bool

Проверка доступности источника метрик:

  • 1 — успешно;
  • 0 — сбой
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера
ipmi_up
Gauge, bool

Проверка доступности IPMI:

  • 1 — успешно;
  • 0 — сбой
  • datacenter — название дата-центра, в котором размещен сервер;
  • collector — имя внутреннего коллектора экспортера, который отвечает за сбор определенной группы метрик;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера
ipmi_scrape_duration_seconds
Gauge, секунды
Время сбора метрик IPMI exporter
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера
ipmi_sel_events_count_by_state
Gauge, количество
Количество событий из журнала SEL (System Event Log), сгруппированных по уровню критичности события
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • state — уровень критичности события
ipmi_chassis_cooling_fault_state
Gauge, bool

Состояние системы охлаждения сервера:

  • 1 — исправно;
  • 0 — сбой
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера
ipmi_chassis_drive_fault_state
Gauge, bool

Состояние дисков:

  • 1 — исправно;
  • 0 — сбой
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера
ipmi_chassis_power_state
Gauge, bool

Состояние питания сервера:

  • 1 — включен;
  • 0 — выключен
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера
ipmi_fan_speed_state
Gauge, enum

Состояние вентиляторов:

  • 0 — исправно;
  • 1 — отклонение;
  • 2 — сбой
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • id — идентификатор датчика;
  • name — имя датчика
ipmi_power_state
Gauge, enum

Состояние питания компонентов сервера:

  • 0 — исправно;
  • 1 — отклонение;
  • 2 — сбой
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • id — ID датчика;
  • name — имя датчика
ipmi_temperature_state
Gauge, enum

Состояние температуры компонентов сервера:

  • 0 — исправно;
  • 1 — отклонение;
  • 2 — сбой
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • id — ID датчика;
  • name — имя датчика
ipmi_voltage_state
Gauge, enum

Состояние напряжения:

  • 0 — исправно;
  • 1 — отклонение;
  • 2 — сбой
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • id — ID датчика;
  • name — имя датчика
ipmi_sensor_state
Gauge, enum

Состояние компонентов сервера:

  • 0 — исправно;
  • 1 — отклонение;
  • 2 — сбой
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • id — ID датчика;
  • name — имя датчика;
  • type — тип датчика
ipmi_fan_speed_rpm
Gauge, RPM
Скорость вращения вентилятора
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • id — ID датчика;
  • name — имя датчика
ipmi_power_watts
Gauge, ватты
Потребляемая мощность
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • id — ID датчика;
  • name — имя датчика
ipmi_temperature_celsius
Gauge, градусы °C
Температура компонентов сервера
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • name — имя датчика;
  • id — ID датчика
ipmi_voltage_volts
Gauge, вольты
Напряжение
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • id — ID датчика;
  • name — имя датчика
ipmi_sensor_value
Gauge
Данные с IPMI датчика. Единица измерения зависит от типа датчика
  • datacenter — название дата-центра, в котором размещен сервер;
  • location_id — пул, в котором размещен сервер;
  • resource_id — UUID сервера;
  • id — ID датчика;
  • name — имя датчика;
  • type — тип датчика

Облачные серверы

Пространство имен (namespace) облачных серверов — compute.

Метрики собираются на уровне гипервизора. Метрики со стороны гипервизора и метрики внутри ОС облачного сервера могут расходиться в значениях:

  • метрики гипервизора отражают физическое состояние облачных серверов и их ресурсов — CPU, памяти, дисков и сети, включая работу по обслуживанию дисковых и сетевых операций и служебные операции по виртуализации;
  • метрики внутри ОС отражают только вычисления, которые видит ядро ОС, и не учитывают фоновую работу.

При высокой нагрузке на диск или сеть значения метрик могут отличаться – это ожидаемое поведение виртуализированной среды, а не ошибка сбора метрик.

Сбор метрик не зависит от состояния ОС. Метрики собираются даже если облачный сервер загружается, находится под высокой нагрузкой или не отвечает по сети. Метрики не собираются только когда облачный сервер выключен.

Имя метрики
Тип, единица измерения
ОписаниеЛейблы
server_meta_info
Gauge, UNIT
Метаданные облачного сервера
  • project_name — имя проекта;
  • server_uuid — ID облачного сервера;
  • server_name — имя облачного сервера
server_state_info
Gauge, UNIT

Текущий статус облачного сервера:

  • 0 (no state) — состояние сервера неизвестно или не определено;
  • 1 (running) — сервер работает;
  • 2 (blocked) — сервер заблокирован (ожидает ресурсов или завершения операции чтения или записи с диска);
  • 3 (paused) — сервер приостановлен;
  • 4 (shutdown) — сервер выключается;
  • 5 (shut off) — сервер остановлен и выключен;
  • 6 (crashed) — сервер аварийно завершил работу;
  • 7 (pmsuspended) — сервер приостановлен и перешел в спящий режим
  • server_uuid — ID облачного сервера
cpu_count
Gauge, количество
Количество vCPU облачного сервера
  • server_uuid — ID облачного сервера
vcpu_usage_ratio
Gauge, %
Утилизация каждого из vCPU облачного сервера в %
  • server_uuid — ID облачного сервера;
  • vcpu — номер виртуального процессора
cpu_usage_ratio
Gauge, %
Утилизация CPU облачного сервера в %
  • server_uuid — ID облачного сервера
memory_total_bytes
Gauge, байты
Размер памяти на облачном сервере
  • server_uuid — ID облачного сервера
memory_usage_bytes
Gauge, байты
Используемый размер памяти облачным сервером
  • server_uuid — ID облачного сервера
memory_usage_ratio
Gauge, %
Процент оперативной памяти, которая используется облачным сервером
  • server_uuid — ID облачного сервера
memory_major_faults_total
Counter, штуки
Количество крупных страничных сбоев (major page faults), которые возникли на облачном сервере с момента его последнего запуска
  • server_uuid — ID облачного сервера
disk_meta_info
Gauge, UNIT
Метаданные диска облачного сервера
  • server_uuid — ID облачного сервера;
  • disk_uuid — ID диска облачного сервера;
  • disk_type="network" / "file" — тип диска
disk_write_requests_rate
Gauge, операции/с
Количество операций записи в секунду на диск облачного сервера
  • server_uuid — ID облачного сервера;
  • disk_uuid — ID диска облачного сервера
disk_read_requests_rate
Gauge, операции/с
Количество операций чтения в секунду с диска облачного сервера
  • server_uuid — ID облачного сервера;
  • disk_uuid — ID диска облачного сервера
disk_read_requests_limit
Gauge, операции/с
Максимальное количество операций чтения диска облачного сервера
  • server_uuid — ID облачного сервера;
  • disk_uuid — ID диска облачного сервера
disk_write_requests_limit
Gauge, операции/с
Максимальное количество операций записи диска облачного сервера
  • server_uuid — ID облачного сервера;
  • disk_uuid — ID диска облачного сервера
disk_flush_requests_rate
Gauge, операции/с
Количество операций на очистку кэша диска облачного сервера
  • server_uuid — ID облачного сервера;
  • disk_uuid — ID диска облачного сервера
disk_read_bytes_rate
Gauge, байты/с
Количество байт в секунду, прочитанных с диска облачного сервера
  • server_uuid — ID облачного сервера;
  • disk_uuid — ID диска облачного сервера
disk_write_bytes_rate
Gauge, байты/с
Количество байт в секунду, записанных на диск облачного сервера
  • server_uuid — ID облачного сервера;
  • disk_uuid — ID диска облачного сервера
network_meta_info
Gauge, UNIT
Метаданные сетевых интерфейсов облачного сервера
  • server_uuid — ID облачного сервера;
  • virtual_interface — ID порта облачного сервера
network_receive_packets_rate
Gauge, пакеты/с
Количество пакетов в секунду, полученных на сетевом интерфейсе облачного сервера
  • server_uuid — ID облачного сервера;
  • virtual_interface — ID порта облачного сервера
network_transmit_packets_rate
Gauge, пакеты/с
Количество пакетов в секунду, переданных через сетевой интерфейс облачного сервера
  • server_uuid — ID облачного сервера;
  • virtual_interface — ID порта облачного сервера
network_receive_bits_rate
Gauge, биты/с
Количество бит в секунду, полученных на сетевом интерфейсе облачного сервера
  • server_uuid — ID облачного сервера;
  • virtual_interface — ID порта облачного сервера
network_transmit_bits_rate
Gauge, биты/с
Количество бит в секунду, отправленных через сетевой интерфейс облачного сервера
  • server_uuid — ID облачного сервера;
  • virtual_interface — ID порта облачного сервера

Dedicated Inference

Пространство имен (namespace) Dedicated Inference – inference.

Имя метрики
Тип, единица измерения
ОписаниеЛейблы
info
Gauge, UNIT

Метаданные inference-сервиса. Значение метрики всегда равно 1

  • service_id — ID inference-сервиса;
  • name — имя inference-сервиса;
  • status — статус inference-сервиса;
  • availability_zone — сегмент пула, в котором размещен inference-сервис;
  • region — пул, в котором размещен inference-сервис;
  • gpu_count — количество GPU;
  • gpu_name — модель GPU;
  • ram_mb — объем RAM в МБ;
  • vcpu — количество vCPU;
  • disk_size_gb — размер диска в ГБ;
  • disk_type — тип диска;
  • vm_type — линейка конфигурации облачного сервера, на котором развернут inference-сервис:
config_info
Gauge, UNIT

Конфигурация inference-сервиса. Значение метрики всегда равно 1

  • service_id — ID inference-сервиса;
  • max_concurrent_requests — максимальное число одновременных запросов;
  • public_access_enabled — тип подключения к inference-сервису:
    • true — публичный доступ;
    • false — приватный доступ;
  • logs_enabled — логирование:
    • true — включено;
    • false — выключено
autoscaling_config_info
Gauge, UNIT

Настройки автомасштабирования inference-сервиса. Значение метрики всегда равно 1

  • service_id — ID inference-сервиса;
  • min_replicas — минимальное количество inference-инстансов;
  • max_replicas — максимальное количество inference-инстансов
model_config_info
Gauge, UNIT

Конфигурация модели inference-сервиса. Значение метрики всегда равно 1

  • service_id — ID inference-сервиса;
  • model_id — название модели;
  • model_quantization — тип квантизации модели;
  • cache_quantization — тип данных для KV-кэша (Key-Value Cache);
  • context_window_size — максимальная длина контекста
vllm_cache_config_info
Gauge, UNIT

Настройки KV-кэша движка vLLM. Значение метрики всегда равно 1

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс;
  • block_size — размер блока KV-кэша в токенах;
  • cache_dtype — тип данных KV-кэша;
  • cpu_kvcache_space_bytes — место под KV-кэш на CPU, байты;
  • cpu_offload_gb — объем дополнительной памяти CPU под KV-кэш в ГБ;
  • enable_prefix_caching — кэширование префиксов запросов:
    • true — включено;
    • false — выключено;
  • gpu_memory_utilization — допустимая доля загрузки памяти GPU;
  • kv_cache_memory_bytes — объем памяти GPU под KV-кэш в байтах;
  • kv_offloading_size — размер области для временной выгрузки KV-кэша в оперативную память в байтах;
  • kv_sharing_fast_prefill — ускоренная обработка закэшированных префиксов запроса:
    • true — включена;
    • false — выключена;
  • num_cpu_blocks — количество блоков KV-кэша в памяти CPU;
  • num_gpu_blocks — количество блоков KV-кэша в памяти GPU;
  • num_gpu_blocks_override — явно заданное количество блоков KV-кэша в памяти GPU;
  • prefix_caching_hash_algo — алгоритм хэширования префиксов запросов;
  • sliding_window — размер ограниченного контекстного окна в токенах;
  • swap_space — размер области обмена KV-кэша в байтах
vllm_kv_cache_usage_perc
Gauge, доля

Доля занятых блоков KV-кэша (от 0 до 1)

  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_prefix_cache_hits_total
Gauge, штуки

Количество совпадений в кэше префиксов

  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_prefix_cache_queries_total
Gauge, штуки

Количество обращений к кэшу префиксов

  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_prompt_tokens_total
Gauge, токены

Общее количество входных токенов, которые обработаны моделью

  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_generation_tokens_total
Gauge, токены

Общее количество сгенерированных токенов

  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_num_requests_running
Gauge, штуки

Количество запросов, которые находятся в обработке моделью

  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_num_requests_waiting
Gauge, штуки

Количество запросов, которые ожидают в очереди

  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_request_success_total
Gauge, штуки

Количество успешно обработанных запросов

  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс;
  • finished_reason — причина завершения обработки запроса
vllm_engine_sleep_state
Gauge, bool

Состояние загрузки inference-инстанса. Метрика экспортирует три строки одновременно — по одной строке на каждое значение лейбла sleep_state. Значение 1 присваивается строке с текущим состоянием inference-инстанса. Остальным строкам присваивается значение 0:

  • sleep_state="awake" — inference-инстанс активен, готов обрабатывать запросы;

  • sleep_state="weights_offloaded" — веса модели выгружены из памяти GPU, inference-инстанс частично освобожден;

  • sleep_state="discard_all" — веса модели и данные KV-кэша сброшены, inference-инстанс полностью освобожден

  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс;
  • sleep_state — состояние inference-инстанса: awake, weights_offloaded или discard_all
vllm_e2e_request_latency_seconds
Histogram, секунды

Задержка обработки запроса от получения промта до полного завершения ответа (end-to-end)

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_request_queue_time_seconds
Histogram, секунды

Время ожидания запроса в очереди

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_request_prefill_time_seconds
Histogram, секунды

Время обработки входного промта

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_request_decode_time_seconds
Histogram, секунды

Время генерации ответа на запрос

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_request_inference_time_seconds
Histogram, секунды

Общее время обработки промта и генерации ответа

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_request_time_per_output_token_seconds
Histogram, секунды

Среднее время на генерацию каждого токена

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_time_to_first_token_seconds
Histogram, секунды

Время от получения запроса до генерации первого токена

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_inter_token_latency_seconds
Histogram, секунды

Задержка между токенами

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_request_prompt_tokens
Histogram, токены

Количество входных токенов на запрос

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_request_generation_tokens
Histogram, токены

Количество сгенерированных токенов на запрос

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
vllm_iteration_tokens_total
Histogram, токены

Количество токенов, которое обработала модель за одну итерацию по всем активным запросам

  • le — верхняя граница бакета гистограммы;
  • engine — уникальный идентификатор движка vLLM;
  • model_name — название модели;
  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
cpu_usage_cores
Gauge, ядра

Текущее потребление CPU inference-инстансом

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
cpu_limit_cores
Gauge, ядра

Заданный лимит CPU на inference-инстанс

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
memory_usage_bytes
Gauge, байты

Текущее потребление памяти inference-инстансом

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
memory_limit_bytes
Gauge, байты

Заданный лимит памяти на inference-инстанс

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
http_requests_total
Gauge, штуки

Общее количество HTTP-запросов на inference-сервис

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • code — код ответа на HTTP-запрос
http_requests_bytes_total
Gauge, байты

Общий размер HTTP-запросов

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис
http_responses_bytes_total
Gauge, байты

Общий размер HTTP-ответов

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис
network_receive_bytes_total
Gauge, байты/с

Количество байт в секунду, полученных inference-инстансом

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
network_receive_packets_total
Gauge, пакеты/с

Количество пакетов в секунду, полученных inference-инстансом

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
network_receive_packets_dropped_total
Gauge, пакеты/с

Количество пакетов в секунду, потерянных при приеме inference-инстансом

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
network_transmit_bytes_total
Gauge, байты/с

Количество байт в секунду, отправленных inference-инстансом

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
network_transmit_packets_total
Gauge, пакеты/с

Количество пакетов в секунду, отправленных inference-инстансом

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс
network_transmit_packets_dropped_total
Gauge, пакеты/с

Количество пакетов в секунду, потерянных при передаче inference-инстансом

  • service_id — ID inference-сервиса;
  • region — пул, в котором размещен inference-сервис;
  • pod — inference-инстанс