LLM Latency P95 (Inference) (LLM-P95)

95-й перцентиль времени от запроса до полного ответа модели.

Что такое LLM Latency P95 (Inference) (LLM-P95)?

95-й перцентиль времени от запроса до полного ответа модели.

Категория: AI / LLM продукты. Метрика применяется для анализа продуктовых показателей, A/B-тестов и когортного анализа.

Формула и расчёт LLM Latency P95 (Inference) — в Pro

В Pro-подписке по этой метрике вы получите:

Бесплатные метрики этой же категории:

Открыть все 390+ метрик →
Обновлено:
Открыть каталог метрик