LLM Latency P95 (Inference) (LLM-P95)
95-й перцентиль времени от запроса до полного ответа модели.
Что такое LLM Latency P95 (Inference) (LLM-P95)?
95-й перцентиль времени от запроса до полного ответа модели.
Категория: AI / LLM продукты. Метрика применяется для анализа продуктовых показателей, A/B-тестов и когортного анализа.
Формула и расчёт LLM Latency P95 (Inference) — в Pro
В Pro-подписке по этой метрике вы получите:
- Точную формулу расчёта (LaTeX)
- Готовый SQL-запрос для вашей БД
- Инструкцию «как считать на реальных данных»
- Зачем метрика нужна бизнесу и когда её применять
- Типичные ошибки расчёта и как их избежать
Бесплатные метрики этой же категории:
Открыть все 390+ метрик →
Обновлено:
Открыть каталог метрик