теория
Смотри, вот первое, что стоит принять как данность: время ответа — не одно число, а целое распределение. Запусти один и тот же запрос дважды подряд — цифры будут разные. То пакет потерялся, то сборщик мусора замер на миг (программа-уборщик памяти; пока она убирает, всё на мгновение замирает), то запрос просто постоял в очереди к процессору. Живая система дышит, и это нормально.
Поэтому честно описывать её :
А теперь то, что многих удивляет: этот хвост важнее, чем кажется по его доле. Вот почему:
Из перцентилей собирается SLO — обещание вида «p50 < 200 мс, p99 < 1 с, 99,9% успешных». А — тот же SLO, но уже как контракт, за нарушение которого платят живыми деньгами.
И два предостережения, о которые все спотыкаются. Первое: перцентили нельзя усреднять — среднее из p99 десяти серверов прячет худший из них; складывай гистограммы, а не средние. Второе: перегруженная система порой не восстанавливается сама — повторные запросы клиентов только подливают масла (). Поэтому рядом с SLO всегда живут , и . Познакомимся с ними ближе в третьем акте — пока просто запомни, что они есть.