Un serveur traite au plus 10 requêtes par seconde. L'engagement de service impose un temps de réponse moyen inférieur à 200 millisecondes.
Objectif
Déterminer le trafic que ce serveur peut accepter, puis ce qu'il faudrait pour tenir le même engagement sous un trafic bien plus fort.
Ce que la deuxième réponse dit
La capacité laissée inutilisée n'est pas du gaspillage : c'est elle qui paie le temps de réponse. Un dimensionnement qui vise à occuper le serveur au maximum promet une latence qu'il ne tiendra pas, et la découverte se fait en production.
Ce que la dernière réponse dit
Le temps de réponse ne dépend pas du rapport des deux rythmes mais de leur écart. C'est le seul endroit du sujet où la non-linéarité joue en faveur de celui qui dimensionne : un trafic multiplié par plus de deux ne demande pas de doubler la capacité.