Si lega a
delimita l'utilizzo dell'inferenza e quindi la quota della capacità impegnata che entra nel costo di servizio
Da qui ci si arriva
- Utilizzo dell'inferenza
quota della capacità che serve lavoro utile entro il livello di servizio, non semplice occupazione della GPU