« Model Warm-Up » : différence entre les versions
Aucun résumé des modifications |
Aucun résumé des modifications |
||
Ligne 17 : | Ligne 17 : | ||
''' Model Warmup''' | ''' Model Warmup''' | ||
== | == Sources == | ||
'' À trouver'' | '' À trouver'' | ||
[[Catégorie:vocabulary]] | [[Catégorie:vocabulary]] |
Dernière version du 23 mai 2025 à 14:35
en construction
Définition
Lors de la phase de déploiement d'un modèle qui a été préalablement entraîné, l'échauffement du modèle consiste à exécuter un petit nombre de requêtes d'inférence à un modèle pour initialiser tous ses composants.
Compléments
Il est important d'observer si le temps de réponse moyen diminue jusqu'à la valeur de latence attendue en production à mesure que l'échauffement progresse.
Français
Échauffement du modèle
Échauffement à l'inférence
Anglais
Model Warm-up
Model Warmup
Sources
À trouver
Contributeurs: Arianne
