« Échauffement du modèle » : différence entre les versions
(Page créée avec « == en construction == == Définition == Lors de la phase de déploiement d'un modèle qui a été préalablement entraîné, l'échauffement du modèle consiste à exécuter un petit nombre de requêtes d'inférence à un modèle pour initialiser tous ses composants. == Compléments == Il est important d'observer si le temps de réponse moyen diminue jusqu'à la valeur de latence attendue en production à mesure que l'échauffement progresse. == Français ==... ») |
Aucun résumé des modifications |
||
(4 versions intermédiaires par 2 utilisateurs non affichées) | |||
Ligne 1 : | Ligne 1 : | ||
== Définition == | == Définition == | ||
Lors de la phase de déploiement d'un modèle qui a été préalablement entraîné, l'échauffement du modèle consiste à exécuter un petit nombre de requêtes d'inférence à un modèle pour initialiser tous ses composants. | Lors de la phase de déploiement d'un modèle qui a été préalablement entraîné, l'échauffement du modèle consiste à exécuter un petit nombre de requêtes d'inférence à un modèle pour initialiser tous ses composants. | ||
Ligne 15 : | Ligne 13 : | ||
''' Model Warm-up''' | ''' Model Warm-up''' | ||
== | ''' Model Warmup''' | ||
== Sources == | |||
[[ | [[Catégorie:GRAND_LEXIQUE_FRANÇAIS]] |
Dernière version du 5 août 2025 à 10:05
Définition
Lors de la phase de déploiement d'un modèle qui a été préalablement entraîné, l'échauffement du modèle consiste à exécuter un petit nombre de requêtes d'inférence à un modèle pour initialiser tous ses composants.
Compléments
Il est important d'observer si le temps de réponse moyen diminue jusqu'à la valeur de latence attendue en production à mesure que l'échauffement progresse.
Français
Échauffement du modèle
Échauffement à l'inférence
Anglais
Model Warm-up
Model Warmup
Sources
Contributeurs: Arianne Arel, wiki
