Évaluer un modèle sous dérive de distribution
Partir de la distribution de déploiement, des splits, des métriques, des seuils et de l’incertitude plutôt que de traiter un score de test comme une capacité universelle.
Partir de la distribution de déploiement, des splits, des métriques, des seuils et de l’incertitude plutôt que de traiter un score de test comme une capacité universelle.