Quand arrêter l'entraînement
L'entraînement n'a pas besoin de tourner « pour toujours ». Dans les projets réels, les meilleurs résultats viennent d'un arrêt au bon moment :
pas trop tôt (le modèle n'a pas encore appris)
pas trop tard (le modèle commence à surapprendre / mémoriser)
Dans AugeLab Studio, l'entraînement s'arrête généralement lorsqu'il atteint les max iterations configurées, ou lorsque vous cliquez sur Stop Training. Le Training Chart vous aide à décider s'il vaut la peine de continuer.
Si c'est votre premier entraînement, commencez par la Starter Checklist.
Surveiller la progression de l'entraînement
Pendant l'entraînement, surveillez la progression du modèle et observez la relation entre :
Loss
mAP
IOU
Iterations
Loss et mAP sont affichés sur un graphique comme ci-dessous :

Toutes les métriques peuvent fortement varier selon :
la diversité des données
la taille des données
la précision des annotations
la taille du modèle
Les chiffres ci-dessous servent seulement de repères initiaux pour les débutants.
Règle rapide (ce qui marche généralement)
Si vous ne retenez qu'une règle :
Arrêtez lorsque la mAP de validation cesse de s'améliorer pendant longtemps, ou quand elle commence à baisser pendant que Loss continue de baisser.
Ce second cas est le signe classique de surapprentissage.
Schémas courants d'entraînement (antisèche)
Ces schémas sont fréquents en pratique. Pour chacun, regardez d'abord le graphique, puis lisez l'explication.
Ces graphiques d'exemple sont générés à des fins de formation/documentation. Dans votre dépôt, placez-les sous le dossier .assets/ à côté de cette page.
Données insuffisantes

Explication :
Ce que ça signifie : vous n'avez pas encore assez de signal pour faire confiance à la tendance.
Causes probables : trop peu d'images, exécution trop courte, split de validation trop faible.
Que faire : entraîner plus longtemps ; ajouter des données ; vérifier que la validation existe et couvre la vraie variété.
Faible variance

Explication :
Ce que ça signifie : le modèle apprend rapidement les répétitions « faciles », puis n'obtient plus d'informations nouvelles.
Causes probables : dataset répétitif (même fond/angle/lumière), absence d'exemples négatifs, cas limites manquants.
Que faire : ajouter de la variété (angles, fonds, éclairages), ajouter des négatifs, capturer volontairement des cas difficiles.
Surentraînement

Le surentraînement n'est pas toujours catastrophique, mais indique généralement de la mémorisation plutôt que de la généralisation. Pour des environnements stricts (caméra fixe, éclairage fixe), c'est acceptable.
Ce que ça signifie : le modèle s'améliore sur le jeu d'entraînement, mais se dégrade sur la validation (mémorisation).
Causes probables : manque de variété, validation trop petite, doublons/near-duplicates.
Que faire : arrêter et conserver les meilleurs poids ; ajouter de la variété ; augmenter la part de validation ; supprimer les doublons.
Modèle qui n'apprend pas

Explication :
Ce que ça signifie : l'entraînement ne progresse pas de manière significative.
Causes probables : mauvaises étiquettes/classes, décalage des IDs de classes, format d'annotation cassé, mauvaise configuration.
Que faire : vérifier l'ordre du fichier
.namesvs les IDs des labels ; contrôler manuellement des étiquettes ; confirmer le format YOLO ; ajuster les paramètres d'entraînement.
Jeu de données corrompu

Explication :
Ce que ça signifie : l'entraînement est perturbé par des données incohérentes ou cassées.
Causes probables : fichiers images corrompus, labels invalides, sources/résolutions mixtes, images « vides mais contenant des objets ».
Que faire : vérifier le dataset ; supprimer les données corrompues ; corriger le format des labels ; réexporter un jeu propre.
Bon entraînement

Explication :
Ce que ça signifie : apprentissage sain et bonne généralisation.
Causes probables : labels cohérents + assez de variété.
Que faire : arrêter lorsque la mAP se stabilise ; valider sur des vidéos réelles / un « golden set » ; déployer les meilleurs poids.
Loss
Loss est un signal d'ajustement pendant l'entraînement. Il représente à quel point le modèle s'adapte aux batches d'entraînement.
Loss est utile, mais peut être trompeur :
Loss peut continuer à diminuer même si le modèle surapprend déjà.
Loss ne garantit pas la performance « en conditions réelles ».
Le Loss seul ne suffit pas pour juger de la précision. Utilisez la mAP pour comprendre la généralisation sur les données de validation.
**Loss ≥ 2.0**
Indique souvent que « l'apprentissage a commencé », mais la qualité peut rester faible. À utiliser comme un signe que la pipeline fonctionne, pas comme une ligne d'arrivée.
Comme montré dans le graphique ci-dessus, des valeurs de loss autour de 2.0 peuvent ne pas produire des modèles précis.
**Loss ≥ 1.0**
Souvent une base utilisable sur de nombreux datasets ciblés.
**Loss ≥ 0.5**
Souvent indicateur d'un modèle bien ajusté sur un dataset propre et cohérent. Après ce point, les améliorations peuvent être lentes et le risque de surapprentissage augmente.
Les seuils de Loss ne sont pas universels (pourquoi)
Les valeurs de loss dépendent de l'architecture du modèle, de la taille d'image, du nombre de classes, du bruit dans les labels, des augmentations et de la complexité du dataset. Utilisez les seuils de loss pour construire une intuition, pas comme un verdict universel.
mAP
La métrique mAP (mean average precision) combine précision et rappel pour fournir une évaluation complète de la capacité du modèle à détecter des objets.
Elle est calculée en comparant les prédictions aux labels ground-truth à des seuils IoU donnés (les détails exacts dépendent du backend/configuration d'entraînement).
La mAP n'est valable que si votre ensemble de validation est représentatif. Si les images de validation sont trop peu nombreuses, trop « propres », trop similaires à l'entraînement, ou mal étiquetées, la mAP peut paraître excellente alors que le modèle échoue en production.
Interprétation pratique :
Un plateau stable vaut souvent mieux que de pourchasser le dernier +1 %.
Une mAP très élevée (95–99 %) sur un petit jeu répétitif est souvent un piège de surapprentissage.
Si la mAP atteint un pic puis baisse, consultez la section Over-Fitting.
IOU
L'IOU (Intersection over Union) mesure le recouvrement entre les boîtes prédites et les boîtes réelles pour chaque détection d'objet. La mAP évalue la performance globale du modèle de détection en tenant compte de la précision et du rappel.
Plus l'IOU est élevé, plus la boîte prédite est serrée autour de l'objet.
Vous pouvez suivre chaque IOU dans les logs de la Training Window :

Affinage (Fine Tuning)
Durée d'entraînement
Définissez un budget de temps maximal d'entraînement en fonction des ressources disponibles et des contraintes du projet. Si le modèle n'atteint pas de performance satisfaisante dans le temps imparti, envisagez d'arrêter l'entraînement et d'explorer d'autres approches telles que :
analyser manuellement la qualité des annotations
vérifier la variété des classes
choisir d'autres tailles de modèle et tailles de batch
augmenter la taille de la base de données
Over-Fitting
Évitez le surapprentissage en surveillant comment la mAP évolue dans le temps.
Le signal de surapprentissage le plus fiable en « conditions réelles » est :
loss diminue, mais la mAP atteint un pic puis se détériore.
Le surapprentissage n'est pas toujours « catastrophique » dans des configurations très contraintes et fixes. Mais si vous visez la robustesse (éclairages différents, variations d'environnement), le surapprentissage se manifestera vite.
Ce qui aide généralement :
Ajouter de la variété (nouveaux jours, nouveaux éclairages, nouveaux fonds)
Ajouter des négatifs ressemblant à votre environnement réel
Renforcer la cohérence des labels (même style entre les annotateurs)
Augmenter la part de validation pour rendre la mAP plus difficile à « tricher »


Équilibrer temps et performance
Mettez en balance le temps d'entraînement et la performance souhaitée. Parfois, des itérations supplémentaires améliorent le résultat, mais le gain diminue avec le temps. Pesez les bénéfices face au coût computationnel et à l'urgence du projet.
Généralement, selon le nombre de classes et la taille de la base, la durée d'entraînement peut varier d'un jour à une semaine.
Checklist de démarrage (Starter Checklist)
Base de données :
Modèle :
Arrêt d'entraînement (arrêter si) :
Checklist de débogage rapide (quand quelque chose ne va pas)
Vérifier rapidement 20–50 images réparties dans le dataset (pas seulement la première page)
Confirmer le mapping des classes :
l'ordre du fichier
.namescorrespond aux IDs des labelspas de classes manquantes/en trop
Vérifier des fichiers de labels :
Format YOLO :
class x_center y_center width height(normalisé)les boîtes sont dans les limites et non de taille zéro
Si la mAP semble « trop belle pour être vraie » :
la part de validation peut être trop petite ou trop similaire à l'entraînement
vous pouvez avoir des doublons / near-duplicates
Si l'entraînement est instable ou provoque des OOM :
augmenter les subdivisions ou réduire le batch
réduire temporairement la résolution d'entrée pour déboguer
Mis à jour