Ce protocole compare six modèles YOLO pour la détection en temps réel du comportement des bovins afin de soutenir l’optimisation du bien-être et de la gestion de l’exploitation.
Un abonnement JoVE est requis pour visualiser ce contenu. Connectez-vous ou commencez votre période d'essai gratuite.
Article de méthode
Ce protocole compare six modèles YOLO pour la détection en temps réel du comportement des bovins afin de soutenir l’optimisation du bien-être et de la gestion de l’exploitation.
La détection précise et en temps réel du comportement des bovins est cruciale pour améliorer le bien-être des animaux et optimiser la gestion du bétail. Pour y remédier, cette étude évalue de manière exhaustive six modèles légers YOLO (You Only Look Once) développés par la communauté - YOLOv8n, YOLOv9t, YOLOv10n, YOLOv11n, YOLOv12n et YOLOv13n - pour reconnaître cinq comportements clés des bovins (debout, couché, recherche de nourriture, boisson et rumination) à l’aide de l’ensemble de données CBVD-5 personnalisé. L’ensemble de données comprend diverses conditions d’éclairage et des environnements naturels de grange pour refléter des scénarios de surveillance réels. Tous les modèles ont été évalués à l’aide de mesures de détection d’objets standard (précision, rappel, mAP@50 et mAP@50-95) et d’indicateurs orientés déploiement, notamment le temps d’inférence, les images par seconde (FPS), la taille du modèle et la durée de l’entraînement, afin de fournir une évaluation équilibrée de la précision et de l’efficacité. YOLOv13n a atteint le mAP@50-95 le plus élevé (0,712), tandis que YOLOv11n a atteint le mAP@50 le plus élevé (0,967) et a montré une convergence stable avec un bon compromis entre la précision de détection et la vitesse d’inférence. YOLOv10n a démontré la vitesse d’inférence la plus rapide (1,2 ms/image, ~833 FPS), ce qui le rend bien adapté aux applications sensibles à la latence telles que la surveillance continue des granges. Tous les modèles ont conservé des tailles compactes inférieures à 6 Mo et un débit en temps réel supérieur à ~300 FPS, confirmant ainsi leur praticité pour le déploiement en périphérie. Les résultats établissent un cadre de référence reproductible pour l’évaluation des variantes modernes de YOLO, offrant des informations sur la sélection de modèles pour des systèmes de surveillance du bétail efficaces, évolutifs et axés sur le bien-être.
La surveillance efficace du comportement des bovins est essentielle dans l’élevage de précision, car elle permet de gérer le bien-être, de détecter les maladies et d’optimiser les opérations. Les approches non invasives basées sur la vision sont particulièrement prometteuses en raison de leur évolutivité et de leur polyvalence. Les ensembles de données standardisés tels que CBVD-5 (Cow Behavior Video Dataset with 5 classes) offrent diverses annotations de comportement dans des conditions d’éclairage variées, ce qui en fait des références précieuses dans ce domaine1. Dans la plupart des exploitations agricoles, les caméras sont fixées à une hauteur modérée avec un éclairage relativement stable, bien qu’une occlusion occasionnelle chez les bovins puisse affecter les performances de détection. La reconnaissance du comportement chez le bétail continue de faire face à des défis tels que l’occlusion, la variabilité des mouvements et la rareté des données d’entraînement. Pour relever ces défis, des travaux antérieurs ont exploré des approches basées sur des capteurs2, la modélisation de motifs d’images3 et des stratégies d’apprentissage profond d’ensemble4. Les frameworks de détection d’objets tels que YOLO (You Only Look Once), introduit pour la première fois par Redmon et al.5, et sa version plus avancée YOLOv76, se distinguent par leur capacité à équilibrer la précision de détection, la latence et l’efficacité de calcul. Dans cette étude, les performances en temps réel font référence à l’atteinte d’une vitesse d’inférence supérieure à 30 images par seconde (FPS), ce qui garantit un suivi du comportement vidéo fluide et continu dans des environnements pratiques de ferme. Cette étude évalue systématiquement les performances de YOLOv8n à YOLOv13n sur l’ensemble de données CBVD-5, en mettant l’accent sur la détection du comportement en temps réel et les contraintes de déploiement. Les progrès récents de l’architecture YOLO, y compris les versions de la communauté ouverte YOLOv87, YOLOv98, YOLOv109, YOLOv1110, YOLOv1211 et YOLOv1312, ont apporté des améliorations à la précision de détection et à l’efficacité de calcul. Ces modèles s’appuient sur des innovations telles que l’apprentissage multitâche, les têtes sans ancrage et l’apprentissage par transfert optimisé, ce qui les rend plus adaptés aux environnements à ressources limitées que l’on rencontre généralement dans les fermes d’élevage à grande échelle. Cependant, à notre connaissance, il n’y a pas eu d’étude exhaustive évaluant spécifiquement ces modèles pour la reconnaissance du comportement des bovins. Pour combler cette lacune, nous effectuons une évaluation comparative des modèles YOLO récents (v8n-v13n) pour la détection du comportement des bovins à l’aide d’un ensemble de données conçu pour simuler des environnements agricoles réels. Les modèles sont évalués à l’aide de mesures de détection standard telles que la précision moyenne (mAP), la précision, le rappel, le temps d’inférence et le FPS afin de déterminer quelle variante est la mieux adaptée aux applications de surveillance des bovins en temps réel dans des conditions agricoles. Plutôt que de proposer une nouvelle architecture, cette étude établit un cadre de benchmarking systématique et reproductible pour les variantes récentes de YOLO dans le contexte de la surveillance du comportement du bétail, comblant ainsi une lacune de la littérature actuelle où leurs performances comparatives restent largement inexplorées.
La famille de détecteurs d’objets YOLO a considérablement fait progresser la vision par ordinateur en temps réel, en particulier dans les applications nécessitant à la fois vitesse et précision. Dans la reconnaissance du comportement des bovins, où le suivi en temps réel des mouvements du bétail est essentiel, l’équilibre de ces attributs de YOLO le rend très efficace. Cette revue décrit l’évolution des modèles YOLO, des premières versions aux plus récentes, en mettant en évidence les principales innovations pertinentes pour la détection du comportement des bovins. Chaque itération a apporté des améliorations en termes de vitesse, de précision et de robustesse de détection dans les conditions de la ferme, ce qui rend les modèles YOLO de plus en plus adaptés à la surveillance des bovins dans des environnements dynamiques.
Les premières générations de YOLO (v1-v3) ont jeté les bases de la détection d’objets en une seule étape en unifiant la classification et la localisation en un seul cadre de régression. Ces versions ont progressivement amélioré la vitesse d’inférence, la précision spatiale et la capacité de détection multi-échelle, jetant les bases de l’application de YOLO dans l’analyse du comportement du bétail et d’autres scénarios agricoles en temps réel 13,14,15,16. Avec la sortie de YOLOv4 en 2020, l’architecture a connu d’autres améliorations, notamment l’adoption du backbone Cross Stage Partial (CSP), l’activation de Mish et des techniques avancées d’agrégation de fonctionnalités 17,18,19. Ces mises à jour ont amélioré les performances du modèle sur des ensembles de données plus petits, un scénario courant dans la détection du comportement du bétail en raison d’échantillons annotés limités pour des événements rares. Le projet communautaire YOLOv5, lancé par Ultralytics en 2020, a été largement adopté pour sa conception modulaire et sa facilité de déploiement via un cadre PyTorch20. Bien qu’il n’ait pas fait l’objet d’un article évalué par des pairs, YOLOv5 est devenu une référence de facto dans les tâches de détection de bétail en temps réel en raison de son fort équilibre entre précision et flexibilité de déploiement. YOLOv6, sorti en 2022, a privilégié une conception respectueuse du matériel avec le backbone EfficientRep et le manche Rep-PAN21,22. En intégrant la détection sans ancrage, le modèle a amélioré la robustesse dans les scénarios impliquant une occlusion et une visibilité partielle, conditions fréquemment rencontrées dans les environnements bovins surpeuplés. YOLOv7 a encore optimisé l’efficacité des calculs grâce à l’architecture E-ELAN, permettant une formation plus rapide et des performances améliorées sur plusieurs échelles de détection23. Parallèlement, des modèles alternatifs tels que YOLOX24 et YOLOR25 offrent une vitesse de détection et une généralisation avancées, deux attributs essentiels pour les systèmes de surveillance du bétail en plein air. La version 2023 de YOLOv8 par Ultralytics a introduit plusieurs modifications architecturales, notamment des têtes sans ancrage, une reparamétrisation structurelle et des stratégies d’augmentation plus fortes. Ces mises à jour ont permis des gains significatifs en termes de précision de détection et de vitesse d’inférence, faisant de YOLOv8 une option compétitive pour l’analyse du comportement des bovins en temps réel. L’évolution s’est poursuivie avec l’émergence de YOLOv9, YOLOv10, YOLOv11, YOLOv12 et YOLOv13. YOLOv9 a intégré l’apprentissage multitâche pour améliorer conjointement la classification, la localisation et les tâches auxiliaires telles que la détection de points clés. YOLOv10 a été construit sur cette base en intégrant des modules d’adaptation de domaine et des mécanismes d’attention sensibles à la segmentation. YOLOv11 a introduit des protocoles d’entraînement auto-supervisés qui ont réduit la dépendance à l’égard de données entièrement étiquetées, offrant des avantages dans les applications peu nombreuses comme la surveillance du comportement des bovins. YOLOv12 a mis l’accent sur l’amélioration de la fusion des fonctionnalités et le reparamétrage dynamique. Enfin, YOLOv13 a incorporé des modules basés sur des transformateurs et une attention spatio-temporelle, offrant des performances supérieures pour la détection à haut débit et à faible latence dans des scénarios agricoles complexes en temps réel.
Ces dernières années, les modèles d’apprentissage profond basés sur YOLO sont devenus largement utilisés pour la surveillance automatisée et en temps réel du comportement des bovins en raison de leur efficacité et de leur précision. Avant l’adoption des détecteurs basés sur YOLO, plusieurs des premiers systèmes basés sur la vision avaient démontré la faisabilité de la surveillance du bétail par imagerie. Par exemple, Sumi et al. ont développé un système de surveillance des vaches pour la détection des vêlages à l’aide de l’analyse des caractéristiques de mouvement26, tandis que Zin et al. ont proposé un cadre d’identification des vaches basé sur l’apprentissage profond atteignant une précision de reconnaissance de 97 %27. Ces travaux ont jeté les bases d’approches ultérieures de détection d’objets dans l’élevage de précision. Plusieurs études ont appliqué différentes variantes de YOLO pour la classification du comportement, le suivi de mouvement et la reconnaissance de la posture dans des conditions variées. Par exemple, Mu et al. ont proposé un modèle amélioré de reconnaissance du comportement des bovins légers - YOLO28 (CBR-YOLO) basé sur YOLOv8, optimisé pour l’adaptation à plusieurs scènes météorologiques. Le modèle a atteint une précision moyenne de 90,2 % tout en réduisant considérablement le nombre de paramètres. Tong et al. ont présenté le modèle YOLO-BoT29, incorporant des modules d’attention et basés sur des transformateurs dans YOLOv8 pour la détection et le suivi du comportement des bovins dans des environnements complexes, atteignant un mAP de détection de 91,7 % à 31,2 FPS. Hao et al. ont intégré un mécanisme d’attention multi-échelle efficace (EMA) dans YOLOv530 (YOLOv5-EMA), qui a amélioré les performances de détection des parties du corps des bovins (par exemple, la tête, les pattes), atteignant des valeurs mAP comprises entre 94,8 % et 95,5 %. Guarnido-Lopez et al.31 ont évalué YOLOv8 et YOLOv10 pour la reconnaissance des comportements liés à l’alimentation (par exemple, mâcher, mordre, s’approcher) chez les taureaux charolais, rapportant que YOLOv10 a légèrement surpassé YOLOv8 en mAP@50, mAP@50-95, précision et rappel, tandis que YOLOv8 a montré une convergence plus rapide et un surajustement plus faible. Alors que YOLOv1 à YOLOv8 ont été largement adoptés et validés pour les tâches liées à l’élevage, l’applicabilité de YOLOv9 à YOLOv13 dans ce domaine reste sous-explorée. À ce jour, il n’y a pas eu d’évaluation complète de ces nouveaux modèles de détection du comportement des bovins, ce qui met en évidence une lacune critique dans les recherches existantes et motive une enquête plus approfondie sur leurs performances dans le monde réel.
Accès restreint. Veuillez vous connecter ou commencer un essai pour afficher ce contenu.
1. Préparation de l’ensemble de données
REMARQUE : Cette étude n’a pas impliqué de nouvelles expériences sur des animaux. Toutes les données ont été obtenues à partir de l’ensemble de données CBVD-5 accessible au public, qui a été recueilli et publié conformément aux directives institutionnelles en matière de soins aux animaux par ses auteurs originaux. Par conséquent, aucune approbation éthique supplémentaire n’était requise pour ce travail.
2. Sélection et configuration du modèle
3. Formation du modèle
4. Évaluation du modèle
Accès restreint. Veuillez vous connecter ou commencer un essai pour afficher ce contenu.
Cette section présente les résultats de l’évaluation des modèles YOLOv8 à YOLOv13 sur l’ensemble de données CBVD-5 pour la reconnaissance multi-comportements des bovins. L’analyse se concentre sur la précision de la détection, la convergence de l’entraînement, la distribution comportementale et l’adéquation du déploiement dans des environnements à ressources limitées. La qualité de l’ensemble de données et l’équilibre des classes suivent les divisions décrites dans le protocole (70/20/10), ce qui garantit une représentat...
Accès restreint. Veuillez vous connecter ou commencer un essai pour afficher ce contenu.
Le succès global du cadre comparatif proposé dépend de plusieurs étapes du protocole, notamment l’annotation de comportement de haute qualité, l’augmentation de diverses données et la surveillance stable de la convergence pendant l’entraînement. Ces facteurs garantissent que les différences de performances du modèle reflètent la variation architecturale réelle plutôt que le bruit des données ou de l’entraînement. Cette étude a systématiquement évalué six variantes légères de YOLO (v8n à ...
Accès restreint. Veuillez vous connecter ou commencer un essai pour afficher ce contenu.
Les auteurs déclarent qu’ils n’ont pas d’intérêts concurrents.
Ce travail a été financé par une bourse de transition de l’Universiti Sains Malaysia, projet n° : R501-LR-RND003-0000001342-0000.
Accès restreint. Veuillez vous connecter ou commencer un essai pour afficher ce contenu.
| Nom | Entreprise | Numéro de catalogue | Commentaires |
|---|---|---|---|
| Enregistreur Dahua DH-NVR2216-HDS3 | Technologie Dahua | https://www.dahuasecurity.com/ | |
| Commutateur Gigabit Dahua DH-S3000C-16GT | Technologie Dahua | https://www.dahuasecurity.com/ | |
| Caméra de surveillance Dahua M/K (objectif 2,8 mm / 3,6 mm) | Technologie Dahua | https://www.dahuasecurity.com/ | |
| Google Colab Pro | https://colab.research.google.com/ | ||
| Matplotlib | Communauté Matplotlib | https://matplotlib.org/ | |
| NVIDIA A100 GPU | NVIDIA | https://www.nvidia.com/en-us/data-center/a100/ | |
| NumPy | Communauté NumPy | https://numpy.org/ | |
| OpenCV | OpenCV.org | https://opencv.org/ | |
| Optuna (Optimisation des hyperparamètres) | Optuna.org | https://optuna.org/ | |
| Pandas | Communauté Pandas | https://pandas.pydata.org/ | |
| PyTorch (v2.0+) | Fondation PyTorch | https://pytorch.org/ | |
| Python (v3.10) | Fondation Python Software | https://www.python.org/ | |
| Jeu de données Roboflow TSL | Roboflow | https://roboflow.com/ | |
| Ubuntu 20.04 LTS | Canonique | https://ubuntu.com/ | |
| Visual Studio Code | Microsoft | https://code.visualstudio.com/ | |
| YOLOv13 | Ultralytiques | https://github.com/ultralytics/YOLOv13 | |
| YOLOv9 | Ultralytiques | https://github.com/ultralytics/YOLOv9 |
Accès restreint. Veuillez vous connecter ou commencer un essai pour afficher ce contenu.