Этот протокол сравнивает шесть моделей YOLO для обнаружения поведения крупного рогатого скота в режиме реального времени для поддержки благополучия и оптимизации управления фермой.
Для просмотра этого контента требуется подписка на JoVE. Войдите или начните свой бесплатный пробный период.
Методическая статья
Этот протокол сравнивает шесть моделей YOLO для обнаружения поведения крупного рогатого скота в режиме реального времени для поддержки благополучия и оптимизации управления фермой.
Точное определение поведения крупного рогатого скота в режиме реального времени имеет решающее значение для улучшения благополучия животных и оптимизации управления животноводством. Чтобы решить эту проблему, в данном исследовании всесторонне оцениваются шесть разработанных сообществом легких моделей YOLO (You Only Look Once) — YOLOv8n, YOLOv9t, YOLOv10n, YOLOv11n, YOLOv12n и YOLOv13n — для распознавания пяти ключевых моделей поведения крупного рогатого скота (стоять, лежать, добывать пищу, пить и пережевать жвачку) с использованием пользовательского набора данных CBVD-5. Набор данных включает в себя различные условия освещения и естественную среду в коровнике, чтобы отразить реальные сценарии мониторинга. Все модели оценивались с использованием стандартных метрик обнаружения объектов (точность, полнота, mAP@50 и mAP@50-95) и показателей, ориентированных на развертывание, включая время вывода, количество кадров в секунду (FPS), размер модели и продолжительность обучения, чтобы обеспечить сбалансированную оценку точности и эффективности. YOLOv13n достиг наивысшего mAP@50-95 (0,712), в то время как YOLOv11n достиг наибольшего mAP@50 (0,967) и продемонстрировал стабильную сходимость с хорошим компромиссом между точностью обнаружения и скоростью вывода. YOLOv10n продемонстрировал самую высокую скорость инференса (1,2 мс/кадр, ~833 кадра в секунду), что делает его хорошо подходящим для приложений, чувствительных к задержкам, таких как непрерывное наблюдение за коровником. Все модели сохраняли компактные размеры менее 6 МБ и пропускную способность в режиме реального времени более ~300 кадров в секунду, что подтверждает их практичность для развертывания на периферии. Результаты устанавливают воспроизводимую систему сравнительного анализа для оценки современных вариантов YOLO, предлагая понимание выбора моделей для эффективных, масштабируемых и ориентированных на благополучие систем мониторинга скота.
Эффективный мониторинг поведения крупного рогатого скота имеет важное значение в точном животноводстве, поддерживая управление благополучием, выявление болезней и операционную оптимизацию. Неинвазивные подходы, основанные на зрении, особенно перспективны из-за их масштабируемости и универсальности. Стандартизированные наборы данных, такие как CBVD-5 (Cow Behavior Video Dataset with 5 classes), предлагают разнообразные аннотации поведения в различных условиях освещения, что делает их ценными эталонами в этой области1. В большинстве практических условий фермы камеры фиксируются на умеренной высоте с относительно стабильным освещением, хотя случайное скопление крупного рогатого скота может повлиять на производительность обнаружения. Распознавание поведения у домашнего скота по-прежнему сталкивается с такими проблемами, как окклюзия, вариативность движений и разреженность обучающих данных. Для решения этих проблем в предыдущих работах были изученысенсорные подходы2, моделирование образов изображений3 и ансамблевые стратегии глубокого обучения4. Фреймворки для обнаружения объектов, такие как YOLO (You Only Look Once), впервые представленный Redmon et al.5, и его более продвинутая версия YOLOv76, выделяются своей способностью балансировать между точностью обнаружения, задержкой и вычислительной эффективностью. В этом исследовании производительность в реальном времени означает достижение скорости вывода выше 30 кадров в секунду (FPS), что обеспечивает плавное и непрерывное отслеживание поведения на основе видео в практических условиях фермы. В этом исследовании систематически оценивается производительность YOLOv8n по YOLOv13n в наборе данных CBVD-5, уделяя особое внимание ограничениям по обнаружению поведения в режиме реального времени и развертыванию. Последние достижения в архитектуре YOLO, в том числе выпуски открытого сообщества YOLOv87, YOLOv98, YOLOv109, YOLOv1110, YOLOv1211 и YOLOv1312, привели к повышению точности обнаружения и эффективности вычислений. В этих моделях используются такие инновации, как многозадачное обучение, головки без якорей и оптимизированное трансферное обучение, что делает их более подходящими для сред с ограниченными ресурсами, которые обычно встречаются на крупных животноводческих фермах. Однако, насколько нам известно, не было всестороннего исследования, оценивающего эти модели специально для распознавания поведения крупного рогатого скота. Чтобы восполнить этот пробел, мы провели сравнительную оценку последних моделей YOLO (v8n-v13n) для определения поведения крупного рогатого скота с использованием набора данных, предназначенного для моделирования реальных фермерских условий. Модели оцениваются с использованием стандартных показателей обнаружения, таких как средняя точность (mAP), точность, отзыв, время вывода и FPS, чтобы определить, какой вариант лучше всего подходит для приложений мониторинга крупного рогатого скота в режиме реального времени в сельскохозяйственных условиях. Вместо того, чтобы предлагать новую архитектуру, это исследование устанавливает систематическую и воспроизводимую систему бенчмаркинга для последних вариантов YOLO в контексте мониторинга поведения скота, устраняя пробел в текущей литературе, где их сравнительная эффективность остается в значительной степени неизученной.
Семейство детекторов объектов YOLO значительно продвинуло компьютерное зрение в реальном времени, особенно в приложениях, требующих скорости и точности. При распознавании поведения крупного рогатого скота, где мониторинг перемещений скота в режиме реального времени имеет важное значение, баланс этих атрибутов YOLO делает его очень эффективным. В этом обзоре описывается эволюция моделей YOLO, от ранних версий до самых последних, с выделением ключевых инноваций, имеющих отношение к определению поведения крупного рогатого скота. Каждая итерация повышала скорость, точность и надежность обнаружения в условиях фермы, что делает модели YOLO все более подходящими для мониторинга крупного рогатого скота в динамичных условиях.
Ранние поколения YOLO (v1-v3) заложили основу одноступенчатого обнаружения объектов, объединив классификацию и локализацию в единую регрессионную структуру. Эти версии постепенно улучшили скорость вывода, пространственную точность и возможность многомасштабного обнаружения, заложив основу для применения YOLO в анализе поведения скота и других сельскохозяйственных сценариях в реальном времени 13,14,15,16. С выпуском YOLOv4 в 2020 году архитектура претерпела дальнейшие усовершенствования, включая внедрение магистрали Cross Stage Partial (CSP), активацию Mish и передовые методы агрегации функций 17,18,19. Эти обновления повысили производительность модели на небольших наборах данных, что является распространенным сценарием при обнаружении поведения домашнего скота из-за ограниченного количества аннотированных выборок для редких событий. Проект YOLOv5, управляемый сообществом, запущенный компанией Ultralytics в 2020 году, получил широкое распространение благодаря своей модульной структуре и простоте развертывания с помощью фреймворка PyTorch20. Несмотря на то, что YOLOv5 не сопровождался рецензируемой статьей, он стал де-факто базой для задач обнаружения крупного рогатого скота в режиме реального времени благодаря сильному балансу между точностью и гибкостью развертывания. В YOLOv6, выпущенном в 2022 году, приоритет отдавался аппаратному обеспечению с магистралью EfficientRep и горловиной Rep-PAN21,22. За счет включения обнаружения без якоря модель повысила устойчивость в сценариях, включающих окклюзию и частичную видимость, условиях, часто встречающихся в условиях скопления крупного рогатого скота. YOLOv7 еще больше оптимизировал вычислительную эффективность с помощью архитектуры E-ELAN, обеспечив более быстрое обучение и повышенную производительность в нескольких масштабах обнаружения23. В то же время, альтернативные модели, такие как YOLOX24 и YOLOR25, обладают повышенной скоростью обнаружения и обобщением, которые являются важными атрибутами для систем мониторинга скота на открытом воздухе. В выпуске YOLOv8 2023 года от Ultralytics было внесено несколько архитектурных изменений, в том числе головки без якорей, структурная репараметризация и более сильные стратегии расширения. Эти обновления обеспечили значительный прирост как точности обнаружения, так и скорости вывода, что сделало YOLOv8 конкурентоспособным вариантом для анализа поведения крупного рогатого скота в режиме реального времени. Эволюция продолжилась с появлением YOLOv9, YOLOv10, YOLOv11, YOLOv12 и YOLOv13. В YOLOv9 интегрировано многозадачное обучение для совместного улучшения классификации, локализации и вспомогательных задач, таких как обнаружение ключевых точек. YOLOv10 был построен на этом фундаменте путем встраивания модулей адаптации к предметной области и механизмов внимания, учитывающих сегментацию. В YOLOv11 были представлены протоколы обучения с самоконтролем, которые снижали зависимость от полностью размеченных данных, предлагая преимущества в приложениях с разреженными данными, таких как мониторинг поведения крупного рогатого скота. В YOLOv12 особое внимание уделялось улучшенному слиянию функций и динамической репараметризации. Наконец, YOLOv13 включает в себя модули на основе трансформаторов и пространственно-временное внимание, обеспечивая превосходную производительность для высокоскоростного обнаружения с низкой задержкой в сложных сельскохозяйственных сценариях в реальном времени.
В последние годы модели глубокого обучения на основе YOLO стали широко использоваться для автоматизированного мониторинга поведения крупного рогатого скота в режиме реального времени благодаря их эффективности и точности. До появления детекторов на основе YOLO несколько ранних систем на основе машинного зрения продемонстрировали возможность мониторинга скота на основе изображений. Например, Sumi et al. разработали систему мониторинга коров для обнаружения отела с использованием анализа признаков движения26, в то время как Zin et al. предложили структуру идентификации коров на основе глубокого обучения, достигающую 97% точности распознавания27. Эти работы заложили основу для последующих подходов к обнаружению объектов в точном животноводстве. В нескольких исследованиях применялись различные варианты YOLO для классификации поведения, отслеживания движений и распознавания поз в различных условиях. Например, Mu et al. предложили улучшенную облегченную модель распознавания поведения крупного рогатого скота — YOLO28 (CBR-YOLO) на основе YOLOv8, оптимизированную для адаптации к погоде в нескольких сценах. Модель достигла средней точности 90,2% при значительном сокращении количества параметров. Tong et al. представили модель YOLO-BoT29, включающую модули внимания и трансформации в YOLOv8 для обнаружения и отслеживания поведения крупного рогатого скота в сложных условиях, достигнув mAP обнаружения 91,7% при 31,2 кадрах в секунду. Hao et al. интегрировали механизм эффективного многоуровневого внимания (EMA) в YOLOv530 (YOLOv5-EMA), который повысил производительность обнаружения частей тела крупного рогатого скота (например, головы, ног), достигнув значений mAP от 94,8% до 95,5%. Guarnido-Lopez et al.31 оценили YOLOv8 и YOLOv10 на предмет распознавания поведения, связанного с кормлением (например, жевание, кусание, приближение) у быков породы Шароле, сообщив, что YOLOv10 немного превосходит YOLOv8 в mAP@50, mAP@50-95, точности и запоминаемости, в то время как YOLOv8 продемонстрировал более быструю сходимость и меньшую переподготовку. В то время как YOLOv1 - YOLOv8 были широко приняты и валидированы для задач, связанных с животноводством, применимость YOLOv9 - YOLOv13 в этой области остается недостаточно изученной. На сегодняшний день не было всесторонней оценки этих новых моделей для определения поведения крупного рогатого скота, что подчеркивает критический пробел в существующих исследованиях и мотивирует к дальнейшему изучению их реальных результатов.
Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.
1. Подготовка датасета
Примечание: Это исследование не включало в себя новые эксперименты на животных. Все данные были получены из общедоступного набора данных CBVD-5, который был собран и опубликован в соответствии с рекомендациями по уходу за животными его первоначальными авторами. Таким образом, никакого дополнительного этического одобрения для этой работы не требовалось.
2. Выбор модели и настройка
3. Обучение модели
4. Оценка модели
Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.
В этом разделе представлены результаты оценки моделей YOLOv8 - YOLOv13 на наборе данных CBVD-5 для распознавания крупного рогатого скота с несколькими моделями поведения. Анализ сосредоточен на точности обнаружения, сходимости обучения, распределении поведения и пригодности развертывания в средах с ограниченными ресурсами. Качество набора данных и баланс классов соответствуют разделениям, описанным в протоколе (70/20/10), что обеспечивает согласованное представление всех пяти моделей поведения в наборах для обучения, про...
Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.
Общий успех предложенной сравнительной структуры в значительной степени зависит от нескольких этапов протокола, включая высококачественную аннотацию поведения, расширение разнообразных данных и стабильный мониторинг сходимости во время обучения. Эти факторы гарантируют, что различия в производительности моделей отражают истинные архитектурные вариации, а не данные или шум обучения. В этом исследовании систематически оценивались шесть облегченных вариантов YOLO (от v8n до v13n) для обнару...
Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.
Авторы заявляют, что у них нет конкурирующих интересов.
Эта работа была профинансирована грантом Universiti Sains Malaysia Bridging Grant, проект No: R501-LR-RND003-0000001342-0000.
Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.
| Имя | Компания | Каталожный номер | Комментарии |
|---|---|---|---|
| Рекордер Dahua DH-NVR2216-HDS3 | Dahua Technology | https://www.dahuasecurity.com/ | |
| Гигабитный коммутатор Dahua DH-S3000C-16GT | Dahua Technology | https://www.dahuasecurity.com/ | |
| Камера наблюдения Dahua M/K (объектив 2,8 мм / 3,6 мм) | Dahua Technology | https://www.dahuasecurity.com/ | |
| Google Colab Pro | https://colab.research.google.com/ | ||
| Matplotlib | Сообщество Матплотлиб | https://matplotlib.org/ | |
| Видеокарта NVIDIA A100 | NVIDIA | https://www.nvidia.com/en-us/data-center/a100/ | |
| NumPy | Сообщество NumPy | https://numpy.org/ | |
| OpenCV | OpenCV.org | https://opencv.org/ | |
| Optuna (гиперпараметрическая оптимизация) | Optuna.org | https://optuna.org/ | |
| Панды | Сообщество панд | https://pandas.pydata.org/ | |
| PyTorch (v2.0+) | Фонд PyTorch | https://pytorch.org/ | |
| Python (версия 3.10) | Фонд программного обеспечения Python | https://www.python.org/ | |
| Набор данных Roboflow TSL | Roboflow | https://roboflow.com/ | |
| Ubuntu 20.04 LTS | Канонический | https://ubuntu.com/ | |
| Visual Studio Code | Microsoft | https://code.visualstudio.com/ | |
| YOLOv13 | Ultralytics | https://github.com/ultralytics/YOLOv13 | |
| YOLOv9 | Ultralytics | https://github.com/ultralytics/YOLOv9 |
Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.