YOLO Vision 2026:

YOLOv9 vs YOLOv5#

O campo da visão computacional tem testemunhado um crescimento tremendo, com a detecção de objetos atuando como a espinha dorsal para inúmeras aplicações industriais e de pesquisa. Escolher a arquitetura certa frequentemente requer uma avaliação cuidadosa da mean Average Precision (mAP), da velocidade de inferência e da sobrecarga de memória. Nesta comparação, exploramos dois modelos altamente influentes: YOLOv9, celebrado por seus avanços arquitetônicos na retenção de informações de gradiente, e Ultralytics YOLOv5, o padrão da indústria testado em batalha, conhecido por sua incrível facilidade de uso e versatilidade de implantação inigualável.

Inovações Arquitetônicas e Origens Técnicas#

Compreender a mecânica subjacente desses dois modelos fornece um contexto crítico para seus respectivos perfis de desempenho.

YOLOv9: Informação de Gradiente Programável#

Desenvolvido pelos pesquisadores Chien-Yao Wang e Hong-Yuan Mark Liao no Institute of Information Science, Academia Sinica em Taiwan, o YOLOv9 foi lançado em 21 de fevereiro de 2024. O modelo introduz dois conceitos inovadores para abordar o gargalo de informação comum em redes neurais profundas: Programmable Gradient Information (PGI) e a Generalized Efficient Layer Aggregation Network (GELAN).

Ao utilizar PGI, o YOLOv9 garante que informações vitais sejam retidas durante todo o processo de alimentação direta (feed-forward), resultando em atualizações de gradiente altamente precisas. Enquanto isso, a arquitetura GELAN maximiza a eficiência de parâmetros, permitindo que o modelo alcance precisão de ponta com uma sobrecarga computacional surpreendentemente baixa. Podes explorar os detalhes técnicos no artigo oficial do YOLOv9 Arxiv paper ou ver o YOLOv9 GitHub repository.

Saiba mais sobre o YOLOv9

Ultralytics YOLOv5: O Padrão de Produção#

Criado por Glenn Jocher e lançado pela Ultralytics em 26 de junho de 2020, o YOLOv5 revolucionou a acessibilidade da visão computacional. Como um dos primeiros modelos de detecção de objetos construídos nativamente no framework PyTorch, ele contornou as complexidades do antigo framework Darknet em C. O YOLOv5 aproveita uma espinha dorsal (backbone) CSPNet altamente otimizada e um pescoço (neck) PANet, priorizando um equilíbrio perfeito entre velocidade e precisão.

Sua principal conquista, no entanto, é a integração no ecossistema mais amplo da Ultralytics. O YOLOv5 é altamente otimizado para uma rápida efficiency de treinamento e ambientes de baixa memória, tornando-o incrivelmente estável para implantações de borda (edge).

Saiba mais sobre o YOLOv5

Eficiência de memória

Ao avaliar modelos para dispositivos edge, lembre-se de que os modelos Ultralytics YOLO geralmente exigem significativamente menos memória GPU durante o treinamento e a inferência em comparação com arquiteturas pesadas baseadas em Transformer.

Análise de Desempenho: Velocidade vs. Precisão#

Ao projetar um pipeline de visão computacional, os desenvolvedores devem ponderar as compensações entre precisão e latência. A tabela a seguir ilustra as diferenças de desempenho no COCO dataset padrão.

Modelotamanho
(pixels)
mAPval
50-95
Velocidade
CPU ONNX
(ms)
Velocidade
T4 TensorRT10
(ms)
params
(M)
FLOPs
(B)
YOLOv9t64038.3-2.32.07.7
YOLOv9s64046.8-3.547.126.4
YOLOv9m64051.4-6.4320.076.3
YOLOv9c64053.0-7.1625.3102.1
YOLOv9e64055.6-16.7757.3189.0
YOLOv5n64028.073.61.122.67.7
YOLOv5s64037.4120.71.929.124.0
YOLOv5m64045.4233.94.0325.164.2
YOLOv5l64049.0408.46.6153.2135.0
YOLOv5x64050.7763.211.8997.2246.4

Analisando os Compromissos#

O YOLOv9 estabelece dominância absoluta em precisão bruta. O YOLOv9e eleva os limites do mAP para 55,6%, utilizando suas camadas GELAN para preservar detalhes de granulação fina. Isso o torna uma escolha excepcional para medical imaging ou cenários que exigem precisão rigorosa em objetos pequenos.

Por outro lado, o YOLOv5 brilha em sua velocidade de implantação bruta e flexibilidade de hardware. O YOLOv5n (Nano) é famoso por ser leve, executando inferências em apenas 1,12 ms em uma GPU T4 via TensorRT. Se estás a implantar em dispositivos IoT restritos, telemóveis ou Raspberry Pi, a pegada de memória do YOLOv5 torna-o extraordinariamente fiável.

A Vantagem do Ecossistema Ultralytics#

Uma consideração importante ao selecionar um modelo é o ecossistema de software ao redor. Embora o YOLOv9 forneça benchmarks de pesquisa de alto nível, utilizar ambos os modelos através da moderna Ultralytics Python API preenche a lacuna, oferecendo aos desenvolvedores uma experiência unificada e simplificada.

Facilidade de Uso e Exportação#

A Ultralytics abstrai os obstáculos complexos de engenharia. Recursos como data augmentation automática e hyperparameter tuning são tratados nativamente. Mudar modelos para produção é igualmente trivial, com comandos de exportação integrados para converter modelos em formatos ONNX, OpenVINO ou TFLite.

Versatilidade de Tarefas#

Embora ambos os modelos se excelen em object detection, os modelos modernos da Ultralytics são construídos para lidar com uma variedade de desafios de visão computacional. O framework mais amplo fornece suporte nativo para image classification, instance segmentation, pose estimation e oriented bounding boxes (OBB), permitindo que os desenvolvedores resolvam múltiplos problemas de visão sem trocar de base de código.

Casos de uso e recomendações#

Escolher entre o YOLOv9 e o YOLOv5 depende dos requisitos específicos do seu projeto, das restrições de implantação e das preferências de ecossistema.

Quando escolher o YOLOv9#

O YOLOv9 é uma escolha forte para:

  • Pesquisa sobre o Gargalo de Informação: Projetos acadêmicos que estudam as arquiteturas Programmable Gradient Information (PGI) e Generalized Efficient Layer Aggregation Network (GELAN).
  • Estudos de Otimização de Fluxo de Gradiente: Pesquisas focadas em entender e mitigar a perda de informação em camadas de rede profundas durante o treino.
  • Benchmarking de Detecção de Alta Precisão: Cenários onde o forte desempenho do YOLOv9 no benchmark COCO é necessário como ponto de referência para comparações arquiteturais.

Quando escolher o YOLOv5#

O YOLOv5 é recomendado para:

  • Sistemas de Produção Comprovados: Implantações existentes onde o longo histórico de estabilidade, documentação extensa e enorme suporte da comunidade do YOLOv5 são valorizados.
  • Treinamento com Recursos Limitados: Ambientes com recursos de GPU limitados onde o pipeline de treinamento eficiente e os menores requisitos de memória do YOLOv5 são vantajosos.
  • Extensive Export Format Support: Projetos que exigem implementação em vários formatos, incluindo ONNX, TensorRT, CoreML e TFLite.

Quando escolher a Ultralytics (YOLO26)#

Para a maioria dos novos projetos, o Ultralytics YOLO26 oferece a melhor combinação de desempenho e experiência de desenvolvedor:

  • Implantação de borda sem NMS: Aplicações que requerem inferência consistente e de baixa latência sem a complexidade do pós-processamento de Supressão de Não-Máximos.
  • Ambientes apenas com CPU: Dispositivos sem aceleração de GPU dedicada, onde a inferência em CPU até 43% mais rápida do YOLO26 oferece uma vantagem decisiva.
  • Detecção de Pequenos Objetos: Cenários desafiadores como imagens de drones aéreos ou análise de sensores IoT onde ProgLoss e STAL aumentam significativamente a precisão em objetos minúsculos.

Exemplo de Implementação#

A beleza do ecossistema Ultralytics é que você pode alternar entre um modelo YOLOv5 e um modelo YOLOv9 simplesmente alterando a string de pesos.

from ultralytics import YOLO

# Load a pretrained YOLOv9 model (swap to "yolov5s.pt" to use YOLOv5)
model = YOLO("yolov9c.pt")

# Train the model efficiently on a custom dataset
train_results = model.train(data="coco8.yaml", epochs=100, imgsz=640)

# Run inference on new images
predictions = model.predict("https://ultralytics.com/images/zidane.jpg")

# Export to ONNX for seamless deployment
model.export(format="onnx")

Explorando Arquiteturas Mais Recentes#

Embora o YOLOv5 e o YOLOv9 sejam modelos excelentes com vantagens distintas, o campo continua a avançar. Usuários que exploram novos projetos também podem querer avaliar as iterações mais recentes da Ultralytics.

  • YOLO11: Uma evolução poderosa e refinada da linhagem YOLOv8, oferecendo excelente equilíbrio entre velocidade e precisão em todas as tarefas de visão.
  • YOLO26: Lançado em 2026, o YOLO26 é a recomendação definitiva para pipelines modernos. Ele introduz um Design End-to-End NMS-Free, eliminando completamente os gargalos de pós-processamento. Com a Remoção de DFL (Distribution Focal Loss removida para exportação simplificada e melhor compatibilidade com dispositivos de borda e de baixo consumo), ele alcança até 43% mais velocidade na inferência em CPU. A estabilidade do treinamento é potencializada pelo novo MuSGD Optimizer, e ProgLoss + STAL entrega funções de perda aprimoradas com melhorias notáveis no reconhecimento de pequenos objetos, críticos para IoT, robótica e imagens aéreas, tornando-o a arquitetura mais robusta para implantações de borda e em nuvem.

Para equipas que gerem grandes conjuntos de dados e pipelines de implantação complexos, utilizar a Ultralytics Platform oferece uma solução sem código (no-code) para treinar, rastrear e implantar esses modelos de ponta sem esforço.

Colaboradores

Comentários