Tarefas de Visão Computacional Suportadas pelo Ultralytics YOLO26#
O Ultralytics YOLO26 é um framework de IA versátil que suporta várias tarefas de computer vision. O framework pode ser usado para realizar detection, segmentation, semantic segmentation, depth estimation, classification, estimação de pose e OBB. Cada uma dessas tarefas tem um objetivo e caso de uso diferentes, permitindo que resolves vários desafios de visão computacional com um único framework.
Watch: Explore Ultralytics YOLO26 Tasks: Object Detection, Segmentation, Depth Estimation, Classification, Pose Estimation, and OBB.
Detecção#
A detecção é a principal tarefa suportada pelo YOLO26. Ela envolve identificar objetos em uma imagem ou quadro de vídeo e desenhar caixas delimitadoras ao redor deles. Os objetos detectados são classificados em diferentes categorias com base em suas características. O YOLO26 pode detectar vários objetos em uma única imagem ou quadro de vídeo com alta precisão e velocidade, tornando-o ideal para aplicações em tempo real como sistemas de vigilância e veículos autônomos.
Segmentação de imagem#
A segmentação leva a detecção de objetos mais longe ao produzir máscaras em nível de pixel para cada objeto. Essa precisão é útil para aplicações como imagens médicas, análise agrícola e controle de qualidade na fabricação.
Segmentação Semântica#
A segmentação semântica atribui um rótulo de classe a cada pixel em uma imagem, produzindo um mapa de classe denso de toda a cena. Ao contrário da segmentação de instâncias, ela não distingue entre objetos individuais da mesma classe. Isso a torna ideal para direção autônoma, análise de cenas e mapeamento de cobertura da terra, onde entender o layout espacial completo importa mais do que identificar objetos individuais.
Exemplos de Segmentação Semântica
Estimativa de Profundidade Monocular#
A estimativa de profundidade monocular prevê um mapa de profundidade por pixel em metros a partir de uma única imagem RGB. A saída é um mapa de ponto flutuante denso alinhado à imagem de entrada, tornando-o adequado para reconstrução de cenas 3D, navegação de robôs e aplicações de AR/VR onde o layout espacial deve ser inferido a partir de uma única câmera.
Exemplos de Estimativa de Profundidade
Classificação#
A classificação envolve categorizar imagens inteiras com base em seu conteúdo. Essa tarefa é essencial para aplicações como categorização de produtos no e-commerce, moderação de conteúdo e monitoramento de vida selvagem.
Estimativa de pose#
A estimativa de pose detecta pontos-chave específicos em imagens ou quadros de vídeo para rastrear movimentos ou estimar poses. Esses pontos-chave podem representar articulações humanas, características faciais ou outros pontos de interesse significativos. O YOLO26 se destaca na detecção de pontos-chave com alta precisão e velocidade, tornando-o valioso para aplicações de fitness, análise esportiva e interação homem-computador.
OBB#
A detecção de Caixa Delimitadora Orientada (OBB) aprimora a detecção de objetos tradicional adicionando um ângulo de orientação para localizar melhor objetos rotulados. Essa capacidade é particularmente valiosa para análise de imagens aéreas, processamento de documentos e aplicações industriais onde os objetos aparecem em vários ângulos. O YOLO26 oferece alta precisão e velocidade para detectar objetos rotacionados em diversos cenários.
Conclusão#
O Ultralytics YOLO26 suporta várias tarefas de visão computacional, incluindo deteção, segmentação de instâncias, segmentação semântica, estimativa de profundidade monocular, classificação, deteção de pontos-chave e deteção de objetos orientados. Cada tarefa responde a necessidades específicas no panorama da visão computacional, desde a identificação básica de objetos até à inferência densa de profundidade por píxel. Ao compreender as capacidades e aplicações de cada tarefa, podes selecionar a abordagem mais adequada para os teus desafios específicos de visão computacional e aproveitar as poderosas funcionalidades do YOLO26 para construir soluções eficazes.
O que vem a seguir#
Escolheste uma tarefa? Formata os teus dados para ela com o guia de datasets e depois treina com as tuas próprias imagens.
FAQ#
O Ultralytics YOLO26 é um framework de IA versátil capaz de realizar várias tarefas de visão computacional com alta precisão e velocidade. Essas tarefas incluem:
- Detecção de Objetos: Identificar e localizar objetos em imagens ou quadros de vídeo desenhando caixas delimitadoras ao redor deles.
- Segmentação de imagem: Segmentar imagens em diferentes regiões com base em seu conteúdo, útil para aplicações como imagens médicas.
- Segmentação Semântica: Atribuir um rótulo de classe a cada pixel em uma imagem para compreensão densa de cenas.
- Estimativa de Profundidade Monocular: Prever um mapa de profundidade por pixel em metros a partir de uma única imagem RGB.
- Classificação: Categorizar imagens inteiras com base em seu conteúdo.
- Estimativa de pose: Detectar pontos-chave específicos em uma imagem ou quadro de vídeo para rastrear movimentos ou poses.
- Detecção de Objetos Orientados (OBB): Detectar objetos rotacionados com um ângulo de orientação adicionado para maior precisão.
Para usar o Ultralytics YOLO26 para detecção de objetos, segue estes passos:
- Prepara o teu conjunto de dados no formato apropriado.
- Treina o modelo YOLO26 usando a tarefa de detecção.
- Usa o modelo para fazer previsões inserindo novas imagens ou frames de vídeo.
Exemplofrom ultralytics import YOLO # Load a pretrained YOLO model (adjust model type as needed) model = YOLO("yolo26n.pt") # n, s, m, l, x versions available # Perform object detection on an image results = model.predict(source="image.jpg") # Can also use video, directory, URL, etc. # Display the results results[0].show() # Show the first image resultsPara instruções mais detalhadas, confere os nossos exemplos de detecção.
Usar o YOLO26 para tarefas de segmentação oferece várias vantagens:
- Alta Precisão: A tarefa de segmentação fornece máscaras precisas em nível de pixel.
- Velocidade: O YOLO26 é otimizado para aplicações em tempo real, oferecendo processamento rápido mesmo para imagens de alta resolução.
- Múltiplas Aplicações: É ideal para imagiologia médica, condução autônoma e outras aplicações que requerem segmentação de imagem detalhada.
Sabe mais sobre os benefícios e casos de uso do YOLO26 para segmentação na seção de segmentação de imagem.
Sim, o Ultralytics YOLO26 pode realizar eficazmente a estimativa de pose e a detecção de pontos-chave com alta precisão e velocidade. Este recurso é particularmente útil para rastrear movimentos em análise esportiva, saúde e aplicações de interação humano-computador. O YOLO26 detecta pontos-chave em uma imagem ou frame de vídeo, permitindo uma estimativa de pose precisa.
Para mais detalhes e dicas de implementação, visita os nossos exemplos de estimativa de pose.
A Detecção de Objetos Orientados (OBB) com o YOLO26 fornece precisão aprimorada ao detectar objetos com um parâmetro de ângulo adicional. Esse recurso é benéfico para aplicações que exigem localização precisa de objetos rotacionados, como análise de imagens aéreas e automação de armazéns.
- Maior Precisão: O componente de ângulo reduz falsos positivos para objetos rotacionados.
- Aplicações Versáteis: Útil para tarefas em análise geoespacial, robótica, etc.
Confere a seção de Detecção de Objetos Orientados para mais detalhes e exemplos.