Ultralytics YOLO27:

Evolução de hiperparâmetros para YOLOv5#

📚 Este guia explica a evolução de hiperparâmetros para YOLOv5 🚀. A evolução de hiperparâmetros é um método de Otimização de hiperparâmetros que usa um Algoritmo genético (GA) para otimização.

Os hiperparâmetros em aprendizagem automática controlam vários aspetos do treino, e encontrar valores ideais para eles pode ser um desafio. Os métodos tradicionais, como as pesquisas em grelha, podem rapidamente tornar-se impraticáveis devido a:

  1. O elevado espaço de pesquisa dimensional
  2. As correlações desconhecidas entre as dimensões
  3. O custo elevado de avaliar a aptidão em cada ponto

Isto torna os algoritmos genéticos uma opção adequada para a pesquisa de hiperparâmetros.

Antes de Começares#

Clona o repositório e instala o requirements.txt num ambiente Python>=3.8.0, incluindo PyTorch>=1.8. Os modelos e os conjuntos de dados são transferidos automaticamente a partir da versão mais recente do YOLOv5.

git clone https://github.com/ultralytics/yolov5 # clone
cd yolov5
pip install -r requirements.txt # install

1. Inicializar hiperparâmetros#

O YOLOv5 tem cerca de 30 hiperparâmetros usados para várias definições de treino. Estes são definidos nos ficheiros *.yaml no diretório /data/hyps. Melhores estimativas iniciais produzirão melhores resultados finais, por isso é importante inicializar corretamente estes valores antes da evolução. Em caso de dúvida, usa simplesmente os valores predefinidos, que estão otimizados para o treino do YOLOv5 no COCO a partir do zero.

# YOLOv5 🚀 by Ultralytics, AGPL-3.0 license
# Hyperparameters for low-augmentation COCO training from scratch
# python train.py --batch 64 --cfg yolov5n6.yaml --weights '' --data coco.yaml --img 640 --epochs 300 --linear
# See tutorials for hyperparameter evolution https://github.com/ultralytics/yolov5#tutorials

lr0: 0.01 # initial learning rate (SGD=1E-2, Adam=1E-3)
lrf: 0.01 # final OneCycleLR learning rate (lr0 * lrf)
momentum: 0.937 # SGD momentum/Adam beta1
weight_decay: 0.0005 # optimizer weight decay 5e-4
warmup_epochs: 3.0 # warmup epochs (fractions ok)
warmup_momentum: 0.8 # warmup initial momentum
warmup_bias_lr: 0.1 # warmup initial bias lr
box: 0.05 # box loss gain
cls: 0.5 # cls loss gain
cls_pw: 1.0 # cls BCELoss positive_weight
obj: 1.0 # obj loss gain (scale with pixels)
obj_pw: 1.0 # obj BCELoss positive_weight
iou_t: 0.20 # IoU training threshold
anchor_t: 4.0 # anchor-multiple threshold
# anchors: 3  # anchors per output layer (0 to ignore)
fl_gamma: 0.0 # focal loss gamma (efficientDet default gamma=1.5)
hsv_h: 0.015 # image HSV-Hue augmentation (fraction)
hsv_s: 0.7 # image HSV-Saturation augmentation (fraction)
hsv_v: 0.4 # image HSV-Value augmentation (fraction)
degrees: 0.0 # image rotation (+/- deg)
translate: 0.1 # image translation (+/- fraction)
scale: 0.5 # image scale (+/- gain)
shear: 0.0 # image shear (+/- deg)
perspective: 0.0 # image perspective (+/- fraction), range 0-0.001
flipud: 0.0 # image flip up-down (probability)
fliplr: 0.5 # image flip left-right (probability)
mosaic: 1.0 # image mosaic (probability)
mixup: 0.0 # image mixup (probability)
copy_paste: 0.0 # segment copy-paste (probability)

2. Definir a aptidão#

A aptidão é o valor que procuramos maximizar. No YOLOv5, definimos uma função de aptidão padrão como uma combinação ponderada de métricas: mAP@0.5 contribui com 10% do peso e mAP@0.5:0.95 contribui com os 90% restantes, com a precisão (P) e o revocação (R) ausentes. Podes ajustar estes valores conforme achares conveniente ou usar a definição de aptidão predefinida em utils/metrics.py (recomendado). Esta aptidão decide qual o resultado guardado em hyp_evolve.yaml; o próprio algoritmo genético classifica os progenitores e as elites apenas por mAP@0.5, pelo que alterar estes pesos não altera a seleção de progenitores.

def fitness(x):
    """Return model fitness as the sum of weighted metrics [P, R, mAP@0.5, mAP@0.5:0.95]."""
    w = [0.0, 0.0, 0.1, 0.9]  # weights for [P, R, mAP@0.5, mAP@0.5:0.95]
    return (x[:, :4] * w).sum(1)

3. Evoluir#

A evolução é realizada em torno de um cenário-base que procuramos melhorar. O cenário-base neste exemplo consiste em fazer fine-tuning do COCO128 durante 10 épocas, usando o YOLOv5s pré-treinado. O comando de treino do cenário-base é:

python train.py --epochs 10 --data coco128.yaml --weights yolov5s.pt --cache

Para evoluir hiperparâmetros específicos deste cenário, começando pelos nossos valores iniciais definidos na Secção 1. e maximizando a aptidão definida na Secção 2., acrescenta --evolve:

# Single-GPU
python train.py --epochs 10 --data coco128.yaml --weights yolov5s.pt --cache --evolve

# Multi-GPU with delay
for i in {0..7}; do
  sleep $((30 * i)) # 30-second delay (optional)
  echo "Starting GPU $i..."
  nohup python train.py --epochs 10 --data coco128.yaml --weights yolov5s.pt --cache --device $i --evolve > "evolve_gpu_$i.log" &
done

# Continuous training (use with caution)
# for i in {0..7}; do
#   sleep $((30 * i))  # 30-second delay (optional)
#   echo "Starting continuous training on GPU $i..."
#   (
#     while true; do
#       python train.py --epochs 10 --data coco128.yaml --weights yolov5s.pt --cache --device $i --evolve > "evolve_gpu_$i.log"
#     done
#   ) &
# done

As definições de evolução predefinidas executam-se durante 300 gerações, e cada geração treina o cenário base uma vez para cada um dos 50 indivíduos da população. Podes modificar as gerações através do argumento --evolve, ou seja, python train.py --evolve 1000.

Os principais operadores genéticos são o cruzamento e a mutação. Cada geração treina cada indivíduo e pontua-o por mAP@0.5, seleciona progenitores por seleção de torneio com as elites mais aptas adicionadas ao grupo de progenitores, e constrói a população seguinte através de cruzamento e mutação, com taxas que se adaptam à medida que a evolução progride. Os resultados são registados em runs/evolve/exp/evolve.csv, e a descendência com maior aptidão é guardada em cada geração como runs/evolve/exp/hyp_evolve.yaml:

# YOLOv5 Hyperparameter Evolution Results
# Best generation: 287
# Last generation: 300
#    metrics/precision,       metrics/recall,      metrics/mAP_0.5, metrics/mAP_0.5:0.95,         val/box_loss,         val/obj_loss,         val/cls_loss
#              0.54634,              0.55625,              0.58201,              0.33665,             0.056451,             0.042892,             0.013441

lr0: 0.01 # initial learning rate (SGD=1E-2, Adam=1E-3)
lrf: 0.2 # final OneCycleLR learning rate (lr0 * lrf)
momentum: 0.937 # SGD momentum/Adam beta1
weight_decay: 0.0005 # optimizer weight decay 5e-4
warmup_epochs: 3.0 # warmup epochs (fractions ok)
warmup_momentum: 0.8 # warmup initial momentum
warmup_bias_lr: 0.1 # warmup initial bias lr
box: 0.05 # box loss gain
cls: 0.5 # cls loss gain
cls_pw: 1.0 # cls BCELoss positive_weight
obj: 1.0 # obj loss gain (scale with pixels)
obj_pw: 1.0 # obj BCELoss positive_weight
iou_t: 0.20 # IoU training threshold
anchor_t: 4.0 # anchor-multiple threshold
# anchors: 3  # anchors per output layer (0 to ignore)
fl_gamma: 0.0 # focal loss gamma (efficientDet default gamma=1.5)
hsv_h: 0.015 # image HSV-Hue augmentation (fraction)
hsv_s: 0.7 # image HSV-Saturation augmentation (fraction)
hsv_v: 0.4 # image HSV-Value augmentation (fraction)
degrees: 0.0 # image rotation (+/- deg)
translate: 0.1 # image translation (+/- fraction)
scale: 0.5 # image scale (+/- gain)
shear: 0.0 # image shear (+/- deg)
perspective: 0.0 # image perspective (+/- fraction), range 0-0.001
flipud: 0.0 # image flip up-down (probability)
fliplr: 0.5 # image flip left-right (probability)
mosaic: 1.0 # image mosaic (probability)
mixup: 0.0 # image mixup (probability)
copy_paste: 0.0 # segment copy-paste (probability)

Recomendamos um mínimo de 300 gerações de evolução para obteres os melhores resultados. Tem em atenção que a evolução é geralmente dispendiosa e demorada, uma vez que o cenário base é treinado milhares de vezes, exigindo possivelmente centenas ou milhares de horas de GPU.

Quando a evolução terminar, reutiliza as definições descobertas apontando o treino para o ficheiro guardado, por exemplo python train.py --hyp runs/evolve/exp/hyp_evolve.yaml --data your.yaml --weights yolov5s.pt.

4. Visualizar#

evolve.csv é representado como evolve.png por utils.plots.plot_evolve() após a conclusão da evolução, com um gráfico por hiperparâmetro que mostra a aptidão (eixo y) em função dos valores do hiperparâmetro (eixo x). O amarelo indica concentrações mais elevadas. As distribuições verticais indicam que um parâmetro foi desativado e não sofre mutação. Esta opção pode ser selecionada pelo utilizador no dicionário meta em train.py e é útil para fixar parâmetros e impedir a sua evolução.

Resultados de aptidão da evolução de hiperparâmetros do YOLOv5

Ambientes suportados#

A Ultralytics disponibiliza vários ambientes prontos a utilizar, cada um com dependências essenciais pré-instaladas, como CUDA, CUDNN, Python e PyTorch, para iniciares os teus projetos.

Estado do projeto#

YOLOv5 CI

Este selo indica que todos os testes de Integração Contínua (CI) das GitHub Actions do YOLOv5 estão a passar com sucesso. Estes testes de CI verificam rigorosamente a funcionalidade e o desempenho do YOLOv5 em vários aspetos importantes: treino, validação, inferência, exportação e benchmarks. Garantem um funcionamento consistente e fiável no macOS, Windows e Ubuntu, com testes realizados a cada 24 horas e após cada novo commit.

Perguntas frequentes#

  • Cada geração treina o cenário base uma vez por indivíduo na população de 50 membros, pelo que 300 gerações de uma execução de 10 épocas em COCO128 equivalem aproximadamente a 15.000 vezes o custo de uma tal execução. Mantém o cenário base curto e representativo. O ciclo multi-GPU acima inicia uma pesquisa independente em cada GPU em vez de partilhar uma única pesquisa, pelo que deves reduzir --evolve por processo se estiveres a trabalhar com um orçamento fixo.

  • Sim. --evolve tem o valor predefinido de 300 gerações; passa um número como --evolve 1000 para executares mais.

  • Define o primeiro valor da respetiva entrada no dicionário meta em train.py como False. Os parâmetros excluídos mantêm o seu valor inicial e aparecem como linhas verticais em evolve.png.

  • Passa o ficheiro guardado para uma execução de treino normal: python train.py --hyp runs/evolve/exp/hyp_evolve.yaml --data your.yaml --weights yolov5s.pt.

Comentários