Link to this sectionConjunto de dados de profundidade Make3D#
Make3D é um benchmark clássico ao ar livre para estimativa de profundidade monocular. Contém imagens de cenas de campus emparelhadas com profundidade ground truth capturada por um scanner a laser 3D personalizado, e é amplamente utilizado para testar a generalização fora da distribuição.
Link to this sectionPrincipais recursos#
- Profundidade ground truth capturada com um scanner a laser 3D personalizado.
- Cobre cenas reais de campus ao ar livre.
- Alcance de profundidade de aproximadamente até 70 m.
- A avaliação é realizada no conjunto de teste padrão de 134 imagens.
- Um benchmark clássico de generalização fora da distribuição.
Link to this sectionPapel no YOLO26-Depth#
Make3D é um benchmark de avaliação zero-shot para a família YOLO26-Depth; os modelos publicados não são treinados nele. Como um conjunto externo fora da distribuição, é o benchmark mais difícil para todos os modelos, e os valores absolutos de delta1 são baixos em todos os aspectos, o que é esperado para este conjunto de dados.
A avaliação utiliza aumento de dados no momento do teste (TTA) de múltiplas escalas e inversão horizontal, seguido por alinhamento de escala de log-mínimos quadrados entre os mapas de profundidade previstos e os de referência antes que as métricas sejam calculadas.
Link to this sectionResultados#
A tabela abaixo apresenta a precisão delta1 (porcentagem de pixels dentro de um limite de 1,25×, quanto maior, melhor) no conjunto de teste Make3D por tamanho de modelo.
| Modelo | delta1 |
|---|---|
| YOLO26n-depth | 0,307 |
| YOLO26s-depth | 0,311 |
| YOLO26m-depth | 0,293 |
| YOLO26l-depth | 0,297 |
| YOLO26x-depth | 0,299 |
Link to this sectionAvaliação#
O Make3D não é fornecido com um YAML de conjunto de dados incluído. Ele é avaliado por meio de um script de avaliação dedicado que carrega as imagens do Make3D e a profundidade ground truth do scanner a laser, aplica o TTA padrão e o alinhamento de escala log-least-squares, e reporta as métricas de profundidade.
Link to this sectionUso#
Make3D é um benchmark externo, portanto, os modelos são normalmente executados com predict em suas imagens. Para uma lista abrangente de argumentos disponíveis, consulte a página de Predição do modelo.
from ultralytics import YOLO
# Load a model
model = YOLO("yolo26x-depth.pt") # load a pretrained depth model
# Predict depth on Make3D images
results = model.predict("path/to/make3d/images")Link to this sectionModelos pré-treinados#
A família YOLO26 depth é avaliada zero-shot no benchmark Make3D. Estes modelos baixam automaticamente da versão mais recente do Ultralytics, por exemplo YOLO26x-depth da v8.4.0, e abrangem uma gama de tamanhos (yolo26n/s/m/l/x-depth) para diferentes requisitos de precisão e recursos.
Link to this sectionCitações e Agradecimentos#
Se você usar o conjunto de dados Make3D em seu trabalho de pesquisa ou desenvolvimento, por favor cite o seguinte artigo:
@article{saxena2009make3d,
title={Make3D: Learning 3D Scene Structure from a Single Still Image},
author={Saxena, Ashutosh and Sun, Min and Ng, Andrew Y.},
journal={IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)},
year={2009}
}Gostaríamos de agradecer aos autores pela criação e manutenção deste recurso valioso para a comunidade de visão computacional.