YOLO Vision 2026:

KITTI 数据集#

Open KITTI Dataset In Colab

Ultralytics KITTI 数据集是一个用于自动驾驶的 2D object detection 数据集,包含 7,481 张标注图像(5,985 张用于训练,1,496 张用于验证),涵盖 8 个类别——car、van、truck、pedestrian、person_sitting、cyclist、tram 和 misc。该数据集由卡尔斯鲁厄理工学院和芝加哥丰田技术研究所发布,其图像来自现实世界的城市、乡村和高速公路驾驶场景。



Watch: How to Train Ultralytics YOLO on the KITTI Dataset | Object Detection, Inference & ONNX Export 🚀

更广泛的 KITTI Vision Benchmark Suite 还涵盖深度估计、光流、立体视觉和视觉里程计,但此处的 Ultralytics kitti.yaml 配置设置为 2D 目标检测,并且完全兼容 Ultralytics YOLO26

数据集结构#

警告

原始的 KITTI 测试集未包含在此处,因为它没有公开的标注数据(ground-truth annotations)。

该数据集包含 7,481 张标注图像,涵盖汽车、行人和骑自行车的人等对象,并分为由 kitti.yaml 配置定义的两个预定义子集:

拆分图像描述
训练5,985用于模型训练的标注图像
验证1,496用于评估和基准测试的预留图像

物体类别#

kitti.yaml 文件定义了 8 个对象类别,涵盖驾驶场景中常见的车辆、人员和其他道路使用者:

KITTI 类别
  1. car
  2. van
  3. truck
  4. pedestrian
  5. person_sitting
  6. cyclist
  7. tram
  8. misc

应用#

KITTI 数据集支持自动驾驶和机器人领域中一系列 2D 检测应用:

  • 自动驾驶感知:训练模型以检测并跟踪汽车、行人和骑行者,从而使自动驾驶系统能够安全行驶。
  • ADAS 开发:利用真实驾驶影像构建驾驶辅助功能,例如碰撞预警和行人检测。
  • 交通与道路场景分析:检测并统计车辆和道路使用者,以研究交通流量和道路安全。
  • Computer vision benchmarking:使用 KITTI 作为评估 2D object detectiontracking 模型的标准基准。

要在浏览器中标记你自己的驾驶图像、训练和管理数据集版本,请使用 Ultralytics Platform 运行完整的工作流。

数据集 YAML#

Ultralytics 使用 YAML 文件定义 KITTI 数据集配置。此文件指定训练所需的数据集路径、类标签和元数据。配置文件可在 https://github.com/ultralytics/ultralytics/blob/main/ultralytics/cfg/datasets/kitti.yaml 获取。

ultralytics/cfg/datasets/kitti.yaml
# Ultralytics 🚀 AGPL-3.0 License - https://ultralytics.com/license

# KITTI dataset by Karlsruhe Institute of Technology and Toyota Technological Institute at Chicago
# Documentation: https://docs.ultralytics.com/datasets/detect/kitti
# Example usage: yolo train data=kitti.yaml
# parent
# ├── ultralytics
# └── datasets
#     └── kitti ← downloads here (390.5 MB)

# Train/val/test sets as 1) dir: path/to/imgs, 2) file: path/to/imgs.txt, or 3) list: [path/to/imgs1, path/to/imgs2, ..]
path: kitti # dataset root dir
train: images/train # train images (relative to 'path') 5985 images
val: images/val # val images (relative to 'path') 1496 images

names:
  0: car
  1: van
  2: truck
  3: pedestrian
  4: person_sitting
  5: cyclist
  6: tram
  7: misc

# Download script/URL (optional)
download: https://github.com/ultralytics/assets/releases/download/v0.0.0/kitti.zip

用法#

要在 KITTI 数据集上训练 YOLO26n 模型 100 个 epochs,图像大小为 640,请使用以下命令。数据集(390.5 MB)会在首次使用时自动下载。有关更多详细信息,请参阅 Training 页面。

训练示例
from ultralytics import YOLO

# Load a pretrained YOLO26 model
model = YOLO("yolo26n.pt")

# Train on kitti dataset
results = model.train(data="kitti.yaml", epochs=100, imgsz=640)

你还可以使用相同的配置文件直接从命令行或 Python API 执行评估、inferenceexport 任务。

样本图像和标注#

下方的示例展示了数据集中带有 2D 边界框标注的驾驶场景。KITTI 图像涵盖了在真实交通中捕获的城市、乡村和高速公路场景,为模型提供了多样的目标尺度、视角和光照条件。

KITTI dataset vehicle detection sample

引用与致谢#

如果你在研究中使用了 KITTI 数据集,请引用以下论文:

引用
@article{Geiger2013IJRR,
  author = {Andreas Geiger and Philip Lenz and Christoph Stiller and Raquel Urtasun},
  title = {Vision meets Robotics: The KITTI Dataset},
  journal = {International Journal of Robotics Research (IJRR)},
  year = {2013}
}

我们感谢 KITTI Vision Benchmark Suite 提供这个全面的数据集,它持续塑造着计算机视觉、机器人技术和自主系统领域的进展。访问 KITTI website 了解更多信息。

常见问题解答#

  • Ultralytics KITTI 数据集用于训练和评估自动驾驶领域的 2D 目标检测模型。它提供了涵盖 8 个类别(包括汽车、行人和骑行者)的 7,481 张带标注图像,并被广泛用于感知模型基准测试。

  • Ultralytics KITTI 配置包含 7,481 张图像(5,985 张用于训练,1,496 张用于验证),没有单独的测试集。每张图像均针对 8 个类别进行了标注:car、van、truck、pedestrian、person_sitting、cyclist、tram 和 misc。

  • 不包含。Ultralytics KITTI 配置仅提供训练(5,985 张图像)和验证(1,496 张图像)子集。原始的 KITTI 测试集因缺少公开标注数据而被排除。

  • 数据集(390.5 MB)在你第一次使用 data="kitti.yaml" 进行训练时会自动下载——无需手动步骤。Ultralytics 会获取图像和标签并将其解压到你的本地数据集目录中。你可以在 detection datasets overview 中浏览相关数据集。

  • 是的,KITTI 与 Ultralytics YOLO26 完全兼容。你可以使用提供的 YAML 配置文件直接 trainvalidate 模型。

  • 你可以在 https://github.1s4k.ru/ultralytics/ultralytics/blob/main/ultralytics/cfg/datasets/kitti.yaml 访问 kitti.yaml 文件。它定义了数据集路径和用于训练的 8 个类名。

评论