Ultralytics YOLO27:

使用 Ultralytics YOLO 进行旋转边界框检测#

Ultralytics YOLO oriented bounding box detection of boats in aerial imagery

定向对象检测通过引入额外的角度来更准确地定位图像中的对象,比标准对象检测更进一步。

定向对象检测器的输出是一组旋转边界框,可精确包围图像中的对象,同时为每个框提供类别标签和置信度分数。当对象以各种角度出现时,定向边界框尤其有用,例如在航空影像中,传统的轴对齐边界框可能会包含不必要的背景。

提示

YOLO26 OBB 模型使用 -obb 后缀,即 yolo26n-obb.pt,并在 DOTAv1 上进行预训练。



Watch: How to Detect & Track Objects with Ultralytics YOLO26 Oriented Bounding Boxes (OBB) | Ship Tracking 🚢

可视化示例#

使用 OBB 进行船舶检测使用 OBB 进行车辆检测
使用 OBB 进行船舶检测使用 OBB 进行车辆检测

模型#

此处展示了 YOLO26 预训练 OBB 模型,这些模型在 DOTAv1 数据集上进行预训练。

首次使用时,模型 会自动从最新的 Ultralytics 发布版本 下载。

模型尺寸
(像素)
mAPtest
50-95(e2e)
mAPtest
50(e2e)
速度
CPU ONNX
(毫秒)
速度
T4 TensorRT10
(毫秒)
参数量
(M)
FLOPs
(B)
YOLO26n-obb102452.478.997.7 ± 0.92.8 ± 0.02.414.8
YOLO26s-obb102454.880.9218.0 ± 1.44.9 ± 0.19.856.7
YOLO26m-obb102455.381.0579.2 ± 3.810.2 ± 0.321.2184.9
YOLO26l-obb102456.281.6735.6 ± 3.113.0 ± 0.225.6232.4
YOLO26x-obb102456.781.71485.7 ± 11.530.5 ± 0.957.6520.1
  • mAPtest 值针对 DOTAv1 数据集上的单模型多尺度结果。
    通过 yolo val obb data=DOTAv1.yaml device=0 split=test nms=False 重现,并将合并结果提交至 DOTA 评估
  • 速度为使用 Amazon EC2 P4d 实例在 DOTAv1 验证图像上测得的平均值。
    通过 yolo val obb data=DOTAv1.yaml batch=1 device=0|cpu nms=False 重现
  • ParamsFLOPs 数值适用于在进行卷积与批归一化折叠以及移除未使用的检测分支之后的融合模型。预训练检查点保留完整的训练架构,可能会显示更高的数值。

查看未发布的 YOLO27 预览版以获取 DOTAv1 的初步结果。

训练#

在 DOTA8 数据集上训练 YOLO26n-obb,共进行 100 个训练周期,图像尺寸为 640。有关可用参数的完整列表,请参阅配置页面。

注意

OBB 与其 180° 旋转后的结果相同,因此旋转角度按模 180° 定义,框没有方向。训练标签会规范化为长边形式:框宽度 w 是较长的一边,角度从正 x 轴顺时针测量至 w 边的方向,并以弧度存储在 [-π/4, 3π/4)[-45°, 135°))中。预测结果不会进行规范化,因此预测框可能将短边报告为 w;请参阅结果输出[0°, 90°) 形式是经过正则化的 DOTA 风格约定,不会应用于训练或推理。

示例
from ultralytics import YOLO

# Load a model
model = YOLO("yolo26n-obb.yaml")  # build a new model from YAML
model = YOLO("yolo26n-obb.pt")  # load a pretrained model (recommended for training)
model = YOLO("yolo26n-obb.yaml").load("yolo26n-obb.pt")  # build from YAML and transfer weights

# Train the model
results = model.train(data="dota8.yaml", epochs=100, imgsz=640)


Watch: How to Train Ultralytics YOLO-OBB (Oriented Bounding Boxes) Models on DOTA Dataset using Ultralytics Platform

数据集格式#

OBB 数据集格式的详细信息请参阅数据集指南。YOLO OBB 格式通过四个角点指定边界框,坐标归一化到 0 和 1 之间,结构如下。Ultralytics Platform 标注支持使用专用定向边界框绘制工具创建 OBB 标签:

class_index x1 y1 x2 y2 x3 y3 x4 y4

在内部,YOLO 使用 xywhr 格式处理损失和输出,该格式表示边界框的中心点(xy)、宽度、高度和旋转角度。

验证#

在 DOTA8 数据集上验证已训练的 YOLO26n-obb 模型准确率。无需提供参数,因为 model 会将其训练时的 data 和参数保留为模型属性。

示例
from ultralytics import YOLO

# Load a model
model = YOLO("yolo26n-obb.pt")  # load an official model
model = YOLO("path/to/best.pt")  # load a custom model

# Validate the model
metrics = model.val(data="dota8.yaml")  # validate on the DOTA8 dataset
metrics.box.map  # map50-95(B)
metrics.box.map50  # map50(B)
metrics.box.map75  # map75(B)
metrics.box.maps  # a list containing mAP50-95(B) for each category
metrics.box.image_metrics  # per-image metrics dictionary with precision, recall, F1, TP, FP, and FN

Predict#

使用已训练的 YOLO26n-obb 模型对图像运行预测。

示例
from ultralytics import YOLO

# Load a model
model = YOLO("yolo26n-obb.pt")  # load an official model
model = YOLO("path/to/best.pt")  # load a custom model

# Predict with the model
results = model("https://ultralytics.com/images/boats.jpg")  # predict on an image

# Access the results
for result in results:
    xywhr = result.obb.xywhr  # center-x, center-y, width, height, angle (radians)
    xyxyxyxy = result.obb.xyxyxyxy  # polygon format with 4-points
    names = [result.names[cls.item()] for cls in result.obb.cls.int()]  # class name of each box
    confs = result.obb.conf  # confidence score of each box


Watch: How to Detect and Track Storage Tanks using Ultralytics YOLO-OBB | Oriented Bounding Boxes | DOTA

请在预测页面查看完整的 predict 模式详情。

结果输出#

定向边界框检测会为每张图像返回一个 Results 对象。主要预测字段是 result.obb,其中包含每个检测对象的旋转框、类别 ID 和置信度分数。

属性类型形状描述
result.obbOBB(N)定向框。
result.obb.datatorch.float32(N,7/8)带置信度/类别的原始旋转框。
result.obb.xywhrtorch.float32(N,5)xywhr 旋转框。
result.obb.xyxyxyxytorch.float32(N,4,2)四个角点。
result.obb.conftorch.float32(N,)置信度分数。

标签会规范化为长边约定,但预测结果不会,因此 result.obb.xywhr 可能会报告小于 hw,且旋转角度从短边开始测量。两种形式描述的是同一个矩形,因此无论哪种形式,result.obb.xyxyxyxy 都是正确的。当下游代码需要长边形式时,请将角点转换回来,同时注意重写框参数可能会使角点顺序发生循环移位:

from ultralytics.utils.ops import xyxyxyxy2xywhr

xywhr = xyxyxyxy2xywhr(result.obb.xyxyxyxy)  # w >= h, rotation in [-pi/4, 3pi/4)

有关每项任务中任务专用的 Results 字段,请参阅按任务划分的预测结果部分。

导出#

将 YOLO26n-obb 模型导出为 ONNX、CoreML 等其他格式。

示例
from ultralytics import YOLO

# Load a model
model = YOLO("yolo26n-obb.pt")  # load an official model
model = YOLO("path/to/best.pt")  # load a custom-trained model

# Export the model
model.export(format="onnx")

下表列出了可用的 YOLO26-obb 导出格式。你可以使用 format 参数导出为任意格式,即 format='onnx'format='engine'。你可以直接在已导出的模型上进行预测或验证,即 yolo predict model=yolo26n-obb.onnx。导出完成后,系统会为你的模型显示使用示例。

格式format 参数模型元数据参数
PyTorch-yolo26n-obb.pt-
TorchScripttorchscriptyolo26n-obb.torchscriptimgszquantizedynamicnmsbatchdevice
ONNXonnxyolo26n-obb.onnximgszquantizedynamicsimplifyopsetnmsbatchdatafractiondevice
OpenVINOopenvinoyolo26n-obb_openvino_model/imgszquantizedynamicnmsbatchdatafractiondevice
TensorRTengineyolo26n-obb.engineimgszquantizedynamicsimplifyopsetworkspacenmsbatchdatafractiondevice
CoreMLcoremlyolo26n-obb.mlpackageimgszdynamicquantizenmsbatchdevice
TF SavedModelsaved_modelyolo26n-obb_saved_model/imgszkerasquantizeopsetnmsbatchdatafractiondevice
TF GraphDefpbyolo26n-obb.pbimgszopsetbatchdevice
TF Edge TPUedgetpuyolo26n-obb_edgetpu.tfliteimgszquantizeopsetdatafractiondevice
PaddlePaddlepaddleyolo26n-obb_paddle_model/imgszbatchdevice
MNNmnnyolo26n-obb.mnnimgszbatchdynamicquantizesimplifyopsetnmsdevice
NCNNncnnyolo26n-obb_ncnn_model/imgszquantizebatchdevice
IMX500imxyolo26n-obb_imx_model/imgszquantizedatafractionnmsdevice
RKNNrknnyolo26n-obb_rknn_model/imgszbatchnamequantizesimplifyopsetdatafractiondevice
ExecuTorchexecutorchyolo26n-obb_executorch_model/imgszbatchdevice
Axeleraaxelerayolo26n-obb_axelera_model/imgszbatchquantizedatafractiondevice
DEEPXdeepxyolo26n-obb_deepx_model/imgszquantizesimplifyopsetdataoptimizedevice
Qualcomm QNNqnnyolo26n-obb_qnn.onnximgszbatchnamequantizesimplifyopsetdatafractiondevice
LiteRTlitertyolo26n-obb.tfliteimgszquantizebatchdatafractiondevice
Hailohailoyolo26n-obb_hailo_model/imgsznamequantizedatafractionsimplifyconfiou
Huawei Ascendascendyolo26n-obb_ascend_model/imgszbatchnamequantizeopsetsimplifynms
Apple Core AIcoreaiyolo26n-obb.aimodelimgszbatchquantize

nms=None 默认对外部 NMS 使用原始输出。设置 nms=False 以选择可用的无 NMS 检测头;不支持的格式将回退到其本机输出路径。上面的 nms 条目标识了可以通过 nms=True 嵌入 NMS 的格式。

请在导出页面查看完整的 export 详情。

实际应用#

YOLO26 的 OBB 检测在各个行业中有许多实际应用:

  • 海事与港口管理:以各种角度检测船舶和舰艇,用于船队管理和监控。
  • 城市规划:通过航空影像分析建筑物和基础设施。
  • 农业:通过无人机影像监测农作物和农业设备。
  • 能源行业:以不同方向检查太阳能电池板和风力涡轮机。
  • 交通运输:从各种视角跟踪道路和停车场中的车辆。

这些应用受益于 OBB 能够精确贴合任意角度的对象,相比传统边界框可提供更准确的检测结果。

常见问题#

  • 定向边界框(OBB)包含一个额外角度,可提升图像中对象定位的准确性。常规边界框是轴对齐矩形,而 OBB 可以旋转,从而更好地贴合对象的方向。这对于需要精确定位对象的应用特别有用,例如航空或卫星影像(数据集指南)。

  • 要使用自定义数据集训练 YOLO26n-obb 模型,请参考下面使用 Python 或 CLI 的示例:

    示例
    from ultralytics import YOLO
    
    # Load a pretrained model
    model = YOLO("yolo26n-obb.pt")
    
    # Train the model
    results = model.train(data="path/to/custom_dataset.yaml", epochs=100, imgsz=640)

    有关更多训练参数,请查看配置部分。

  • YOLO26-OBB 模型在 DOTAv1 等数据集上进行预训练,但你可以使用任何采用 OBB 格式的数据集。有关 OBB 数据集格式的详细信息,请参阅数据集指南

  • 使用 Python 或 CLI 可以轻松将 YOLO26-OBB 模型导出为 ONNX 格式:

    示例
    from ultralytics import YOLO
    
    # Load a model
    model = YOLO("yolo26n-obb.pt")
    
    # Export the model
    model.export(format="onnx")

    有关更多导出格式和详细信息,请参阅导出页面。

  • 要验证 YOLO26n-obb 模型,你可以使用如下所示的 Python 或 CLI 命令:

    示例
    from ultralytics import YOLO
    
    # Load a model
    model = YOLO("yolo26n-obb.pt")
    
    # Validate the model
    metrics = model.val(data="dota8.yaml")

    请在验证部分查看完整的验证详情。

评论