Azure Blob Storage 集成#
Azure Blob Storage 集成将你的存储账户容器连接到 Ultralytics Platform。你的图片保留在你的容器中 —— Platform 会就地为其建立索引,因此你无需上传副本即可浏览、标注和训练 YOLO 模型。
Azure Blob Storage 数据集需要 Pro 或 Enterprise plan。免费工作区可以看到集成,并在连接时提示升级。如果订阅结束,现有的 Azure Blob Storage 数据集仍可完全访问 —— 只有新连接和导入才需要 Pro。
获取连接字符串#
平台仅从你的存储中进行读取——它绝不会写入、修改或删除你的 blob。当前的集成需要一个账户访问密钥连接字符串,尽管平台仅使用列表(list)和读取(read)操作,但该字符串会授予账户级的特权:
- 在 Azure 门户中,打开你的存储账户。
- 转到 Security + networking > Access keys(安全+网络 > 访问密钥)。
- 复制一个 connection string(连接字符串)。
连接使用标准 blob.core.windows.net 端点。不支持主权云(Azure China、Azure Government)和自定义 blob 端点。
连接到 Platform#
- 前往 Settings > Integrations 并从集成列表中选择 Microsoft Azure。
- 粘贴连接字符串。
- 点击 Find available containers,然后选择要连接的容器。你也可以手动输入容器名称。
- 点击 Connect(连接)。平台在保存任何内容之前,会验证其是否可以列出并读取每个选定的容器。

稍后重新连接同一个存储账户会将新容器添加到现有集成中。仅当替换后的凭据仍然可以读取你已连接的所有容器时,已保存的凭据才会被替换。
如果账户密钥在平台外部泄露,它可能被用于授权写入和删除操作或创建 SAS 令牌。凭据在静态时会使用 AES-256-GCM 进行加密,绝不会返回给浏览器,也绝不会进入训练作业载荷。请尽可能使用专用的存储账户。若要撤销访问权限,请在 Azure 中轮换存储账户访问密钥。
从 Blob 容器创建数据集#
- 点击 New Dataset 并打开 Cloud storage 选项卡。
- 选择一个已连接的容器并浏览到包含你数据的文件夹。
- 确认文件夹,调整数据集名称,然后创建数据集。
Platform 会列出文件夹一次并索引其发现的内容:
- Images —
.jpg、.jpeg、.png、.webp和.avifblob 通过有界请求读取的尺寸进行索引。Platform 不会保留源图片的第二个副本。 - Labels — YOLO
.txt附属文件会被解析为 Platform 标注,通过标准的images/→labels/布局进行匹配,或者作为同一文件夹下的同级文件匹配。 - Metadata —
data.yaml/data.yml提供类别名称、任务类型和姿态关键点形状,其效果与存档上传完全相同。 - Splits — blob 路径中的
train、val和test文件夹名称会自动分配拆分。
该数据集随后表现得与其他数据集一样:你可以浏览并标注它、将其设为公开或私有、与团队共享,并通过托管训练在其上进行训练。原始内容按需流式传输,且索引后的图片不会消耗你的 Platform存储配额。
单次导入最多可索引 50,000 个 blob,标签或 YAML 文件每个最多 1 MB。较大的容器应拆分为多个数据集。
每个已索引的图像都会固定在其 blob ETag 上,如果 blob 在后台发生变化,平台会失败以确保安全。请添加新的 blob,而不是覆盖现有文件。
导入失败#
如果导入失败(例如空文件夹、路径拼写错误或权限被撤销),数据集页面会显示错误。编辑者可以点击 Retry import(重试导入),使用存储的容器和文件夹重新启动,或者创建一个指向已更正路径的新数据集。
训练#
托管训练通过正常的训练流程进行。工作节点会在运行期间将固定的原始文件下载到临时作业存储中,并在作业清理时将其删除——你的 Azure 凭据绝不会到达计算环境。
当前限制#
Azure 支持的数据集目前不包含需要 Platform 拥有你的图片副本的功能:自动标注、clustering analysis、数据集克隆以及不可变的 version snapshots。
删除 Azure 支持的数据集或其中的单个图像仅会移除平台的引用——你的 blob 绝不会被触及。
另请参阅 Google Cloud Storage 和 Amazon S3 集成。