Google Cloud Storage 集成#
Google Cloud Storage 集成将你的 GCS 存储桶连接到 Ultralytics Platform。你的图片会保留在存储桶中 — Platform 会就地对它们进行索引,因此你可以直接浏览、标注和训练 YOLO 模型,而无需上传副本。
Google Cloud Storage 数据集需要 Pro 或 Enterprise 计划。免费工作区可以看到此集成,并在连接时提示进行升级。如果订阅到期,现有的 Google Cloud Storage 数据集仍可完全访问 — 只有新的连接和导入才需要 Pro。
创建只读服务账号#
Platform 始终只从你的存储中读取 — 绝不会写入、修改或删除你的对象。请创建一个仅具有读取权限的专用服务账号:
- 在 Google Cloud 控制台中,前往 IAM & Admin > Service Accounts 并创建一个服务账号。
- 在要连接的存储桶上授予其 Storage Object Viewer(
roles/storage.objectViewer)角色。 - 打开该服务账号,选择 Keys > Add key > Create new key,选择 JSON,然后下载密钥文件。
连接到 Platform#
- 前往 Settings > Integrations,然后从集成列表中选择 Google Cloud Storage。
- 粘贴服务账号 JSON 密钥的内容。
- 点击 Find available buckets,然后选择要连接的存储桶。如果服务账号无法列出存储桶,请手动输入已知的存储桶名称。
- 点击 Connect。Platform 在保存任何内容之前会验证它是否可以列出并读取每个选定的存储桶。

稍后重新连接同一个服务账号会将新存储桶添加到现有集成中。仅当已保存的凭据被替换后仍然可以读取你已连接的所有存储桶时,该凭据才会被替换。
凭据在静态时使用 AES-256-GCM 加密,绝不会返回给浏览器,也不会进入训练任务负载。要撤销访问权限,请在 Google Cloud 中删除该服务账号密钥。
从 GCS 存储桶创建数据集#
- 点击 New Dataset 并打开 Cloud storage 选项卡。
- 选择一个已连接的存储桶并浏览到包含你数据的文件夹。
- 确认文件夹,调整数据集名称,然后创建数据集。
Platform 会列出文件夹一次并索引其发现的内容:
- Images —
.jpg、.jpeg、.png、.webp和.avif对象通过有界请求读取尺寸进行索引。Platform 不会保留源图片的第二份副本。 - Labels — YOLO
.txt附属文件会被解析为 Platform 标注,通过标准的images/→labels/布局进行匹配,或者作为同一文件夹下的同级文件匹配。 - Metadata —
data.yaml/data.yml提供类别名称、任务类型和姿态关键点形状,其效果与存档上传完全相同。 - Splits — 对象路径中的
train、val和test文件夹名称会自动分配数据集分割。
该数据集随后表现得与其他数据集一样:你可以浏览并标注它、将其设为公开或私有、与团队共享,并通过托管训练在其上进行训练。原始内容按需流式传输,且索引后的图片不会消耗你的 Platform存储配额。
单次导入可索引多达 50,000 个对象,标签或 YAML 文件每个最大 1 MB。更大的存储桶应拆分到多个数据集中。
每个索引图像都固定到其 GCS 对象生成版本,如果对象在底层发生更改,Platform 将会失败关闭。请添加新对象,而不是覆盖现有对象。
导入失败#
如果导入失败(如文件夹为空、路径拼写错误或权限被撤销),数据集会在其页面上显示错误。编辑者可以点击 Retry import 以使用已存储的存储桶和文件夹重新启动,或者创建一个指向更正路径的新数据集。
训练#
托管训练通过正常的训练流程进行。Worker 将固定的原始文件下载到临时作业存储中进行运行,并在作业清理时将其删除——你的 Google Cloud 凭据永远不会进入计算环境。
当前限制#
GCS 支持的数据集目前不包含需要 Platform 持有图片副本的功能:自动标注、聚类分析、数据集克隆以及不可变的版本快照。
删除 GCS 支持的数据集或其中的单个图像仅会删除 Platform 的引用——你的对象永远不会被触及。
另请参阅 Amazon S3 和 Azure Blob Storage 集成。