تكامل Google Cloud Storage#
يعمل تكامل Google Cloud Storage على ربط حاويات GCS الخاصة بك بـ Ultralytics Platform. تظل صورك في حاوياتك — حيث تقوم المنصة بفهرستها في مكانها، مما يتيح لك تصفح وتسمية وتدريب نماذج YOLO دون الحاجة إلى تحميل نسخة منها.
تتطلب مجموعات بيانات Google Cloud Storage خطة Pro أو Enterprise. ستظهر ميزة التكامل لمساحات العمل المجانية مع مطالبة بالترقية عند الاتصال. تظل مجموعات بيانات Google Cloud Storage الموجودة متاحة بالكامل إذا انتهى اشتراكك — فقط الاتصالات وعمليات الاستيراد الجديدة تتطلب خطة Pro.
إنشاء حساب خدمة للقراءة فقط#
لا تقوم المنصة إلا بالقراءة من مساحة التخزين الخاصة بك — فهي لا تقوم أبداً بكتابة أو تعديل أو حذف ملفاتك. قم بإنشاء حساب خدمة مخصص يتمتع بصلاحية القراءة فقط:
- في وحدة تحكم Google Cloud، انتقل إلى IAM & Admin > Service Accounts وأنشئ حساب خدمة.
- امنحه دور Storage Object Viewer (
roles/storage.objectViewer) على الحاويات التي تريد ربطها. - افتح حساب الخدمة، اختر Keys > Add key > Create new key، حدد JSON، وقم بتنزيل ملف المفتاح.
الاتصال بالمنصة#
- انتقل إلى Settings > Integrations وحدد Google Cloud Storage من قائمة التكاملات.
- الصق محتويات مفتاح JSON الخاص بحساب الخدمة.
- انقر فوق Find available buckets، ثم حدد الحاويات المراد الاتصال بها. إذا تعذر على حساب الخدمة سرد الحاويات، فأدخل اسم حاوية معروف يدوياً.
- انقر فوق Connect. تتحقق المنصة من قدرتها على سرد وقراءة كل حاوية محددة قبل حفظ أي شيء.

إعادة ربط نفس حساب الخدمة لاحقاً يضيف حاويات جديدة إلى التكامل الحالي. لا يتم استبدال بيانات الاعتماد المحفوظة إلا إذا كان البديل قادراً على قراءة كل حاوية ربطتها بالفعل.
يتم تشفير بيانات الاعتماد أثناء التخزين باستخدام AES-256-GCM، ولا يتم إرجاعها أبداً إلى المتصفح، ولا تدخل أبداً في حمولات مهام التدريب. لإلغاء الوصول، احذف مفتاح حساب الخدمة في Google Cloud.
إنشاء مجموعة بيانات من حاوية GCS#
- انقر فوق New Dataset وافتح علامة التبويب Cloud storage.
- اختر حاوية متصلة وانتقل إلى المجلد الذي يحتوي على بياناتك.
- أكد المجلد، واضبط اسم مجموعة البيانات، وأنشئ مجموعة البيانات.
تدرج المنصة المجلد مرة واحدة وتفهرس ما تجده:
- Images — تتم فهرسة كائنات
.jpgو.jpegو.pngو.webpو.avifمع قراءة الأبعاد من خلال طلبات محددة. لا تحتفظ المنصة بنسخة ثانية من صورة المصدر. - Labels — يتم تحليل ملفات YOLO الجانبية بتنسيق
.txtإلى تعليقات توضيحية (annotations) في المنصة، ويتم مطابقتها حسب التخطيط القياسيimages/→labels/أو كملفات مصاحبة في المجلد نفسه. - Metadata — يوفر ملف
data.yaml/data.ymlأسماء الفئات، ونوع المهمة، وشكل النقاط الرئيسية (keypoint shape)، تماماً مثل تحميل الأرشيف. - Splits — تقوم أسماء المجلدات
trainوvalوtestالموجودة في مسار الكائن بتعيين التقسيمات تلقائياً.
تعمل مجموعة البيانات بعد ذلك مثل أي مجموعة أخرى: يمكنك تصفحها وتسميتها، وتعيينها كعامة أو خاصة، ومشاركتها مع فريقك، والتدريب عليها من خلال التدريب المُدار. يتم بث النسخ الأصلية عند الطلب، ولا تستهلك الصور المفهرسة حصة التخزين الخاصة بك على المنصة.
تقوم عملية استيراد واحدة بفهرسة ما يصل إلى 50,000 كائن، وملفات التسميات أو YAML حتى 1 ميجابايت لكل منها. يجب تقسيم الحاويات الأكبر عبر مجموعات بيانات متعددة.
يتم تثبيت كل صورة مفهرسة على إصدار كائن GCS الخاص بها، وتتوقف المنصة عن العمل إذا تغير كائن ما تحتها. أضف كائنات جديدة بدلاً من الكتابة فوق الموجودة.
إخفاقات الاستيراد#
إذا فشلت عملية الاستيراد — بسبب مجلد فارغ، أو خطأ مطبعي في المسار، أو صلاحيات ملغاة — تعرض مجموعة البيانات الخطأ في صفحتها. يمكن للمحررين النقر فوق Retry import لإعادة تشغيلها باستخدام الحاوية والمجلد المخزنين، أو إنشاء مجموعة بيانات جديدة تشير إلى المسار المصحح.
التدريب#
يعمل التدريب المُدار من خلال تدفق التدريب العادي. يقوم العمال بتنزيل النسخ الأصلية المثبتة إلى وحدة تخزين المهام المؤقتة للتشغيل وإزالتها عند تنظيف المهمة — بيانات اعتماد Google Cloud الخاصة بك لا تصل أبداً إلى بيئة الحوسبة.
القيود الحالية#
تستبعد مجموعات البيانات المدعومة بـ GCS حالياً الميزات التي تتطلب نسخاً مملوكة للمنصة من صورك: التسمية التلقائية، تحليل التجمعات، استنساخ مجموعات البيانات، ولقطات الإصدارات غير القابلة للتغيير.
حذف مجموعة بيانات مدعومة بـ GCS، أو صور فردية منها، يزيل مراجع المنصة فقط — لا يتم لمس كائناتك أبداً.
راجع أيضاً عمليات تكامل Amazon S3 و Azure Blob Storage.