في المكتب
Unison Group -
الإمارات
--
Unison Group

تفاصيل الوظيفة

وصف الوظيفة

نظرة عامة على الدور نحن نبحث عن مهندس بيانات ذو خبرة (من 5 إلى 9 سنوات) مع خبرة عملية عميقة في Apache Spark، Databricks، Delta Lake، وUnity Catalog. المسؤوليات الأساسية تصميم وبناء والحفاظ على خطوط أنابيب بيانات دفعة وبث على Databricks باستخدام Spark (SQL، PySpark، أو Scala) تنفيذ نماذج بيانات قوية وعمليات ETL/ELT على رأس Delta Lake، بما في ذلك تطور المخطط، السفر عبر الزمن، وأنماط CDC إعداد وإدارة Unity Catalog (مساحات العمل، الكتالوجات، المخططات، الأذونات، الأساليب الوراثية) لفرض حوكمة البيانات وأمان عبر lakehouse تحسين أداء خطوط الأنابيب والاستعلامات باستخدام معرفة بنى Spark الداخلية، بما في ذلك: التقسيم، Z-Ordering، التجميع السائل، وضبط تخطيط الملفات استراتيجيات التخزين المؤقت، الانضمام البثّي، وإدارة shuffle بشكل فعال قياس الكتلة/التوسع الآلي وتبادل التكاليف/الأداء العمل مع تنسيقات الجدول والملف المتعددة (Delta، Iceberg، Parquet، ORC، Avro، JSON، وغير ذلك) واختيار التنسيق المناسب بناءً على عبء العمل واحتياجات الحوكمة المساهمة في والحفاظ على خطوط CI/CD لعمليات Databricks، الملاحظات، وسير العمل، و/أو Databricks Asset Bundles (DABs) المؤهلات المطلوبة خبرة عملية قوية في بناء خطوط بيانات باستخدام Apache Spark مع خبرة لا تقل عن 5 سنوات (PySpark/Scala/SQL) في الإنتاج خبرة عملية مع Databricks على الأقل في سحابة رئيسية واحدة (AWS، Azure، أو GCP) فهم عميق لـ: Spark internals (نموذج التنفيذ، DAGs، المراحل، المهام، shuffle، Catalyst optimizer) تحسين الأداء وحل المشكلات (مثلاً تقليل التحريف، الانسكاب، تعزيز التبديل، استراتيجيات الانضمام) خبرة صلبة مع Delta Lake (معاملات ACID، فرض المخطط، السفر عبر الزمن، OPTIMIZE/VACUUM) المعرفة بأنظمة الجداول والتنسيقات بما في ذلك Delta، Iceberg، وParquet، ومتى تستخدم أي منها خبرة عملية في: Liquid Clustering وZ-Ordering لتحسين أداء الاستعلام وكفاءة التكلفة تقنيات تحسين التخزين/التخطيط الأخرى (التقسيم، الانضغاط، معالجة الملفات الصغيرة)

وظائف مشابهة

حول Unison Group
الإمارات
تكنولوجيا المعلومات والخدمات