في المكتب
Sucafina -
لبنان , بيروت
--
Company

تفاصيل الوظيفة

وصف الوظيفة ونظرة عامة على الدور: يعد مهندس بيانات Microsoft Fabric مسؤولاً عن تصميم وبناء وتحسين وتشغيل منصات بيانات على نطاق المؤسسة باستخدام Microsoft Fabric. يركز هذا الدور على استيعاب البيانات وتحويلها وتخزينها وحوكمتها والأتمتة وموثوقية المنصة باستخدام تقنيات OneLake وLakehouse وData Warehouse وData Pipelines وSpark. يتركز المنصب بشكل كبير على هندسة البيانات وهندسة المنصات أكثر من التطوير للتقارير ولوحات المعلومات. سيبني المرشح الناجح حلول بيانات قابلة للتوسع ومحمية وعالية الأداء تدعم التحليلات والذكاء الاصطناعي والتقارير التشغيلية ومبادرات ذكاء الأعمال عبر المؤسسة. يتركز الدور بشكل أساسي على هندسة البيانات وتطوير منصة البيانات وهندسة معمارية Microsoft Fabric. قد لا يكون المرشحون الذين تكون خبرتهم مركّزة أصلاً على تطوير تقارير Power BI أو إنشاء لوحات معلومات أو تصور البيانات بدون خبرة هندسية بيانات كبيرة مناسبين لهذا المنصب.

المسؤوليات الأساسية

  1. هندسة البيانات وتطوير المنصة تصميم وتنفيذ معماريات Lakehouse على مستوى المؤسسة باستخدام OneLake وDelta Lake. بناء وصيانة أنابيب استيعاب بيانات دفعات، وتصاعدية، وCDC، وتقريب الوقت الحقيقي. تطوير حلول ETL/ELT قابلة للتوسع باستخدام Fabric Data Pipelines وDataflows Gen2 وPySpark وSQL. تنفيذ وإدارة Medallion Architecture (Bronze, Silver, Gold). تطوير أطر استيعاب وتحويل قابلة لإعادة الاستخدام ومبنًاة على البيانات الوصفية. دمج البيانات من أنظمة ERP وSAP وواجهات REST وSQL Server وDataverse وغيرها من تطبيقات المؤسسة. تصميم وصيانة نماذج بيانات المؤسسة التي تدعم أحمال العمل التحليلية والتشغيلية.
  2. هندسة Fabric والتحسين تطوير وتحسين Fabric Lakehouses وData Warehouses. بناء تحويلات Notebook المتقدمة باستخدام PySpark وSpark SQL. تنفيذ قدرات Delta Lake بما في ذلك: الدمج/التحديث، تغذية البيانات بالتغيّر (CDF)، السفر عبر الزمن، تطور المخطط، تحسين Vacuum، تصميم تخزين قابل للتوسع، تقطيع وتقسيم وإدارة الملفات ضمن OneLake. تحسين أحمال Spark وأداء مستودع البيانات.
  3. الأداء والموثوقية والمراقبة ضبط أحمال Spark وSQL على نطاق واسع. تنفيذ المراقبة والتنبيه ولوحات التشغيل باستخدام Fabric Monitoring Hub وMetrics. إجراء اختبارات الأداء وتقييمات القابلية للتوسع. استكشاف أخطاء فشل الأنابيب واختناقات أداء المنصة. تعريف ومراقبة اتفاقيات مستوى الخدمة (SLAs) للأصول والأنابيب الحيوية للبيانات. ضمان توافر عالي وتفوق تشغيلي عبر أحمال البيانات.
  4. DevOps وأتمتة المنصة تنفيذ CI/CD باستخدام تكامل Git في Fabric وخطوط النشر. بناء عمليات نشر آلية عبر بيئات التطوير والاختبار والإنتاج. تطوير أطر اختبار آلي لجودة البيانات والتحقق من المخطط والاختبارالتراجعي. إدارة إعدادات البيئة والأسرار وزparameters النشر. استخدام Azure DevOps أو GitHub Actions لدعم أتمتة الإصدار والحوكمة. تحديد عمليات التراجع وإدارة الإصدارات وتغيير الضوابط.
  5. جودة البيانات والحكومة والأمن تنفيذ أطر تحقق من جودة البيانات آلياً. تطوير مطابقة وChecks للكمال والاتساق. إدارة سلاسل البيانات والبيانات التعريفية ومعايير التوثيق. تنفيذ علامات الحساسية، والضوابط الوصول، والتدقيق، ومتطلبات الامتثال. التأكد من الالتزام بمعايير المنظمة للحكومة والأمان والاحتفاظ والتعامل مع PII. إدارة أذونات مساحة العمل والهويات المُدارة وRLS وCLS عند الحاجة.
  6. القيادة الفنية والتعاون ترجمة متطلبات العمل إلى حلول تقنية قابلة للتوسع. التعاون مع مهندسي البيانات والمحللين ومهندسي التكامل وأصحاب المصلحة من الأعمال. قيادة أفضل ممارسات الهندسة ومعايير المنصة. توجيه المهندسين المبتدئين ودعم مبادرات تبادل المعرفة. إنتاج وثائق الهندسة والتصاميم الفنية. قيادة التحسين المستمر لمنصة البيانات وممارسات الهندسة.

الملف المرغوب للمترشح

المؤهلات والخبرة:

  • درجة البكالوريوس في علوم الحاسوب، هندسة البيانات، نظم المعلومات، أو مجال ذو صلة.
  • خبرة لا تقل عن 5 سنوات في هندسة البيانات.
  • خبرة hands-on لا تقل عن سنتين مع Microsoft Fabric وAzure Data Engineering وDatabricks أو منصات Lakehouse الحديثة.
  • خبرة مثبتة في تصميم وبناء منصات بيانات على مستوى المؤسسة.

المهارات الفنية المطلوبة

  • Microsoft Fabric
  • OneLake
  • Lakehouse
  • Delta Lake
  • Fabric Data Warehouse
  • Data Pipelines
  • Dataflows Gen2
  • Notebooks
  • Monitoring Hub
  • Deployment Pipelines
  • Git Integration
  • Data Engineering
  • PySpark
  • Spark SQL
  • SQL / T-SQL
  • ETL / ELT Development
  • Data Modeling
  • Incremental Processing
  • Change Data Capture (CDC)
  • Data Quality Frameworks
  • Medallion Architecture
  • Performance Optimization
  • Delta Lake Optimization
  • Partitioning Strategies
  • File Management
  • Query Optimization
  • Spark Performance Tuning
  • Workload Management
  • Integration
  • REST APIs
  • SQL Server
  • SAP
  • Azure Storage
  • Dataverse
  • Enterprise Application Integration
  • DevOps
  • Git
  • Azure DevOps
  • GitHub Actions
  • YAML Pipelines
  • CI/CD
  • Automated Testing
  • Security & Governance
  • Row-Level Security (RLS)
  • Column-Level Security (CLS)
  • Sensitivity Labels
  • Managed Identities
  • Data Lineage
  • Audit and Compliance Controls

وظائف مشابهة

حول Sucafina
لبنان, بيروت