ناء خط أنابيب بيانات (ETL Pipeline) متكامل.
تفاصيل العمل
صميم ومعالجة كميات كبيرة من البيانات باستخدام Apache Spark. جدولة المهام ومراقبة تدفق البيانات باستخدام Apache Airflow. ربط مصادر بيانات مختلفة وتخزين النتائج النهائية في قاعدة بيانات منظمة (مثل SQL Server) لدعم اتخاذ القرار. التركيز على الـ Scalability وتقليل وقت المعالجة.
مهارات العمل