Analytics Pipeline | Python, Pandas, Docker
تفاصيل العمل

قمت بتطوير مشروع متكامل لمعالجة وتحليل البيانات باستخدام Python وDocker يعتمد على مفهوم ETL Pipeline (Extract, Transform, Load)، حيث يقوم المشروع باستخراج بيانات المستخدمين من API خارجي، ثم تنظيفها وتحويلها وتحليلها إحصائيًا، وأخيرًا إنشاء Visualizations احترافية بشكل تلقائي. المشروع يعمل داخل Docker Container لتسهيل التشغيل والنشر بدون الحاجة لإعداد بيئة محلية معقدة، مما يجعله Plug-and-Play وقابل للتشغيل على أي جهاز. أهم ما يقدمه المشروع: -استخراج البيانات من API باستخدام Requests -التعامل مع Pagination لجلب جميع البيانات -تنظيف البيانات ومعالجة Missing Values وDuplicates -تنفيذ Feature Engineering وإضافة مؤشرات تحليلية مثل BMI -تحليل البيانات إحصائيًا باستخدام Pandas -إنشاء رسوم بيانية احترافية باستخدام Matplotlib وSeaborn -تصدير النتائج تلقائيًا كصور PNG -تشغيل كامل المشروع باستخدام Docker التقنيات المستخدمة -Python -Pandas -Requests -Matplotlib -Seaborn -Docker مخرجات المشروع يقوم المشروع بتوليد عدة تحليلات ورسوم بيانية تلقائيًا مثل: -توزيع الأعمار -تحليل المستخدمين حسب الجنس -أعلى المدن من حيث عدد المستخدمين -تحليل الطول والوزن -Correlation بين العمر والطول والوزن -تحليل BMI وتصنيفاته

شارك
بطاقة العمل
تاريخ النشر
منذ شهرين
المشاهدات
60
المستقل
Abdallah Ahmed
Abdallah Ahmed
مهندس و محلل بيانات
طلب عمل مماثل
شارك
مركز المساعدة