مشروع يهدف إلى تنظيف ومعالجة البيانات الخام (Raw Data) وتحويلها إلى بيانات جاهزة للتحليل والنمذجة. تم التركيز على تحسين جودة البيانات من خلال التعامل مع القيم المفقودة، وتصحيح الأخطاء، وتوحيد التنسيقات، مما يساعد في الحصول على نتائج دقيقة وموثوقة في أي تحليل لاحق.
تفاصيل العمل
فحص البيانات واكتشاف المشاكل الموجودة
معالجة القيم المفقودة (Missing Values)
إزالة القيم الشاذة (Outliers) أو التعامل معها
حذف البيانات المكررة (Duplicates)
توحيد صيغ البيانات (Dates – Text – Categories)
تحويل البيانات النصية إلى رقمية (Encoding)
التأكد من جاهزية البيانات للتحليل أو Machine Learning
الأدوات المستخدمة
Python
Pandas
NumPy