الهدف من المشروع هو التنبؤ بما إذا كانت عينة سرطان الثدي Benign أو Malignant بناءً على الخصائص الطبية الموجودة في dataset.
تم استخدام عدة خوارزميات للتصنيف، مثل:
Logistic Regression
Ridge Classifier
SVC
K Neighbors Classifier
Decision Tree
Random Forest
Gradient Boosting
AdaBoost
وبعد ذلك تم مقارنة أداء هذه النماذج لاختيار أفضل نموذج من حيث الدقة والثبات وجودة الاحتمالات المتوقعة.