أبني لك نموذجاً للتنبؤ أو التصنيف على بياناتك الجدولية باستخدام Scikit-learn. أجهّز البيانات، ثم أدرّب ثلاثة نماذج وأقارنها على بيانات الاختبار نفسها وأختار الأفضل بالأرقام. الخدمة الأساسية تشمل ملفاً حتى 20 ألف صف. سبق أن نفّذت مشروعاً للتنبؤ بترك الموظفين للعمل قارنت فيه ثلاثة نماذج ووصل أفضلها إلى ROC-AUC يقارب 0.79.
تستلم أرقام الاختبار كما هي، مع توضيح نقاط ضعف النموذج وما الذي يحسّنه.
jupyter notebook
.joblib trained after data
مقاييس الأداء، مصفوفة الالتباس، أهم المتغيرات
بيانات حتى 100 الف صف
10.00
|
|
واجهة streamlit
5.00
|
|
K-Means clustring
10.00
|
بيانات حتى 100 الف صف
10.00
|
|
واجهة streamlit
5.00
|
|
K-Means clustring
10.00
|