🏠 होम
बेंचमार्क
📊 सभी बेंचमार्क 🦖 डायनासोर v1 🦖 डायनासोर v2 ✅ टू-डू लिस्ट ऐप्स 🎨 रचनात्मक फ्री पेज 🎯 FSACB - अल्टीमेट शोकेस 🌍 अनुवाद बेंचमार्क
मॉडल
🏆 टॉप 10 मॉडल 🆓 मुफ्त मॉडल 📋 सभी मॉडल ⚙️ किलो कोड
संसाधन
💬 प्रॉम्प्ट लाइब्रेरी 📖 एआई शब्दावली 🔗 उपयोगी लिंक
متقدم

تحليل وتنظيف البيانات المعقدة

#علم البيانات #تعلم الآلة #بايثون

اقتراح منهجية للتعامل مع مجموعات بيانات فوضوية وعالية الأبعاد

لديك مجموعة بيانات غير متوازنة (Imbalanced Dataset) تحتوي على 5 ملايين سجل لمعاملات مالية، حيث 0.1% منها فقط تمثل احتيالًا. اشرح خطوات معالجة البيانات مسبقًا (Preprocessing) بالتفصيل، بما في ذلك التعامل مع القيم المفقودة، وتحديد الميزات (Feature Engineering)، وتقنيات الموازنة (SMOTE أو Random Under-sampling). ثم، قارن بين أداء خوارزميات الغابات العشوائية (Random Forest) و XGBoost في هذا السياق، مع توضيح مقاييس التقييم المناسبة غير الدقة (Accuracy).