🏠 হোম
বেঞ্চমার্ক
📊 সমস্ত বেঞ্চমার্ক 🦖 ডাইনোসর v1 🦖 ডাইনোসর v2 ✅ টু-ডু লিস্ট অ্যাপস 🎨 সৃজনশীল ফ্রি পেজ 🎯 FSACB - চূড়ান্ত শোকেস 🌍 অনুবাদ বেঞ্চমার্ক
মডেল
🏆 সেরা ১০টি মডেল 🆓 ফ্রি মডেল 📋 সমস্ত মডেল ⚙️ কিলো কোড
রিসোর্স
💬 প্রম্পট লাইব্রেরি 📖 এআই গ্লসারি 🔗 দরকারী লিঙ্ক
متقدم

تحليل وتنظيف البيانات المعقدة

#علم البيانات #تعلم الآلة #بايثون

اقتراح منهجية للتعامل مع مجموعات بيانات فوضوية وعالية الأبعاد

لديك مجموعة بيانات غير متوازنة (Imbalanced Dataset) تحتوي على 5 ملايين سجل لمعاملات مالية، حيث 0.1% منها فقط تمثل احتيالًا. اشرح خطوات معالجة البيانات مسبقًا (Preprocessing) بالتفصيل، بما في ذلك التعامل مع القيم المفقودة، وتحديد الميزات (Feature Engineering)، وتقنيات الموازنة (SMOTE أو Random Under-sampling). ثم، قارن بين أداء خوارزميات الغابات العشوائية (Random Forest) و XGBoost في هذا السياق، مع توضيح مقاييس التقييم المناسبة غير الدقة (Accuracy).