🏠 Accueil
基準測試
📊 Tous les Benchmarks 🦖 Dinosaure v1 🦖 Dinosaure v2 ✅ To-Do List Apps 🎨 Pages Libres 🎯 FSACB - Showcase 🌍 Traduction
Modèles
🏆 Top 10 Modèles 🆓 Modèles Gratuits 📋 Tous les Modèles ⚙️ Modes Kilo Code
Ressources
💬 Prompts IA 📖 人工智能詞彙表 🔗 Liens Utiles
📖
批量约束Q学习(BCQ)

隐式Q学习

一种通过避免直接评估分布外动作来隐式学习Q函数的方法。IQL将学习表述为期望分位数学习问题,以更好地处理离线数据中的不确定性。

← 返回