🏠 Inicio
Pruebas de rendimiento
📊 Todos los benchmarks 🦖 Dinosaurio v1 🦖 Dinosaurio v2 ✅ Aplicaciones To-Do List 🎨 Páginas libres creativas 🎯 FSACB - Showcase definitivo 🌍 Benchmark de traducción
Modelos
🏆 Top 10 modelos 🆓 Modelos gratuitos 📋 Todos los modelos ⚙️ Kilo Code
Recursos
💬 Biblioteca de prompts 📖 Glosario de IA 🔗 Enlaces útiles
📖
Trust Region Policy Optimization (TRPO)

Eficiencia de Muestreo

Medida de la eficiencia de un algoritmo de aprendizaje por refuerzo para utilizar los datos recolectados, TRPO siendo conocido por su buena eficiencia de muestreo.

← Volver