BenchVibe AI Ecosystem

VIP 👤

🏠 Trang chủ

Benchmark

📊 Tất cả benchmark 🦖 Khủng long v1 🦖 Khủng long v2 ✅ Ứng dụng To-Do List 🎨 Trang tự do sáng tạo 🎯 FSACB - Trình diễn cuối cùng 🌍 Benchmark dịch thuật

Mô hình

🏆 Top 10 mô hình 🆓 Mô hình miễn phí 📋 Tất cả mô hình ⚙️ Kilo Code

Tài nguyên

💬 Thư viện prompt 📖 Thuật ngữ AI 🔗 Liên kết hữu ích

📖

Benchmarks et Évaluation

HumanEval

Ensemble de 164 problèmes de programmation Python créés par OpenAI pour évaluer la capacité des LLM à générer du code fonctionnel, mesurant la compréhension syntaxique et algorithmique à travers des tests unitaires automatisés.

← Quay lại