🏠 Início
Avaliações
📊 Todos os Benchmarks 🦖 Dinossauro v1 🦖 Dinossauro v2 ✅ Aplicações To-Do List 🎨 Páginas Livres Criativas 🎯 FSACB - Showcase Definitivo 🌍 Benchmark de Tradução
Modelos
🏆 Top 10 Modelos 🆓 Modelos Gratuitos 📋 Todos os Modelos ⚙️ Kilo Code
Recursos
💬 Biblioteca de Prompts 📖 Glossário de IA 🔗 Links Úteis
📖
Avaliação de Robustez

Benchmark AutoAttack

Conjunto de avaliação padronizado e automatizado que combina múltiplos ataques (APGD-CE, APGD-T, FAB, Square) para fornecer uma avaliação robusta e confiável da resistência dos modelos. O AutoAttack adapta dinamicamente seus parâmetros para maximizar a eficácia dos ataques e minimizar o mascaramento de gradiente.

← Voltar