🏠 홈
벤치마크
📊 모든 벤치마크 🦖 공룡 v1 🦖 공룡 v2 ✅ 할 일 목록 앱 🎨 창의적인 자유 페이지 🎯 FSACB - 궁극의 쇼케이스 🌍 번역 벤치마크
모델
🏆 톱 10 모델 🆓 무료 모델 📋 모든 모델 ⚙️ 킬로 코드 모드
리소스
💬 프롬프트 라이브러리 📖 AI 용어 사전 🔗 유용한 링크

AI 용어집

인공지능 완전 사전

162
카테고리
2,032
하위 카테고리
23,060
용어
📖
용어

Distillation Temperature

Paramètre hyperthermique appliqué dans la fonction softmax pour contrôler l'adoucissement des probabilités du modèle teacher, permettant au student d'apprendre des relations entre classes au-delà des prédictions les plus probables.

📖
용어

Layer-wise Distillation

Technique de distillation où les représentations intermédiaires de chaque couche du teacher sont transférées aux couches correspondantes du student, assurant un apprentissage progressif des caractéristiques à tous les niveaux d'abstraction.

📖
용어

Contrastive Distillation

Technique utilisant des paires de contrastes pour améliorer la qualité de la distillation, où le student apprend simultanément à imiter le teacher et à se différencier des échantillons négatifs.

📖
용어

Cross-architecture Distillation

Méthode de transfert de connaissances entre modèles d'architectures différentes, comme distiller un transformer vers une architecture CNN ou RNN, permettant une flexibilité dans le déploiement cible.

📖
용어

Knowledge Pruning

Processus combiné d'élagage de paramètres et de distillation où les poids les moins importants sont supprimés du modèle, puis la distillation compense la perte de performance résultant de l'élagage.

📖
용어

Dynamic Distillation

Approche adaptative où la force de la distillation et le choix des cibles sont ajustés dynamiquement pendant l'entraînement selon la progression du student et la difficulté des échantillons.

📖
용어

Zero-shot Distillation

Technique permettant de distiller un modèle teacher sans données d'entraînement explicitement étiquetées, en utilisant des connaissances implicites ou des données synthétiques générées par le teacher.

📖
용어

Relation-aware Distillation

Méthode avancée où le student apprend non seulement les prédictions individuelles du teacher mais aussi les relations structurelles entre différentes parties des données, capturant des dépendances complexes.

📖
용어

Compression-aware Distillation

Stratégie intégrant les contraintes matérielles de compression (quantification, sparsification) directement dans le processus de distillation pour optimiser les performances post-compression du modèle final.

🔍

결과를 찾을 수 없습니다