Glossaire IA
Le dictionnaire complet de l'Intelligence Artificielle
Modèle de Diffusion Temporelle
Architecture de réseau neuronal qui applique le processus de diffusion sur l'axe temporel pour générer des séquences vidéo cohérentes frame par frame.
Diffusion Spatiale
Processus de bruitage et débruitage appliqué sur les dimensions spatiales (hauteur et largeur) de chaque frame vidéo individuelle.
Tenseur Vidéo 3D
Structure de données multidimensionnelle représentant une vidéo avec trois dimensions : temps, hauteur et largeur, utilisée comme entrée des modèles de diffusion.
Latent Video Diffusion
Approche qui effectue le processus de diffusion dans un espace latent compressé plutôt que directement sur l'espace pixel pour réduire les coûts computationnels.
Video Tokenization
Processus de conversion de données vidéo brutes en représentations discrètes (tokens) dans un espace latent pour un traitement plus efficace.
Motion Dynamics Modeling
Apprentissage des patterns de mouvement et des transformations temporelles pour générer des animations réalistes et physiquement plausibles.
Video Denoising Diffusion
Processus itératif de débruitage appliqué séquentiellement sur les frames vidéo pour reconstruire une vidéo claire à partir d'un bruit initial.
Cross-Frame Attention
Mécanisme permettant à chaque frame d'attirer l'information des autres frames pour maintenir la cohérence temporelle et les relations spatiales.
Video Generation Pipeline
Enchaînement séquentiel d'étapes computationnelles incluant l'encodage, la diffusion latente, le débruitage et le décodage pour produire des vidéos.
Video Latent Space
Espace vectoriel compressé où les vidéos sont représentées sous forme de codes latents, facilitant la manipulation et la génération efficiente.
Diffusion Sampling Vidéo
Processus d'échantillonnage itératif dans le temps et l'espace pour générer des frames vidéo à partir de distributions de probabilité apprises.
Conditional Video Synthesis
Génération de vidéos contrôlées par des entrées conditionnelles multiples comme des poses, des masques ou des trajectoires de mouvement.
Video Frame Prediction
Tâche consistant à prédire les frames futures d'une vidéo à partir des frames passées, utilisant des modèles de diffusion pour la génération.