Glossário IA
O dicionário completo da Inteligência Artificial
Modelo de Difusão Temporal
Arquitetura de rede neural que aplica o processo de difusão no eixo temporal para gerar sequências de vídeo coerentes quadro a quadro.
Difusão Espacial
Processo de ruído e denoising aplicado nas dimensões espaciais (altura e largura) de cada quadro de vídeo individual.
Tensor de Vídeo 3D
Estrutura de dados multidimensional que representa um vídeo com três dimensões: tempo, altura e largura, utilizada como entrada para modelos de difusão.
Difusão de Vídeo Latente
Abordagem que realiza o processo de difusão em um espaço latente comprimido em vez de diretamente no espaço de pixels para reduzir os custos computacionais.
Tokenização de Vídeo
Processo de conversão de dados de vídeo brutos em representações discretas (tokens) em um espaço latente para um processamento mais eficiente.
Modelagem de Dinâmicas de Movimento
Aprendizagem de padrões de movimento e transformações temporais para gerar animações realistas e fisicamente plausíveis.
Difusão de Denoising de Vídeo
Processo iterativo de denoising aplicado sequencialmente nos quadros de vídeo para reconstruir um vídeo claro a partir de um ruído inicial.
Atenção Entre Quadros
Mecanismo que permite a cada quadro atrair informações de outros quadros para manter a coerência temporal e as relações espaciais.
Pipeline de Geração de Vídeo
Sequência de etapas computacionais incluindo codificação, difusão latente, denoising e decodificação para produzir vídeos.
Espaço Latente de Vídeo
Espaço vetorial comprimido onde os vídeos são representados como códigos latentes, facilitando a manipulação e geração eficiente.
Amostragem de Difusão de Vídeo
Processo de amostragem iterativa no tempo e no espaço para gerar quadros de vídeo a partir de distribuições de probabilidade aprendidas.
Síntese de Vídeo Condicional
Geração de vídeos controlados por múltiplas entradas condicionais, como poses, máscaras ou trajetórias de movimento.
Previsão de Quadros de Vídeo
Tarefa que consiste em prever quadros futuros de um vídeo a partir de quadros passados, utilizando modelos de difusão para a geração.