VIP 👤
🏠 Início
Avaliações
📊 Todos os Benchmarks 🦖 Dinossauro v1 🦖 Dinossauro v2 ✅ Aplicações To-Do List 🎨 Páginas Livres Criativas 🎯 FSACB - Showcase Definitivo 🌍 Benchmark de Tradução
Modelos
🏆 Top 10 Modelos 🆓 Modelos Gratuitos 📋 Todos os Modelos ⚙️ Kilo Code
Recursos
💬 Biblioteca de Prompts 📖 Glossário de IA 🔗 Links Úteis 🔌 APIs e roteadores

Glossário IA

O dicionário completo da Inteligência Artificial

242
categorias
3.306
subcategorias
39.932
termos
📖
termos

Espectrograma de Mel

Representação tempo-frequência do sinal de áudio em uma escala Mel, que imita a percepção auditiva humana e é comumente usada como entrada para modelos de difusão de áudio.

📖
termos

Processo de Ruído de Áudio

Etapa inicial do modelo de difusão onde ruído gaussiano é adicionado iterativamente a um sinal de áudio limpo ao longo de vários passos de tempo, até que o sinal se torne ruído puro.

📖
termos

Processo de Desruído de Áudio

Fase de geração onde uma rede neural, frequentemente uma U-Net, aprende a prever e subtrair o ruído adicionado em cada etapa para reconstruir um sinal de áudio coerente a partir do ruído.

📖
termos

U-Net de Áudio

Arquitetura de rede neural codificador-decodificador com conexões de salto, adaptada para processar espectrogramas e prever o ruído em cada etapa do processo de desruído de áudio.

📖
termos

Condicionamento de Áudio

Técnica que permite guiar a geração de áudio fornecendo ao modelo informações adicionais, como uma classe de instrumento, um texto descritivo ou uma melodia de referência.

📖
termos

Score Matching para Áudio

Método de treinamento alternativo onde o modelo aprende a estimar o gradiente (o score) da distribuição de probabilidade do log dos dados de áudio em relação à entrada ruidosa.

📖
termos

Vocoder Neural

Rede neural que converte uma representação acústica, como um espectrograma de Mel gerado por um modelo de difusão, em uma forma de onda de áudio final audível.

📖
termos

Difusão de Áudio Latente

Abordagem onde o processo de difusão ocorre em um espaço latente comprimido do áudio, em vez de diretamente no sinal ou espectrograma, reduzindo os custos computacionais.

📖
termos

Ajuste Fino (Fine-tuning) de Áudio

Processo de adaptação de um modelo de difusão de áudio pré-treinado a um conjunto de dados específico, como as vozes de um locutor particular ou um estilo musical, para especializar a sua geração.

📖
termos

Stable Audio

Modelo de difusão de áudio de ponto de difusão latente (latent diffusion) capaz de gerar amostras de áudio de alta fidelidade e longa duração condicionadas por texto.

📖
termos

AudioLDM

Família de modelos de difusão de áudio que utilizam embeddings de texto pré-treinados (como CLAP) para condicionar a geração de sons, música ou fala a partir de descrições textuais.

📖
termos

Difusão em Forma de Onda

Variante dos modelos de difusão que opera diretamente na forma de onda de áudio bruta no domínio do tempo, evitando assim as perdas de informação relacionadas com a transformação em espectrograma.

🔍

Nenhum resultado encontrado