AI用語集
人工知能の完全辞典
236
カテゴリ
3,245
サブカテゴリ
39,334
用語
用語
時間的拡散モデル
時間軸上で拡散プロセスを適用し、フレームごとに一貫性のある動画シーケンスを生成するニューラルネットワークアーキテクチャ。
用語
空間的拡散
各動画フレームの空間的次元(高さと幅)に適用されるノイズ付加とノイズ除去のプロセス。
用語
3D動画テンソル
時間、高さ、幅の3次元で動画を表現する多次元データ構造。拡散モデルの入力として使用される。
用語
潜在動画拡散
計算コストを削減するため、ピクセル空間で直接ではなく、圧縮された潜在空間で拡散プロセスを実行するアプローチ。
用語
動画トークン化
より効率的な処理のため、生の動画データを潜在空間内の離散的表現(トークン)に変換するプロセス。
用語
動力学モデリング
リアルで物理的に妥当なアニメーションを生成するため、動きのパターンと時間的変換を学習すること。
用語
動画ノイズ除去拡散
初期ノイズから明瞭な動画を再構築するため、動画フレームに順次適用される反復的なノイズ除去プロセス。
用語
クロスフレームアテンション
各フレームが他のフレームから情報を引き出し、時間的一貫性と空間的関係を維持するメカニズム。
用語
ビデオ生成パイプライン
エンコーディング、潜在拡散、ノイズ除去、デコーディングなどの計算ステップを順番に実行してビデオを生成するプロセス。
用語
ビデオ潜在空間
ビデオが潜在コードとして表現される圧縮されたベクトル空間で、操作と効率的な生成を容易にする。
用語
ビデオ拡散サンプリング
学習された確率分布からビデオフレームを生成するための、時間と空間における反復サンプリングプロセス。
用語
条件付きビデオ合成
ポーズ、マスク、運動軌道などの複数の条件入力によって制御されるビデオの生成。
用語
ビデオフレーム予測
過去のフレームからビデオの将来のフレームを予測するタスクで、拡散モデルを使用して生成する。
🔍