এআই গ্লসারি
কৃত্রিম বুদ্ধিমত্তার সম্পূর্ণ অভিধান
টেম্পোরাল ডিফিউশন মডেল
সঙ্গতিপূর্ণ ফ্রেম-বাই-ফ্রেম ভিডিও সিকোয়েন্স জেনারেট করার জন্য সময় অক্ষে ডিফিউশন প্রক্রিয়া প্রয়োগ করে এমন নিউরাল নেটওয়ার্ক আর্কিটেকচার।
স্পেশিয়াল ডিফিউশন
প্রতিটি পৃথক ভিডিও ফ্রেমের স্থানিক মাত্রা (উচ্চতা এবং প্রস্থ) প্রয়োগ করা নয়েজিং এবং ডিনয়েজিং প্রক্রিয়া।
৩ডি ভিডিও টেনসর
ডিফিউশন মডেলের ইনপুট হিসাবে ব্যবহৃত তিনটি মাত্রা সহ একটি ভিডিও প্রতিনিধিত্বকারী মাল্টিডাইমেনশনাল ডেটা স্ট্রাকচার: সময়, উচ্চতা এবং প্রস্থ।
লেটেন্ট ভিডিও ডিফিউশন
কম্পিউটেশনাল খরচ কমানোর জন্য পিক্সেল স্পেসে সরাসরি না গিয়ে একটি কম্প্রেসড লেটেন্ট স্পেসে ডিফিউশন প্রক্রিয়া সম্পাদন করে এমন পদ্ধতি।
ভিডিও টোকেনাইজেশন
আরও দক্ষ প্রসেসিংয়ের জন্য লেটেন্ট স্পেসে কাঁচা ভিডিও ডেটাকে বিচ্ছিন্ন উপস্থাপনায় (টোকেন) রূপান্তর করার প্রক্রিয়া।
মোশন ডাইনামিক্স মডেলিং
বাস্তবসম্মত এবং শারীরিকভাবে সম্ভাব্য অ্যানিমেশন জেনারেট করার জন্য গতির প্যাটার্ন এবং টেম্পোরাল ট্রান্সফরমেশন শেখা।
ভিডিও ডিনয়েজিং ডিফিউশন
প্রাথমিক শব্দ থেকে একটি পরিষ্কার ভিডিও পুনর্গঠন করার জন্য ভিডিও ফ্রেমগুলিতে ক্রমান্বয়ে প্রয়োগ করা পুনরাবৃত্তিমূলক ডিনয়েজিং প্রক্রিয়া।
ক্রস-ফ্রেম অ্যাটেনশন
টেম্পোরাল সঙ্গতি এবং স্থানিক সম্পর্ক বজায় রাখার জন্য প্রতিটি ফ্রেমকে অন্যান্য ফ্রেম থেকে তথ্য আকর্ষণ করতে সক্ষম করে এমন মেকানিজম।
ভিডিও জেনারেশন পাইপলাইন
ভিডিও উৎপাদনের জন্য গণনামূলক ধাপগুলির ক্রমিক সন্নিবেশ যার মধ্যে এনকোডিং, লেটেন্ট ডিফিউশন, ডিনোইজিং এবং ডিকোডিং অন্তর্ভুক্ত।
ভিডিও লেটেন্ট স্পেস
সংকুচিত ভেক্টর স্পেস যেখানে ভিডিওগুলি লেটেন্ট কোড আকারে উপস্থাপিত হয়, দক্ষ ম্যানিপুলেশন এবং জেনারেশন সুবিধা প্রদান করে।
ডিফিউশন স্যাম্পলিং ভিডিও
সময় ও স্থানে পুনরাবৃত্তিমূলক নমুনা প্রক্রিয়া যা শেখা সম্ভাব্যতা বন্টন থেকে ভিডিও ফ্রেম তৈরি করে।
কন্ডিশনাল ভিডিও সিন্থেসিস
একাধিক কন্ডিশনাল ইনপুট যেমন পোজ, মাস্ক বা গতির ট্র্যাজেক্টরি দ্বারা নিয়ন্ত্রিত ভিডিও জেনারেশন।
ভিডিও ফ্রেম প্রেডিকশন
অতীত ফ্রেম থেকে ভবিষ্যত ভিডিও ফ্রেম ভবিষ্যদ্বাণী করার কাজ, যেখানে জেনারেশনের জন্য ডিফিউশন মডেল ব্যবহার করা হয়।