VIP 👤
🏠 Главная
Бенчмарки
📊 Все бенчмарки 🦖 Динозавр v1 🦖 Динозавр v2 ✅ Приложения To-Do List 🎨 Творческие свободные страницы 🎯 FSACB - Ультимативный показ 🌍 Бенчмарк перевода
Модели
🏆 Топ-10 моделей 🆓 Бесплатные модели 📋 Все модели ⚙️ Режимы Kilo Code
Ресурсы
💬 Библиотека промптов 📖 Глоссарий ИИ 🔗 Полезные ссылки 🔌 API и маршрутизаторы

Глоссарий ИИ

Полный словарь искусственного интеллекта

235
категории
2 988
подкатегории
33 628
термины
📖
термины

Модели причинного языкового моделирования

Предсказательная архитектура Transformer, генерирующая текст токен за токеном, где каждое предсказание основывается на предыдущих токенах, используется в моделях таких как GPT.

📖
термины

Модели маскированного языкового моделирования

Подход самоконтролируемого обучения, где в входных данных маскируются токены, и модель должна предсказать их, что позволяет обучаться на двунаправленном контексте.

📖
термины

Модели Vision-Transformer (ViT)

Адаптация архитектуры Transformer для обработки изображений, заменяющая свёртки механизмами внимания на участках изображения.

📖
термины

Многомодальные модели

Трансформеры, способные обрабатывать и генерировать одновременно несколько типов данных (текст, изображение, аудио), используя общие пространства вложений.

📖
термины

Вложения токенов

Плотные векторные представления входных токенов, изучаемые во время предобучения и захватывающие семантическую и синтаксическую информацию.

📖
термины

Масштаб внимания

Параметр, контролирующий распределение внимания в моделях Transformer, влияющий на концентрацию или рассредоточение контекстуального фокуса.

📖
термины

Модели диффузии на основе Transformer

Интеграция архитектуры Transformer в итеративный процесс шумоподавления моделей диффузии, улучшающая общую согласованность генерации.

📖
термины

Обратное распространение через внимание

Механизм, позволяющий анализировать и интерпретировать решения моделей Transformer путём визуализации весов внимания между токенами.

📖
термины

Базовые модели (Foundation Models)

Большие модели Transformer, предварительно обученные на массивных данных, служащие отправной точкой для различных приложений с помощью тонкой настройки или промптинга.

🔍

Результаты не найдены