AI Library · Каталог
Каталог156/ 156
Все термины библиотеки с поиском, фильтром по разделу и семью способами сортировки.
Языковые модели
Agentic AI
Agentic AI — системы, которые планируют несколько шагов, используют инструменты и проверяют промежуточный результат. Они особенно полезны там, где есть…
Основы AI
AI ИИ
Искусственный интеллект, AI или ИИ, — широкое название систем, которые распознают данные, строят прогнозы, создают контент, планируют шаги или помогают…
Языковые модели
AI Agent
AI Agent (AI-агент) — это LLM, которая не просто отвечает на вопрос, а решает задачу через несколько шагов и использует…
Применения
AI in Cybersecurity
AI в кибербезопасности помогает разбирать поток событий, искать аномалии, группировать оповещения и готовить черновики расследований. Те же технологии упрощают фишинг,…
Применения
AI in Education
AI в образовании помогает объяснять материал разными способами, давать подсказки, создавать тренировочные задания и разбирать черновики. Учителю он может снять…
Применения
AI in Healthcare
Нейросети в медицине помогают готовить черновики клинических записей, анализировать снимки и искать закономерности в данных. Это не единый «AI-врач», а…
Этика и регулирование
AI Safety
AI Safety изучает, как снизить вероятность вреда от модели и продукта вокруг неё. Сюда входят тесты, защита данных и инструментов,…
Языковые модели
AI Search
AI Search — это новый формат поиска, в котором система не показывает список ссылок, а формирует прямой ответ через LLM…
Языковые модели
Alignment
Alignment — процесс настройки LLM на поведение, согласованное с человеческими ценностями: быть полезной, честной, безопасной (helpful, honest, harmless). Без alignment…
Видео
AnimateDiff
AnimateDiff — способ заставить обычную модель Stable Diffusion рисовать не один кадр, а короткое видео. К модели подключается отдельный «модуль…
Основы AI
API Application Programming Interface
API (Application Programming Interface) в контексте AI — это способ программно отправлять запросы к языковой модели и получать ответы. Вместо…
Параметры
Aspect Ratio AR
Aspect Ratio описывает форму кадра как отношение ширины к высоте. Оно влияет на композицию и на то, насколько размер близок…
Инструменты
AUTOMATIC1111
AUTOMATIC1111 (или Stable Diffusion WebUI) — классический веб-интерфейс для запуска моделей Stable Diffusion, появился в августе 2022 года. Долгое время…
Параметры
Batch Size
Batch Size — количество примеров в одном вычислительном пакете. При генерации он влияет на память, задержку и пропускную способность; при…
Языковые модели
Benchmark
Benchmark — общий набор задач, правил запуска и метрик для сравнения моделей. Результат имеет смысл только вместе с версией датасета,…
Адаптеры
Canny Edge
Canny Edge — алгоритм извлечения контуров изображения, изобретённый Джоном Канни в 1986-м. В Stable Diffusion через ControlNet Canny используется как…
Параметры
CFG Scale Classifier-Free Guidance
CFG Scale управляет тем, насколько сильно диффузионная модель отталкивается от безусловного предсказания в сторону промпта. Слишком слабое влияние может дать…
Языковые модели
ChatGPT
ChatGPT — AI-ассистент OpenAI с чатом, поиском, памятью и инструментами для файлов, изображений, голоса и кода. Это продукт вокруг семейства…
Языковые модели
Chunking
Chunking — разбиение длинных документов на маленькие фрагменты (chunks) для индексации в RAG. От выбора размера и стратегии разбиения зависит…
Языковые модели
Claude
Claude — семейство языковых моделей и AI-ассистент от компании Anthropic, основанной бывшими сотрудниками OpenAI. Модели семейства рассчитаны на разные сочетания…
Генеративные модели
CLIP Contrastive Language-Image Pretraining
CLIP состоит из текстового и визуального энкодеров, обученных сближать подходящие пары «изображение — подпись» и отдалять неподходящие. Благодаря этому текст…
Инструменты
ComfyUI
ComfyUI — это визуальный интерфейс для запуска моделей генерации изображений на основе графа узлов. Каждый шаг пайплайна (загрузка модели, кодирование…
Инструменты
ComfyUI Manager
ComfyUI Manager помогает искать, устанавливать, обновлять и отключать custom nodes, находить недостающие пакеты из чужого workflow, управлять моделями и сохранять…
Языковые модели
Computer Use Computer-Using Agent (CUA)
Computer Use (CUA, компьютерный агент) — ИИ-агент, который управляет компьютером как человек: делает скриншот экрана, «видит» интерфейс, двигает курсор, кликает…
Промпты
Context Engineering
Context Engineering — практика системно снабжать AI-модель нужным контекстом до того, как она ответит. Память о пользователе, документы через RAG,…
Языковые модели
Context Window
Контекстное окно — объём токенов, доступный модели во время одного вызова. Туда попадают инструкции, история диалога, документы, результаты инструментов и…
Адаптеры
ControlNet
ControlNet — техника управления композицией в диффузионных моделях через зрительную подсказку: скелет позы (OpenPose), контур (Canny), карту глубины (Depth), набросок…
Языковые модели
Cost per Token
Cost per Token описывает тарификацию LLM API по объёму входа и выхода. К итоговой сумме могут добавляться кэш, инструменты, хранение…
Инструменты
CUDA Compute Unified Device Architecture
CUDA связывает программы с видеокартами NVIDIA. Через её runtime, драйвер и библиотеки фреймворки запускают матричные операции, свёртки и attention на…
Инструменты
Cursor
Cursor — редактор на базе VS Code с AI-функциями для автодополнения, поиска по проекту и многофайловых изменений. Он соединяет контекст…
Инструменты
Custom Nodes
Custom Nodes — сторонние расширения ComfyUI. Они добавляют новые загрузчики, модели, способы управления, обработку видео, звука и изображений. В обычной…
Генеративные модели
DALL-E
DALL-E — семейство закрытых моделей генерации изображений OpenAI, начатое в 2021 году. Оно прошло путь от отдельного генератора до связки…
Обучение
Dataset
Dataset, или датасет, — организованный набор примеров для обучения, настройки или проверки модели. В нём важны не только объём и…
Обучение
Dataset Captioning
Dataset Captioning — подготовка текстовых подписей к изображениям в обучающем датасете. Подпись связывает конкретный снимок с его содержанием и помогает…
Основы AI
Deep Learning DL
Deep Learning, или глубокое обучение, — область machine learning, где модель строится из нескольких обучаемых преобразований. Вместо заранее написанного списка…
Языковые модели
DeepSeek
DeepSeek — компания и семейство языковых моделей, включающее облачные API, модели рассуждения, кодовые варианты и опубликованные веса. Линейки, лицензии и…
Параметры
Denoising Strength
Denoising Strength задаёт, насколько сильно генерация может отойти от входного изображения. Чем выше сила, тем больше шума получает исходник перед…
Адаптеры
Depth Map
Depth Map кодирует глубину сцены: какие поверхности находятся ближе, а какие дальше. Такая карта помогает генеративной модели сохранить расстановку и…
Языковые модели
Diffusion LLM Diffusion Language Model
Diffusion LLM, или dLLM, генерирует текст через несколько раундов уточнения. Модель начинает с замаскированной последовательности, восстанавливает часть токенов и снова…
Генеративные модели
Diffusion Model
Diffusion Model — семейство генеративных моделей, которые учатся восстанавливать данные из зашумлённого состояния. При генерации процесс идёт от случайного шума…
Адаптеры
DreamBooth
DreamBooth — рецепт персонализации text-to-image модели по нескольким изображениям конкретного объекта. Во время обучения редкий идентификатор связывается с его внешностью,…
Инструменты
Edge AI
Edge AI запускает модель на телефоне, компьютере, камере, автомобиле или локальном сервере рядом с устройством. Такой подход уменьшает зависимость от…
Видео
ElevenLabs
ElevenLabs — облачная платформа для работы с AI-аудио. Она превращает текст в речь, создаёт и клонирует голоса, переводит аудио и…
Языковые модели
Embedding
Embedding (эмбеддинг) — это длинный вектор чисел, который представляет смысл слова, фразы, документа или изображения. Близкие по смыслу объекты получают…
Обучение
Epoch
Epoch, или эпоха, — один проход через весь обучающий набор. Она показывает, сколько раз данные были охвачены тренировкой, но сама…
Этика и регулирование
EU AI Act
EU AI Act регулирует AI в Евросоюзе с учётом назначения системы, уровня риска и роли компании. Для запрещённых практик, высокорисковых…
Этика и регулирование
Explainable AI XAI
Explainable AI объединяет методы, которые помогают исследовать вклад признаков, сравнивать возможные решения и объяснять работу системы разным людям. Одно объяснение…
Инструменты
Face Restoration
Face Restoration — отдельный пост-обработочный шаг, который улучшает лица на сгенерированной или старой фотографии. Решает классическую проблему AI-генерации: лица «уплывают»,…
Инструменты
Faceswap
Faceswap переносит черты лица из изображения-источника в фотографию или видео. Система находит лицо, сопоставляет его с позой и мимикой человека…
Обучение
Fine-tuning
Fine-tuning продолжает обучение готовой модели на данных конкретной задачи. Так можно закрепить формат, стиль, терминологию или способ принимать решения. Полное…
Генеративные модели
FLUX
FLUX — семейство генеративных моделей Black Forest Labs для создания и редактирования изображений. В нём есть облачные и self-hosted варианты,…
Параметры
FP16, BF16, FP8
FP16, BF16 и FP8 по-разному делят биты между экспонентой и дробной частью. FP16 оставляет больше значащих битов, BF16 сохраняет диапазон…
Языковые модели
Function Calling
Function Calling позволяет модели выбрать описанную функцию и вернуть её имя с JSON-аргументами. Функцию выполняет приложение, а не сама LLM.…
Языковые модели
Gemini
Gemini — семейство моделей Google для текста, изображений, аудио, видео и работы с инструментами. Доступ к нему встроен в пользовательские…
Основы AI
Generative AI Генеративный AI
Генеративный AI создаёт текст, изображения, звук, видео, код и другие данные по примерам и условиям. Модель не достаёт готовый файл…
Инструменты
GGUF GPT-Generated Unified Format
GGUF — переносимый формат тензоров и метаданных, тесно связанный с llama.cpp и совместимыми приложениями. Файл может содержать квантизированные веса, сведения…
Инструменты
Google AI Studio
Google AI Studio помогает испытать модели Gemini в браузере, настроить промпт и мультимодальный вход, получить пример вызова API и собрать…
Языковые модели
GPT Generative Pre-trained Transformer
GPT расшифровывается как Generative Pre-trained Transformer. Это семейство моделей OpenAI, которые предварительно обучаются на больших наборах данных, а затем настраиваются…
Основы AI
Graph Neural Networks GNN
Graph Neural Networks (GNN) — класс нейросетей, который работает не с таблицами, картинками или текстами, а с графами: узлами и…
Языковые модели
Grok
Grok — семейство языковых моделей и AI-ассистент компании xAI. Он умеет отвечать на вопросы, работать с текстом и кодом, а…
Параметры
Guidance
Guidance — семейство способов направлять генерацию к условию. Классический CFG усиливает разницу между условным и опорным предсказаниями, некоторые модели получают…
Языковые модели
Hallucination
Hallucination (галлюцинация) — ошибка LLM, когда модель уверенно выдумывает факт, который выглядит правдоподобно, но не существует. Это не баг, а…
Инструменты
Harness
Harness — это программный слой, который организует работу модели: собирает вход, ведёт состояние, вызывает разрешённые инструменты, проверяет результат и сохраняет…
Параметры
Hires.fix
Hires.fix строит изображение в два прохода. Сначала модель создаёт базовый кадр и его композицию. Затем кадр увеличивается и частично зашумляется,…
Языковые модели
Hybrid Search
Hybrid Search объединяет несколько способов найти документы. Лексическая ветка удерживает точные слова и коды, семантическая замечает близкий смысл и перефразировки,…
Адаптеры
Hypernetwork
Hypernetwork в генерации изображений — отдельный обучаемый модуль, который преобразует ключи и значения attention и добавляет к ним свою поправку.…
Видео
Image-to-Video
Image-to-Video (I2V) — модель берёт статичную картинку и достраивает движение объектов, камеры и света во времени. Исходник задаёт внешний вид…
Инструменты
img2img image-to-image
img2img (image-to-image) — режим генерации, в котором на вход модели подаётся картинка, а не случайный шум. Модель частично её «стирает»…
Основы AI
Inference
Inference, или инференс, начинается, когда готовая модель получает новые данные и строит результат: класс, прогноз, текст, изображение или эмбеддинг. В…
Инструменты
Inpainting
Inpainting меняет часть изображения внутри маски и старается связать новую область с окружением. Так удаляют предметы, меняют одежду, исправляют детали…
Промпты
Intent Recognition
Intent Recognition (Intent Detection) — задача NLP: понять, какую цель преследует пользователь в своём сообщении, даже если он сформулировал её…
Адаптеры
IP-Adapter Image Prompt Adapter
IP-Adapter добавляет к текстовому промпту визуальное условие. Image encoder превращает референс в признаки, а отдельная ветка внимания передаёт их диффузионной…
Языковые модели
Jailbreak
Jailbreak — техника обхода встроенных ограничений LLM (alignment-фильтров), чтобы заставить модель выполнить запрещённое: написать вредоносный код, обойти политики, выдать опасные…
Языковые модели
JSON Mode
JSON Mode ограничивает ответ языковой модели синтаксисом JSON. Это удобнее обычной просьбы «верни JSON», но режим не задаёт обязательные поля,…
Инструменты
JSON Workflow
JSON Workflow хранит структуру графа, типы нод, их параметры и связи в машиночитаемом тексте. В ComfyUI есть формат для визуального…
Языковые модели
Kimi
Kimi — продукт Moonshot AI: чат, модели, API и агентные инструменты для поиска, кода и работы с файлами. Сервис стал…
Языковые модели
Knowledge Graph
Knowledge Graph, или граф знаний, хранит сущности и утверждения о связях между ними. В нём можно явно показать, что человек…
Сэмплеры
KSampler
KSampler объединяет модель, conditioning, исходный latent и настройки sampling в один узел ComfyUI. Scheduler строит последовательность уровней шума, sampler задаёт…
Языковые модели
Latency
Latency описывает, сколько времени проходит от отправки запроса до результата. У потоковой языковой модели отдельно измеряют ожидание первого токена, интервалы…
Генеративные модели
Latent Space
Latent space — внутреннее пространство представлений, с которым работает модель. В latent diffusion изображение обычно кодируется в компактный пространственный тензор,…
Обучение
Learning Rate LR
Learning rate задаёт масштаб обновлений, которые делает оптимизатор. Слишком маленький шаг может не успеть за бюджет обучения, слишком большой —…
Видео
Lip Sync
Lip Sync меняет движение губ в видео так, чтобы оно совпадало с новой речью. Техника помогает при дубляже, замене реплик…
Языковые модели
LLM Large Language Model
LLM (Large Language Model) — большая языковая модель, нейросеть, обученная на триллионах слов и умеющая осмысленно продолжать любой текст. Принципиально…
Адаптеры
LoRA Low-Rank Adaptation
LoRA (Low-Rank Adaptation) — техника тонкой настройки больших диффузионных моделей. Вместо переобучения целой модели (6+ ГБ) рядом с базой подключается…
Основы AI
Machine Learning ML
Machine Learning (машинное обучение, ML) — раздел AI, в котором программа не получает готовые правила, а выводит их сама из…
Языковые модели
Manus
Manus — облачный AI-агент, который получает цель, использует браузер, код и файлы, а затем возвращает готовый артефакт: таблицу, отчёт или…
Параметры
Mask
Mask — одноканальная карта, которая задаёт, где операция действует полностью, частично или совсем не действует. В inpainting маска ограничивает область…
Языковые модели
MCP Model Context Protocol
MCP (Model Context Protocol) задаёт общий способ, которым AI-приложение обнаруживает инструменты, читает доступные данные и вызывает внешние действия. Протокол разделяет…
Языковые модели
Memory
Memory — способность AI-ассистента помнить факты о пользователе между сессиями. В отличие от Context Window (один разговор) Memory сохраняет информацию…
Генеративные модели
Midjourney
Midjourney создаёт изображения по тексту и визуальным референсам, предлагает варианты и позволяет продолжать выбранный кадр в редакторе. Это облачный сервис…
Обучение
Mixture of Experts MoE
Mixture of Experts (MoE) — архитектура нейросетей, где модель состоит не из одной плотной сети, а из набора «экспертов». Маршрутизатор…
Языковые модели
MMLU и HumanEval
MMLU проверяет выбор ответа по разным предметам, а HumanEval — способность написать небольшую функцию, которая проходит тесты. Обе цифры полезны,…
Основы AI
Model
AI-модель — обученная математическая функция. Для запуска нужны архитектура, веса, конфигурация и обработчики входа и выхода. Они могут лежать в…
Основы AI
Model License
Лицензия модели описывает, что разрешено делать с конкретными весами: использовать, изменять и распространять их, в том числе в коммерческих сценариях.…
Обучение
Model Merge
Model Merge создаёт новую модель из весов нескольких совместимых моделей. Простое смешивание интерполирует одинаковые тензоры, delta merge переносит разницу между…
Основы AI
Multimodal AI
Multimodal AI принимает или создаёт данные нескольких типов: текст, изображения, аудио, видео и сигналы датчиков. Возможности не обязаны быть симметричными:…
Видео
Music Generation
Музыкальные модели создают аудио по описанию, напеву, референсу или заданной структуре. Одни генерируют готовую песню с вокалом, другие — инструментал,…
Промпты
Negative Prompt
Negative Prompt описывает признаки, от которых генерацию нужно оттолкнуть. В классическом classifier-free guidance его embedding участвует в сравнении с положительным…
Основы AI
Neural Network NN, ANN
Нейросеть (neural network, искусственная нейронная сеть) — математическая модель, в которой простые элементы-«нейроны» собраны в слои и обмениваются числами. На…
Сэмплеры
Noise Schedule
Noise schedule задаёт, какой уровень сигнала и шума соответствует каждому моменту диффузионного процесса. При генерации sampler идёт по выбранным точкам…
Инструменты
NotebookLM
NotebookLM собирает отдельное рабочее пространство из документов, ссылок, аудио и других источников. Чат отвечает с переходами к использованным фрагментам, а…
Основы AI
Open-source AI
Open-source AI даёт свободу использовать, изучать, изменять и распространять систему, а также материалы, без которых её нельзя осмысленно доработать. Доступные…
Адаптеры
OpenPose
OpenPose — препроцессор и модель ControlNet для управления позой человека в Stable Diffusion. Превращает любое фото в палочную фигуру (skeleton),…
Инструменты
Outpainting
Outpainting расширяет холст и генерирует сцену в новых областях за пределами исходного кадра. Модель опирается на пиксели возле старой границы,…
Обучение
Overfitting
Overfitting, или переобучение, возникает, когда модель всё точнее подстраивается под обучающие примеры, но хуже работает на новых данных. В генерации…
Основы AI
Parameters
Параметры модели — обучаемые числа внутри матриц и других тензоров нейросети. Обучение меняет их по градиентам, checkpoint сохраняет найденные значения,…
Языковые модели
Perplexity
Perplexity соединяет веб-поиск с языковой моделью: находит страницы, собирает связный ответ и показывает ссылки. Такой формат удобен для обзора темы,…
Промпты
Prompt
Промпт (prompt) — текстовый запрос, который пользователь передаёт языковой модели, чтобы получить ответ. От формулировки промпта зависит результат: одна и…
Промпты
Prompt Engineering
Prompt Engineering (промпт-инженерия) — навык формулировать запросы к языковой модели так, чтобы получать предсказуемый, точный и полезный ответ. Это не…
Промпты
Prompt Injection
Prompt Injection — атака, при которой пользователь или внешние данные заставляют LLM нарушить исходные инструкции (system prompt). Direct injection: пользователь…
Промпты
Prompt Weighting
Prompt Weighting усиливает или ослабляет отдельные фрагменты текстового условия до генерации. Запись вроде `(красный шарф:1.2)` работает только там, где интерфейс…
Инструменты
PyTorch
PyTorch — open-source библиотека для работы с тензорами, нейросетями и автоматическим дифференцированием. Модель описывается обычным Python-кодом, autograd вычисляет градиенты, а…
Параметры
Quantization
Quantization переводит веса или активации модели в более компактное числовое представление. Памяти и передач становится меньше, но значения округляются, а…
Языковые модели
Qwen
Qwen — семейство моделей Alibaba для текста, кода, рассуждения и мультимодальных задач. Часть весов публикуется для локального запуска, а облачные…
Языковые модели
RAG Retrieval-Augmented Generation
RAG (Retrieval-Augmented Generation) — техника, в которой LLM перед ответом достаёт из внешней базы релевантные документы и использует их как…
Языковые модели
Reasoning Models
Reasoning-модели тратят дополнительные вычисления перед финальным ответом: разбивают задачу, пробуют варианты, используют инструменты и проверяют промежуточный результат. Это особенно полезно…
Генеративные модели
Refiner
Refiner — отдельная модель или стадия, которая принимает промежуточный результат base и дорабатывает его в позднем диапазоне denoising. Такой этап…
Промпты
Regional Prompting
Regional Prompting — семейство способов связать отдельные описания с нужными участками изображения. Маски, прямоугольники или другие пространственные условия помогают развести…
Языковые модели
Reranking
Reranking — второй этап поиска, на котором уже найденные документы получают новые оценки и меняются местами. Быстрый retriever собирает кандидатов,…
Обучение
RLHF и DPO
RLHF и DPO используют сравнения ответов, чтобы скорректировать поведение модели. В классическом RLHF отдельная модель награды оценивает новые ответы, а…
Видео
Runway, Kling, Pika
Runway, Kling и Pika — закрытые платформы генерации и редактирования видео. Их модели и тарифы меняются, поэтому устойчивое сравнение строится…
Инструменты
Safetensors
Safetensors — открытый формат файлов для хранения весов нейросетевых моделей. Разработан Hugging Face как безопасная альтернатива формату .ckpt (Python pickle),…
Сэмплеры
Sampler sampling method
Sampler задаёт правило, по которому диффузионная модель обновляет noisy latent на каждом шаге. Он работает вместе с scheduler, checkpoint и…
Сэмплеры
Scheduler Karras schedule
Scheduler задаёт, на каких уровнях шума или временных точках sampler делает шаги генерации. При одинаковом числе шагов расписание может распределить…
Генеративные модели
SDXL Stable Diffusion XL
SDXL (Stable Diffusion XL) — поколение Stable Diffusion, рассчитанное на изображения примерно мегапиксельного масштаба. Оно использует два текстовых кодировщика, дополнительное…
Параметры
Seed
Seed (сид) — число, которое задаёт начальный шум для диффузионной модели. При одинаковой вычислительной среде он помогает повторить стартовую точку…
Адаптеры
Segmentation Map
Segmentation Map делит изображение на области и хранит для каждого пикселя метку класса или экземпляра объекта. В генеративном конвейере такая…
Языковые модели
Semantic Search
Semantic Search — поиск документов по **смыслу запроса**, а не по ключевым словам. Запрос превращается в эмбеддинг, документы заранее тоже,…
Языковые модели
Small Language Models SLM
Small Language Model — относительное название компактной LLM. Такая модель требует меньше памяти и вычислений, поэтому подходит для устройства, edge-сервера…
Генеративные модели
Stable Diffusion
Stable Diffusion — семейство диффузионных моделей изображений, начавшееся с выпуска открытых весов Stability AI. Поколения различаются архитектурой, лицензией и совместимыми…
Параметры
Steps
Steps — число итераций, за которые sampler переводит шум в изображение. Больше шагов обычно означает больше вычислений, но улучшение быстро…
Языковые модели
Structured Output
Structured Output ограничивает форму ответа схемой: обязательными полями, типами, enum и вложенными объектами. Это снимает многие ошибки парсинга, но не…
Этика и регулирование
Sustainable AI
Sustainable AI рассматривает энергию, воду и оборудование на всём жизненном цикле модели: обучение, инференс, хранение и замену серверов. Одна цифра…
Обучение
Synthetic Data
Синтетические данные создаются программой, симулятором или другой моделью, а не собираются напрямую из наблюдений за реальным миром. Они помогают покрыть…
Промпты
System Prompt
System Prompt задаёт модели роль, правила, формат и границы конкретного приложения. Он влияет на ответы сильнее обычного запроса, но не…
Языковые модели
Test-Time Compute Inference-Time Scaling
Test-Time Compute — способы потратить больше вычислений на конкретный ответ: сделать несколько попыток, провести поиск, проверить решение или увеличить внутренний…
Видео
Text-to-Video
Text-to-Video — генерация видео по текстовому описанию. Есть облачные сервисы и открытые модели для локального запуска, в том числе через…
Адаптеры
Textual Inversion TI
Textual Inversion учит новое текстовое представление концепта по примерам, сохраняя остальные веса генеративной модели замороженными. Полученный embedding загружается в совместимый…
Адаптеры
Tile / Tiling
Tile называют сразу несколько разных приёмов: обработку большого изображения перекрывающимися фрагментами, tiled diffusion во время sampling, tiled VAE для снижения…
Языковые модели
Token
Токен — элемент словаря модели: целое слово, часть слова, знак, пробел или последовательность байтов. Токенизатор превращает текст в идентификаторы, а…
Языковые модели
Tool Calling
Tool Calling позволяет модели предложить вызов поиска, калькулятора, базы или другой функции в структурированном виде. Само действие выполняет приложение или…
Основы AI
Training
Training, или обучение модели, — процесс настройки её параметров на примерах. Модель делает предсказание, функция потерь измеряет ошибку, а оптимизатор…
Основы AI
Transformer
Transformer — архитектура нейросети, представленная в статье Attention Is All You Need в 2017 году. Она обрабатывает последовательность через attention:…
Промпты
Trigger Word
Trigger word — слово или короткая фраза, которую во время обучения связывают с персонажем, предметом или стилем. Повтор той же…
Этика и регулирование
Trust in AI
Доверие к AI полезно, когда оно соответствует реальной надёжности системы. Пользователю нужны понятное назначение, проверенные ограничения, источники, возможность отменить действие…
Видео
TTS и STT
STT превращает запись речи в текст, а TTS — текст в звучащую речь. Вместе они лежат в основе транскрипции, дубляжа…
Инструменты
Upscaler
Upscaler делает изображение крупнее. Обычная интерполяция вычисляет новые пиксели по соседним, а обученная модель ещё и оценивает, какие контуры и…
Генеративные модели
VAE Variational Autoencoder
VAE переводит изображение в компактный латентный тензор и декодирует его обратно в пиксели. В txt2img обычно работает decoder, а в…
Языковые модели
Vector Database Vector DB
Vector Database хранит embedding-вектора вместе со ссылками на исходные объекты и метаданными. Для нового запроса она находит ближайшие записи по…
Промпты
Vibe Coding
Vibe Coding — название для подхода, в котором человек описывает желаемое поведение, принимает сгенерированный код и ориентируется на результат, почти…
Мультимодальные модели
VLA Vision-Language-Action
Vision-Language-Action-модель получает изображение или видео, понимает текстовую задачу и превращает её в действия робота. Вместо жёсткого сценария «увидел метку —…
Видео
Voice Cloning
Voice Cloning переносит тембр, акцент и манеру речи из образцов на новый текст. Быстрый клон строится по короткой записи, профессиональный…
Параметры
VRAM Video RAM
VRAM хранит данные, с которыми графический процессор работает прямо сейчас: веса модели, активации, кадры и временные буферы. Чем больше данных…
Видео
Whisper
Whisper — семейство моделей OpenAI для многоязычного распознавания речи и перевода аудио в английский. Веса опубликованы для локального запуска, а…
Мультимодальные модели
World Models World Model
Мировая модель хранит внутреннее представление среды и предсказывает её следующее состояние. Она помогает агенту представить последствия действия до того, как…
Промпты
Zero-shot и Few-shot
Zero-shot означает, что модель получает инструкцию и новую задачу без готовых примеров. При few-shot в тот же контекст добавляют несколько…
Ничего не найдено по этим фильтрам.