AI Library · Каталог
Каталог156/ 156
Все термины библиотеки с поиском, фильтром по разделу и семью способами сортировки.
Языковые модели
Agentic AI
Agentic AI — системы, которые планируют несколько шагов, используют инструменты и проверяют промежуточный результат. Они особенно полезны там, где есть…
Основы AI
AI ИИ
Искусственный интеллект, AI или ИИ, — широкое название систем, которые распознают данные, строят прогнозы, создают контент, планируют шаги или помогают…
Языковые модели
AI Agent
AI-агент — система, которая выбирает действия для решения задачи и получает обратную связь от среды. Агент на базе языковой модели…
Применения
AI in Cybersecurity
AI в кибербезопасности помогает разбирать поток событий, искать аномалии, группировать оповещения и готовить черновики расследований. Те же технологии упрощают фишинг,…
Применения
AI in Education
AI в образовании помогает объяснять материал разными способами, давать подсказки, создавать тренировочные задания и разбирать черновики. Учителю он может снять…
Применения
AI in Healthcare
Нейросети в медицине помогают готовить черновики клинических записей, анализировать снимки и искать закономерности в данных. Это не единый «AI-врач», а…
Этика и регулирование
AI Safety
AI Safety изучает, как снизить вероятность вреда от модели и продукта вокруг неё. Сюда входят тесты, защита данных и инструментов,…
Языковые модели
AI Search
AI-поиск использует модели, чтобы находить и сопоставлять сведения. В генеративном поиске система собирает ответ по найденным материалам и показывает ссылки.…
Языковые модели
Alignment
Alignment — работа над тем, чтобы поведение AI соответствовало заданным человеческим целям и ограничениям. Для языковых моделей это включает обучение…
Видео
AnimateDiff
AnimateDiff — способ заставить обычную модель Stable Diffusion рисовать не один кадр, а короткое видео. К модели подключается отдельный «модуль…
Основы AI
API Application Programming Interface
API — программный интерфейс: правила, по которым одна программа обращается к другой. Через API можно передать модели текст, изображение или…
Параметры
Aspect Ratio AR
Aspect Ratio описывает форму кадра как отношение ширины к высоте. Оно влияет на композицию и на то, насколько размер близок…
Инструменты
AUTOMATIC1111
AUTOMATIC1111, или Stable Diffusion WebUI, — интерфейс для генерации изображений с помощью совместимых моделей Stable Diffusion. Промпт, параметры и результат…
Параметры
Batch Size
Batch Size — количество примеров в одном вычислительном пакете. При генерации он влияет на память, задержку и пропускную способность; при…
Языковые модели
Benchmark
Benchmark — общий набор задач, правил запуска и метрик для сравнения моделей. Результат имеет смысл только вместе с версией набора…
Адаптеры
Canny Edge
Canny Edge — алгоритм извлечения контуров изображения, изобретённый Джоном Канни в 1986-м. В Stable Diffusion через ControlNet Canny используется как…
Параметры
CFG Scale Classifier-Free Guidance
CFG Scale управляет тем, насколько сильно диффузионная модель отталкивается от безусловного предсказания в сторону промпта. Слишком слабое влияние может дать…
Языковые модели
ChatGPT
ChatGPT — AI-ассистент OpenAI с чатом, поиском, памятью и инструментами для файлов, изображений, голоса и кода. Это продукт вокруг семейства…
Языковые модели
Chunking
Chunking — разбиение документов на фрагменты для поиска и подготовки контекста модели. Маленький фрагмент может потерять важное пояснение, большой —…
Языковые модели
Claude
Claude — семейство языковых моделей и AI-ассистент от компании Anthropic, для работы с текстом, документами и кодом. Готовый чат помогает…
Генеративные модели
CLIP Contrastive Language-Image Pretraining
CLIP состоит из текстового и визуального энкодеров, обученных сближать подходящие пары «изображение — подпись» и отдалять неподходящие. Благодаря этому текст…
Инструменты
ComfyUI
ComfyUI — это визуальный интерфейс для запуска моделей генерации изображений на основе графа узлов. Каждый шаг пайплайна (загрузка модели, кодирование…
Инструменты
ComfyUI Manager
ComfyUI Manager помогает искать, устанавливать, обновлять и отключать сторонние ноды, находить недостающие пакеты из чужой схемы, управлять моделями и сохранять…
Языковые модели
Computer Use Computer-Using Agent (CUA)
Computer Use (CUA, компьютерный агент) — ИИ-агент, который управляет компьютером как человек: делает скриншот экрана, «видит» интерфейс, двигает курсор, кликает…
Промпты
Context Engineering
Context Engineering — практика системно снабжать AI-модель нужным контекстом до того, как она ответит. Память о пользователе, документы через RAG,…
Языковые модели
Context Window
Контекстное окно — объём токенов, доступный модели во время одного вызова. Туда попадают инструкции, история диалога, документы, результаты инструментов и…
Адаптеры
ControlNet
ControlNet — техника управления композицией в диффузионных моделях через зрительную подсказку: скелет позы (OpenPose), контур (Canny), карту глубины (Depth), набросок…
Языковые модели
Cost per Token
Cost per Token описывает тарификацию LLM API по объёму входа и выхода. К итоговой сумме могут добавляться кэш, инструменты, хранение…
Инструменты
CUDA Compute Unified Device Architecture
CUDA связывает программы с видеокартами NVIDIA. Через её runtime, драйвер и библиотеки фреймворки запускают матричные операции, свёртки и attention на…
Инструменты
Cursor
Cursor — редактор на базе VS Code с AI-функциями для автодополнения, поиска по проекту и многофайловых изменений. Он соединяет контекст…
Инструменты
Custom Nodes
Custom Nodes — сторонние расширения ComfyUI. Они добавляют новые загрузчики, модели, способы управления, обработку видео, звука и изображений. Пакеты из…
Генеративные модели
DALL-E
DALL-E — семейство генераторов изображений OpenAI, с которым связаны ранние опыты рисования по тексту и редактирования в диалоге. Объясняем, чем…
Обучение
Dataset
Dataset, или датасет, — организованный набор примеров для обучения, настройки или проверки модели. В нём важны не только объём и…
Обучение
Dataset Captioning
Dataset Captioning — подготовка текстовых подписей к изображениям в обучающем датасете. Подпись связывает конкретный снимок с его содержанием и помогает…
Основы AI
Deep Learning DL
Deep Learning, или глубокое обучение, — область машинного обучения, где модель строится из нескольких обучаемых преобразований. Вместо заранее написанного списка…
Языковые модели
DeepSeek
DeepSeek — компания и семейство языковых моделей, включающее облачные API, модели рассуждения, варианты для кода и опубликованные веса. Облачный сервис…
Параметры
Denoising Strength
Denoising Strength задаёт, насколько сильно генерация может отойти от входного изображения. Чем выше сила, тем больше шума получает исходник перед…
Адаптеры
Depth Map
Depth Map кодирует глубину сцены: какие поверхности находятся ближе, а какие дальше. Такая карта помогает генеративной модели сохранить расстановку и…
Языковые модели
Diffusion LLM Diffusion Language Model
Diffusion LLM, или dLLM, генерирует текст через несколько раундов уточнения. В маскированном варианте модель начинает с пропусков и постепенно заполняет…
Генеративные модели
Diffusion Model
Diffusion Model — семейство генеративных моделей, которые учатся восстанавливать данные из зашумлённого состояния. При генерации процесс идёт от случайного шума…
Адаптеры
DreamBooth
DreamBooth — рецепт персонализации text-to-image модели по нескольким изображениям конкретного объекта. Во время обучения редкий идентификатор связывается с его внешностью,…
Инструменты
Edge AI
Edge AI запускает модель на телефоне, компьютере, камере, автомобиле или локальном сервере рядом с устройством. Такой подход уменьшает зависимость от…
Видео
ElevenLabs
ElevenLabs — облачная платформа для работы с AI-аудио. Она превращает текст в речь, создаёт и клонирует голоса, переводит аудио и…
Языковые модели
Embedding
Embedding (эмбеддинг) — числовой вектор, которым модель представляет объект: слово, фрагмент текста, изображение или другой материал. Если модель обучена для…
Обучение
Epoch
Epoch, или эпоха, — один проход через весь обучающий набор. Она показывает, сколько раз данные были охвачены тренировкой, но сама…
Этика и регулирование
EU AI Act
EU AI Act регулирует AI в Евросоюзе с учётом назначения системы, уровня риска и роли компании. Для запрещённых практик, высокорисковых…
Этика и регулирование
Explainable AI XAI
Explainable AI объединяет методы, которые помогают исследовать вклад признаков, сравнивать возможные решения и объяснять работу системы разным людям. Одно объяснение…
Инструменты
Face Restoration
Face Restoration — обработка лица на фотографии или сгенерированном кадре. Специальная модель добавляет правдоподобные детали, а автоматический inpainting перерисовывает выбранную…
Инструменты
Faceswap
Faceswap переносит черты лица из изображения-источника в фотографию или видео. Система находит лицо, сопоставляет его с позой и мимикой человека…
Обучение
Fine-tuning
Fine-tuning продолжает обучение готовой модели на данных конкретной задачи. Так можно закрепить формат, стиль, терминологию или способ принимать решения. Полное…
Генеративные модели
FLUX
FLUX — семейство генеративных моделей Black Forest Labs для создания и редактирования изображений. В нём есть облачные варианты и модели…
Параметры
FP16, BF16, FP8
FP16, BF16 и FP8 по-разному делят биты между экспонентой и дробной частью. FP16 оставляет больше значащих битов, BF16 сохраняет диапазон…
Языковые модели
Function Calling
Function Calling позволяет модели выбрать описанную функцию и вернуть её имя с JSON-аргументами. Функцию выполняет приложение, а не сама LLM.…
Языковые модели
Gemini
Gemini — семейство моделей Google для текста, изображений, аудио, видео и работы с инструментами. Доступ к нему встроен в пользовательские…
Основы AI
Generative AI Генеративный AI
Генеративный AI создаёт текст, изображения, звук, видео, код и другие данные по примерам и условиям. Модель не обязана искать готовый…
Инструменты
GGUF GPT-Generated Unified Format
GGUF — переносимый формат тензоров и метаданных, тесно связанный с llama.cpp и совместимыми приложениями. Файл может содержать квантизированные веса, сведения…
Инструменты
Google AI Studio
Google AI Studio помогает испытать модели Gemini в браузере, настроить промпт и мультимодальный вход, получить пример вызова API и собрать…
Языковые модели
GPT Generative Pre-trained Transformer
GPT расшифровывается как Generative Pre-trained Transformer. Это семейство моделей OpenAI, которые предварительно обучаются на больших наборах данных, а затем настраиваются…
Основы AI
Graph Neural Networks GNN
Графовые нейросети учитывают не только свойства объектов, но и связи между ними. Так можно исследовать молекулы, искать подозрительные транзакции или…
Языковые модели
Grok
Grok — семейство моделей и AI-ассистент, разработанные xAI. Он умеет отвечать на вопросы, работать с текстом и кодом, а при…
Параметры
Guidance
Guidance — семейство способов направлять генерацию к условию. Классический CFG усиливает разницу между условным и опорным предсказаниями, некоторые модели получают…
Языковые модели
Hallucination
Галлюцинация LLM — правдоподобное, но неверное утверждение в ответе языковой модели. Она может придумать источник, приписать программе несуществующую функцию или…
Инструменты
Harness
Harness — это программный слой, который организует работу модели: собирает вход, ведёт состояние, вызывает разрешённые инструменты, проверяет результат и сохраняет…
Параметры
Hires.fix
Hires.fix строит изображение в два прохода. Сначала модель создаёт базовый кадр и его композицию. Затем кадр увеличивается и частично зашумляется,…
Языковые модели
Hybrid Search
Hybrid Search объединяет несколько способов найти документы. Лексическая ветка удерживает точные слова и коды, семантическая замечает близкий смысл и перефразировки,…
Адаптеры
Hypernetwork
Hypernetwork в генерации изображений — отдельный обучаемый модуль, который влияет на работу attention — механизма внимания. В загрузчике ComfyUI он…
Видео
Image-to-Video
Image-to-Video (I2V) — модель берёт статичную картинку и достраивает движение объектов, камеры и света во времени. Исходник задаёт внешний вид…
Инструменты
img2img image-to-image
img2img — генерация на основе существующего изображения. В типичной схеме Stable Diffusion исходник кодируется в латентное представление, зашумляется и перерабатывается…
Основы AI
Inference
Inference, или инференс, начинается, когда готовая модель получает новые данные и строит результат: класс, прогноз, текст, изображение или эмбеддинг. В…
Инструменты
Inpainting
Inpainting меняет часть изображения внутри маски и старается связать новую область с окружением. Так удаляют предметы, меняют одежду, исправляют детали…
Промпты
Intent Recognition
Распознавание намерений помогает понять, зачем человек написал сообщение: хочет заказать еду, узнать статус доставки или отменить заказ. Параметры — адрес,…
Адаптеры
IP-Adapter Image Prompt Adapter
IP-Adapter добавляет к текстовому промпту визуальное условие. Визуальный энкодер превращает референс в признаки, а отдельная ветка внимания передаёт их диффузионной…
Языковые модели
Jailbreak
Jailbreak — попытка добиться от AI ответа или поведения, которое запрещено его защитными правилами. Обычно речь идёт об обходе через…
Языковые модели
JSON Mode
JSON Mode ограничивает ответ языковой модели синтаксисом JSON. Это удобнее обычной просьбы «верни JSON», но режим не задаёт обязательные поля,…
Инструменты
JSON Workflow
JSON Workflow хранит структуру графа, типы нод, их параметры и связи в машиночитаемом тексте. В ComfyUI есть формат для визуального…
Языковые модели
Kimi
Kimi — продукт Moonshot AI: чат, модели, API и агентные инструменты для поиска, кода и работы с файлами. Сервис стал…
Языковые модели
Knowledge Graph
Knowledge Graph, или граф знаний, хранит сущности и утверждения о связях между ними. В нём можно явно показать, что человек…
Сэмплеры
KSampler
KSampler объединяет модель, условия генерации, исходный латент и настройки в один узел ComfyUI. Scheduler строит последовательность уровней шума, sampler задаёт…
Языковые модели
Latency
Latency описывает, сколько времени проходит от отправки запроса до результата. У потоковой языковой модели отдельно измеряют ожидание первого токена, интервалы…
Генеративные модели
Latent Space
Latent space — внутреннее пространство представлений, с которым работает модель. В латентной диффузии изображение представлено компактным пространственным тензором. Модель меняет…
Обучение
Learning Rate LR
Learning rate задаёт масштаб обновлений, которые делает оптимизатор. Слишком маленький шаг может не успеть за бюджет обучения, слишком большой —…
Видео
Lip Sync
Lip Sync меняет движение губ в видео так, чтобы оно совпадало с новой речью. Техника помогает при дубляже, замене реплик…
Языковые модели
LLM Large Language Model
LLM — большая языковая модель, обученная работать с языком на множестве примеров. Она может составить письмо, объяснить код, перевести текст…
Адаптеры
LoRA Low-Rank Adaptation
LoRA позволяет адаптировать модель к задаче, обучая небольшие добавки к выбранным весам вместо полного набора параметров. В генерации изображений так…
Основы AI
Machine Learning ML
Машинное обучение помогает программе находить закономерности в данных и использовать их для предсказаний, распознавания или генерации. Вместо подробного списка правил…
Языковые модели
Manus
Manus — облачный AI-агент, который получает цель, использует браузер, код и файлы, а затем возвращает результат: таблицу, отчёт или сайт.…
Параметры
Mask
Mask — одноканальная карта, которая задаёт, где операция действует полностью, частично или совсем не действует. В inpainting маска ограничивает область…
Языковые модели
MCP Model Context Protocol
MCP (Model Context Protocol) задаёт общий способ, которым AI-приложение обнаруживает инструменты, читает доступные данные и вызывает внешние действия. Протокол разделяет…
Языковые модели
Memory
Память AI-ассистента сохраняет сведения для дальнейших обращений: предпочтения, договорённости, описание проекта или итоги прошлой работы. Приложение выбирает, что добавить в…
Генеративные модели
Midjourney
Midjourney создаёт изображения по тексту и визуальным референсам, предлагает варианты и позволяет продолжать выбранный кадр в редакторе. Это облачный сервис:…
Обучение
Mixture of Experts MoE
В разреженной Mixture of Experts (MoE) часть слоёв содержит несколько экспертных модулей. Маршрутизатор выбирает для каждого токена часть из них.…
Языковые модели
MMLU и HumanEval
MMLU проверяет выбор ответа по разным предметам, а HumanEval — способность написать небольшую функцию, которая проходит тесты. Обе цифры полезны,…
Основы AI
Model
Модель машинного обучения преобразует данные, используя закономерности, найденные при обучении. Для нейросетевой модели нужны архитектура, веса, конфигурация и обработчики входа…
Основы AI
Model License
Лицензия модели описывает, что разрешено делать с конкретными весами: использовать, изменять и распространять их, в том числе в коммерческих сценариях.…
Обучение
Model Merge
Model Merge создаёт новую модель из весов нескольких совместимых моделей. Простое смешивание интерполирует одинаковые тензоры, delta merge переносит разницу между…
Основы AI
Multimodal AI
Multimodal AI принимает или создаёт данные нескольких типов: текст, изображения, аудио, видео и сигналы датчиков. Возможности не обязаны быть симметричными:…
Видео
Music Generation
Музыкальные модели создают аудио по описанию, напеву, референсу или заданной структуре. Одни генерируют готовую песню с вокалом, другие — инструментал,…
Промпты
Negative Prompt
Negative Prompt описывает признаки, от которых генерацию нужно оттолкнуть. В распространённой схеме classifier-free guidance модель сравнивает предсказания с положительным и…
Основы AI
Neural Network NN, ANN
Нейросеть (neural network, искусственная нейронная сеть) — математическая модель, в которой простые элементы-«нейроны» собраны в слои и обмениваются числами. На…
Сэмплеры
Noise Schedule
Noise schedule задаёт, какой уровень сигнала и шума соответствует каждому моменту диффузионного процесса. При генерации сэмплер идёт по выбранным точкам…
Инструменты
NotebookLM (Gemini Notebook)
NotebookLM собирает отдельное рабочее пространство из документов, ссылок, аудио и других источников. Чат отвечает с переходами к использованным фрагментам, а…
Основы AI
Open-source AI
Open-source AI даёт свободу использовать, изучать, изменять и распространять систему, а также материалы, без которых её нельзя осмысленно доработать. Доступные…
Адаптеры
OpenPose
OpenPose оценивает положение ключевых точек тела, лица и кистей на изображении. В генерации такую карту можно передать совместимому ControlNet, чтобы…
Инструменты
Outpainting
Outpainting расширяет холст и генерирует сцену в новых областях за пределами исходного кадра. Модель опирается на пиксели возле старой границы,…
Обучение
Overfitting
Overfitting, или переобучение, возникает, когда модель всё точнее подстраивается под обучающие примеры, но хуже работает на новых данных. В генерации…
Основы AI
Parameters
Параметры модели — обучаемые числа внутри матриц и других тензоров нейросети. При обучении эти значения подбираются по данным, а затем…
Языковые модели
Perplexity
Perplexity соединяет веб-поиск с языковой моделью: находит страницы, собирает связный ответ и показывает ссылки. Такой формат удобен для обзора темы,…
Промпты
Prompt
Промпт — запрос, который задаёт модели задачу и исходные условия. Он может включать инструкцию, текст для обработки, примеры и желаемый…
Промпты
Prompt Engineering
Промпт-инженерия — работа над запросом к языковой модели: формулировкой задачи, исходными данными, примерами и форматом ответа. Запрос проверяют на разных…
Промпты
Prompt Injection
Prompt injection — попытка изменить задачу AI через текст или другие данные, которые приложение не должно принимать за команды. Инструкция…
Промпты
Prompt Weighting
Prompt Weighting усиливает или ослабляет отдельные фрагменты текстового условия до генерации. Запись вроде `(красный шарф:1.2)` работает только там, где интерфейс…
Инструменты
PyTorch
PyTorch — библиотека с открытым исходным кодом для работы с тензорами, нейросетями и автоматическим дифференцированием. Модель описывается обычным Python-кодом, autograd…
Параметры
Quantization
Quantization переводит веса или активации модели в более компактное числовое представление. Данных для хранения и передачи становится меньше, но значения…
Языковые модели
Qwen
Qwen — семейство моделей Alibaba для текста, кода, рассуждения и мультимодальных задач. Часть весов публикуется для локального запуска, а облачные…
Языковые модели
RAG Retrieval-Augmented Generation
RAG (Retrieval-Augmented Generation) — техника, в которой LLM перед ответом достаёт из внешней базы релевантные документы и использует их как…
Языковые модели
Reasoning Models
Reasoning-модели тратят дополнительные вычисления перед финальным ответом: разбивают задачу, пробуют варианты, используют инструменты и проверяют промежуточный результат. Это особенно полезно…
Генеративные модели
Refiner
Refiner — отдельная модель или стадия, которая принимает промежуточный результат базовой модели и продолжает генерацию при небольшом уровне шума. Такой…
Промпты
Regional Prompting
Regional Prompting — семейство способов связать отдельные описания с нужными участками изображения. Маски, прямоугольники или другие пространственные условия помогают развести…
Языковые модели
Reranking
Reranking — второй этап поиска, на котором уже найденные документы получают новые оценки и меняются местами. Первичный поиск собирает кандидатов,…
Обучение
RLHF и DPO
RLHF и DPO используют сравнения ответов, чтобы скорректировать поведение модели. В классическом RLHF отдельная модель награды оценивает новые ответы, а…
Видео
Runway, Kling, Pika
Runway, Kling и Pika — закрытые платформы генерации и редактирования видео. Их модели и тарифы меняются, поэтому устойчивое сравнение строится…
Инструменты
Safetensors
Safetensors — открытый формат хранения тензоров, в том числе весов нейросетей. Он описывает числовые массивы и не использует механизм pickle,…
Сэмплеры
Sampler sampling method
Sampler задаёт правило обновления зашумлённого представления на каждом шаге генерации. Результат зависит также от расписания шума, модели и числа шагов.…
Сэмплеры
Scheduler Karras schedule
Scheduler задаёт, на каких уровнях шума или временных точках sampler делает шаги генерации. При одинаковом числе шагов расписание может распределить…
Генеративные модели
SDXL Stable Diffusion XL
SDXL (Stable Diffusion XL) — поколение Stable Diffusion, рассчитанное на изображения примерно мегапиксельного масштаба. Оно использует два текстовых кодировщика, дополнительное…
Параметры
Seed
Seed (сид) — число, которое задаёт начальный шум для диффузионной модели. При одинаковой вычислительной среде он помогает повторить стартовую точку…
Адаптеры
Segmentation Map
Segmentation Map делит изображение на области и хранит для каждого пикселя метку класса или экземпляра объекта. В генеративном конвейере такая…
Языковые модели
Semantic Search
Семантический поиск помогает находить материалы по смысловой близости, даже если запрос и документ сформулированы разными словами. В распространённой схеме тексты…
Языковые модели
Small Language Models SLM
Small Language Model — относительное название компактной LLM. Такая модель требует меньше памяти и вычислений, поэтому подходит для устройства, сервера…
Генеративные модели
Stable Diffusion
Stable Diffusion — семейство диффузионных моделей изображений, начавшееся с выпуска открытых весов Stability AI. Поколения различаются архитектурой, лицензией и совместимыми…
Параметры
Steps
Steps — число итераций, за которые sampler переводит шум в изображение. Больше шагов обычно означает больше вычислений, но улучшение быстро…
Языковые модели
Structured Output
Structured Output ограничивает форму ответа схемой: обязательными полями, типами, списками допустимых значений и вложенными объектами. Это снимает многие ошибки парсинга,…
Этика и регулирование
Sustainable AI
Sustainable AI рассматривает энергию, воду и оборудование на всём жизненном цикле модели: обучение, инференс, хранение и замену серверов. Одна цифра…
Обучение
Synthetic Data
Синтетические данные создаются программой, симулятором или другой моделью, а не собираются напрямую из наблюдений за реальным миром. Они помогают покрыть…
Промпты
System Prompt
System Prompt задаёт модели роль, правила, формат и границы конкретного приложения. Платформа обычно задаёт ему более высокий приоритет, чем запросу…
Языковые модели
Test-Time Compute Inference-Time Scaling
Test-Time Compute — способы потратить больше вычислений на конкретный ответ: сделать несколько попыток, провести поиск, проверить решение или увеличить внутренний…
Видео
Text-to-Video
Text-to-Video — генерация видео по текстовому описанию. Есть облачные сервисы и открытые модели для локального запуска, в том числе через…
Адаптеры
Textual Inversion TI
Textual Inversion учит новое текстовое представление концепта по примерам, сохраняя остальные веса генеративной модели замороженными. Полученный embedding загружается в совместимый…
Адаптеры
Tile / Tiling
Tile называют сразу несколько разных приёмов: обработку большого изображения перекрывающимися фрагментами, тайловый денойзинг, tiled VAE для снижения пиковой нагрузки на…
Языковые модели
Token
Токен — элемент словаря модели: целое слово, часть слова, знак, пробел или последовательность байтов. Токенизатор превращает текст в идентификаторы, а…
Языковые модели
Tool Calling
Tool Calling позволяет модели предложить вызов поиска, калькулятора, базы или другой функции в структурированном виде. Само действие выполняет приложение или…
Основы AI
Training
Training, или обучение модели, — процесс настройки её параметров на примерах. Модель делает предсказание, функция потерь измеряет ошибку, а оптимизатор…
Основы AI
Transformer
Transformer — архитектура нейросети, представленная в статье Attention Is All You Need в 2017 году. Она обрабатывает последовательность через attention:…
Промпты
Trigger Word
Trigger word — слово или короткая фраза, которую во время обучения связывают с персонажем, предметом или стилем. Повтор той же…
Этика и регулирование
Trust in AI
Доверие к AI полезно, когда оно соответствует реальной надёжности системы. Пользователю нужны понятное назначение, проверенные ограничения, источники, возможность отменить действие…
Видео
TTS и STT
STT превращает запись речи в текст, а TTS — текст в звучащую речь. Вместе они лежат в основе транскрипции, дубляжа…
Инструменты
Upscaler
Upscaler делает изображение крупнее. Обычная интерполяция вычисляет новые пиксели по соседним, а обученная модель ещё и оценивает, какие контуры и…
Генеративные модели
VAE Variational Autoencoder
VAE переводит изображение в компактный латентный тензор и декодирует его обратно в пиксели. В txt2img обычно работает decoder, а в…
Языковые модели
Vector Database Vector DB
Vector Database хранит векторы признаков вместе со ссылками на исходные объекты и метаданными. Для нового запроса она находит ближайшие записи…
Промпты
Vibe Coding
Vibe Coding — название для подхода, в котором человек описывает желаемое поведение, принимает сгенерированный код и ориентируется на результат, почти…
Мультимодальные модели
VLA Vision-Language-Action
Vision-Language-Action-модель получает изображение или видео и текстовую задачу, затем предсказывает действия робота. Вместо жёсткого сценария «увидел метку — выполнил одну…
Видео
Voice Cloning
Voice Cloning помогает синтезировать речь с признаками конкретного голоса. Одни методы используют образец сразу, другие дообучаются на записях. Названия режимов…
Параметры
VRAM Video RAM
VRAM хранит данные, с которыми графический процессор работает прямо сейчас: веса модели, активации, кадры и временные буферы. Чем больше данных…
Видео
Whisper
Whisper — семейство моделей OpenAI для многоязычного распознавания речи и перевода аудио в английский. Веса опубликованы для локального запуска, а…
Мультимодальные модели
World Models World Model
Мировая модель хранит внутреннее представление среды и предсказывает её следующее состояние. Она помогает агенту представить последствия действия до того, как…
Промпты
Zero-shot и Few-shot
Zero-shot означает, что модель получает инструкцию и новую задачу без готовых примеров. При few-shot в тот же контекст добавляют несколько…
Ничего не найдено по этим фильтрам.