AI Library · Каталог
Каталог156/ 156
Все термины библиотеки с поиском, фильтром по разделу и семью способами сортировки.
Языковые модели
Agentic AI
Agentic AI — системы, которые **действуют**: планируют многошаговые задачи, используют инструменты, итерируют без человека на каждом шаге. Не «ответ на…
Основы AI
AI ИИ
Искусственный интеллект (AI, Artificial Intelligence) — это технологии, которые позволяют компьютерам решать задачи, прежде доступные только человеку: распознавать речь и…
Языковые модели
AI Agent
AI Agent (AI-агент) — это LLM, которая не просто отвечает на вопрос, а решает задачу через несколько шагов и использует…
Применения
AI in Cybersecurity
AI in Cybersecurity — двусторонняя гонка вооружений: AI помогает защитникам обнаруживать атаки в реальном времени и AI помогает атакующим создавать…
Применения
AI in Education
AI in Education — применение нейросетей в обучении: персональные репетиторы (Khanmigo, Duolingo Max), адаптивные системы (которые меняют уровень сложности под…
Применения
AI in Healthcare
AI in Healthcare — применение нейросетей в медицине: от анализа КТ-снимков до автоматизации клинической записи и поиска новых лекарств. К…
Этика и регулирование
AI Safety
AI Safety — широкая дисциплина: как делать AI-системы, которые не причинят вреда людям и обществу. Включает alignment (модель делает то,…
Языковые модели
AI Search
AI Search — это новый формат поиска, в котором система не показывает список ссылок, а формирует прямой ответ через LLM…
Языковые модели
Alignment
Alignment — процесс настройки LLM на поведение, согласованное с человеческими ценностями: быть полезной, честной, безопасной (helpful, honest, harmless). Без alignment…
Видео
AnimateDiff
AnimateDiff — способ заставить обычную модель Stable Diffusion рисовать не один кадр, а короткое видео. К модели подключается отдельный «модуль…
Основы AI
API Application Programming Interface
API (Application Programming Interface) в контексте AI — это способ программно отправлять запросы к языковой модели и получать ответы. Вместо…
Параметры
Aspect Ratio AR
Aspect Ratio (соотношение сторон) — пропорция между шириной и высотой результата генерации. Самые частые: 1:1 (квадрат, соцсети), 16:9 (видео, обложки),…
Инструменты
AUTOMATIC1111
AUTOMATIC1111 (или Stable Diffusion WebUI) — классический веб-интерфейс для запуска моделей Stable Diffusion, появился в августе 2022 года. Долгое время…
Параметры
Batch Size
Batch Size — количество изображений (или текстовых примеров), которые модель обрабатывает за один проход. В Stable Diffusion определяет, сколько картинок…
Языковые модели
Benchmark
Benchmark — стандартизированный набор задач для сравнения моделей. MMLU тестирует знания, HumanEval — программирование, GSM8K — арифметику, MATH — математику,…
Адаптеры
Canny Edge
Canny Edge — алгоритм извлечения контуров изображения, изобретённый Джоном Канни в 1986-м. В Stable Diffusion через ControlNet Canny используется как…
Параметры
CFG Scale Classifier-Free Guidance
CFG Scale (Classifier-Free Guidance) — параметр, который управляет тем, насколько строго диффузионная модель следует промпту. Низкие значения (1–3) дают свободную…
Языковые модели
ChatGPT
ChatGPT — продукт OpenAI для общения с языковой моделью GPT в формате чата. Доступен через сайт chat.openai.com, мобильные приложения и…
Языковые модели
Chunking
Chunking — разбиение длинных документов на маленькие фрагменты (chunks) для индексации в RAG. От выбора размера и стратегии разбиения зависит…
Языковые модели
Claude
Claude — семейство языковых моделей и AI-ассистент от компании Anthropic, основанной выходцами из OpenAI. Сильная сторона Claude — длинные рассуждения,…
Генеративные модели
CLIP Contrastive Language-Image Pretraining
CLIP (Contrastive Language-Image Pretraining) — модель OpenAI 2021 года, которая учится одновременно понимать текст и картинки. Внутри две нейросети: image…
Инструменты
ComfyUI
ComfyUI — это визуальный интерфейс для запуска моделей генерации изображений на основе графа узлов. Каждый шаг пайплайна (загрузка модели, кодирование…
Инструменты
ComfyUI Manager
ComfyUI Manager — расширение-менеджер для ComfyUI: установка, обновление, удаление custom nodes; скачивание моделей с Civitai и Hugging Face; обнаружение отсутствующих…
Языковые модели
Computer Use Computer-Using Agent (CUA)
Computer Use (CUA, компьютерный агент) — ИИ-агент, который управляет компьютером как человек: делает скриншот экрана, «видит» интерфейс, двигает курсор, кликает…
Промпты
Context Engineering
Context Engineering — практика системно снабжать AI-модель нужным контекстом до того, как она ответит. Память о пользователе, документы через RAG,…
Языковые модели
Context Window
Контекстное окно (context window) — максимальное количество токенов, которое языковая модель может удержать в одном запросе. Туда входят системный промпт,…
Адаптеры
ControlNet
ControlNet — техника управления композицией в диффузионных моделях через зрительную подсказку: скелет позы (OpenPose), контур (Canny), карту глубины (Depth), набросок…
Языковые модели
Cost per Token
Cost per Token — главная единица стоимости LLM API. Цена считается отдельно за input (то, что вы отправили) и output…
Инструменты
CUDA Compute Unified Device Architecture
CUDA (Compute Unified Device Architecture) — платформа и язык параллельных вычислений от NVIDIA. Это слой, через который PyTorch, TensorFlow, Stable…
Инструменты
Cursor
Cursor — AI-IDE на базе VS Code, переписанный под программирование «с AI как со-пилотом». К 2026-му ~25 млн визитов/мес (+41%…
Инструменты
Custom Nodes
Custom Nodes — пользовательские ноды ComfyUI, написанные сообществом. Расширяют возможности базового ComfyUI новыми операциями: видео-генерация (AnimateDiff), управление лицом (FaceID), быстрые…
Генеративные модели
DALL-E
DALL-E — семейство закрытых моделей генерации изображений от OpenAI, начатое в 2021 году. Третья версия (DALL-E 3) интегрирована в ChatGPT:…
Обучение
Dataset
Датасет (dataset) — это набор примеров, на которых модель учится решать задачу. Каждый пример состоит из входа (картинка, текст, аудио)…
Обучение
Dataset Captioning
Dataset Captioning — это процесс добавления текстовых подписей к каждой картинке датасета перед тренировкой LoRA или DreamBooth. От качества подписей…
Основы AI
Deep Learning DL
Deep Learning (глубокое обучение, DL) — раздел машинного обучения, в котором используются нейросети с большим числом скрытых слоёв (от десятков…
Языковые модели
DeepSeek
DeepSeek — китайская AI-компания и одноимённая семейство моделей, взорвавшая индустрию в январе 2025 релизом R1 — open-weight reasoning-модели уровня OpenAI…
Параметры
Denoising Strength
Denoising Strength (сила шумоподавления) — параметр img2img в диапазоне 0..1, определяющий, насколько модель «перепишет» входную картинку. При 0.0 выход идентичен…
Адаптеры
Depth Map
Depth Map — чёрно-белое изображение, где яркость каждого пикселя означает расстояние до камеры: ближе — светлее, дальше — темнее. В…
Языковые модели
Diffusion LLM Diffusion Language Model
Diffusion LLM (диффузионная языковая модель, dLLM) — языковая модель, которая генерирует текст не по одному токену слева направо, а «проявляет»…
Генеративные модели
Diffusion Model
Diffusion Model — архитектура генеративных моделей, которая работает наоборот привычной интуиции: учится «расшумлять» данные. На вход — белый шум, на…
Адаптеры
DreamBooth
DreamBooth — техника тонкой настройки диффузионной модели под конкретный объект, разработанная Google Research в 2022 году. Отличие от LoRA и…
Инструменты
Edge AI
Edge AI — запуск нейросетей прямо на устройстве пользователя или ближайшем «edge»-сервере: телефоне, ноутбуке, авто, камере наблюдения, микроволновке. Без облака.…
Видео
ElevenLabs
ElevenLabs — лидер AI-голоса. Клонирование любого голоса по 30 секундам аудио, text-to-speech на 32 языках, моментальный дубляж видео с сохранением…
Языковые модели
Embedding
Embedding (эмбеддинг) — это длинный вектор чисел, который представляет смысл слова, фразы, документа или изображения. Близкие по смыслу объекты получают…
Обучение
Epoch
Epoch (эпоха) — единица тренировки нейросети: один полный проход по всему датасету. Если в датасете 50 картинок и batch size…
Этика и регулирование
EU AI Act
EU AI Act — первый в мире комплексный закон об искусственном интеллекте. Принят Евросоюзом в 2024-м, поэтапное вступление 2025-2027. Делит…
Этика и регулирование
Explainable AI XAI
Explainable AI (XAI) — направление, делающее решения нейросетей понятными для человека. Когда модель отказывает в кредите, ставит диагноз или дисквалифицирует…
Инструменты
Face Restoration
Face Restoration — отдельный пост-обработочный шаг, который улучшает лица на сгенерированной или старой фотографии. Решает классическую проблему AI-генерации: лица «уплывают»,…
Инструменты
Faceswap
Faceswap — замена лица на фото или в видео на другое одной нейросетью, без обучения. Готовая модель (inswapper) берёт лицо…
Обучение
Fine-tuning
Fine-tuning (тонкая настройка) — дообучение готовой модели на узком наборе данных под конкретную задачу. Полное обучение с нуля стоит миллионы…
Генеративные модели
FLUX
FLUX (FLUX.1) — семейство диффузионных моделей для генерации изображений, выпущенное Black Forest Labs в августе 2024 года. Команда — те…
Параметры
FP16, BF16, FP8
FP16, BF16 и FP8 — форматы хранения чисел с плавающей запятой в нейросетях. FP16 (16 бит) — старый стандарт точной…
Языковые модели
Function Calling
Function Calling — механизм, при котором LLM решает, какую внешнюю функцию вызвать и с какими аргументами. Модель сама не выполняет…
Языковые модели
Gemini
Gemini — семейство мультимодальных языковых моделей от Google DeepMind, третий главный игрок на рынке AI-ассистентов рядом с ChatGPT и Claude.…
Основы AI
Generative AI Генеративный AI
Генеративный AI (Generative AI) — класс нейросетей, которые создают новый контент: тексты, изображения, видео, музыку, код. В отличие от классических…
Инструменты
GGUF GPT-Generated Unified Format
GGUF (GPT-Generated Unified Format) — формат файла для запуска квантизованных нейросетей на обычном железе. Один файл хранит и веса, и…
Инструменты
Google AI Studio
Google AI Studio — официальный playground Google для работы с моделями Gemini: тестируешь промпты в браузере, получаешь готовый код для…
Языковые модели
GPT Generative Pre-trained Transformer
GPT (Generative Pre-trained Transformer) — семейство больших языковых моделей OpenAI, на которых построены ChatGPT и платный API. Архитектурно это трансформер,…
Основы AI
Graph Neural Networks GNN
Graph Neural Networks (GNN) — класс нейросетей, который работает не с таблицами, картинками или текстами, а с графами: узлами и…
Языковые модели
Grok
Grok — большая языковая модель от xAI, компании Илона Маска. Главная фишка — доступ к ленте X (Twitter) в реальном…
Параметры
Guidance
Guidance — общее понятие управления тем, насколько модель следует заданному условию: промпту, изображению, ControlNet-карте. В Stable Diffusion проявляется как CFG…
Языковые модели
Hallucination
Hallucination (галлюцинация) — ошибка LLM, когда модель уверенно выдумывает факт, который выглядит правдоподобно, но не существует. Это не баг, а…
Инструменты
Harness
Harness — это программная обёртка вокруг языковой модели, которая превращает её из единичного API-вызова «дал текст — получил ответ» в…
Параметры
Hires.fix
Hires.fix — техника двухэтапной генерации в Stable Diffusion: сначала модель рисует базовое изображение в 512×512 или 1024×1024, потом апскейлит его…
Языковые модели
Hybrid Search
Hybrid Search — комбинация semantic search (по векторам смысла) и keyword search (BM25, по точным словам). Каждый ловит то, что…
Адаптеры
Hypernetwork
Hypernetwork — техника тонкой настройки Stable Diffusion 2022 года. Подключает к U-Net дополнительную маленькую нейросеть, которая модифицирует cross-attention слои на…
Видео
Image-to-Video
Image-to-Video (I2V) — модель берёт статичную картинку и генерирует из неё короткое видео: 3–10 секунд. Можно задать промпт о желаемом…
Инструменты
img2img image-to-image
img2img (image-to-image) — режим генерации, в котором на вход модели подаётся картинка, а не случайный шум. Модель частично её «стирает»…
Основы AI
Inference
Inference (инференс) — использование уже обученной модели. На вход подаются данные (текст, картинка, аудио), модель прогоняет их через слои и…
Инструменты
Inpainting
Inpainting (вписывание) — режим, где модель переписывает только выделенную маской область картинки, а остальные пиксели сохраняются нетронутыми. Используется для удаления…
Промпты
Intent Recognition
Intent Recognition (Intent Detection) — задача NLP: понять, какую цель преследует пользователь в своём сообщении, даже если он сформулировал её…
Адаптеры
IP-Adapter Image Prompt Adapter
IP-Adapter (Image Prompt Adapter) — адаптер от Tencent, выпущенный в августе 2023 года, который позволяет использовать картинку как «промпт». Модель…
Языковые модели
Jailbreak
Jailbreak — техника обхода встроенных ограничений LLM (alignment-фильтров), чтобы заставить модель выполнить запрещённое: написать вредоносный код, обойти политики, выдать опасные…
Языковые модели
JSON Mode
JSON Mode — режим API LLM, гарантирующий, что ответ будет **валидным JSON**, но без контроля конкретной схемы. Появился в OpenAI…
Инструменты
JSON Workflow
JSON Workflow — формат сохранения и обмена пайплайнами в ComfyUI. Каждый workflow — это JSON-файл с описанием нод, их параметров…
Языковые модели
Kimi
Kimi — AI-ассистент от китайской Moonshot AI, известный гигантским контекстным окном (до 2M токенов в Kimi K2) и сильной поддержкой…
Языковые модели
Knowledge Graph
Knowledge Graph — структурированная база знаний в виде узлов (сущности) и рёбер (связи между ними). «Москва — столица — России»,…
Сэмплеры
KSampler
KSampler — центральный узел диффузионного пайплайна в ComfyUI. Он получает на вход модель, два промпта (положительный и отрицательный) и пустой…
Языковые модели
Latency
Latency — задержка между запросом и ответом LLM. У современных моделей две ключевые метрики: TTFT (Time To First Token) —…
Генеративные модели
Latent Space
Latent Space (латентное пространство) — это многомерное пространство, в котором нейросеть хранит сжатое представление данных. В Stable Diffusion каждая картинка…
Обучение
Learning Rate LR
Learning Rate (LR) — самый важный параметр любой тренировки: скорость, с которой модель «делает шаг» в сторону уменьшения ошибки. Слишком…
Видео
Lip Sync
Lip Sync — техника, которая «пересинхронизирует» движение губ говорящего на видео с другой аудио-дорожкой. Главные сценарии: дубляж видео на другие…
Языковые модели
LLM Large Language Model
LLM (Large Language Model) — большая языковая модель, нейросеть, обученная на триллионах слов и умеющая осмысленно продолжать любой текст. Принципиально…
Адаптеры
LoRA Low-Rank Adaptation
LoRA (Low-Rank Adaptation) — техника тонкой настройки больших диффузионных моделей. Вместо переобучения целой модели (6+ ГБ) рядом с базой подключается…
Основы AI
Machine Learning ML
Machine Learning (машинное обучение, ML) — раздел AI, в котором программа не получает готовые правила, а выводит их сама из…
Языковые модели
Manus
Manus — general-purpose AI-агент от китайской Butterfly Effect, заявленный в марте 2025 как «первый AGI-агент». В отличие от чат-ассистентов, Manus…
Параметры
Mask
Mask (маска) — чёрно-белое изображение, которое сообщает модели, где она должна работать, а где не трогать. Белые пиксели — активная…
Языковые модели
MCP Model Context Protocol
MCP (Model Context Protocol) — открытый протокол от Anthropic для подключения внешних инструментов и источников данных к LLM. Принцип: серверы…
Языковые модели
Memory
Memory — способность AI-ассистента помнить факты о пользователе между сессиями. В отличие от Context Window (один разговор) Memory сохраняет информацию…
Генеративные модели
Midjourney
Midjourney — закрытая коммерческая модель для генерации изображений от одноимённой компании Дэвида Хольца, запущена в 2022 году. Работает только через…
Обучение
Mixture of Experts MoE
Mixture of Experts (MoE) — архитектура нейросетей, где модель состоит не из одной плотной сети, а из десятков «экспертов»: на…
Языковые модели
MMLU и HumanEval
MMLU и HumanEval — два самых цитируемых бенчмарка LLM. MMLU (Massive Multitask Language Understanding) — 15 908 вопросов из 57…
Основы AI
Model
Модель в AI — это файл с обученной нейросетью. Внутри лежат архитектура (как соединены слои) и веса (миллионы или миллиарды…
Основы AI
Model License
Лицензия модели — юридическое соглашение, описывающее, как можно использовать веса AI-модели. Скачать модель и запустить локально часто можно бесплатно, но…
Обучение
Model Merge
Model Merge — объединение весов двух или нескольких моделей в одну новую. Применяется в Stable Diffusion и SDXL: смешивают чекпоинты,…
Основы AI
Multimodal AI
Multimodal AI (мультимодальный AI) — модели, которые принимают и/или выдают разные типы данных: текст, изображения, аудио, видео. Одна модель может…
Видео
Music Generation
Music Generation — создание музыки и песен по текстовому описанию. Главные платформы: Suno (песни с вокалом), Udio (студийное качество), Stable…
Промпты
Negative Prompt
Negative Prompt — текст, который указывает диффузионной модели, чего НЕ должно быть в результате. Параллелен положительному промпту: один описывает желаемое,…
Основы AI
Neural Network NN, ANN
Нейросеть (neural network, искусственная нейронная сеть) — математическая модель, в которой простые элементы-«нейроны» собраны в слои и обмениваются числами. На…
Сэмплеры
Noise Schedule
Noise Schedule — расписание уровней шума по шагам диффузии. На каждом шаге модели нужно знать, **сколько шума** должно быть в…
Инструменты
NotebookLM
NotebookLM — исследовательский AI-инструмент Google: загружаешь до 50 источников (PDF, Google Docs, ссылки, видео), AI отвечает на вопросы, цитируя только…
Основы AI
Open-source AI
Open-source AI и open-weight AI — это разные степени открытости моделей. «Open-weight» значит, что компания публикует обученные веса: их можно…
Адаптеры
OpenPose
OpenPose — препроцессор и модель ControlNet для управления позой человека в Stable Diffusion. Превращает любое фото в палочную фигуру (skeleton),…
Инструменты
Outpainting
Outpainting (дорисовывание за края) — режим, где модель достраивает картинку за её первоначальные границы. Технически это inpainting с маской по…
Обучение
Overfitting
Overfitting (переобучение) — главная проблема тренировки нейросетей. Модель начинает «зазубривать» обучающий датасет вместо того, чтобы обобщать закономерности. В LoRA это…
Основы AI
Parameters
Параметры (parameters, веса модели) — это числа внутри нейросети, которые подбираются во время обучения. У одного нейрона есть веса входов…
Языковые модели
Perplexity
Perplexity — AI-поисковик нового поколения: задаёшь вопрос, получаешь не «10 синих ссылок», а готовый ответ с цитатами на источники в…
Промпты
Prompt
Промпт (prompt) — текстовый запрос, который пользователь передаёт языковой модели, чтобы получить ответ. От формулировки промпта зависит результат: одна и…
Промпты
Prompt Engineering
Prompt Engineering (промпт-инженерия) — навык формулировать запросы к языковой модели так, чтобы получать предсказуемый, точный и полезный ответ. Это не…
Промпты
Prompt Injection
Prompt Injection — атака, при которой пользователь или внешние данные заставляют LLM нарушить исходные инструкции (system prompt). Direct injection: пользователь…
Промпты
Prompt Weighting
Prompt Weighting — техника локального управления силой отдельных слов в промпте. Синтаксис `(красная роза:1.4)` усиливает слово в 1.4 раза, `[жёлтый:0.7]`…
Инструменты
PyTorch
PyTorch — open-source библиотека для глубокого обучения, созданная Meta (Facebook AI Research) в 2016 году. Главная особенность — динамический граф…
Параметры
Quantization
Quantization (квантизация) — техника снижения точности чисел в модели для экономии памяти и ускорения работы. Стандартные веса FP16 (16 бит)…
Языковые модели
Qwen
Qwen (произносится «чвен») — семейство open-weight LLM от Alibaba Cloud. К 2026-му Qwen3 — гибридная модель: умеет переключаться между быстрым…
Языковые модели
RAG Retrieval-Augmented Generation
RAG (Retrieval-Augmented Generation) — техника, в которой LLM перед ответом достаёт из внешней базы релевантные документы и использует их как…
Языковые модели
Reasoning Models
Reasoning Models — категория LLM, которые перед финальным ответом проходят через явный chain-of-thought (внутренний диалог), пробуя гипотезы, переоценивая, исправляя ошибки.…
Генеративные модели
Refiner
Refiner — это дополнительная модель в SDXL, которую запускают на последних 20–30% шагов диффузии для финальной полировки. Базовая модель формирует…
Промпты
Regional Prompting
Regional Prompting — техника, которая разрешает использовать **разные промпты для разных областей** одного изображения. Левый верхний угол — «горный пейзаж»,…
Языковые модели
Reranking
Reranking — двухступенчатый поиск: сначала быстрый retrieval достаёт топ-50 кандидатов, потом более точная (но медленная) reranker-модель переоценивает их и оставляет…
Обучение
RLHF и DPO
RLHF (Reinforcement Learning from Human Feedback) и DPO (Direct Preference Optimization) — главные методы обучения LLM на предпочтениях. RLHF —…
Видео
Runway, Kling, Pika
Runway, Kling и Pika — главные альтернативы Sora и Veo для генерации видео. Runway Gen-4 (USA) — для VFX-pipelines, профессиональный…
Инструменты
Safetensors
Safetensors — открытый формат файлов для хранения весов нейросетевых моделей. Разработан Hugging Face как безопасная альтернатива формату .ckpt (Python pickle),…
Сэмплеры
Sampler sampling method
Sampler (сэмплер) — алгоритм, который ведёт диффузионную модель от чистого шума к готовой картинке за 15–40 шагов. От его выбора…
Сэмплеры
Scheduler Karras schedule
Scheduler (шедулер) — правило, по которому при генерации картинки уменьшается уровень шума на каждом шаге диффузии. Семь актуальных шедулеров в…
Генеративные модели
SDXL Stable Diffusion XL
SDXL (Stable Diffusion XL) — увеличенная версия Stable Diffusion от Stability AI, выпущенная в июле 2023 года. По параметрам в…
Параметры
Seed
Seed (сид) — число, которое задаёт начальный шум для диффузионной модели. При одинаковом seed, промпте и остальных параметрах получается одна…
Адаптеры
Segmentation Map
Segmentation Map — цветная карта изображения, где каждый пиксель окрашен по категории объекта: небо одним цветом, человек другим, дерево третьим.…
Языковые модели
Semantic Search
Semantic Search — поиск документов по **смыслу запроса**, а не по ключевым словам. Запрос превращается в эмбеддинг, документы заранее тоже,…
Языковые модели
Small Language Models SLM
Small Language Models (SLM) — компактные LLM до ~10 миллиардов параметров, которые запускаются на ноутбуке или телефоне, часто без интернета.…
Генеративные модели
Stable Diffusion
Stable Diffusion — семейство открытых диффузионных моделей от Stability AI, выпущенное в августе 2022 года. Первая массовая модель, веса которой…
Параметры
Steps
Steps (sampling steps) — количество шагов, за которые диффузионная модель превращает шум в картинку. Каждый шаг убирает часть шума и…
Языковые модели
Structured Output
Structured Output — режим LLM, в котором модель **гарантированно** возвращает ответ в заданном формате (обычно JSON по схеме). Раньше приходилось…
Этика и регулирование
Sustainable AI
Sustainable AI — направление, которое считает экологический след нейросетей и снижает его. Обучение GPT-4 — оценочно 50 ГВт·ч электричества и…
Обучение
Synthetic Data
Synthetic Data — данные, созданные не людьми, а самими нейросетями: сгенерированные тексты, картинки, диалоги, симуляции. К 2026 — половина обучающих…
Промпты
System Prompt
System Prompt — отдельная инструкция языковой модели, задающая её роль, характер, формат ответа и ограничения. В отличие от обычного user…
Языковые модели
Test-Time Compute Inference-Time Scaling
Test-Time Compute (вычисления во время вывода, inference-time scaling) — подход, при котором модель отвечает точнее не за счёт большего размера,…
Видео
Text-to-Video
Text-to-Video — генерация видео по текстовому описанию. Главные модели на 2026: OpenAI Sora 2 (до 60 сек, 1080p), Google Veo…
Адаптеры
Textual Inversion TI
Textual Inversion (TI) — самая лёгкая техника настройки диффузионной модели: тренируется эмбеддинг одного нового токена в словаре CLIP, веса модели…
Адаптеры
Tile / Tiling
Tile (тайлинг) в Stable Diffusion — две связанные техники. Первая — деление большого изображения на маленькие квадраты для пошаговой обработки…
Языковые модели
Token
Токен (token) — это единица текста, в которой LLM измеряет свой вход и выход. Чаще всего это часть слова: «программирование»…
Языковые модели
Tool Calling
Tool Calling — концепция использования внешних инструментов языковой моделью: поиск в интернете, выполнение кода, доступ к календарю, чтение файлов. Шире,…
Основы AI
Training
Training (обучение модели) — процесс, в котором алгоритм подбирает значения параметров нейросети по размеченным данным. На каждом шаге модели показывают…
Основы AI
Transformer
Transformer — архитектура нейросети, представленная Google в статье «Attention Is All You Need» (2017). На ней построены все современные LLM:…
Промпты
Trigger Word
Trigger Word — это специальное слово в промпте, которое активирует обученный LoRA, DreamBooth-чекпоинт или Textual Inversion. Без него адаптер подключён,…
Этика и регулирование
Trust in AI
Trust in AI — концепция, отвечающая на вопрос: при каких условиях люди начинают доверять решениям нейросетей и пользоваться AI-продуктами? Доверие…
Видео
TTS и STT
TTS (Text-to-Speech) и STT (Speech-to-Text) — две стороны работы с человеческой речью. TTS превращает текст в озвучку: ElevenLabs, OpenAI TTS,…
Инструменты
Upscaler
Upscaler — это нейросеть для увеличения картинки с восстановлением деталей, а не простой интерполяцией. Классическое увеличение в Photoshop в 4…
Генеративные модели
VAE Variational Autoencoder
VAE (Variational Autoencoder) — это пара нейросетей внутри Stable Diffusion, SDXL и FLUX, которая сжимает картинку в компактное представление и…
Языковые модели
Vector Database Vector DB
Vector Database (векторная БД) — специальная база данных для хранения embedding-векторов и быстрого поиска ближайших по смыслу. В отличие от…
Промпты
Vibe Coding
Vibe Coding — стиль работы с AI-IDE, который ввёл в обиход Andrej Karpathy в феврале 2025. Идея: даёшь AI цель…
Применения
Vision-Language-Action VLA
Vision-Language-Action (VLA) — нейросеть, которая одновременно видит мир (Vision), понимает команду на языке (Language) и генерирует движения для робота (Action).…
Видео
Voice Cloning
Voice Cloning — создание AI-голоса, неотличимого от голоса конкретного человека, по 10–30-секундной записи-сэмплу. Главные платформы: ElevenLabs (топ-качество), Resemble.ai, Play.ht. Open-source…
Параметры
VRAM Video RAM
VRAM (Video RAM) — собственная память видеокарты, отдельная от системной RAM. Это главный лимит для локального AI: модель должна целиком…
Видео
Whisper
Whisper — открытая модель распознавания речи (STT) от OpenAI, выпущена в сентябре 2022. Поддерживает 99 языков, включая русский на отличном…
Генеративные модели
World Models
World Models (мировые модели) — нейросети, которые не просто рисуют видео, а строят интерактивную симуляцию мира: помнят его состояние и…
Промпты
Zero-shot и Few-shot
Zero-shot и Few-shot — два основных подхода к обращению к LLM. Zero-shot: даём задачу без примеров, модель отвечает «с чистого…
Ничего не найдено по этим фильтрам.