Термины
Языковые модели ChatGPT
ChatGPT — AI-ассистент OpenAI с чатом, поиском, памятью и инструментами для файлов, изображений, голоса и кода.…
Основы AI AI
Искусственный интеллект, AI или ИИ, — широкое название систем, которые распознают данные, строят прогнозы, создают контент,…
Языковые модели GPT
GPT расшифровывается как Generative Pre-trained Transformer. Это семейство моделей OpenAI, которые предварительно обучаются на больших наборах…
Генеративные модели Stable Diffusion
Stable Diffusion — семейство диффузионных моделей изображений, начавшееся с выпуска открытых весов Stability AI. Поколения различаются…
Языковые модели LLM
LLM — большая языковая модель, обученная работать с языком на множестве примеров. Она может составить письмо,…
Промпты Prompt
Промпт — запрос, который задаёт модели задачу и исходные условия. Он может включать инструкцию, текст для…
Основы AI Transformer
Transformer — архитектура нейросети, представленная в статье Attention Is All You Need в 2017 году. Она…
Языковые модели DeepSeek
DeepSeek — компания и семейство языковых моделей, включающее облачные API, модели рассуждения, варианты для кода и…
Генеративные модели Midjourney
Midjourney создаёт изображения по тексту и визуальным референсам, предлагает варианты и позволяет продолжать выбранный кадр в…
Основы AI Machine Learning
Машинное обучение помогает программе находить закономерности в данных и использовать их для предсказаний, распознавания или генерации.…
Инструменты Cursor
Cursor — редактор на базе VS Code с AI-функциями для автодополнения, поиска по проекту и многофайловых…
Языковые модели Perplexity
Perplexity соединяет веб-поиск с языковой моделью: находит страницы, собирает связный ответ и показывает ссылки. Такой формат…
Видео Text-to-Video
Text-to-Video — генерация видео по текстовому описанию. Есть облачные сервисы и открытые модели для локального запуска,…
Основы AI Neural Network
Нейросеть (neural network, искусственная нейронная сеть) — математическая модель, в которой простые элементы-«нейроны» собраны в слои…
Инструменты Faceswap
Faceswap переносит черты лица из изображения-источника в фотографию или видео. Система находит лицо, сопоставляет его с…
Языковые модели Computer Use
Computer Use (CUA, компьютерный агент) — ИИ-агент, который управляет компьютером как человек: делает скриншот экрана, «видит»…
Мультимодальные модели World Models
Мировая модель хранит внутреннее представление среды и предсказывает её следующее состояние. Она помогает агенту представить последствия…
Применения AI in Education
AI в образовании помогает объяснять материал разными способами, давать подсказки, создавать тренировочные задания и разбирать черновики.…
Языковые модели Agentic AI
Agentic AI — системы, которые планируют несколько шагов, используют инструменты и проверяют промежуточный результат. Они особенно…
Языковые модели Claude
Claude — семейство языковых моделей и AI-ассистент от компании Anthropic, для работы с текстом, документами и…
Основы AI Generative AI
Генеративный AI создаёт текст, изображения, звук, видео, код и другие данные по примерам и условиям. Модель…
Языковые модели Test-Time Compute
Test-Time Compute — способы потратить больше вычислений на конкретный ответ: сделать несколько попыток, провести поиск, проверить…
Применения AI in Healthcare
Нейросети в медицине помогают готовить черновики клинических записей, анализировать снимки и искать закономерности в данных. Это…
Генеративные модели Diffusion Model
Diffusion Model — семейство генеративных моделей, которые учатся восстанавливать данные из зашумлённого состояния. При генерации процесс…
Языковые модели Reasoning Models
Reasoning-модели тратят дополнительные вычисления перед финальным ответом: разбивают задачу, пробуют варианты, используют инструменты и проверяют промежуточный…
Видео ElevenLabs
ElevenLabs — облачная платформа для работы с AI-аудио. Она превращает текст в речь, создаёт и клонирует…
Генеративные модели FLUX
FLUX — семейство генеративных моделей Black Forest Labs для создания и редактирования изображений. В нём есть…
Языковые модели Gemini
Gemini — семейство моделей Google для текста, изображений, аудио, видео и работы с инструментами. Доступ к…
Промпты Prompt Engineering
Промпт-инженерия — работа над запросом к языковой модели: формулировкой задачи, исходными данными, примерами и форматом ответа.…
Основы AI Deep Learning
Deep Learning, или глубокое обучение, — область машинного обучения, где модель строится из нескольких обучаемых преобразований.…
Инструменты GGUF
GGUF — переносимый формат тензоров и метаданных, тесно связанный с llama.cpp и совместимыми приложениями. Файл может…
Этика и регулирование AI Safety
AI Safety изучает, как снизить вероятность вреда от модели и продукта вокруг неё. Сюда входят тесты,…
Промпты Vibe Coding
Vibe Coding — название для подхода, в котором человек описывает желаемое поведение, принимает сгенерированный код и…
Языковые модели Grok
Grok — семейство моделей и AI-ассистент, разработанные xAI. Он умеет отвечать на вопросы, работать с текстом…
Видео Voice Cloning
Voice Cloning помогает синтезировать речь с признаками конкретного голоса. Одни методы используют образец сразу, другие дообучаются…
Языковые модели Jailbreak
Jailbreak — попытка добиться от AI ответа или поведения, которое запрещено его защитными правилами. Обычно речь…
Инструменты ComfyUI
ComfyUI — это визуальный интерфейс для запуска моделей генерации изображений на основе графа узлов. Каждый шаг…
Генеративные модели DALL-E
DALL-E — семейство генераторов изображений OpenAI, с которым связаны ранние опыты рисования по тексту и редактирования…
Языковые модели AI Agent
AI-агент — система, которая выбирает действия для решения задачи и получает обратную связь от среды. Агент…
Языковые модели RAG
RAG (Retrieval-Augmented Generation) — техника, в которой LLM перед ответом достаёт из внешней базы релевантные документы…
Адаптеры LoRA
LoRA позволяет адаптировать модель к задаче, обучая небольшие добавки к выбранным весам вместо полного набора параметров.…
Видео AnimateDiff
AnimateDiff — способ заставить обычную модель Stable Diffusion рисовать не один кадр, а короткое видео. К…
Мультимодальные модели VLA
Vision-Language-Action-модель получает изображение или видео и текстовую задачу, затем предсказывает действия робота. Вместо жёсткого сценария «увидел…
Инструменты PyTorch
PyTorch — библиотека с открытым исходным кодом для работы с тензорами, нейросетями и автоматическим дифференцированием. Модель…
Языковые модели Diffusion LLM
Diffusion LLM, или dLLM, генерирует текст через несколько раундов уточнения. В маскированном варианте модель начинает с…
Применения AI in Cybersecurity
AI в кибербезопасности помогает разбирать поток событий, искать аномалии, группировать оповещения и готовить черновики расследований. Те…
Этика и регулирование Explainable AI
Explainable AI объединяет методы, которые помогают исследовать вклад признаков, сравнивать возможные решения и объяснять работу системы…
Промпты Context Engineering
Context Engineering — практика системно снабжать AI-модель нужным контекстом до того, как она ответит. Память о…
Инструменты NotebookLM (Gemini Notebook)
NotebookLM собирает отдельное рабочее пространство из документов, ссылок, аудио и других источников. Чат отвечает с переходами…
Языковые модели Qwen
Qwen — семейство моделей Alibaba для текста, кода, рассуждения и мультимодальных задач. Часть весов публикуется для…
Видео Music Generation
Музыкальные модели создают аудио по описанию, напеву, референсу или заданной структуре. Одни генерируют готовую песню с…
Видео Runway, Kling, Pika
Runway, Kling и Pika — закрытые платформы генерации и редактирования видео. Их модели и тарифы меняются,…
Видео Image-to-Video
Image-to-Video (I2V) — модель берёт статичную картинку и достраивает движение объектов, камеры и света во времени.…
Промпты System Prompt
System Prompt задаёт модели роль, правила, формат и границы конкретного приложения. Платформа обычно задаёт ему более…
Генеративные модели SDXL
SDXL (Stable Diffusion XL) — поколение Stable Diffusion, рассчитанное на изображения примерно мегапиксельного масштаба. Оно использует…
Этика и регулирование EU AI Act
EU AI Act регулирует AI в Евросоюзе с учётом назначения системы, уровня риска и роли компании.…
Языковые модели Small Language Models
Small Language Model — относительное название компактной LLM. Такая модель требует меньше памяти и вычислений, поэтому…
Видео Whisper
Whisper — семейство моделей OpenAI для многоязычного распознавания речи и перевода аудио в английский. Веса опубликованы…
Языковые модели Function Calling
Function Calling позволяет модели выбрать описанную функцию и вернуть её имя с JSON-аргументами. Функцию выполняет приложение,…
Обучение Fine-tuning
Fine-tuning продолжает обучение готовой модели на данных конкретной задачи. Так можно закрепить формат, стиль, терминологию или…
Языковые модели Hallucination
Галлюцинация LLM — правдоподобное, но неверное утверждение в ответе языковой модели. Она может придумать источник, приписать…
Языковые модели Token
Токен — элемент словаря модели: целое слово, часть слова, знак, пробел или последовательность байтов. Токенизатор превращает…
Основы AI Model
Модель машинного обучения преобразует данные, используя закономерности, найденные при обучении. Для нейросетевой модели нужны архитектура, веса,…
Промпты Intent Recognition
Распознавание намерений помогает понять, зачем человек написал сообщение: хочет заказать еду, узнать статус доставки или отменить…
Инструменты Edge AI
Edge AI запускает модель на телефоне, компьютере, камере, автомобиле или локальном сервере рядом с устройством. Такой…
Обучение Mixture of Experts
В разреженной Mixture of Experts (MoE) часть слоёв содержит несколько экспертных модулей. Маршрутизатор выбирает для каждого…
Видео Lip Sync
Lip Sync меняет движение губ в видео так, чтобы оно совпадало с новой речью. Техника помогает…
Языковые модели MCP
MCP (Model Context Protocol) задаёт общий способ, которым AI-приложение обнаруживает инструменты, читает доступные данные и вызывает…
Языковые модели Tool Calling
Tool Calling позволяет модели предложить вызов поиска, калькулятора, базы или другой функции в структурированном виде. Само…
Адаптеры ControlNet
ControlNet — техника управления композицией в диффузионных моделях через зрительную подсказку: скелет позы (OpenPose), контур (Canny),…
Основы AI Graph Neural Networks
Графовые нейросети учитывают не только свойства объектов, но и связи между ними. Так можно исследовать молекулы,…
Языковые модели Manus
Manus — облачный AI-агент, который получает цель, использует браузер, код и файлы, а затем возвращает результат:…
Языковые модели Kimi
Kimi — продукт Moonshot AI: чат, модели, API и агентные инструменты для поиска, кода и работы…
Видео TTS и STT
STT превращает запись речи в текст, а TTS — текст в звучащую речь. Вместе они лежат…
Языковые модели Semantic Search
Семантический поиск помогает находить материалы по смысловой близости, даже если запрос и документ сформулированы разными словами.…
Промпты Prompt Injection
Prompt injection — попытка изменить задачу AI через текст или другие данные, которые приложение не должно…
Инструменты Inpainting
Inpainting меняет часть изображения внутри маски и старается связать новую область с окружением. Так удаляют предметы,…
Инструменты img2img
img2img — генерация на основе существующего изображения. В типичной схеме Stable Diffusion исходник кодируется в латентное…
Промпты Negative Prompt
Negative Prompt описывает признаки, от которых генерацию нужно оттолкнуть. В распространённой схеме classifier-free guidance модель сравнивает…
Языковые модели AI Search
AI-поиск использует модели, чтобы находить и сопоставлять сведения. В генеративном поиске система собирает ответ по найденным…
Основы AI API
API — программный интерфейс: правила, по которым одна программа обращается к другой. Через API можно передать…
Основы AI Multimodal AI
Multimodal AI принимает или создаёт данные нескольких типов: текст, изображения, аудио, видео и сигналы датчиков. Возможности…
Языковые модели Embedding
Embedding (эмбеддинг) — числовой вектор, которым модель представляет объект: слово, фрагмент текста, изображение или другой материал.…
Основы AI Training
Training, или обучение модели, — процесс настройки её параметров на примерах. Модель делает предсказание, функция потерь…
Параметры Seed
Seed (сид) — число, которое задаёт начальный шум для диффузионной модели. При одинаковой вычислительной среде он…
Этика и регулирование Sustainable AI
Sustainable AI рассматривает энергию, воду и оборудование на всём жизненном цикле модели: обучение, инференс, хранение и…
Обучение Synthetic Data
Синтетические данные создаются программой, симулятором или другой моделью, а не собираются напрямую из наблюдений за реальным…
Инструменты Google AI Studio
Google AI Studio помогает испытать модели Gemini в браузере, настроить промпт и мультимодальный вход, получить пример…
Языковые модели Cost per Token
Cost per Token описывает тарификацию LLM API по объёму входа и выхода. К итоговой сумме могут…
Языковые модели Alignment
Alignment — работа над тем, чтобы поведение AI соответствовало заданным человеческим целям и ограничениям. Для языковых…
Языковые модели JSON Mode
JSON Mode ограничивает ответ языковой модели синтаксисом JSON. Это удобнее обычной просьбы «верни JSON», но режим…
Языковые модели Structured Output
Structured Output ограничивает форму ответа схемой: обязательными полями, типами, списками допустимых значений и вложенными объектами. Это…
Этика и регулирование Trust in AI
Доверие к AI полезно, когда оно соответствует реальной надёжности системы. Пользователю нужны понятное назначение, проверенные ограничения,…
Языковые модели Benchmark
Benchmark — общий набор задач, правил запуска и метрик для сравнения моделей. Результат имеет смысл только…
Языковые модели Memory
Память AI-ассистента сохраняет сведения для дальнейших обращений: предпочтения, договорённости, описание проекта или итоги прошлой работы. Приложение…
Параметры VRAM
VRAM хранит данные, с которыми графический процессор работает прямо сейчас: веса модели, активации, кадры и временные…
Инструменты Safetensors
Safetensors — открытый формат хранения тензоров, в том числе весов нейросетей. Он описывает числовые массивы и…
Параметры Steps
Steps — число итераций, за которые sampler переводит шум в изображение. Больше шагов обычно означает больше…
Инструменты AUTOMATIC1111
AUTOMATIC1111, или Stable Diffusion WebUI, — интерфейс для генерации изображений с помощью совместимых моделей Stable Diffusion.…
Обучение Dataset
Dataset, или датасет, — организованный набор примеров для обучения, настройки или проверки модели. В нём важны…
Сэмплеры Sampler
Sampler задаёт правило обновления зашумлённого представления на каждом шаге генерации. Результат зависит также от расписания шума,…
Языковые модели Hybrid Search
Hybrid Search объединяет несколько способов найти документы. Лексическая ветка удерживает точные слова и коды, семантическая замечает…
Языковые модели Chunking
Chunking — разбиение документов на фрагменты для поиска и подготовки контекста модели. Маленький фрагмент может потерять…
Промпты Zero-shot и Few-shot
Zero-shot означает, что модель получает инструкцию и новую задачу без готовых примеров. При few-shot в тот…
Инструменты CUDA
CUDA связывает программы с видеокартами NVIDIA. Через её runtime, драйвер и библиотеки фреймворки запускают матричные операции,…
Параметры Quantization
Quantization переводит веса или активации модели в более компактное числовое представление. Данных для хранения и передачи…
Инструменты Upscaler
Upscaler делает изображение крупнее. Обычная интерполяция вычисляет новые пиксели по соседним, а обученная модель ещё и…
Языковые модели Reranking
Reranking — второй этап поиска, на котором уже найденные документы получают новые оценки и меняются местами.…
Языковые модели Latency
Latency описывает, сколько времени проходит от отправки запроса до результата. У потоковой языковой модели отдельно измеряют…
Обучение RLHF и DPO
RLHF и DPO используют сравнения ответов, чтобы скорректировать поведение модели. В классическом RLHF отдельная модель награды…
Инструменты Custom Nodes
Custom Nodes — сторонние расширения ComfyUI. Они добавляют новые загрузчики, модели, способы управления, обработку видео, звука…
Адаптеры OpenPose
OpenPose оценивает положение ключевых точек тела, лица и кистей на изображении. В генерации такую карту можно…
Параметры Hires.fix
Hires.fix строит изображение в два прохода. Сначала модель создаёт базовый кадр и его композицию. Затем кадр…
Инструменты Outpainting
Outpainting расширяет холст и генерирует сцену в новых областях за пределами исходного кадра. Модель опирается на…
Адаптеры IP-Adapter
IP-Adapter добавляет к текстовому промпту визуальное условие. Визуальный энкодер превращает референс в признаки, а отдельная ветка…
Генеративные модели CLIP
CLIP состоит из текстового и визуального энкодеров, обученных сближать подходящие пары «изображение — подпись» и отдалять…
Языковые модели Vector Database
Vector Database хранит векторы признаков вместе со ссылками на исходные объекты и метаданными. Для нового запроса…
Языковые модели Context Window
Контекстное окно — объём токенов, доступный модели во время одного вызова. Туда попадают инструкции, история диалога,…
Сэмплеры Scheduler
Scheduler задаёт, на каких уровнях шума или временных точках sampler делает шаги генерации. При одинаковом числе…
Параметры CFG Scale
CFG Scale управляет тем, насколько сильно диффузионная модель отталкивается от безусловного предсказания в сторону промпта. Слишком…
Языковые модели MMLU и HumanEval
MMLU проверяет выбор ответа по разным предметам, а HumanEval — способность написать небольшую функцию, которая проходит…
Инструменты ComfyUI Manager
ComfyUI Manager помогает искать, устанавливать, обновлять и отключать сторонние ноды, находить недостающие пакеты из чужой схемы,…
Параметры Mask
Mask — одноканальная карта, которая задаёт, где операция действует полностью, частично или совсем не действует. В…
Языковые модели Knowledge Graph
Knowledge Graph, или граф знаний, хранит сущности и утверждения о связях между ними. В нём можно…
Промпты Prompt Weighting
Prompt Weighting усиливает или ослабляет отдельные фрагменты текстового условия до генерации. Запись вроде `(красный шарф:1.2)` работает…
Адаптеры Canny Edge
Canny Edge — алгоритм извлечения контуров изображения, изобретённый Джоном Канни в 1986-м. В Stable Diffusion через…
Адаптеры Depth Map
Depth Map кодирует глубину сцены: какие поверхности находятся ближе, а какие дальше. Такая карта помогает генеративной…
Параметры Batch Size
Batch Size — количество примеров в одном вычислительном пакете. При генерации он влияет на память, задержку…
Параметры FP16, BF16, FP8
FP16, BF16 и FP8 по-разному делят биты между экспонентой и дробной частью. FP16 оставляет больше значащих…
Адаптеры DreamBooth
DreamBooth — рецепт персонализации text-to-image модели по нескольким изображениям конкретного объекта. Во время обучения редкий идентификатор…
Параметры Denoising Strength
Denoising Strength задаёт, насколько сильно генерация может отойти от входного изображения. Чем выше сила, тем больше…
Генеративные модели VAE
VAE переводит изображение в компактный латентный тензор и декодирует его обратно в пиксели. В txt2img обычно…
Основы AI Open-source AI
Open-source AI даёт свободу использовать, изучать, изменять и распространять систему, а также материалы, без которых её…
Основы AI Inference
Inference, или инференс, начинается, когда готовая модель получает новые данные и строит результат: класс, прогноз, текст,…
Основы AI Parameters
Параметры модели — обучаемые числа внутри матриц и других тензоров нейросети. При обучении эти значения подбираются…
Параметры Guidance
Guidance — семейство способов направлять генерацию к условию. Классический CFG усиливает разницу между условным и опорным…
Параметры Aspect Ratio
Aspect Ratio описывает форму кадра как отношение ширины к высоте. Оно влияет на композицию и на…
Генеративные модели Latent Space
Latent space — внутреннее пространство представлений, с которым работает модель. В латентной диффузии изображение представлено компактным…
Инструменты JSON Workflow
JSON Workflow хранит структуру графа, типы нод, их параметры и связи в машиночитаемом тексте. В ComfyUI…
Адаптеры Tile / Tiling
Tile называют сразу несколько разных приёмов: обработку большого изображения перекрывающимися фрагментами, тайловый денойзинг, tiled VAE для…
Обучение Model Merge
Model Merge создаёт новую модель из весов нескольких совместимых моделей. Простое смешивание интерполирует одинаковые тензоры, delta…
Инструменты Face Restoration
Face Restoration — обработка лица на фотографии или сгенерированном кадре. Специальная модель добавляет правдоподобные детали, а…
Сэмплеры KSampler
KSampler объединяет модель, условия генерации, исходный латент и настройки в один узел ComfyUI. Scheduler строит последовательность…
Адаптеры Segmentation Map
Segmentation Map делит изображение на области и хранит для каждого пикселя метку класса или экземпляра объекта.…
Промпты Regional Prompting
Regional Prompting — семейство способов связать отдельные описания с нужными участками изображения. Маски, прямоугольники или другие…
Обучение Learning Rate
Learning rate задаёт масштаб обновлений, которые делает оптимизатор. Слишком маленький шаг может не успеть за бюджет…
Генеративные модели Refiner
Refiner — отдельная модель или стадия, которая принимает промежуточный результат базовой модели и продолжает генерацию при…
Сэмплеры Noise Schedule
Noise schedule задаёт, какой уровень сигнала и шума соответствует каждому моменту диффузионного процесса. При генерации сэмплер…
Обучение Overfitting
Overfitting, или переобучение, возникает, когда модель всё точнее подстраивается под обучающие примеры, но хуже работает на…
Обучение Epoch
Epoch, или эпоха, — один проход через весь обучающий набор. Она показывает, сколько раз данные были…
Адаптеры Textual Inversion
Textual Inversion учит новое текстовое представление концепта по примерам, сохраняя остальные веса генеративной модели замороженными. Полученный…
Промпты Trigger Word
Trigger word — слово или короткая фраза, которую во время обучения связывают с персонажем, предметом или…
Основы AI Model License
Лицензия модели описывает, что разрешено делать с конкретными весами: использовать, изменять и распространять их, в том…
Адаптеры Hypernetwork
Hypernetwork в генерации изображений — отдельный обучаемый модуль, который влияет на работу attention — механизма внимания.…
Обучение Dataset Captioning
Dataset Captioning — подготовка текстовых подписей к изображениям в обучающем датасете. Подпись связывает конкретный снимок с…
Инструменты Harness
Harness — это программный слой, который организует работу модели: собирает вход, ведёт состояние, вызывает разрешённые инструменты,…
Указатель
-
11
AI in Cybersecurity
AI в кибербезопасности помогает разбирать поток событий, искать аномалии, группировать оповещения и готовить черновики расследований. Те же технологии упрощают фишинг, подделку голоса и масштабирование атак. Польза…
-
12
AI in Education
AI в образовании помогает объяснять материал разными способами, давать подсказки, создавать тренировочные задания и разбирать черновики. Учителю он может снять часть подготовки и сортировки материалов. Польза…
-
13
AI in Healthcare
Нейросети в медицине помогают готовить черновики клинических записей, анализировать снимки и искать закономерности в данных. Это не единый «AI-врач», а набор узких систем с разным уровнем…
-
14
Trust in AI
Доверие к AI полезно, когда оно соответствует реальной надёжности системы. Пользователю нужны понятное назначение, проверенные ограничения, источники, возможность отменить действие и человек, отвечающий за последствия. Красивый…
-
15
Sustainable AI
Sustainable AI рассматривает энергию, воду и оборудование на всём жизненном цикле модели: обучение, инференс, хранение и замену серверов. Одна цифра «на запрос» редко переносится между системами,…
-
16
EU AI Act
EU AI Act регулирует AI в Евросоюзе с учётом назначения системы, уровня риска и роли компании. Для запрещённых практик, высокорисковых систем, отдельных пользовательских интерфейсов и моделей…
-
17
AI Safety
AI Safety изучает, как снизить вероятность вреда от модели и продукта вокруг неё. Сюда входят тесты, защита данных и инструментов, ограничения доступа, наблюдение за ошибками и…
-
18
Explainable AI XAI
Explainable AI объединяет методы, которые помогают исследовать вклад признаков, сравнивать возможные решения и объяснять работу системы разным людям. Одно объяснение не доказывает справедливость или правильность модели:…
-
19
Graph Neural Networks GNN
Графовые нейросети учитывают не только свойства объектов, но и связи между ними. Так можно исследовать молекулы, искать подозрительные транзакции или подбирать рекомендации. Разбираем передачу сообщений между…
-
20
Intent Recognition
Распознавание намерений помогает понять, зачем человек написал сообщение: хочет заказать еду, узнать статус доставки или отменить заказ. Параметры — адрес, время, номер заказа — извлекаются отдельно.…