AI Library · Каталог

Каталог156/ 156

Все термины библиотеки с поиском, фильтром по разделу и семью способами сортировки.

Раздел
Языковые модели Agentic AI Agentic AI — системы, которые **действуют**: планируют многошаговые задачи, используют инструменты, итерируют без человека на каждом шаге. Не «ответ на… 5 мин Основы AI AI ИИ Искусственный интеллект (AI, Artificial Intelligence) — это технологии, которые позволяют компьютерам решать задачи, прежде доступные только человеку: распознавать речь и… 6 мин Языковые модели AI Agent AI Agent (AI-агент) — это LLM, которая не просто отвечает на вопрос, а решает задачу через несколько шагов и использует… 7 мин Применения AI in Cybersecurity AI in Cybersecurity — двусторонняя гонка вооружений: AI помогает защитникам обнаруживать атаки в реальном времени и AI помогает атакующим создавать… 6 мин Применения AI in Education AI in Education — применение нейросетей в обучении: персональные репетиторы (Khanmigo, Duolingo Max), адаптивные системы (которые меняют уровень сложности под… 6 мин Применения AI in Healthcare AI in Healthcare — применение нейросетей в медицине: от анализа КТ-снимков до автоматизации клинической записи и поиска новых лекарств. К… 6 мин Этика и регулирование AI Safety AI Safety — широкая дисциплина: как делать AI-системы, которые не причинят вреда людям и обществу. Включает alignment (модель делает то,… 6 мин Языковые модели AI Search AI Search — это новый формат поиска, в котором система не показывает список ссылок, а формирует прямой ответ через LLM… 6 мин Языковые модели Alignment Alignment — процесс настройки LLM на поведение, согласованное с человеческими ценностями: быть полезной, честной, безопасной (helpful, honest, harmless). Без alignment… 5 мин Видео AnimateDiff AnimateDiff — способ заставить обычную модель Stable Diffusion рисовать не один кадр, а короткое видео. К модели подключается отдельный «модуль… 5 мин Основы AI API Application Programming Interface API (Application Programming Interface) в контексте AI — это способ программно отправлять запросы к языковой модели и получать ответы. Вместо… 6 мин Параметры Aspect Ratio AR Aspect Ratio (соотношение сторон) — пропорция между шириной и высотой результата генерации. Самые частые: 1:1 (квадрат, соцсети), 16:9 (видео, обложки),… 5 мин Инструменты AUTOMATIC1111 AUTOMATIC1111 (или Stable Diffusion WebUI) — классический веб-интерфейс для запуска моделей Stable Diffusion, появился в августе 2022 года. Долгое время… 5 мин Параметры Batch Size Batch Size — количество изображений (или текстовых примеров), которые модель обрабатывает за один проход. В Stable Diffusion определяет, сколько картинок… 4 мин Языковые модели Benchmark Benchmark — стандартизированный набор задач для сравнения моделей. MMLU тестирует знания, HumanEval — программирование, GSM8K — арифметику, MATH — математику,… 5 мин Адаптеры Canny Edge Canny Edge — алгоритм извлечения контуров изображения, изобретённый Джоном Канни в 1986-м. В Stable Diffusion через ControlNet Canny используется как… 5 мин Параметры CFG Scale Classifier-Free Guidance CFG Scale (Classifier-Free Guidance) — параметр, который управляет тем, насколько строго диффузионная модель следует промпту. Низкие значения (1–3) дают свободную… 5 мин Языковые модели ChatGPT ChatGPT — продукт OpenAI для общения с языковой моделью GPT в формате чата. Доступен через сайт chat.openai.com, мобильные приложения и… 5 мин Языковые модели Chunking Chunking — разбиение длинных документов на маленькие фрагменты (chunks) для индексации в RAG. От выбора размера и стратегии разбиения зависит… 5 мин Языковые модели Claude Claude — семейство языковых моделей и AI-ассистент от компании Anthropic, основанной выходцами из OpenAI. Сильная сторона Claude — длинные рассуждения,… 6 мин Генеративные модели CLIP Contrastive Language-Image Pretraining CLIP (Contrastive Language-Image Pretraining) — модель OpenAI 2021 года, которая учится одновременно понимать текст и картинки. Внутри две нейросети: image… 6 мин Инструменты ComfyUI ComfyUI — это визуальный интерфейс для запуска моделей генерации изображений на основе графа узлов. Каждый шаг пайплайна (загрузка модели, кодирование… 6 мин Инструменты ComfyUI Manager ComfyUI Manager — расширение-менеджер для ComfyUI: установка, обновление, удаление custom nodes; скачивание моделей с Civitai и Hugging Face; обнаружение отсутствующих… 4 мин Языковые модели Computer Use Computer-Using Agent (CUA) Computer Use (CUA, компьютерный агент) — ИИ-агент, который управляет компьютером как человек: делает скриншот экрана, «видит» интерфейс, двигает курсор, кликает… 7 мин Промпты Context Engineering Context Engineering — практика системно снабжать AI-модель нужным контекстом до того, как она ответит. Память о пользователе, документы через RAG,… 5 мин Языковые модели Context Window Контекстное окно (context window) — максимальное количество токенов, которое языковая модель может удержать в одном запросе. Туда входят системный промпт,… 6 мин Адаптеры ControlNet ControlNet — техника управления композицией в диффузионных моделях через зрительную подсказку: скелет позы (OpenPose), контур (Canny), карту глубины (Depth), набросок… 6 мин Языковые модели Cost per Token Cost per Token — главная единица стоимости LLM API. Цена считается отдельно за input (то, что вы отправили) и output… 4 мин Инструменты CUDA Compute Unified Device Architecture CUDA (Compute Unified Device Architecture) — платформа и язык параллельных вычислений от NVIDIA. Это слой, через который PyTorch, TensorFlow, Stable… 4 мин Инструменты Cursor Cursor — AI-IDE на базе VS Code, переписанный под программирование «с AI как со-пилотом». К 2026-му ~25 млн визитов/мес (+41%… 5 мин Инструменты Custom Nodes Custom Nodes — пользовательские ноды ComfyUI, написанные сообществом. Расширяют возможности базового ComfyUI новыми операциями: видео-генерация (AnimateDiff), управление лицом (FaceID), быстрые… 7 мин Генеративные модели DALL-E DALL-E — семейство закрытых моделей генерации изображений от OpenAI, начатое в 2021 году. Третья версия (DALL-E 3) интегрирована в ChatGPT:… 6 мин Обучение Dataset Датасет (dataset) — это набор примеров, на которых модель учится решать задачу. Каждый пример состоит из входа (картинка, текст, аудио)… 6 мин Обучение Dataset Captioning Dataset Captioning — это процесс добавления текстовых подписей к каждой картинке датасета перед тренировкой LoRA или DreamBooth. От качества подписей… 4 мин Основы AI Deep Learning DL Deep Learning (глубокое обучение, DL) — раздел машинного обучения, в котором используются нейросети с большим числом скрытых слоёв (от десятков… 7 мин Языковые модели DeepSeek DeepSeek — китайская AI-компания и одноимённая семейство моделей, взорвавшая индустрию в январе 2025 релизом R1 — open-weight reasoning-модели уровня OpenAI… 5 мин Параметры Denoising Strength Denoising Strength (сила шумоподавления) — параметр img2img в диапазоне 0..1, определяющий, насколько модель «перепишет» входную картинку. При 0.0 выход идентичен… 7 мин Адаптеры Depth Map Depth Map — чёрно-белое изображение, где яркость каждого пикселя означает расстояние до камеры: ближе — светлее, дальше — темнее. В… 5 мин Языковые модели Diffusion LLM Diffusion Language Model Diffusion LLM (диффузионная языковая модель, dLLM) — языковая модель, которая генерирует текст не по одному токену слева направо, а «проявляет»… 7 мин Генеративные модели Diffusion Model Diffusion Model — архитектура генеративных моделей, которая работает наоборот привычной интуиции: учится «расшумлять» данные. На вход — белый шум, на… 6 мин Адаптеры DreamBooth DreamBooth — техника тонкой настройки диффузионной модели под конкретный объект, разработанная Google Research в 2022 году. Отличие от LoRA и… 5 мин Инструменты Edge AI Edge AI — запуск нейросетей прямо на устройстве пользователя или ближайшем «edge»-сервере: телефоне, ноутбуке, авто, камере наблюдения, микроволновке. Без облака.… 5 мин Видео ElevenLabs ElevenLabs — лидер AI-голоса. Клонирование любого голоса по 30 секундам аудио, text-to-speech на 32 языках, моментальный дубляж видео с сохранением… 5 мин Языковые модели Embedding Embedding (эмбеддинг) — это длинный вектор чисел, который представляет смысл слова, фразы, документа или изображения. Близкие по смыслу объекты получают… 6 мин Обучение Epoch Epoch (эпоха) — единица тренировки нейросети: один полный проход по всему датасету. Если в датасете 50 картинок и batch size… 4 мин Этика и регулирование EU AI Act EU AI Act — первый в мире комплексный закон об искусственном интеллекте. Принят Евросоюзом в 2024-м, поэтапное вступление 2025-2027. Делит… 6 мин Этика и регулирование Explainable AI XAI Explainable AI (XAI) — направление, делающее решения нейросетей понятными для человека. Когда модель отказывает в кредите, ставит диагноз или дисквалифицирует… 6 мин Инструменты Face Restoration Face Restoration — отдельный пост-обработочный шаг, который улучшает лица на сгенерированной или старой фотографии. Решает классическую проблему AI-генерации: лица «уплывают»,… 4 мин Инструменты Faceswap Faceswap — замена лица на фото или в видео на другое одной нейросетью, без обучения. Готовая модель (inswapper) берёт лицо… 5 мин Обучение Fine-tuning Fine-tuning (тонкая настройка) — дообучение готовой модели на узком наборе данных под конкретную задачу. Полное обучение с нуля стоит миллионы… 7 мин Генеративные модели FLUX FLUX (FLUX.1) — семейство диффузионных моделей для генерации изображений, выпущенное Black Forest Labs в августе 2024 года. Команда — те… 6 мин Параметры FP16, BF16, FP8 FP16, BF16 и FP8 — форматы хранения чисел с плавающей запятой в нейросетях. FP16 (16 бит) — старый стандарт точной… 5 мин Языковые модели Function Calling Function Calling — механизм, при котором LLM решает, какую внешнюю функцию вызвать и с какими аргументами. Модель сама не выполняет… 5 мин Языковые модели Gemini Gemini — семейство мультимодальных языковых моделей от Google DeepMind, третий главный игрок на рынке AI-ассистентов рядом с ChatGPT и Claude.… 6 мин Основы AI Generative AI Генеративный AI Генеративный AI (Generative AI) — класс нейросетей, которые создают новый контент: тексты, изображения, видео, музыку, код. В отличие от классических… 6 мин Инструменты GGUF GPT-Generated Unified Format GGUF (GPT-Generated Unified Format) — формат файла для запуска квантизованных нейросетей на обычном железе. Один файл хранит и веса, и… 5 мин Инструменты Google AI Studio Google AI Studio — официальный playground Google для работы с моделями Gemini: тестируешь промпты в браузере, получаешь готовый код для… 4 мин Языковые модели GPT Generative Pre-trained Transformer GPT (Generative Pre-trained Transformer) — семейство больших языковых моделей OpenAI, на которых построены ChatGPT и платный API. Архитектурно это трансформер,… 6 мин Основы AI Graph Neural Networks GNN Graph Neural Networks (GNN) — класс нейросетей, который работает не с таблицами, картинками или текстами, а с графами: узлами и… 6 мин Языковые модели Grok Grok — большая языковая модель от xAI, компании Илона Маска. Главная фишка — доступ к ленте X (Twitter) в реальном… 5 мин Параметры Guidance Guidance — общее понятие управления тем, насколько модель следует заданному условию: промпту, изображению, ControlNet-карте. В Stable Diffusion проявляется как CFG… 5 мин Языковые модели Hallucination Hallucination (галлюцинация) — ошибка LLM, когда модель уверенно выдумывает факт, который выглядит правдоподобно, но не существует. Это не баг, а… 6 мин Инструменты Harness Harness — это программная обёртка вокруг языковой модели, которая превращает её из единичного API-вызова «дал текст — получил ответ» в… 8 мин Параметры Hires.fix Hires.fix — техника двухэтапной генерации в Stable Diffusion: сначала модель рисует базовое изображение в 512×512 или 1024×1024, потом апскейлит его… 5 мин Языковые модели Hybrid Search Hybrid Search — комбинация semantic search (по векторам смысла) и keyword search (BM25, по точным словам). Каждый ловит то, что… 5 мин Адаптеры Hypernetwork Hypernetwork — техника тонкой настройки Stable Diffusion 2022 года. Подключает к U-Net дополнительную маленькую нейросеть, которая модифицирует cross-attention слои на… 5 мин Видео Image-to-Video Image-to-Video (I2V) — модель берёт статичную картинку и генерирует из неё короткое видео: 3–10 секунд. Можно задать промпт о желаемом… 4 мин Инструменты img2img image-to-image img2img (image-to-image) — режим генерации, в котором на вход модели подаётся картинка, а не случайный шум. Модель частично её «стирает»… 5 мин Основы AI Inference Inference (инференс) — использование уже обученной модели. На вход подаются данные (текст, картинка, аудио), модель прогоняет их через слои и… 6 мин Инструменты Inpainting Inpainting (вписывание) — режим, где модель переписывает только выделенную маской область картинки, а остальные пиксели сохраняются нетронутыми. Используется для удаления… 5 мин Промпты Intent Recognition Intent Recognition (Intent Detection) — задача NLP: понять, какую цель преследует пользователь в своём сообщении, даже если он сформулировал её… 5 мин Адаптеры IP-Adapter Image Prompt Adapter IP-Adapter (Image Prompt Adapter) — адаптер от Tencent, выпущенный в августе 2023 года, который позволяет использовать картинку как «промпт». Модель… 5 мин Языковые модели Jailbreak Jailbreak — техника обхода встроенных ограничений LLM (alignment-фильтров), чтобы заставить модель выполнить запрещённое: написать вредоносный код, обойти политики, выдать опасные… 5 мин Языковые модели JSON Mode JSON Mode — режим API LLM, гарантирующий, что ответ будет **валидным JSON**, но без контроля конкретной схемы. Появился в OpenAI… 4 мин Инструменты JSON Workflow JSON Workflow — формат сохранения и обмена пайплайнами в ComfyUI. Каждый workflow — это JSON-файл с описанием нод, их параметров… 4 мин Языковые модели Kimi Kimi — AI-ассистент от китайской Moonshot AI, известный гигантским контекстным окном (до 2M токенов в Kimi K2) и сильной поддержкой… 5 мин Языковые модели Knowledge Graph Knowledge Graph — структурированная база знаний в виде узлов (сущности) и рёбер (связи между ними). «Москва — столица — России»,… 5 мин Сэмплеры KSampler KSampler — центральный узел диффузионного пайплайна в ComfyUI. Он получает на вход модель, два промпта (положительный и отрицательный) и пустой… 7 мин Языковые модели Latency Latency — задержка между запросом и ответом LLM. У современных моделей две ключевые метрики: TTFT (Time To First Token) —… 4 мин Генеративные модели Latent Space Latent Space (латентное пространство) — это многомерное пространство, в котором нейросеть хранит сжатое представление данных. В Stable Diffusion каждая картинка… 6 мин Обучение Learning Rate LR Learning Rate (LR) — самый важный параметр любой тренировки: скорость, с которой модель «делает шаг» в сторону уменьшения ошибки. Слишком… 5 мин Видео Lip Sync Lip Sync — техника, которая «пересинхронизирует» движение губ говорящего на видео с другой аудио-дорожкой. Главные сценарии: дубляж видео на другие… 5 мин Языковые модели LLM Large Language Model LLM (Large Language Model) — большая языковая модель, нейросеть, обученная на триллионах слов и умеющая осмысленно продолжать любой текст. Принципиально… 6 мин Адаптеры LoRA Low-Rank Adaptation LoRA (Low-Rank Adaptation) — техника тонкой настройки больших диффузионных моделей. Вместо переобучения целой модели (6+ ГБ) рядом с базой подключается… 6 мин Основы AI Machine Learning ML Machine Learning (машинное обучение, ML) — раздел AI, в котором программа не получает готовые правила, а выводит их сама из… 6 мин Языковые модели Manus Manus — general-purpose AI-агент от китайской Butterfly Effect, заявленный в марте 2025 как «первый AGI-агент». В отличие от чат-ассистентов, Manus… 5 мин Параметры Mask Mask (маска) — чёрно-белое изображение, которое сообщает модели, где она должна работать, а где не трогать. Белые пиксели — активная… 4 мин Языковые модели MCP Model Context Protocol MCP (Model Context Protocol) — открытый протокол от Anthropic для подключения внешних инструментов и источников данных к LLM. Принцип: серверы… 5 мин Языковые модели Memory Memory — способность AI-ассистента помнить факты о пользователе между сессиями. В отличие от Context Window (один разговор) Memory сохраняет информацию… 5 мин Генеративные модели Midjourney Midjourney — закрытая коммерческая модель для генерации изображений от одноимённой компании Дэвида Хольца, запущена в 2022 году. Работает только через… 6 мин Обучение Mixture of Experts MoE Mixture of Experts (MoE) — архитектура нейросетей, где модель состоит не из одной плотной сети, а из десятков «экспертов»: на… 5 мин Языковые модели MMLU и HumanEval MMLU и HumanEval — два самых цитируемых бенчмарка LLM. MMLU (Massive Multitask Language Understanding) — 15 908 вопросов из 57… 5 мин Основы AI Model Модель в AI — это файл с обученной нейросетью. Внутри лежат архитектура (как соединены слои) и веса (миллионы или миллиарды… 6 мин Основы AI Model License Лицензия модели — юридическое соглашение, описывающее, как можно использовать веса AI-модели. Скачать модель и запустить локально часто можно бесплатно, но… 5 мин Обучение Model Merge Model Merge — объединение весов двух или нескольких моделей в одну новую. Применяется в Stable Diffusion и SDXL: смешивают чекпоинты,… 5 мин Основы AI Multimodal AI Multimodal AI (мультимодальный AI) — модели, которые принимают и/или выдают разные типы данных: текст, изображения, аудио, видео. Одна модель может… 6 мин Видео Music Generation Music Generation — создание музыки и песен по текстовому описанию. Главные платформы: Suno (песни с вокалом), Udio (студийное качество), Stable… 5 мин Промпты Negative Prompt Negative Prompt — текст, который указывает диффузионной модели, чего НЕ должно быть в результате. Параллелен положительному промпту: один описывает желаемое,… 5 мин Основы AI Neural Network NN, ANN Нейросеть (neural network, искусственная нейронная сеть) — математическая модель, в которой простые элементы-«нейроны» собраны в слои и обмениваются числами. На… 6 мин Сэмплеры Noise Schedule Noise Schedule — расписание уровней шума по шагам диффузии. На каждом шаге модели нужно знать, **сколько шума** должно быть в… 5 мин Инструменты NotebookLM NotebookLM — исследовательский AI-инструмент Google: загружаешь до 50 источников (PDF, Google Docs, ссылки, видео), AI отвечает на вопросы, цитируя только… 5 мин Основы AI Open-source AI Open-source AI и open-weight AI — это разные степени открытости моделей. «Open-weight» значит, что компания публикует обученные веса: их можно… 6 мин Адаптеры OpenPose OpenPose — препроцессор и модель ControlNet для управления позой человека в Stable Diffusion. Превращает любое фото в палочную фигуру (skeleton),… 5 мин Инструменты Outpainting Outpainting (дорисовывание за края) — режим, где модель достраивает картинку за её первоначальные границы. Технически это inpainting с маской по… 5 мин Обучение Overfitting Overfitting (переобучение) — главная проблема тренировки нейросетей. Модель начинает «зазубривать» обучающий датасет вместо того, чтобы обобщать закономерности. В LoRA это… 5 мин Основы AI Parameters Параметры (parameters, веса модели) — это числа внутри нейросети, которые подбираются во время обучения. У одного нейрона есть веса входов… 6 мин Языковые модели Perplexity Perplexity — AI-поисковик нового поколения: задаёшь вопрос, получаешь не «10 синих ссылок», а готовый ответ с цитатами на источники в… 5 мин Промпты Prompt Промпт (prompt) — текстовый запрос, который пользователь передаёт языковой модели, чтобы получить ответ. От формулировки промпта зависит результат: одна и… 6 мин Промпты Prompt Engineering Prompt Engineering (промпт-инженерия) — навык формулировать запросы к языковой модели так, чтобы получать предсказуемый, точный и полезный ответ. Это не… 6 мин Промпты Prompt Injection Prompt Injection — атака, при которой пользователь или внешние данные заставляют LLM нарушить исходные инструкции (system prompt). Direct injection: пользователь… 5 мин Промпты Prompt Weighting Prompt Weighting — техника локального управления силой отдельных слов в промпте. Синтаксис `(красная роза:1.4)` усиливает слово в 1.4 раза, `[жёлтый:0.7]`… 5 мин Инструменты PyTorch PyTorch — open-source библиотека для глубокого обучения, созданная Meta (Facebook AI Research) в 2016 году. Главная особенность — динамический граф… 6 мин Параметры Quantization Quantization (квантизация) — техника снижения точности чисел в модели для экономии памяти и ускорения работы. Стандартные веса FP16 (16 бит)… 5 мин Языковые модели Qwen Qwen (произносится «чвен») — семейство open-weight LLM от Alibaba Cloud. К 2026-му Qwen3 — гибридная модель: умеет переключаться между быстрым… 5 мин Языковые модели RAG Retrieval-Augmented Generation RAG (Retrieval-Augmented Generation) — техника, в которой LLM перед ответом достаёт из внешней базы релевантные документы и использует их как… 7 мин Языковые модели Reasoning Models Reasoning Models — категория LLM, которые перед финальным ответом проходят через явный chain-of-thought (внутренний диалог), пробуя гипотезы, переоценивая, исправляя ошибки.… 6 мин Генеративные модели Refiner Refiner — это дополнительная модель в SDXL, которую запускают на последних 20–30% шагов диффузии для финальной полировки. Базовая модель формирует… 5 мин Промпты Regional Prompting Regional Prompting — техника, которая разрешает использовать **разные промпты для разных областей** одного изображения. Левый верхний угол — «горный пейзаж»,… 5 мин Языковые модели Reranking Reranking — двухступенчатый поиск: сначала быстрый retrieval достаёт топ-50 кандидатов, потом более точная (но медленная) reranker-модель переоценивает их и оставляет… 5 мин Обучение RLHF и DPO RLHF (Reinforcement Learning from Human Feedback) и DPO (Direct Preference Optimization) — главные методы обучения LLM на предпочтениях. RLHF —… 5 мин Видео Runway, Kling, Pika Runway, Kling и Pika — главные альтернативы Sora и Veo для генерации видео. Runway Gen-4 (USA) — для VFX-pipelines, профессиональный… 5 мин Инструменты Safetensors Safetensors — открытый формат файлов для хранения весов нейросетевых моделей. Разработан Hugging Face как безопасная альтернатива формату .ckpt (Python pickle),… 4 мин Сэмплеры Sampler sampling method Sampler (сэмплер) — алгоритм, который ведёт диффузионную модель от чистого шума к готовой картинке за 15–40 шагов. От его выбора… 6 мин Сэмплеры Scheduler Karras schedule Scheduler (шедулер) — правило, по которому при генерации картинки уменьшается уровень шума на каждом шаге диффузии. Семь актуальных шедулеров в… 7 мин Генеративные модели SDXL Stable Diffusion XL SDXL (Stable Diffusion XL) — увеличенная версия Stable Diffusion от Stability AI, выпущенная в июле 2023 года. По параметрам в… 6 мин Параметры Seed Seed (сид) — число, которое задаёт начальный шум для диффузионной модели. При одинаковом seed, промпте и остальных параметрах получается одна… 5 мин Адаптеры Segmentation Map Segmentation Map — цветная карта изображения, где каждый пиксель окрашен по категории объекта: небо одним цветом, человек другим, дерево третьим.… 5 мин Языковые модели Semantic Search Semantic Search — поиск документов по **смыслу запроса**, а не по ключевым словам. Запрос превращается в эмбеддинг, документы заранее тоже,… 5 мин Языковые модели Small Language Models SLM Small Language Models (SLM) — компактные LLM до ~10 миллиардов параметров, которые запускаются на ноутбуке или телефоне, часто без интернета.… 5 мин Генеративные модели Stable Diffusion Stable Diffusion — семейство открытых диффузионных моделей от Stability AI, выпущенное в августе 2022 года. Первая массовая модель, веса которой… 6 мин Параметры Steps Steps (sampling steps) — количество шагов, за которые диффузионная модель превращает шум в картинку. Каждый шаг убирает часть шума и… 5 мин Языковые модели Structured Output Structured Output — режим LLM, в котором модель **гарантированно** возвращает ответ в заданном формате (обычно JSON по схеме). Раньше приходилось… 5 мин Этика и регулирование Sustainable AI Sustainable AI — направление, которое считает экологический след нейросетей и снижает его. Обучение GPT-4 — оценочно 50 ГВт·ч электричества и… 5 мин Обучение Synthetic Data Synthetic Data — данные, созданные не людьми, а самими нейросетями: сгенерированные тексты, картинки, диалоги, симуляции. К 2026 — половина обучающих… 5 мин Промпты System Prompt System Prompt — отдельная инструкция языковой модели, задающая её роль, характер, формат ответа и ограничения. В отличие от обычного user… 5 мин Языковые модели Test-Time Compute Inference-Time Scaling Test-Time Compute (вычисления во время вывода, inference-time scaling) — подход, при котором модель отвечает точнее не за счёт большего размера,… 7 мин Видео Text-to-Video Text-to-Video — генерация видео по текстовому описанию. Главные модели на 2026: OpenAI Sora 2 (до 60 сек, 1080p), Google Veo… 5 мин Адаптеры Textual Inversion TI Textual Inversion (TI) — самая лёгкая техника настройки диффузионной модели: тренируется эмбеддинг одного нового токена в словаре CLIP, веса модели… 5 мин Адаптеры Tile / Tiling Tile (тайлинг) в Stable Diffusion — две связанные техники. Первая — деление большого изображения на маленькие квадраты для пошаговой обработки… 5 мин Языковые модели Token Токен (token) — это единица текста, в которой LLM измеряет свой вход и выход. Чаще всего это часть слова: «программирование»… 6 мин Языковые модели Tool Calling Tool Calling — концепция использования внешних инструментов языковой моделью: поиск в интернете, выполнение кода, доступ к календарю, чтение файлов. Шире,… 5 мин Основы AI Training Training (обучение модели) — процесс, в котором алгоритм подбирает значения параметров нейросети по размеченным данным. На каждом шаге модели показывают… 6 мин Основы AI Transformer Transformer — архитектура нейросети, представленная Google в статье «Attention Is All You Need» (2017). На ней построены все современные LLM:… 6 мин Промпты Trigger Word Trigger Word — это специальное слово в промпте, которое активирует обученный LoRA, DreamBooth-чекпоинт или Textual Inversion. Без него адаптер подключён,… 4 мин Этика и регулирование Trust in AI Trust in AI — концепция, отвечающая на вопрос: при каких условиях люди начинают доверять решениям нейросетей и пользоваться AI-продуктами? Доверие… 5 мин Видео TTS и STT TTS (Text-to-Speech) и STT (Speech-to-Text) — две стороны работы с человеческой речью. TTS превращает текст в озвучку: ElevenLabs, OpenAI TTS,… 5 мин Инструменты Upscaler Upscaler — это нейросеть для увеличения картинки с восстановлением деталей, а не простой интерполяцией. Классическое увеличение в Photoshop в 4… 5 мин Генеративные модели VAE Variational Autoencoder VAE (Variational Autoencoder) — это пара нейросетей внутри Stable Diffusion, SDXL и FLUX, которая сжимает картинку в компактное представление и… 7 мин Языковые модели Vector Database Vector DB Vector Database (векторная БД) — специальная база данных для хранения embedding-векторов и быстрого поиска ближайших по смыслу. В отличие от… 6 мин Промпты Vibe Coding Vibe Coding — стиль работы с AI-IDE, который ввёл в обиход Andrej Karpathy в феврале 2025. Идея: даёшь AI цель… 5 мин Применения Vision-Language-Action VLA Vision-Language-Action (VLA) — нейросеть, которая одновременно видит мир (Vision), понимает команду на языке (Language) и генерирует движения для робота (Action).… 7 мин Видео Voice Cloning Voice Cloning — создание AI-голоса, неотличимого от голоса конкретного человека, по 10–30-секундной записи-сэмплу. Главные платформы: ElevenLabs (топ-качество), Resemble.ai, Play.ht. Open-source… 5 мин Параметры VRAM Video RAM VRAM (Video RAM) — собственная память видеокарты, отдельная от системной RAM. Это главный лимит для локального AI: модель должна целиком… 4 мин Видео Whisper Whisper — открытая модель распознавания речи (STT) от OpenAI, выпущена в сентябре 2022. Поддерживает 99 языков, включая русский на отличном… 5 мин Генеративные модели World Models World Models (мировые модели) — нейросети, которые не просто рисуют видео, а строят интерактивную симуляцию мира: помнят его состояние и… 7 мин Промпты Zero-shot и Few-shot Zero-shot и Few-shot — два основных подхода к обращению к LLM. Zero-shot: даём задачу без примеров, модель отвечает «с чистого… 5 мин