AI-словарь · Языковые модели
Языковые модели
Языковые модели (LLM) — нейросети, которые понимают и генерируют текст: GPT, Claude, Gemini, DeepSeek и десятки других. В разделе — как они устроены и чем различаются, что такое токены, контекстное окно, RAG, агенты и tool calling. Самый большой раздел словаря.
Указатель
-
11
Perplexity
Perplexity — AI-поисковик нового поколения: задаёшь вопрос, получаешь не «10 синих ссылок», а готовый ответ с цитатами на источники в реальном времени. К 2026-му ~209 млн…
-
12
DeepSeek
DeepSeek — китайская AI-компания и одноимённая семейство моделей, взорвавшая индустрию в январе 2025 релизом R1 — open-weight reasoning-модели уровня OpenAI o1, но открытой и в десятки…
-
13
Knowledge Graph
Knowledge Graph — структурированная база знаний в виде узлов (сущности) и рёбер (связи между ними). «Москва — столица — России», «Толстой — автор — Войны и…
-
14
Reranking
Reranking — двухступенчатый поиск: сначала быстрый retrieval достаёт топ-50 кандидатов, потом более точная (но медленная) reranker-модель переоценивает их и оставляет финальные топ-5. Cross-encoder сравнивает каждый документ…
-
15
Hybrid Search
Hybrid Search — комбинация semantic search (по векторам смысла) и keyword search (BM25, по точным словам). Каждый ловит то, что упускает другой: semantic понимает синонимы, keyword…
-
16
Semantic Search
Semantic Search — поиск документов по **смыслу запроса**, а не по ключевым словам. Запрос превращается в эмбеддинг, документы заранее тоже, поиск идёт через cosine similarity между…
-
17
Chunking
Chunking — разбиение длинных документов на маленькие фрагменты (chunks) для индексации в RAG. От выбора размера и стратегии разбиения зависит качество поиска. Слишком маленькие chunks теряют…
-
18
Cost per Token
Cost per Token — главная единица стоимости LLM API. Цена считается отдельно за input (то, что вы отправили) и output (что модель сгенерировала). Стандартная единица —…
-
19
Latency
Latency — задержка между запросом и ответом LLM. У современных моделей две ключевые метрики: TTFT (Time To First Token) — сколько ждать первого токена, и TPS…
-
20
MMLU и HumanEval
MMLU и HumanEval — два самых цитируемых бенчмарка LLM. MMLU (Massive Multitask Language Understanding) — 15 908 вопросов из 57 предметов с 4 вариантами ответа: проверка…