AI-словарь · Языковые модели
Языковые модели
Языковые модели (LLM) — нейросети, которые понимают и генерируют текст: GPT, Claude, Gemini, DeepSeek и десятки других. В разделе — как они устроены и чем различаются, что такое токены, контекстное окно, RAG, агенты и tool calling. Самый большой раздел словаря.
Указатель
-
11
Perplexity
Perplexity соединяет веб-поиск с языковой моделью: находит страницы, собирает связный ответ и показывает ссылки. Такой формат удобен для обзора темы, но каждая важная дата, цитата и…
-
12
DeepSeek
DeepSeek — компания и семейство языковых моделей, включающее облачные API, модели рассуждения, варианты для кода и опубликованные веса. Облачный сервис и самостоятельно запущенная модель могут различаться…
-
13
Knowledge Graph
Knowledge Graph, или граф знаний, хранит сущности и утверждения о связях между ними. В нём можно явно показать, что человек работает над проектом, проект использует технологию,…
-
14
Reranking
Reranking — второй этап поиска, на котором уже найденные документы получают новые оценки и меняются местами. Первичный поиск собирает кандидатов, а более внимательный реранкер сопоставляет их…
-
15
Hybrid Search
Hybrid Search объединяет несколько способов найти документы. Лексическая ветка удерживает точные слова и коды, семантическая замечает близкий смысл и перефразировки, а их кандидаты собираются в один…
-
16
Semantic Search
Семантический поиск помогает находить материалы по смысловой близости, даже если запрос и документ сформулированы разными словами. В распространённой схеме тексты превращают в векторы и сравнивают их.…
-
17
Chunking
Chunking — разбиение документов на фрагменты для поиска и подготовки контекста модели. Маленький фрагмент может потерять важное пояснение, большой — смешать несколько тем. Границы, размер и…
-
18
Cost per Token
Cost per Token описывает тарификацию LLM API по объёму входа и выхода. К итоговой сумме могут добавляться кэш, инструменты, хранение и повторные вызовы. Конкретные ставки меняются,…
-
19
Latency
Latency описывает, сколько времени проходит от отправки запроса до результата. У потоковой языковой модели отдельно измеряют ожидание первого токена, интервалы между следующими токенами и полное время…
-
20
MMLU и HumanEval
MMLU проверяет выбор ответа по разным предметам, а HumanEval — способность написать небольшую функцию, которая проходит тесты. Обе цифры полезны, если известен протокол, но ни одна…