AI-словарь · Языковые модели

Языковые модели

Языковые модели (LLM) — нейросети, которые понимают и генерируют текст: GPT, Claude, Gemini, DeepSeek и десятки других. В разделе — как они устроены и чем различаются, что такое токены, контекстное окно, RAG, агенты и tool calling. Самый большой раздел словаря.

Указатель

  1. 11
    Perplexity

    Perplexity соединяет веб-поиск с языковой моделью: находит страницы, собирает связный ответ и показывает ссылки. Такой формат удобен для обзора темы, но каждая важная дата, цитата и…

    Средний
  2. 12
    DeepSeek

    DeepSeek — компания и семейство языковых моделей, включающее облачные API, модели рассуждения, варианты для кода и опубликованные веса. Облачный сервис и самостоятельно запущенная модель могут различаться…

    Средний
  3. 13
    Knowledge Graph

    Knowledge Graph, или граф знаний, хранит сущности и утверждения о связях между ними. В нём можно явно показать, что человек работает над проектом, проект использует технологию,…

    Средний
  4. 14
    Reranking

    Reranking — второй этап поиска, на котором уже найденные документы получают новые оценки и меняются местами. Первичный поиск собирает кандидатов, а более внимательный реранкер сопоставляет их…

    Средний
  5. 15
    Hybrid Search

    Hybrid Search объединяет несколько способов найти документы. Лексическая ветка удерживает точные слова и коды, семантическая замечает близкий смысл и перефразировки, а их кандидаты собираются в один…

    Средний
  6. 16
    Semantic Search

    Семантический поиск помогает находить материалы по смысловой близости, даже если запрос и документ сформулированы разными словами. В распространённой схеме тексты превращают в векторы и сравнивают их.…

    Средний
  7. 17
    Chunking

    Chunking — разбиение документов на фрагменты для поиска и подготовки контекста модели. Маленький фрагмент может потерять важное пояснение, большой — смешать несколько тем. Границы, размер и…

    Средний
  8. 18
    Cost per Token

    Cost per Token описывает тарификацию LLM API по объёму входа и выхода. К итоговой сумме могут добавляться кэш, инструменты, хранение и повторные вызовы. Конкретные ставки меняются,…

    Средний
  9. 19
    Latency

    Latency описывает, сколько времени проходит от отправки запроса до результата. У потоковой языковой модели отдельно измеряют ожидание первого токена, интервалы между следующими токенами и полное время…

    Средний
  10. 20
    MMLU и HumanEval

    MMLU проверяет выбор ответа по разным предметам, а HumanEval — способность написать небольшую функцию, которая проходит тесты. Обе цифры полезны, если известен протокол, но ни одна…

    Средний