AI-словарь · Языковые модели

Языковые модели

Языковые модели (LLM) — нейросети, которые понимают и генерируют текст: GPT, Claude, Gemini, DeepSeek и десятки других. В разделе — как они устроены и чем различаются, что такое токены, контекстное окно, RAG, агенты и tool calling. Самый большой раздел словаря.

Указатель

  1. 11
    Perplexity

    Perplexity — AI-поисковик нового поколения: задаёшь вопрос, получаешь не «10 синих ссылок», а готовый ответ с цитатами на источники в реальном времени. К 2026-му ~209 млн…

    Средний
  2. 12
    DeepSeek

    DeepSeek — китайская AI-компания и одноимённая семейство моделей, взорвавшая индустрию в январе 2025 релизом R1 — open-weight reasoning-модели уровня OpenAI o1, но открытой и в десятки…

    Средний
  3. 13
    Knowledge Graph

    Knowledge Graph — структурированная база знаний в виде узлов (сущности) и рёбер (связи между ними). «Москва — столица — России», «Толстой — автор — Войны и…

    Средний
  4. 14
    Reranking

    Reranking — двухступенчатый поиск: сначала быстрый retrieval достаёт топ-50 кандидатов, потом более точная (но медленная) reranker-модель переоценивает их и оставляет финальные топ-5. Cross-encoder сравнивает каждый документ…

    Средний
  5. 15
    Hybrid Search

    Hybrid Search — комбинация semantic search (по векторам смысла) и keyword search (BM25, по точным словам). Каждый ловит то, что упускает другой: semantic понимает синонимы, keyword…

    Средний
  6. 16
    Semantic Search

    Semantic Search — поиск документов по **смыслу запроса**, а не по ключевым словам. Запрос превращается в эмбеддинг, документы заранее тоже, поиск идёт через cosine similarity между…

    Средний
  7. 17
    Chunking

    Chunking — разбиение длинных документов на маленькие фрагменты (chunks) для индексации в RAG. От выбора размера и стратегии разбиения зависит качество поиска. Слишком маленькие chunks теряют…

    Средний
  8. 18
    Cost per Token

    Cost per Token — главная единица стоимости LLM API. Цена считается отдельно за input (то, что вы отправили) и output (что модель сгенерировала). Стандартная единица —…

    Средний
  9. 19
    Latency

    Latency — задержка между запросом и ответом LLM. У современных моделей две ключевые метрики: TTFT (Time To First Token) — сколько ждать первого токена, и TPS…

    Средний
  10. 20
    MMLU и HumanEval

    MMLU и HumanEval — два самых цитируемых бенчмарка LLM. MMLU (Massive Multitask Language Understanding) — 15 908 вопросов из 57 предметов с 4 вариантами ответа: проверка…

    Средний