Midjourney

midjourney — закрытая премиум-модель для генерации изображений

Раздел
Генеративные модели
Обновлено
19.06.26

Midjourney — закрытая коммерческая модель для генерации изображений от одноимённой компании Дэвида Хольца, запущена в 2022 году. Работает только через веб-интерфейс и Discord по подписке от 10 долларов в месяц. От Stable Diffusion и FLUX отличается кинематографическим стилем из коробки и отсутствием локального запуска: веса не публикуются, fine-tune невозможен. В 2026 году актуальна версия v7, остаётся стандартом для художественной генерации.

Коротко

Коротко. Midjourney — закрытый коммерческий AI-генератор изображений с упором на художественный и кинематографический стиль. Доступ только по подписке через веб-интерфейс или Discord, локального запуска нет. Сильные стороны: красивая картинка с минимумом подсказок, продуманная композиция, цветовая режиссура. Слабые: жёсткая цензура, отсутствие fine-tune, невозможность интегрировать в свой пайплайн.

Что это такое

Июль 2022-го. Бывший основатель Leap Motion Дэвид Хольц запускает закрытую бету в Discord. Пишешь /imagine боту — через минуту получаешь четыре картинки. Никакого сайта, никакого API, только текстовая команда в чате.

Через год сервис обрабатывает миллионы запросов в день, у компании 20 сотрудников и нет ни одного венчурного инвестора. Это аномалия рынка: AI-стартап с прибылью и без раундов.

К 2024-му появляется веб-интерфейс, Discord теряет первенство. К 2025-му выходит v7 с новой моделью персонализации Personalize и обновлённой системой контроля композиции. В 2026-м Midjourney — стандарт для:

  • иллюстраций и обложек,
  • концепт-арта в кино и играх,
  • сториборды и рекламы,
  • художественной генерации, где важнее «настроение», а не точность.

В отличие от FLUX и SDXL, у Midjourney нет открытых весов и публичного API. Доступ — только через веб-сайт midjourney.com или Discord-бот, оба требуют подписки.

Как это работает

Архитектурно Midjourney — диффузионная модель с собственной закрытой реализацией. Никаких model cards, technical reports или научных публикаций компания не выпускает. Из эмпирических наблюдений:

  1. Большая модель. Качество ближе к FLUX Pro, чем к SDXL.
  2. Сильный собственный CLIP/text-encoder. Длинные промпты модель понимает, но реагирует не так буквально, как FLUX — добавляет «своего».
  3. Прокрашенные стили. В тренировке явно делался упор на художественный материал: концепт-арт, кино, иллюстрация. Случайная картинка по нулевому промпту обычно красивее, чем у SDXL.

Базовый цикл работы:

  1. Открываете midjourney.com (или Discord).
  2. Пишете промпт: cyberpunk city at dawn, neon reflections, cinematic, --ar 16:9 --stylize 250 --v 7.
  3. Через 30–60 секунд получаете четыре варианта в сетке 2×2.
  4. Один из них Upscale до 2048+, остальные можно перегенерировать «Variations».

Параметры (флаги):

  • --ar 16:9соотношение сторон.
  • --stylize 0..1000 — сила художественного «своего стиля» модели.
  • --chaos 0..100 — разброс между четырьмя вариантами в сетке.
  • --style raw — отключает художественный фильтр, ближе к фотореализму.
  • --cref URL — character reference, удержание персонажа между кадрами.
  • --sref URL — style reference, повторение стиля с примера.

Пример на практике

Концепт-художнику для рекламной кампании нужно 50 ключевых кадров: будущий город, разные времена суток, разные локации. Срок — два дня.

Через Midjourney v7 он генерирует первый кадр: futuristic megacity at golden hour, low angle, cinematic, anamorphic lens, ar 21:9, stylize 350, v 7. Через 40 секунд готовы четыре варианта — выбирает один. Дальше использует --sref с URL этого кадра, и все 49 остальных кадров получают тот же стиль и палитру.

К концу первого дня — 50 кадров с консистентной режиссурой. Цена: Standard Plan за $30/мес, лимит вычислений хватает с запасом. В Stable Diffusion та же серия потребовала бы тренировки LoRA на стиле, ручной подбор настроек ControlNet и в 3–5 раз больше времени.

Обратная ситуация: дизайнеру каталога нужен товар на белом фоне в строго определённой позе. Midjourney тут проиграет SDXL или FLUX: художественная режиссура вылезет даже на простой задаче, и кадр станет слишком «киношным».

С чем часто путают

  • Midjourney и Stable Diffusion — Midjourney закрытая, доступ по подписке через сайт. Stable Diffusion открытая, запускается локально через ComfyUI или Automatic1111. Это разные модели разных компаний, веса не пересекаются.
  • Midjourney и DALL-E 3 — оба закрытые, но DALL-E встроен в ChatGPT, а Midjourney работает отдельным сервисом. У Midjourney более художественный стиль, у DALL-E лучше следование промпту и интеграция с ChatGPT.
  • Midjourney v6 и v7 — v6 (декабрь 2023) — крупный скачок к фотореализму и читаемому тексту. v7 (апрель 2025) — Personalize и обновлённая система контроля; визуально близка к v6, но «послушнее».
  • Midjourney Discord-бот и веб-интерфейс — функционально одно и то же, но веб удобнее: галерея, фильтры, упорядоченные --sref. Discord остался для совместимости со старыми проектами.

Частые ошибки и заблуждения

  • «Можно запустить Midjourney локально». Нельзя. Веса закрыты, API недоступен публично. Все картинки рендерятся на серверах Midjourney.
  • «Midjourney дешевле Stable Diffusion». Зависит от объёма. До 200 картинок в месяц — да, $10 хватит. От нескольких тысяч — локальный SDXL/FLUX выгоднее: ноль за каждую картинку, плата только за электричество.
  • «Midjourney рисует всё». Не рисует. Жёсткая цензура: политические фигуры, NSFW, узнаваемые товарные знаки и логотипы — всё блокируется на уровне промпта или после генерации.
  • «У Midjourney есть API». Официального — нет. Третьи сервисы (TheNextLeg, GoAPI) проксируют запросы через Discord, но это серая зона, тарифы выше, скорость ниже.
  • «Midjourney всегда красивее FLUX». По художественной режиссуре — часто да. По точности промпта, тексту на картинке и анатомии рук — нет: FLUX обогнал по этим параметрам в 2024-м и пока держит лидерство.

Связанные термины

  • Stable Diffusion / SDXL / FLUX — открытые альтернативы Midjourney.
  • DALL-E 3 — закрытый конкурент от OpenAI, встроен в ChatGPT.
  • ComfyUI — основной интерфейс для open-source-альтернатив, которого у Midjourney нет.
  • Image Prompt / Style Reference (--sref) — способ передавать стиль через URL картинки.
  • Character Reference (--cref) — фиксация персонажа между кадрами.
  • CFG Scale / Stylize — параметр силы следования промпту, у Midjourney называется --stylize.

Частые вопросы

Можно ли запустить Midjourney локально? Нет. Midjourney работает только в облаке — через веб-сайт или Discord, веса модели не публикуются и скачать их нельзя. Если нужен локальный запуск на своей видеокарте, берите открытые модели: Stable Diffusion, SDXL или FLUX через ComfyUI.

Сколько стоит Midjourney в 2026 году? Basic — $10/мес (200 картинок), Standard — $30/мес (без жёстких лимитов на Fast-режим), Pro — $60/мес (Stealth Mode и больше Fast-часов), Mega — $120/мес. На активную работу обычно достаточно Standard.

Можно ли использовать картинки Midjourney в коммерции? По правилам компании — да, для всех платных подписчиков. У Basic иногда есть ограничения по компаниям с большим оборотом. Юридически в 2026-м всё ещё много споров об авторском праве на AI-картинки, особенно для брендинга.

Чем Midjourney лучше FLUX? Художественной режиссурой из коробки, разнообразием стилей и Style Reference. Для иллюстраций, концепт-арта и обложек Midjourney чаще даёт «правильную» картинку с первого раза.

Чем FLUX лучше Midjourney? Точностью следования промпту, читаемым текстом, контролем через LoRA и ControlNet, локальным запуском, бесплатностью Schnell. Для каталогов, продукт-съёмки и пайплайнов FLUX обычно выигрывает.

Доступ в России? Прямой оплаты нет, нужны зарубежные карты или сервисы. Сам сервис в большинстве регионов открывается через VPN. Цензура и ограничения по контенту не зависят от региона пользователя.

Что появилось в v7? Personalize — режим, который учится на ваших оценках («нравится / не нравится») и подстраивает выдачу под ваш вкус. Также — улучшение анатомии рук, более стабильные --cref и --sref, новые опции Draft Mode для быстрой итерации.

Главное

Midjourney — премиум-сервис для художественной AI-генерации. Берите его, если важна красивая картинка с минимумом ручной настройки, и нет требований к локальному запуску или точному контролю. Для каталогов, продуктовой съёмки, тренировки своих LoRA и сложных пайплайнов — открытые модели (FLUX, SDXL через ComfyUI) обычно практичнее. Часто оптимальный сценарий — Midjourney для концепта, открытые модели для рендера в продакшен.