Большой разбор
ChatGPT, Claude или Gemini: как выбрать AI-ассистента под свою работу
ChatGPT, Claude и Gemini меняются быстрее сравнительных таблиц. Полезнее не искать вечного победителя, а проверить три продукта на одинаковых рабочих задачах: с теми же файлами, требованиями, источниками и критериями качества. В этом разборе — устойчивые различия между сервисами, готовый тестовый набор и способ выбрать ассистента без привязки к номеру модели или названию тарифа.
Три похожих окна, три разных рабочих места
На столе лежат расшифровка интервью, таблица расходов и черновик письма. Любой из трёх ассистентов способен пересказать текст, найти формулу и предложить редактуру. Разница проявится позже: один удобнее соберёт всё в проект, другой вынесет результат в отдельный редактируемый документ, третий подтянет разрешённые файлы из рабочей экосистемы.
Именно поэтому вопрос «кто умнее?» почти не помогает. Пользователь работает не с голой LLM, а с продуктом вокруг неё: интерфейсом, выбранным режимом, поиском, исполняемым кодом, памятью, подключёнными приложениями и правилами обработки данных.
Сначала разделим продукт, модель и режим
В разговорах эти уровни часто смешиваются.
- ChatGPT, Claude и Gemini — пользовательские продукты.
- Семейство модели — нейросеть под интерфейсом; доступная версия зависит от плана и выбранного режима.
- Инструменты — поиск, выполнение кода, генерация файлов, голос, подключённые приложения и другие действия вокруг модели.
- Workspace — личная или организационная среда со своими настройками доступа, хранения и администрирования.
- API — отдельный способ интеграции, у которого свои модели, цены, лимиты и политика данных.
Фраза «Claude лучше прочитал PDF» ничего не говорит, если один файл был текстовым, другой — сканом, а ChatGPT в соседнем тесте получил таблицу через Python. Для честного вывода нужны одинаковые входы и понятные условия.
Устойчивые различия между тремя продуктами
Набор функций будет расти, поэтому ниже не список кнопок, а направление, в котором выстроен каждый сервис.
ChatGPT: широкий набор инструментов в одном проекте
ChatGPT объединяет обычный чат с веб-поиском, анализом файлов и таблиц, выполнением Python, голосом, генерацией изображений, Canvas и Projects. Проект хранит связанные чаты, файлы и инструкции; доступные инструменты зависят от плана и настроек workspace.
Такой формат удобно проверить, если работа часто перескакивает между текстом, расчётами, диаграммой, поиском и изображением. Сильная сторона здесь не обещание «лучшей модели», а короткий путь между разными типами материала.
Claude: работа с самостоятельным результатом и контекстом проекта
Claude предлагает Projects с файлами и инструкциями, Artifacts для отдельного редактируемого результата, подключаемые источники и среду для создания файлов и анализа данных. Для разработки рядом существует Claude Code, но это отдельный рабочий продукт, а не просто режим веб-чата.
Такую оболочку имеет смысл тестировать на длинной редактуре, спецификации, прототипе или кодовой задаче, где результат живёт дольше одного ответа и требует нескольких аккуратных итераций.
Gemini: связь с сервисами Google и мультимодальными источниками
Gemini умеет работать с загруженными документами, таблицами, кодом, изображениями, аудио и видео. Canvas предназначен для документов, кода, приложений и слайдов; Deep Research собирает отчёты по выбранным источникам. При разрешённом подключении Gemini может использовать данные из сервисов Google.
Отдельный NotebookLM полезен, когда ответы должны опираться на выбранный корпус источников и сопровождаться ссылками на фрагменты. Это соседний продукт, поэтому его не стоит молча записывать в возможности обычного чата Gemini.
Похожие функции не означают одинаковый процесс
У всех трёх есть проекты, поиск, файлы и способы создавать крупный результат. Но детали важнее названия функции.
Поиск и исследование
Обычный web search подходит для короткого факта. Deep research собирает много источников, строит план и готовит длинный отчёт. В обоих случаях надо открыть ссылки: наличие цитаты ещё не доказывает, что источник подтверждает соседнее предложение.
Проверяйте, можно ли ограничить поиск выбранными доменами, увидеть план до запуска и отделить найденный факт от вывода модели.
Документы и большой контекст
Размер контекстного окна сам по себе мало говорит о качестве. Сервис может загрузить файл целиком, извлечь только текст, применить поиск по фрагментам или не распознать таблицу в скане. Для работы важнее три вопроса:
- Находит ли ассистент факт в середине документа?
- Показывает ли страницу, строку или цитату, по которой ответ можно проверить?
- Признаёт ли отсутствие сведений вместо правдоподобного дополнения?
Код и анализ данных
Текстовый ответ с формулой и исполненный расчёт — разные вещи. Если результат зависит от чисел, смотрите, выполнил ли сервис код, сохранил ли таблицу, показал ли допущения и можно ли повторить вычисление.
Для репозитория важны доступ к нужным файлам, видимый diff, запуск тестов и контроль разрешений. Красивый фрагмент кода без проверки в проекте оценивается ниже работающего патча.
Голос, изображения и видео
Факт поддержки модальности не гарантирует подходящий сценарий. Голос может быть обычной диктовкой или живым разговором; работа с видео — анализом файла, транскрипта либо изображения и звука вместе. Генерация изображения и его разбор тоже являются разными инструментами.
Перед подпиской полезнее проверить один собственный звонок, скриншот или ролик, чем читать общий список «мультимодальных возможностей».
Тест, который переживёт смену моделей
Выберите пять реальных задач, которые повторяются хотя бы раз в месяц. Не придумывайте олимпиадные вопросы, если в жизни вы редактируете договоры и сводите отчёты.
Подходящий набор выглядит так:
| Задача | Проверяемый результат | Где часто прячется ошибка |
|---|---|---|
| Отредактировать русский текст | сохранены факты, тон и структура | клише, лишние советы, выдуманные детали |
| Ответить по документу | цитаты ведут к нужным фрагментам | потерянная середина, ответ не из файла |
| Разобрать таблицу | контрольная сумма и формула совпадают | неверный тип данных, пропущенные строки |
| Исследовать тему | первичные источники поддерживают вывод | ссылка существует, но говорит о другом |
| Исправить код | diff минимален, тест воспроизводится | несуществующий API, незапущенные тесты |
Для каждого продукта создайте чистый чат или отдельный проект. Отключите лишнюю память, если она способна подсказать ответ из предыдущих попыток. Используйте один prompt, одни файлы и один формат результата.
Простая шкала оценки
Пяти критериев обычно достаточно:
- верность задаче — выполнены ли все ограничения;
- проверяемость — видны ли источники, расчёты или diff;
- стоимость правки — сколько минут ушло на исправление;
- удобство процесса — легко ли добавить контекст и продолжить работу;
- предсказуемость — повторяется ли качество на нескольких примерах.
Ставьте от 0 до 2 баллов и добавляйте короткое примечание. Итоговая сумма менее важна, чем профиль: один сервис может уверенно выигрывать на таблицах и проигрывать на вашем стиле текста.
Как посчитать реальную стоимость
Цена подписки — только одна строка. Добавьте к ней:
- время на повторные запросы и ручную редактуру;
- стоимость ошибки в документе, расчёте или коде;
- лимиты на файлы, исследования и сложные режимы;
- необходимость второго сервиса для недостающей функции;
- перенос результатов в вашу рабочую систему;
- обучение команды и администрирование доступов.
Если ассистент за минуту выдаёт черновик, который приходится час перепроверять, дешёвым его назвать трудно. И наоборот: более дорогой план может окупиться, если даёт воспроизводимый расчёт или избавляет от ручного копирования между сервисами.
У API отдельная экономика. Считаются входные и выходные токены, кэш, поиск, выполнение инструментов и число повторов. Для оценки возьмите журнал реальных запросов и прогоните его через кандидатов. Прайс из статьи всё равно устареет раньше такого теста.
Данные: название тарифа ничего не гарантирует
Личный чат, бизнес-workspace и API одного провайдера могут обрабатывать данные по-разному. Настройка «не использовать для обучения» также не равна нулевому хранению, отсутствию abuse monitoring или отключённой памяти.
Перед загрузкой рабочих материалов проверьте:
- используется ли ввод и вывод для обучения по умолчанию;
- где отключается такое использование и на какие будущие чаты действует настройка;
- срок хранения чатов и файлов;
- возможен ли human review;
- какие данные видит администратор workspace;
- какие разрешения получают connected apps;
- сохраняются ли данные у стороннего инструмента после отключения;
- можно ли удалить и экспортировать материалы.
У личного аккаунта, организационного workspace и API могут быть разные правила. Политики и настройки меняются, а подключённое приложение добавляет ещё одного обработчика данных. Для коммерческой тайны, медицины, персональных данных и клиентских документов ориентируются на действующие условия выбранного продукта и правила своей организации.
Быстрый выбор без рейтинга
Начальную тройку кандидатов можно сузить так:
- Если основная работа уже живёт в Gmail, Drive, Docs, Sheets и Meet, включите Gemini в тест интеграции. Проверяйте реальные права доступа, а не обещание «знает всё из Google».
- Если нужен один интерфейс для поиска, Python-анализа, графиков, голоса и изображений, проверьте маршрут в ChatGPT целиком.
- Если работа строится вокруг длинного редактируемого результата, проектных материалов или разработки, проверьте Projects, Artifacts и соответствующий инструмент Claude.
- Если ответы должны строго опираться на небольшой выбранный корпус, добавьте NotebookLM или собственный RAG в сравнение.
- Если критичны локальный запуск и контроль инфраструктуры, рассмотрите открытые веса через LM Studio или Ollama. Это уже другой класс решения с собственными затратами на железо и поддержку.
Вполне нормально оставить два инструмента: например, один для работы с источниками, второй для файлов и кода. Но второй должен закрывать измеримый пробел, а не жить в подписках «на всякий случай».
Поле шире трёх логотипов
ChatGPT, Claude и Gemini — лишь один слой рынка. Есть поисковые ассистенты, локальные приложения, API-агрегаторы, встроенные помощники в офисных пакетах и продукты вокруг открытых весов.
DeepSeek, Qwen, Mistral, Llama и другие семейства могут быть доступны через собственный сервис, сторонний API или локальный runtime. «Открытая модель» не означает автоматически бесплатную, приватную или пригодную для коммерции: нужно проверить лицензию, способ размещения и оператора конкретного endpoint.
С чем не путать
- ChatGPT и GPT. ChatGPT — продукт, GPT — семейство моделей OpenAI.
- Claude и Anthropic. Claude — продукт и семейство моделей, Anthropic — компания.
- Gemini и Google Workspace. Чат Gemini и функции Gemini внутри организационных сервисов могут иметь разные возможности и правила данных.
- План и модель. Название подписки не сообщает автоматически, какой mode или model обрабатывает конкретный запрос.
- Контекст и знания. Большой context window позволяет передать больше материала, но не гарантирует правильный поиск факта внутри него.
- Цитата и доказательство. Ссылка рядом с ответом полезна только после проверки содержимого источника.
Частые вопросы
Какой ассистент лучше понимает русский?
Это зависит от типа текста, выбранной модели и ваших требований к стилю. Дайте всем кандидатам один сложный русский оригинал, запретите менять факты и сравните число ручных правок.
Можно ли сравнить бесплатные версии?
Да, если именно ими вы собираетесь пользоваться. Не переносите результат на другие планы: доступные модели, инструменты и лимиты могут отличаться.
Какой сервис меньше галлюцинирует?
Ни один не даёт универсальной гарантии. Отдельно тестируйте ответы по памяти, по загруженному документу и с веб-поиском. В важных задачах требуйте первичный источник или воспроизводимый расчёт.
Что выбрать для кода?
Проверяйте не объяснение функции, а изменение в своём репозитории: минимальный diff, запуск тестов, отсутствие выдуманных зависимостей и удобство отката. Веб-чат и специализированный coding agent сравниваются как разные продукты.
Что выбрать для большой библиотеки документов?
Для ограниченного корпуса важны retrieval и точные цитаты, а не только максимальный context window. Проверьте, как сервис индексирует источники, обновляет их и отвечает, когда нужного факта нет.
Можно ли загружать конфиденциальные файлы?
Только если выбранный workspace, договор и настройки разрешены вашей организацией. Личная подписка и корпоративный продукт одного бренда не взаимозаменяемы.
Нужны ли сразу три подписки?
Редко. Сначала измерьте один основной сервис на пяти задачах. Второй имеет смысл, когда стабильно закрывает конкретный пробел и экономия превышает его стоимость.
Как часто повторять сравнение?
Когда меняется ваша работа, тариф, политика данных или важный инструмент. Ежемесячный забег по случайным бенчмаркам не нужен; небольшой регрессионный набор собственных задач полезнее.
Главное
ChatGPT, Claude и Gemini нельзя честно расставить по местам один раз и навсегда. Это меняющиеся продукты вокруг моделей, инструментов, connected apps и разных режимов данных.
Устойчивый выбор получается из короткого теста: одинаковые исходники, пять реальных задач, проверяемый результат, стоимость исправлений и подходящий режим приватности. Такой протокол переживёт смену названий моделей — и покажет именно вашего победителя, если он вообще один.
Источники
- OpenAI: Projects in ChatGPT
- OpenAI: ChatGPT Search
- OpenAI: Data analysis with ChatGPT
- OpenAI: Data Controls FAQ
- OpenAI: business data privacy
- Anthropic: Projects in Claude
- Anthropic: Artifacts
- Anthropic: create and edit files with Claude
- Anthropic: personal data in model training
- Google: upload and analyse files in Gemini Apps
- Google: Deep Research in Gemini Apps
- Google: Canvas in Gemini Apps
- Google: Gemini Apps Privacy Hub
- Google Workspace: generative AI privacy
- Google: about NotebookLM
Карта дальше — термины из словаря
Если хотите идти глубже — вот все термины, упомянутые в этом гиде. Можно открыть в новой вкладке и читать параллельно.
Подписка Neurosaver
Получать новые разборы Neurosaver
Большие материалы выходят не каждый день, зато их стоит читать спокойно. Подпишитесь, и мы пришлём новые разборы и важные обновления словаря.