ChatGPT, Claude или Gemini: честное сравнение на 12 реальных задачах
Спорить о том, какая модель «умнее», бессмысленно: выигрыш зависит от задачи, а не от названия. 🧪 Полезнее знать, где каждая модель обычно сильна, а где её придётся перепроверять руками.
Ниже — сравнение на 12 типовых рабочих задачах: от черновика статьи до разбора длинного PDF и поиска ошибки в коде. К каждой задаче приложен готовый промпт: скопируйте его, прогоните во всех трёх моделях на своих данных и получите личный результат за один вечер.
⚠️ Как читать это сравнение
Это не лабораторный бенчмарк и не рейтинг «кто лучше вообще». Мы не публикуем выдуманные баллы: числа без версии модели, тарифа и даты измерения вводят в заблуждение. Ниже — профиль поведения моделей по типу задач, открытый протокол проверки и промпты для самостоятельного теста. Версии моделей обновляются независимо, поэтому профиль может измениться в любой момент.
⚡ Короткий вердикт
Формат, структура, таблицы, следование жёсткому ТЗ — чаще выигрывает 🟢 ChatGPT.
Длинные документы, аккуратные формулировки, сложные письма — 🟣 Claude.
Факты со ссылками, поиск, работа с документами Google — 🔵 Gemini.
Если нужна одна модель «на всё» — берите ту, что закрывает вашу самую частую задачу, и держите вторую как замену.
🧪 Методика: 12 задач, 4 критерия, 3 прогона
Задачи подобраны так, чтобы покрыть типовой рабочий день: тексты, документы, данные, факты, код, анализ, обучение и коммуникация. Каждый промпт прогонялся несколько раз на одних и тех же входных данных — иначе результат случайной удачи легко принять за закономерность.
| Критерий | Вес | Что именно смотрим |
|---|---|---|
| Следование ТЗ и формату | 30% | Соблюдены ли структура, объём, список ограничений и запретов из промпта |
| Точность и аккуратность | 30% | Не выдумывает ли факты, помечает ли предположения, сохраняет ли смысл исходника |
| Работа с объёмом | 20% | Держит ли длинный документ, не теряет ли детали из начала и середины |
| Скорость доработки | 20% | Сколько минут правок нужно, чтобы результат можно было отдать дальше |
Главный критерий здесь последний: не «насколько красиво», а «сколько времени вы потратите после». Именно он чаще всего меняет выбор модели на практике.
«Красивый ответ без фактов хуже сухого, но точного: в работе ценится время доработки, а не первое впечатление».
🗂 12 задач с вердиктами
Выберите модель, чтобы видеть только её строку, и категорию задач — или пролистайте всё подряд.
🤖 Модель — показывать только её разбор:
🎯 Тип задачи:
Показано 12 задач из 12
Черновик статьи по жёсткому брифу
Ты — редактор. Тема: [тема], аудитория: [кто], структура: [список разделов], объём: ровно [N] знаков. Напиши текст строго по структуре: в каждом разделе один тезис и один пример. Без вступлений и выводов «в целом». В конце — три вопроса читателя с ответами.
🔍 Что смотрим: соблюдение структуры и объёма, отсутствие воды, время правок
- 🟢 ChatGPT: точнее всех держит лимит по знакам и порядок разделов — черновик почти не требует перекомпоновки.
- 🟣 Claude: язык чище, но объём «плавает» и появляются пояснения, которых в брифе не было.
- 🔵 Gemini: пишет быстрее, чаще переставляет акценты и сокращает часть разделов по своему усмотрению.
🏁 Вывод: жёсткое ТЗ и точный объём — ChatGPT. Свободный бриф и важен язык — Claude.
Редактура и сокращение текста
Отредактируй текст: [текст]. Сократи на 40%, сохранив все факты и цифры. Убери штампы, повторы и канцелярит, разбей длинные предложения. Покажи результат и отдельный список удалённого с причиной. Не добавляй фактов, которых нет в исходнике.
🔍 Что смотрим: сохранение смысла, точность сокращения, прозрачность правок
- 🟢 ChatGPT: хорошо попадает в процент сокращения и аккуратно оформляет список правок.
- 🟣 Claude: бережнее к смыслу исходника, реже теряет нюансы формулировок и оговорки.
- 🔵 Gemini: склонен переписывать вольно: смысл сохраняется, но авторские формулировки исчезают.
🏁 Вывод: сокращение без потерь — Claude. Быстрые правки с отчётом — ChatGPT.
Разбор длинного PDF на 60 страниц
Ниже документ на [N] страниц: [текст или файл]. Сделай: краткое содержание по разделам, список обязательств и сроков, пять пунктов, которые чаще всего пропускают при чтении, и перечень мест, требующих проверки юристом. Только то, что есть в документе.
🔍 Что смотрим: удержание деталей из начала и середины, отсутствие домыслов, структура
- 🟢 ChatGPT: структура аккуратная, но на очень больших объёмах может потерять пункты из первых страниц.
- 🟣 Claude: самый устойчивый результат на длинных документах: держит связи между разделами и сносками.
- 🔵 Gemini: удобно, если файл лежит в Google Drive, но пересказ бывает поверхностным по деталям.
🏁 Вывод: длинные PDF — Claude. Договоры и медзаключения всё равно проверяет специалист, модель лишь готовит вопросы.
Таблица из «грязного» текста
Преобразуй текст в таблицу со столбцами: [столбцы]. Сохрани порядок строк как в исходнике. Если данных для ячейки нет — поставь «нет данных», не придумывай значения и не пересчитывай единицы. Формат: markdown. Текст: [текст].
🔍 Что смотрим: соблюдение столбцов и порядка, отсутствие выдуманных ячеек
- 🟢 ChatGPT: строго держит столбцы и корректно ставит «нет данных» — таблицу можно сразу использовать.
- 🟣 Claude: хорошо разбирает хаотичный текст, но иногда добавляет пояснения внутри ячеек.
- 🔵 Gemini: может пересортировать строки и «дозаполнить» пропуски логикой вместо пометки.
🏁 Вывод: таблицы из грязных данных — ChatGPT. Claude подойдёт, если текст совсем неструктурированный.
Сводка для руководства из 40 страниц
Сожми материал [текст] в сводку на одну страницу: ситуация, ключевые цифры, предлагаемое решение, риски, что требуется от руководства. До 250 слов. Без предыстории, без перечисления этапов работы и без оценок вроде «значительный рост» без цифры.
🔍 Что смотрим: попадание в объём, сохранение цифр, наличие явного запроса решения
- 🟢 ChatGPT: почти всегда укладывается в лимит и заканчивает блоком «что нужно решить».
- 🟣 Claude: точнее вытаскивает суть и меньше воды, но любит добавлять контекст, которого просили не давать.
- 🔵 Gemini: быстрее, однако чаще теряет отдельные цифры и заменяет их общими словами.
🏁 Вывод: сводка для руководства — ChatGPT по формату, Claude по сути. Проверяйте цифры в любом случае.
Фактчекинг десяти утверждений
Проверь утверждения: [список]. Для каждого дай: подтверждение, опровержение или «требует проверки», ссылку на источник и одну фразу, объясняющую вывод. Не додумывай данные: если подтверждения нет — так и напиши.
🔍 Что смотрим: наличие источников, честность формулировок, отсутствие выдуманных цифр
- 🟢 ChatGPT: без доступа к поиску может уверенно сформулировать неверное утверждение — полезнее как генератор списка «что проверять».
- 🟣 Claude: аккуратнее обозначает неопределённость и чаще пишет «данных недостаточно».
- 🔵 Gemini: единственный из трёх, кто штатно ходит в поиск и даёт ссылки — но каждую ссылку нужно открывать.
🏁 Вывод: черновик проверки — Gemini, формулировки и оценка надёжности — Claude. Итог всегда за человеком.
Объяснение незнакомого кода на 300 строк
Объясни код: [код]. Язык и версия: [язык]. Структура ответа: назначение модуля, поток выполнения, разбор по блокам, неочевидные места, потенциальные ошибки, что стоит упростить. Не переписывай код целиком, показывай только значимые фрагменты.
🔍 Что смотрим: удержание файла целиком, качество разбора, отсутствие выдуманных функций
- 🟢 ChatGPT: отлично разбирает по блокам и держит заданную структуру ответа, но большой файл лучше давать частями.
- 🟣 Claude: лучший результат при загрузке всего файла сразу: видит связи между функциями и не теряет детали.
- 🔵 Gemini: склонен к обобщённому описанию и иногда приписывает коду поведение, которого нет.
🏁 Вывод: большой файл целиком — Claude. Точечный разбор по блокам — ChatGPT.
Поиск причины ошибки
Вот код, полный стек вызовов и версия окружения: [код], [стек], [версия]. Найди причину ошибки, предложи минимальную правку и один альтернативный вариант. Объясни, почему ошибка проявляется именно здесь. Если данных не хватает — перечисли, что логировать дополнительно.
🔍 Что смотрим: попадание в причину с первого раза, минимальность правки, объяснение
- 🟢 ChatGPT: быстро выдаёт несколько гипотез и точную правку, но иногда «уверенно» чинит не то место.
- 🟣 Claude: чаще просит недостающий контекст и предлагает минимальное изменение вместо переписывания файла.
- 🔵 Gemini: хорошо находит типовые проблемы окружения, зависимостей и версий.
🏁 Вывод: логика и минимальная правка — ChatGPT. Окружение и зависимости — Gemini. Контекст и осторожность — Claude.
SQL по большой схеме
Напиши SQL-запрос: [что нужно получить]. Схема: [схема таблиц]. Диалект: [диалект]. Дай два варианта — читаемый и оптимизированный — с объяснением разницы, а также пример ожидаемого результата таблицей. Отметь, какие индексы помогут.
🔍 Что смотрим: корректность связей, работа с большой схемой, читаемость и оптимизация
- 🟢 ChatGPT: самые читаемые запросы и внятное объяснение разницы между вариантами.
- 🟣 Claude: увереннее держит большую схему и связи между десятками таблиц.
- 🔵 Gemini: рабочий вариант, но чаще упрощает связи и пропускает условия фильтрации.
🏁 Вывод: сложные схемы — Claude, читаемость и оптимизация — ChatGPT.
План запуска проекта с рисками
Составь план запуска [проект] со сроком [дата]: этапы по неделям, зависимости, ресурсы, пять главных рисков с оценкой вероятности и влияния, а также что считаем признаком того, что пора останавливаться. Контекст: [вводные].
🔍 Что смотрим: полнота рисков, реалистичность сроков, наличие критериев остановки
- 🟢 ChatGPT: аккуратные этапы, чек-листы и таблицы — удобно сразу переносить в трекер.
- 🟣 Claude: глубже прорабатывает допущения и риски, включая организационные.
- 🔵 Gemini: добавляет внешние ориентиры и примеры из практики, но их нужно проверять.
🏁 Вывод: каркас плана — ChatGPT, риски и допущения — Claude.
Объяснение сложной темы для новичка
Объясни [тема] на трёх уровнях: для школьника, для студента и для специалиста. Каждый уровень — до 120 слов, с одним примером из практики. Не упрощай смысл: упрощай формулировки. В конце — один вопрос, который проверит, понял ли я главное.
🔍 Что смотрим: точность терминов, сохранение смысла при упрощении, качество примеров
- 🟢 ChatGPT: стабильно держит три уровня сложности и заданный объём каждого.
- 🟣 Claude: точнее по терминологии и удачнее подбирает примеры для третьего уровня.
- 🔵 Gemini: объясняет живо, но иногда упрощает до неточности — проверяйте ключевые определения.
🏁 Вывод: учёба — ChatGPT или Claude. Gemini хорош для быстрых аналогий и первого знакомства.
Сложное письмо клиенту после конфликта
Помоги написать письмо клиенту после конфликта: [ситуация]. Цель: [цель]. Тон: уважительный, без заискивания и без обвинений. Структура: факты, что уже сделали, предложение по решению, один вопрос клиенту. До [N] слов. Дай три варианта разной степени жёсткости.
🔍 Что смотрим: уместность тона, отсутствие обвинений, вариантность
- 🟢 ChatGPT: даёт три различимых варианта тона — можно выбрать под отношения с клиентом.
- 🟣 Claude: самые бережные формулировки: снимает обострение и не выглядит как отписка.
- 🔵 Gemini: пишет живее, но иногда переходит на фамильярный тон в деловой переписке.
🏁 Вывод: сложные и чувствительные письма — Claude, вариантность тона — ChatGPT.
🙈 Ничего не нашлось. Сбросьте фильтры или нажмите «Все 12».
📊 Сводная таблица по 12 задачам
Обозначения: ● — сильная сторона модели в этой задаче, ◐ — приемлемо, ○ — место, где потребуются значительные правки. Оценки — редакционные, по критериям из методики.
| Задача | 🟢 ChatGPT | 🟣 Claude | 🔵 Gemini | Перевес |
|---|---|---|---|---|
| 1. Черновик по жёсткому брифу | ● | ◐ | ◐ | 🟢 ChatGPT |
| 2. Редактура и сокращение | ◐ | ● | ○ | 🟣 Claude |
| 3. Разбор длинного PDF | ◐ | ● | ◐ | 🟣 Claude |
| 4. Таблица из грязного текста | ● | ◐ | ○ | 🟢 ChatGPT |
| 5. Сводка для руководства | ● | ● | ◐ | 🟢 ChatGPT |
| 6. Фактчекинг утверждений | ◐ | ◐ | ● | 🔵 Gemini |
| 7. Объяснение кода | ◐ | ● | ○ | 🟣 Claude |
| 8. Причина ошибки | ● | ● | ◐ | 🟢 ChatGPT |
| 9. SQL по большой схеме | ● | ◐ | ◐ | 🟢 ChatGPT |
| 10. План запуска с рисками | ◐ | ● | ◐ | 🟣 Claude |
| 11. Объяснение темы новичку | ● | ● | ◐ | 🟢 ChatGPT |
| 12. Сложное письмо клиенту | ◐ | ● | ○ | 🟣 Claude |
Итог по перевесам: 6 задач за ChatGPT, 5 за Claude, 1 за Gemini. Это не значит, что одна модель «лучше»: ChatGPT чаще выигрывает там, где важны формат и структура, Claude — где важны объём и формулировки, Gemini — там, где нужен поиск и ссылки.
🙈 Чего это сравнение не показывает
- 💰 Стоимость и лимиты. Мы сравнивали качество работы, а не цену подписки и бесплатные ограничения — а они в реальном выборе значат не меньше.
- 🔒 Приватность и хранение данных. Политики сервисов различаются: если работаете с чувствительными данными, сравнивать нужно в первую очередь их.
- ⚡ Скорость ответа и доступность. Очереди, лимиты и доступность без VPN меняются от региона к региону и от дня к дню.
- 🧩 Интеграции. Встроенные редакторы, расширения и API иногда важнее качества самого чата.
- 🔮 Будущие версии. Модели обновляются каждые несколько месяцев: сегодняшний профиль — не приговор на год.
«Сравнение моделей имеет смысл только на ваших данных: чужие выводы экономят время, но не заменяют один вечер собственных тестов».
🗓 Как выбрать модель за один вечер
- Выпишите две самые частые задачи. Не «работа с текстом», а «раз в неделю сокращать отчёт на 30%».
- Возьмите промпты из этой статьи (кнопка «Копировать промпт» в каждой задаче) и подставьте свои данные.
- Прогоните каждую задачу во всех трёх моделях по три раза. Один удачный ответ ничего не доказывает.
- Замерьте время доработки. Секундомер честнее впечатления: считайте минуты правок до результата, который можно отдать.
- Оставьте одну основную модель и одну запасную. Вторая нужна на случай лимитов, сбоев и задач, где первая стабильно слабее.
🧱 Что усиливает любую из трёх моделей
Один пример своего текста или кода в промпте, явное ограничение объёма, запрет на домыслы («используй только данные из текста») и требование указать, чего в данных не хватает. Эти четыре добавки дают больше, чем смена модели.
❓ Частые вопросы
Это независимый лабораторный тест моделей?
Нет. Это редакционное сравнение по открытому протоколу: 12 типовых задач, 4 критерия, повторные прогоны. Мы не публикуем выдуманные баллы и не выдаём чужие бенчмарки за свои — вместо этого даём профиль моделей и промпты, чтобы вы получили собственные цифры.
Почему в сравнении нет числовых оценок?
Баллы без указания версии модели, тарифа и даты измерения вводят в заблуждение: версии обновляются каждые несколько месяцев. Поэтому выводы даны по типу задачи, а не в виде абсолютных оценок.
Какие версии моделей сравнивались?
Доступные на бесплатных тарифах и в стандартных подписках на дату обновления статьи. На платных тарифах работают более сильные версии, и профиль по отдельным задачам может отличаться.
Можно ли использовать модели для юридических и медицинских документов?
Только для первичной ориентации и подготовки вопросов специалисту. Модель может уверенно исказить пункт договора или показатель анализа, поэтому решения принимает человек с профильной квалификацией.
Что делать, если мой результат отличается от описанного?
Это нормально: влияют версия модели, тариф, язык запроса и контекст диалога. Профиль устойчив только по типу задачи, поэтому итоговый выбор делайте на своих задачах и своих данных.
🏁 Итог
На 12 рабочих задачах разница между моделями оказалась не в «уме», а в характере: одна держит формат, вторая — объём и формулировки, третья — поиск и ссылки. 🎯 Если нужна одна модель, выбирайте по своей самой частой задаче и держите вторую как замену.
И главное: любой чужой тест — это гипотеза. Промпты в этой статье даны ровно для того, чтобы за один вечер вы получили свой результат на своих данных, а не верили чужому списку на слово.