Claude, GPT или Gemini — какую нейросеть выбрать
Коротко. Мы дали одну и ту же задачу шести флагманским моделям и сравнили не отзывы, а результат. Все шесть справились правильно, включая крайний случай. Разница оказалась не в качестве, а в цене — почти в 25 раз — и во времени ответа, вчетверо. Поэтому правильный вопрос не «какая модель лучшая», а «какая самая дешёвая из тех, что решают мою задачу».
Мы дали шести моделям одну задачу
Обзоры нейросетей обычно пересказывают маркетинговые описания: эта «сильна в тексте», та «хороша в коде». Проверить такое нельзя. Мы поступили иначе: взяли одну задачу с проверяемым правильным ответом и отправили её шести флагманам одновременно, через один и тот же интерфейс, в один и тот же момент.
Задача: «Напиши функцию на Python, которая возвращает второй по величине элемент списка чисел. Учти случай, когда все элементы одинаковые». Она выбрана не случайно: у неё есть очевидное решение и есть ловушка — если просто отсортировать список и взять предпоследний элемент, то на списке из одинаковых чисел функция вернёт неправильный ответ вместо честного «такого элемента нет». Именно на таких мелочах модели обычно и расходятся.
Что получилось
Все шесть моделей выдали корректный код. Все шесть убрали дубликаты
и вернули None, когда уникальных значений меньше двух.
Ни одна не попалась в ловушку. Различались только цена и время.
| Модель | Токенов | Стоило | Время | Правильно |
|---|---|---|---|---|
| Gemini 2.5 Flash | 100 | 0,10 ₽ | 3,5 с | да |
| DeepSeek V4 Pro | 425 | 0,40 ₽ | 14,1 с | да |
| Claude Sonnet 5 | 774 | 0,74 ₽ | 4,3 с | да |
| Claude Opus 5 | 1 181 | 1,12 ₽ | 4,2 с | да |
| Gemini 3.1 Pro | 2 266 | 2,15 ₽ | 6,0 с | да |
| GPT-5 | 2 582 | 2,45 ₽ | 13,0 с | да |
Самый дешёвый ответ обошёлся в десять копеек, самый дорогой — в два рубля сорок пять копеек. Это разница почти в 25 раз за одинаковый результат. Самая быстрая модель ответила за 3,5 секунды, самая медленная — за 14,1. Причём медленными оказались не самые дешёвые: DeepSeek думал дольше всех при цене в шесть раз ниже, чем у GPT-5.
Что из этого следует
Главное: на обычных задачах флагманы неразличимы по качеству. Разрыв между ними виден на длинных рассуждениях, больших документах, многошаговом коде — то есть там, где ошибка накапливается. На однократной задаче со внятным условием их разделяет только цена.
Отсюда практическое правило, которое экономит больше всего: начинайте с дешёвой модели, переходите на дорогую только когда ответ не устроил. Привычка «всегда брать самый мощный флагман» на потоке однотипных задач обходится в разы дороже без выигрыша в пользе. Если вы задаёте в день двадцать простых вопросов, разница между Gemini Flash и GPT-5 за месяц — это примерно 1 400 рублей на ровном месте.
Обратное тоже верно и о нём стоит помнить: когда задача действительно сложная — разобрать договор на сорок страниц, найти ошибку в чужом коде, выстроить длинную цепочку рассуждений — экономия на модели выходит дороже. Дешёвая модель ответит уверенно и неправильно, а проверять её придётся вам.
Чем семейства отличаются на самом деле
Claude (Anthropic). Аккуратный русский текст без канцелярита, хорошо держит длинный контекст и следует инструкциям буквально. Линейка: Opus — самый сильный, Sonnet — рабочая лошадка, Haiku — быстрый и дешёвый. В нашем тесте Sonnet дал самый короткий и самый читаемый из корректных ответов.
GPT (OpenAI). Универсал, привычный по названию. В тесте оказался самым дорогим и одним из самых медленных, но ответ дал верный и с самым подробным объяснением — эта модель склонна писать больше, а платите вы именно за выходные токены.
Gemini (Google). Сильная сторона — картинки и большие объёмы на входе: разобрать скриншот, фотографию, таблицу. Flash-версии дешевле всех на рынке с большим отрывом, и для простых задач это лучший выбор по цене.
DeepSeek. Заметно дешевле западных флагманов при сопоставимом качестве на тексте и коде. Расплата — время: в нашем тесте думал дольше всех. Хорош там, где объём важнее скорости.
Grok (xAI). Живой разговорный стиль и оперативность. В этот тест не попал, но доступен наравне с остальными.
Как выбрать под свою задачу
| Задача | С чего начать | Когда переходить выше |
|---|---|---|
| Короткий вопрос, факт, перевод | Gemini Flash | почти никогда |
| Письмо, пост, правка текста | Claude Sonnet | если нужен особый стиль — Opus |
| Код обычной сложности | DeepSeek или Sonnet | если код не работает — Opus |
| Разбор документа, длинные рассуждения | Claude Opus | — |
| Скриншот, фото, таблица | Gemini Pro | — |
| Много однотипных задач подряд | Gemini Flash или DeepSeek | по выборочной проверке |
И самый надёжный способ: задайте свою настоящую задачу трём моделям подряд и сравните. На стартовом балансе это бесплатно, а вывод получится точнее любого обзора — включая этот.
Как мы проверяли
Тест проведён 31 августа 2026 года. Один и тот же запрос отправлен шести моделям через наш собственный интерфейс, с включённым учётом расхода. Стоимость в рублях посчитана по нашему курсу: 1 000 токенов = 95 копеек. Время — от отправки запроса до получения полного ответа, один замер на модель, без повторов.
Оговорка о честности: один тест на одной задаче — это не бенчмарк. Мы не утверждаем, что модели равны вообще; мы показываем, что на конкретной обычной задаче они дали одинаково правильный ответ при 26-кратной разнице в цене. На вашей задаче расклад может быть другим — именно поэтому мы и советуем проверять самому, а не верить обзорам. Все шесть ответов сохранены, любой из них можно воспроизвести тем же запросом.
Подробнее о том, как считается цена запроса — в статье «Токены и кредиты». Чем агрегаторы отличаются друг от друга — в разборе «Агрегатор нейросетей». С нуля обо всём сразу — «Как пользоваться нейросетями на русском за рубли».
Сравните модели на своей задаче
Все нейросети в одном окне, переключение в один клик. 25 000 токенов при регистрации.
Открыть Умку → Цены на модели