← Блог Сравнение

Claude, GPT или Gemini — какую нейросеть выбрать

· · обновлено · 9 минут чтения
Claude, GPT или Gemini — какую нейросеть выбрать

Коротко. Мы дали одну и ту же задачу шести флагманским моделям и сравнили не отзывы, а результат. Все шесть справились правильно, включая крайний случай. Разница оказалась не в качестве, а в цене — почти в 25 раз — и во времени ответа, вчетверо. Поэтому правильный вопрос не «какая модель лучшая», а «какая самая дешёвая из тех, что решают мою задачу».

Шесть одинаковых по форме предметов разного размера в ряд
Одинаковый результат, разная цена. Именно это и выясняется, когда сравниваешь модели на своей задаче, а не по описаниям.

Мы дали шести моделям одну задачу

Обзоры нейросетей обычно пересказывают маркетинговые описания: эта «сильна в тексте», та «хороша в коде». Проверить такое нельзя. Мы поступили иначе: взяли одну задачу с проверяемым правильным ответом и отправили её шести флагманам одновременно, через один и тот же интерфейс, в один и тот же момент.

Задача: «Напиши функцию на Python, которая возвращает второй по величине элемент списка чисел. Учти случай, когда все элементы одинаковые». Она выбрана не случайно: у неё есть очевидное решение и есть ловушка — если просто отсортировать список и взять предпоследний элемент, то на списке из одинаковых чисел функция вернёт неправильный ответ вместо честного «такого элемента нет». Именно на таких мелочах модели обычно и расходятся.

Что получилось

Все шесть моделей выдали корректный код. Все шесть убрали дубликаты и вернули None, когда уникальных значений меньше двух. Ни одна не попалась в ловушку. Различались только цена и время.

МодельТокеновСтоилоВремяПравильно
Gemini 2.5 Flash1000,10 ₽3,5 сда
DeepSeek V4 Pro4250,40 ₽14,1 сда
Claude Sonnet 57740,74 ₽4,3 сда
Claude Opus 51 1811,12 ₽4,2 сда
Gemini 3.1 Pro2 2662,15 ₽6,0 сда
GPT-52 5822,45 ₽13,0 сда

Самый дешёвый ответ обошёлся в десять копеек, самый дорогой — в два рубля сорок пять копеек. Это разница почти в 25 раз за одинаковый результат. Самая быстрая модель ответила за 3,5 секунды, самая медленная — за 14,1. Причём медленными оказались не самые дешёвые: DeepSeek думал дольше всех при цене в шесть раз ниже, чем у GPT-5.

Что из этого следует

Главное: на обычных задачах флагманы неразличимы по качеству. Разрыв между ними виден на длинных рассуждениях, больших документах, многошаговом коде — то есть там, где ошибка накапливается. На однократной задаче со внятным условием их разделяет только цена.

Отсюда практическое правило, которое экономит больше всего: начинайте с дешёвой модели, переходите на дорогую только когда ответ не устроил. Привычка «всегда брать самый мощный флагман» на потоке однотипных задач обходится в разы дороже без выигрыша в пользе. Если вы задаёте в день двадцать простых вопросов, разница между Gemini Flash и GPT-5 за месяц — это примерно 1 400 рублей на ровном месте.

Обратное тоже верно и о нём стоит помнить: когда задача действительно сложная — разобрать договор на сорок страниц, найти ошибку в чужом коде, выстроить длинную цепочку рассуждений — экономия на модели выходит дороже. Дешёвая модель ответит уверенно и неправильно, а проверять её придётся вам.

Чем семейства отличаются на самом деле

Claude (Anthropic). Аккуратный русский текст без канцелярита, хорошо держит длинный контекст и следует инструкциям буквально. Линейка: Opus — самый сильный, Sonnet — рабочая лошадка, Haiku — быстрый и дешёвый. В нашем тесте Sonnet дал самый короткий и самый читаемый из корректных ответов.

GPT (OpenAI). Универсал, привычный по названию. В тесте оказался самым дорогим и одним из самых медленных, но ответ дал верный и с самым подробным объяснением — эта модель склонна писать больше, а платите вы именно за выходные токены.

Gemini (Google). Сильная сторона — картинки и большие объёмы на входе: разобрать скриншот, фотографию, таблицу. Flash-версии дешевле всех на рынке с большим отрывом, и для простых задач это лучший выбор по цене.

DeepSeek. Заметно дешевле западных флагманов при сопоставимом качестве на тексте и коде. Расплата — время: в нашем тесте думал дольше всех. Хорош там, где объём важнее скорости.

Grok (xAI). Живой разговорный стиль и оперативность. В этот тест не попал, но доступен наравне с остальными.

Как выбрать под свою задачу

ЗадачаС чего начатьКогда переходить выше
Короткий вопрос, факт, переводGemini Flashпочти никогда
Письмо, пост, правка текстаClaude Sonnetесли нужен особый стиль — Opus
Код обычной сложностиDeepSeek или Sonnetесли код не работает — Opus
Разбор документа, длинные рассужденияClaude Opus
Скриншот, фото, таблицаGemini Pro
Много однотипных задач подрядGemini Flash или DeepSeekпо выборочной проверке

И самый надёжный способ: задайте свою настоящую задачу трём моделям подряд и сравните. На стартовом балансе это бесплатно, а вывод получится точнее любого обзора — включая этот.

Как мы проверяли

Тест проведён 31 августа 2026 года. Один и тот же запрос отправлен шести моделям через наш собственный интерфейс, с включённым учётом расхода. Стоимость в рублях посчитана по нашему курсу: 1 000 токенов = 95 копеек. Время — от отправки запроса до получения полного ответа, один замер на модель, без повторов.

Оговорка о честности: один тест на одной задаче — это не бенчмарк. Мы не утверждаем, что модели равны вообще; мы показываем, что на конкретной обычной задаче они дали одинаково правильный ответ при 26-кратной разнице в цене. На вашей задаче расклад может быть другим — именно поэтому мы и советуем проверять самому, а не верить обзорам. Все шесть ответов сохранены, любой из них можно воспроизвести тем же запросом.

Подробнее о том, как считается цена запроса — в статье «Токены и кредиты». Чем агрегаторы отличаются друг от друга — в разборе «Агрегатор нейросетей». С нуля обо всём сразу — «Как пользоваться нейросетями на русском за рубли».

Сравните модели на своей задаче

Все нейросети в одном окне, переключение в один клик. 25 000 токенов при регистрации.

Открыть Умку → Цены на модели