← Блог Разбор

Токены и кредиты: как считается стоимость запроса

· · обновлено · 9 минут чтения
Токены и кредиты: как считается стоимость запроса

Коротко. Нейросеть берёт деньги не за сообщение, а за объём обработанного текста: он измеряется в токенах модели. С вашего счёта списываются токены Умки — внутренняя единица, 1 000 токенов ≈ 95 копеек. Медианный текстовый запрос у нас стоит 142 токена, то есть около 14 копеек. Картинка — от 5 до 42 тысяч токенов. Разброс в триста раз, и ниже разобрано, откуда он берётся.

Раньше внутренняя единица называлась кредитами. Это то же самое и в том же количестве — сменилось только слово.

Лента текста распадается на множество мелких светящихся фрагментов разного размера
Модель не видит слов. Она видит поток текста, разбитый на токены, и считает именно их.

Что такое токен

Токен — это кусочек текста, обычно часть слова. Модель не работает со словами и буквами: она режет текст на такие кусочки и оперирует ими. Для английского один токен — это примерно четыре символа. Для русского дороже: кириллица кодируется хуже, и одно слово занимает в среднем 2–3 токена вместо одного-полутора. Поэтому один и тот же смысл по-русски обходится примерно вдвое дороже, чем по-английски.

Считаются обе стороны разговора. Входные токены — это ваш запрос вместе со всей историей диалога и системными указаниями. Выходные — ответ модели. Выходные почти всегда дороже входных, часто в три-пять раз: сгенерировать текст тяжелее, чем прочитать. Отсюда простое следствие: длинный ответ на короткий вопрос стоит дороже, чем короткий ответ на длинный.

Почему одинаковые сообщения стоят по-разному

Цена одного запроса складывается так:

стоимость = входные_токены × цена_входа
          + выходные_токены × цена_выхода

У каждой модели свои цены за тысячу токенов, и разброс между ними огромен. Но чаще людей удивляет другое: в длинном диалоге каждое следующее сообщение дороже предыдущего. Модель не помнит разговор — при каждом запросе ей заново отправляют всю переписку целиком. На двадцатом сообщении вы платите за девятнадцать предыдущих ещё раз.

Это не особенность Умки, так устроены все нейросети. Практический вывод один: новая тема — новый чат. Сорок сообщений в одном диалоге обойдутся ощутимо дороже, чем те же сорок, разложенные по четырём разговорам, при совершенно одинаковой пользе.

Что такое токены Умки

У моделей цены назначены в долларах за миллион токенов — числа вроде «3 доллара за миллион входных». Считать в них неудобно: один запрос стоит тысячные доли цента, а курс меняется каждый день. Поэтому в Умке единая внутренняя единица — токен Умки. Курс простой: 1 000 токенов ≈ 95 копеек, то есть тысяча рублей — это примерно миллион токенов.

Вы пополняете баланс рублями, а каждый запрос списывает токены по факту: сколько модель обработала, столько и списалось. Подписки нет, ежемесячной платы нет. Остаток не сгорает ни через месяц, ни через год. За неудачную генерацию деньги не берутся вовсе: не ответила — не списала. После каждого ответа под ним видно, сколько именно ушло, а в кабинете есть разбивка по дням и моделям.

Сколько стоят типовые задачи

Это не прикидки, а средние по нашим собственным спискам — по тем самым числам, которые списываются с балансов. Цены на 31 августа 2026 года.

Что делаемМодельТокеновВ рублях
Короткий вопрос в чатеGPT-4o mini40,004 ₽
Обычный ответGemini 2.5 Flash2510,24 ₽
Разбор с рассуждениемClaude Sonnet 4.55 7565,47 ₽
Картинка попрощеGemini 2.5 Flash Image5 0664,81 ₽
Картинка получшеNano Banana 2 Lite14 74514,01 ₽
Картинка на сильной моделиGPT-5.4 Image41 69239,61 ₽

Медиана по всем текстовым запросам — 142 токена, около 14 копеек. То есть на подаренные при регистрации 25 000 токенов приходится примерно сто семьдесят обычных ответов или две картинки. Текст в этом сервисе почти бесплатен; деньги живут в картинках и видео.

Весы: горстка мелких светящихся фрагментов на одной чаше и один тяжёлый куб на другой
Одна картинка перевешивает сотни текстовых ответов — и это не фигура речи, а разница в двести раз.

Почему картинка дороже текста в сотни раз

Картинка тоже считается в токенах — просто их очень много. Изображение на выходе занимает порядка тысячи с лишним токенов, но каждый из них стоит на порядки дороже текстового: рисование требует несравнимо больше вычислений. Отсюда и разрыв: обычный ответ 0,24 ₽, картинка на сильной модели — 39,61 ₽, то есть в 165 раз дороже.

Разброс внутри самих рисующих моделей тоже большой — от 4,81 ₽ до 39,61 ₽ за штуку, восьмикратная разница. Дорогая модель лучше держит композицию, точнее следует описанию и заметно чище рисует текст на картинке. Но для черновика, превью или пробы идеи разница почти не видна, а платите вы за неё восьмикратно. Разумная привычка: сначала дешёвой моделью проверить замысел, и только удачный вариант повторить дорогой.

Видео и музыка — отдельная история

Здесь цены другого порядка, и об этом стоит знать заранее. Ролик на пять секунд стоит от 23 ₽ на Seedance 1 Lite до 330 ₽ на Veo 3 Fast — по нашим же спискам. Разница в четырнадцать раз, и она честно отражает разницу в качестве картинки и в том, умеет ли модель звук.

Музыка неожиданно дешёвая: песня с русским вокалом на ACE-Step обходится в 2,76 ₽, инструментал — ещё меньше. Дороже всех ElevenLabs Music, около 165 ₽ за трек. Перед запуском цена всегда показана в карточке: за ролик и трек списывается фиксированная сумма, посчитанная по длительности и разрешению, и увидеть её можно до нажатия кнопки, а не после.

Точный поворотный регулятор с янтарной риской на тёмной поверхности
Расход в основном регулируется привычками, а не тарифом.

Как тратить меньше

  • Новая тема — новый чат. Самый действенный приём из всех. В длинном диалоге история пересылается заново при каждом сообщении, и к тридцатому запросу вы платите за неё в тридцатый раз.
  • Берите модель под задачу. Переформулировать письмо или составить список прекрасно умеет Gemini Flash за четверть рубля. Флагман нужен там, где важны длинные рассуждения, код или разбор документа, — это разница в двадцать раз.
  • Просите краткость прямо. «Ответь тремя пунктами, без вступления» сокращает выходные токены вдвое-втрое, а они самые дорогие.
  • Черновик — дешёвой моделью. Особенно с картинками: проверьте замысел за 4,81 ₽ и повторите удачный вариант за 39,61 ₽, а не наоборот.
  • Не грузите лишние файлы. Картинка и PDF во входных токенах весят много. Присылайте нужную страницу, а не документ целиком.
  • Смотрите на цифру под ответом. Она там не для красоты: пары дней наблюдений хватает, чтобы понять, куда именно уходит баланс.

Как мы это считали

Все числа в этой статье — не оценки и не маркетинг. Мы взяли собственный журнал списаний за последние девяносто дней, сгруппировали по моделям и посчитали средний расход на один запрос, отбросив модели, к которым обращались меньше трёх раз. Курс на 31 августа 2026 года: 1 000 токенов Умки = 95 копеек.

Это значит, что цифры отражают реальное поведение живых людей, а не синтетический тест: кто-то пишет коротко, кто-то присылает длинные документы, и среднее учитывает и то и другое. Если модель у нас подорожает или подешевеет, статья разойдётся с жизнью — поэтому дату последнего обновления мы держим на виду вверху страницы.

Источники

Мы перепроверяем свои цены по прайсам поставщиков; вот они, если хотите посмотреть сами:

Ссылок на документацию OpenAI здесь нет намеренно: их сайт не открывается из России, и вести туда читателя было бы издевательством. Цены OpenAI мы сверяем через OpenRouter.

Не знаете, с чего начать выбор модели? Прочитайте «Claude, GPT или Gemini — какую нейросеть выбрать». Если только начинаете — «Как пользоваться нейросетями на русском за рубли».

Считайте расходы прозрачно

Баланс и стоимость запросов всегда на виду в кабинете Умки.

Открыть Умку → Посмотреть цены