Токены и кредиты: как считается стоимость запроса
Коротко. Нейросеть берёт деньги не за сообщение, а за объём обработанного текста: он измеряется в токенах модели. С вашего счёта списываются токены Умки — внутренняя единица, 1 000 токенов ≈ 95 копеек. Медианный текстовый запрос у нас стоит 142 токена, то есть около 14 копеек. Картинка — от 5 до 42 тысяч токенов. Разброс в триста раз, и ниже разобрано, откуда он берётся.
Раньше внутренняя единица называлась кредитами. Это то же самое и в том же количестве — сменилось только слово.
Что такое токен
Токен — это кусочек текста, обычно часть слова. Модель не работает со словами и буквами: она режет текст на такие кусочки и оперирует ими. Для английского один токен — это примерно четыре символа. Для русского дороже: кириллица кодируется хуже, и одно слово занимает в среднем 2–3 токена вместо одного-полутора. Поэтому один и тот же смысл по-русски обходится примерно вдвое дороже, чем по-английски.
Считаются обе стороны разговора. Входные токены — это ваш запрос вместе со всей историей диалога и системными указаниями. Выходные — ответ модели. Выходные почти всегда дороже входных, часто в три-пять раз: сгенерировать текст тяжелее, чем прочитать. Отсюда простое следствие: длинный ответ на короткий вопрос стоит дороже, чем короткий ответ на длинный.
Почему одинаковые сообщения стоят по-разному
Цена одного запроса складывается так:
стоимость = входные_токены × цена_входа
+ выходные_токены × цена_выхода
У каждой модели свои цены за тысячу токенов, и разброс между ними огромен. Но чаще людей удивляет другое: в длинном диалоге каждое следующее сообщение дороже предыдущего. Модель не помнит разговор — при каждом запросе ей заново отправляют всю переписку целиком. На двадцатом сообщении вы платите за девятнадцать предыдущих ещё раз.
Это не особенность Умки, так устроены все нейросети. Практический вывод один: новая тема — новый чат. Сорок сообщений в одном диалоге обойдутся ощутимо дороже, чем те же сорок, разложенные по четырём разговорам, при совершенно одинаковой пользе.
Что такое токены Умки
У моделей цены назначены в долларах за миллион токенов — числа вроде «3 доллара за миллион входных». Считать в них неудобно: один запрос стоит тысячные доли цента, а курс меняется каждый день. Поэтому в Умке единая внутренняя единица — токен Умки. Курс простой: 1 000 токенов ≈ 95 копеек, то есть тысяча рублей — это примерно миллион токенов.
Вы пополняете баланс рублями, а каждый запрос списывает токены по факту: сколько модель обработала, столько и списалось. Подписки нет, ежемесячной платы нет. Остаток не сгорает ни через месяц, ни через год. За неудачную генерацию деньги не берутся вовсе: не ответила — не списала. После каждого ответа под ним видно, сколько именно ушло, а в кабинете есть разбивка по дням и моделям.
Сколько стоят типовые задачи
Это не прикидки, а средние по нашим собственным спискам — по тем самым числам, которые списываются с балансов. Цены на 31 августа 2026 года.
| Что делаем | Модель | Токенов | В рублях |
|---|---|---|---|
| Короткий вопрос в чате | GPT-4o mini | 4 | 0,004 ₽ |
| Обычный ответ | Gemini 2.5 Flash | 251 | 0,24 ₽ |
| Разбор с рассуждением | Claude Sonnet 4.5 | 5 756 | 5,47 ₽ |
| Картинка попроще | Gemini 2.5 Flash Image | 5 066 | 4,81 ₽ |
| Картинка получше | Nano Banana 2 Lite | 14 745 | 14,01 ₽ |
| Картинка на сильной модели | GPT-5.4 Image | 41 692 | 39,61 ₽ |
Медиана по всем текстовым запросам — 142 токена, около 14 копеек. То есть на подаренные при регистрации 25 000 токенов приходится примерно сто семьдесят обычных ответов или две картинки. Текст в этом сервисе почти бесплатен; деньги живут в картинках и видео.
Почему картинка дороже текста в сотни раз
Картинка тоже считается в токенах — просто их очень много. Изображение на выходе занимает порядка тысячи с лишним токенов, но каждый из них стоит на порядки дороже текстового: рисование требует несравнимо больше вычислений. Отсюда и разрыв: обычный ответ 0,24 ₽, картинка на сильной модели — 39,61 ₽, то есть в 165 раз дороже.
Разброс внутри самих рисующих моделей тоже большой — от 4,81 ₽ до 39,61 ₽ за штуку, восьмикратная разница. Дорогая модель лучше держит композицию, точнее следует описанию и заметно чище рисует текст на картинке. Но для черновика, превью или пробы идеи разница почти не видна, а платите вы за неё восьмикратно. Разумная привычка: сначала дешёвой моделью проверить замысел, и только удачный вариант повторить дорогой.
Видео и музыка — отдельная история
Здесь цены другого порядка, и об этом стоит знать заранее. Ролик на пять секунд стоит от 23 ₽ на Seedance 1 Lite до 330 ₽ на Veo 3 Fast — по нашим же спискам. Разница в четырнадцать раз, и она честно отражает разницу в качестве картинки и в том, умеет ли модель звук.
Музыка неожиданно дешёвая: песня с русским вокалом на ACE-Step обходится в 2,76 ₽, инструментал — ещё меньше. Дороже всех ElevenLabs Music, около 165 ₽ за трек. Перед запуском цена всегда показана в карточке: за ролик и трек списывается фиксированная сумма, посчитанная по длительности и разрешению, и увидеть её можно до нажатия кнопки, а не после.
Как тратить меньше
- Новая тема — новый чат. Самый действенный приём из всех. В длинном диалоге история пересылается заново при каждом сообщении, и к тридцатому запросу вы платите за неё в тридцатый раз.
- Берите модель под задачу. Переформулировать письмо или составить список прекрасно умеет Gemini Flash за четверть рубля. Флагман нужен там, где важны длинные рассуждения, код или разбор документа, — это разница в двадцать раз.
- Просите краткость прямо. «Ответь тремя пунктами, без вступления» сокращает выходные токены вдвое-втрое, а они самые дорогие.
- Черновик — дешёвой моделью. Особенно с картинками: проверьте замысел за 4,81 ₽ и повторите удачный вариант за 39,61 ₽, а не наоборот.
- Не грузите лишние файлы. Картинка и PDF во входных токенах весят много. Присылайте нужную страницу, а не документ целиком.
- Смотрите на цифру под ответом. Она там не для красоты: пары дней наблюдений хватает, чтобы понять, куда именно уходит баланс.
Как мы это считали
Все числа в этой статье — не оценки и не маркетинг. Мы взяли собственный журнал списаний за последние девяносто дней, сгруппировали по моделям и посчитали средний расход на один запрос, отбросив модели, к которым обращались меньше трёх раз. Курс на 31 августа 2026 года: 1 000 токенов Умки = 95 копеек.
Это значит, что цифры отражают реальное поведение живых людей, а не синтетический тест: кто-то пишет коротко, кто-то присылает длинные документы, и среднее учитывает и то и другое. Если модель у нас подорожает или подешевеет, статья разойдётся с жизнью — поэтому дату последнего обновления мы держим на виду вверху страницы.
Источники
Мы перепроверяем свои цены по прайсам поставщиков; вот они, если хотите посмотреть сами:
- Цены Anthropic на модели Claude
- Цены Google на Gemini
- OpenRouter: как считаются токены и стоимость
- fal.ai: цены на видео и музыку
Ссылок на документацию OpenAI здесь нет намеренно: их сайт не открывается из России, и вести туда читателя было бы издевательством. Цены OpenAI мы сверяем через OpenRouter.
Не знаете, с чего начать выбор модели? Прочитайте «Claude, GPT или Gemini — какую нейросеть выбрать». Если только начинаете — «Как пользоваться нейросетями на русском за рубли».
Считайте расходы прозрачно
Баланс и стоимость запросов всегда на виду в кабинете Умки.
Открыть Умку → Посмотреть цены