MiniMax M3.1 Flash: что умеет новая модель для кода
Коротко. 27 сентября 2026 года китайская компания MiniMax выпустила M3.1-Flash-Preview — новую текстовую модель, заточенную под повседневное программирование. Она работает с контекстом в 1 млн токенов, принимает текст, картинки и видео и позволяет выбирать, насколько глубоко рассуждать перед ответом. Но это превью: модель доступна только внутри экосистемы MiniMax, без публичной цены за токены и без бенчмарков. Разбираем, что известно, чем M3.1 Flash отличается от M3 и есть ли смысл пробовать её из России.
Что случилось
Анонс вышел в аккаунте MiniMax Agent: M3.1-Flash-Preview «дебютирует в MiniMax Code» — фирменном агенте для разработчиков. Компания описывает модель как быструю и надёжную рабочую лошадку «от быстрых исправлений багов до целых фич». Одновременно модель появилась в подписке Token Plan, которая уже покрывала MiniMax-M3 и M2.7.
Чего в анонсе нет: таблицы бенчмарков, карточки модели, открытых весов и цены за миллион токенов. Независимые рейтинги вроде Artificial Analysis модель пока тоже не оценили. Поэтому громких заявлений «быстрее GPT» или «сильнее Claude» делать не стоит — данных для сравнения просто нет.
Про саму компанию, её видеомодель Hailuo и голосовые модели мы подробно писали в обзоре «MiniMax: что умеет нейросеть».
Что умеет M3.1 Flash
Из документации и первых разборов разработчиков складывается такая картина:
- Контекст 1 млн токенов. В модель можно положить крупный проект или длинную переписку целиком, не нарезая на куски. Это визитная карточка линейки MiniMax.
- Мультимодальный вход. Принимает текст, изображения и видео, отвечает текстом. Для программиста это, например, скриншот ошибки или макет интерфейса вместо описания словами.
- Пять уровней рассуждения. Параметр глубины мышления: low, medium, high, xhigh и max. По умолчанию стоит max. Низкие уровни — для быстрых правок, высокие — для сложной логики.
- Рассуждение не отключается. Попытка выключить режим мышления через API возвращает ошибку 400. У предыдущей M3 такое отключение было возможно.
- Совместимость. Модель работает через эндпоинты MiniMax, совместимые с форматами Anthropic и OpenAI, так что подключается к привычным инструментам без переписывания кода.
Чем отличается от MiniMax M3
| MiniMax M3 | M3.1-Flash-Preview | |
|---|---|---|
| Контекст | 1 млн токенов | 1 млн токенов |
| Глубина рассуждения | Можно отключить | 5 уровней, отключить нельзя |
| Цена за токены | Опубликована | Не опубликована |
| Где доступна | API, Token Plan | Только MiniMax Code и Token Plan |
Главное практическое отличие — регулятор глубины. Идея та же, что у западных флагманов: не тратить время на раздумья, когда нужно поправить опечатку, и думать дольше, когда задача сложная. Похожий подход мы разбирали в статьях про GPT-6 Sol и Luna и Claude Opus 5.5.
Как попробовать из России
Честно: сейчас M3.1 Flash можно получить только двумя путями, и оба — внутри экосистемы MiniMax.
- MiniMax Code. Агент для разработчиков, в котором модель вышла первой. С 28 сентября по 7 октября там действует акция: за ежедневный вход начисляют двойные баллы, которые тратятся на модели для кода и видеомодель H3.
- Token Plan. Подписка с ключом для API: Plus за 22 доллара в месяц, Max за 55 и Ultra за 132. Квоты считаются окнами по 5 часов и по неделе. Оплата — в долларах зарубежной картой.
В Умке M3.1 Flash пока нет: модель не продаётся через открытый API с оплатой за токены, а превью-версии обычно дорабатывают и переименовывают. Когда MiniMax выпустит её в общий доступ, подключение станет возможным. А вот видеомодель Hailuo от MiniMax в Умке есть уже сейчас.
Если задача — писать и чинить код прямо сегодня, в Умке доступны сильные модели OpenAI, Anthropic и Google. Оплата в рублях российской картой, без VPN и подписки. Пакеты пополнения: 290 ₽ — 725 токенов, 690 ₽ — 1 811, 1 490 ₽ — 4 172, 3 900 ₽ — 11 700. Ответ сильной модели обходится примерно в 33 токена, быстрой — около 1 токена. То есть минимального пакета хватит примерно на 20 ответов топовой модели или на сотни ответов быстрой, а при регистрации даётся бесплатный стартовый баланс.
Модели для кода без VPN
GPT, Claude, Gemini и Hailuo от MiniMax в одном окне. Оплата в рублях, без подписки.
Открыть Умку →Вывод
M3.1-Flash-Preview — заявка MiniMax на нишу быстрых ассистентов для программиста: миллион токенов контекста, вход с картинками и видео, гибкая глубина рассуждения. Но пока это закрытое превью без цены за токены и без цифр качества, поэтому сравнивать его с GPT-6 или Claude рано. Разработчикам, уже сидящим на Token Plan, модель стоит попробовать — она входит в подписку. Остальным разумно подождать общего релиза и независимых тестов.
Частые вопросы
MiniMax M3.1 Flash бесплатная?
Нет. Модель доступна в MiniMax Code за кредиты и по подписке Token Plan (от 22 долларов в месяц). Отдельной бесплатной версии и открытых весов нет. С 28 сентября по 7 октября в MiniMax Code действует акция с двойными баллами за ежедневный вход.
Чем M3.1 Flash отличается от MiniMax M3?
Контекст тот же — 1 млн токенов. Новое — регулятор глубины рассуждения из пяти уровней, при этом режим рассуждения нельзя отключить. У M3 есть опубликованная цена за токены, у M3.1 Flash её пока нет.
Есть ли MiniMax M3.1 Flash в Умке?
Пока нет: модель вышла в превью только внутри экосистемы MiniMax и не продаётся через открытый API. В Умке доступны видеомодель Hailuo от MiniMax и сильные модели для кода от OpenAI, Anthropic и Google.