Инструменты · 16 мин · обновлено 4 августа 2026 г.

MiniMax Agent (Mavis) в 2026: тестируем ИИ-агента на реальных рабочих задачах

MiniMax переименовал своего агента в Mavis и разделил его на три роли: Leader, Worker и Verifier. Разбираем, что это даёт на бытовых задачах вроде сбора таблицы и отчёта, работает ли сервис из России, сколько стоит в рублях и по какому протоколу проверить его на своих задачах за один вечер.

16 мин чтения

MiniMax Agent (Mavis) в 2026: тестируем ИИ-агента на реальных рабочих задачах

MiniMax Agent - это веб-агент китайской компании MiniMax: ты ставишь задачу обычным текстом, он сам лезет в интернет, пишет код, собирает таблицу или отчёт и отдаёт готовый файл. В мае 2026 продукт переименовали в Mavis и перестроили вокруг режима Agent Teams, где одну задачу делят три роли: Leader, Worker и Verifier.

Идея красивая: вместо одной модели, которая тянет всё сама, над задачей работает маленькая команда, и у неё внутри есть контролёр. Вопрос в другом: облегчает ли это работу на бытовых задачах, ради которых обычный человек вообще открывает такие сервисы. Собрать таблицу по конкурентам. Подготовить отчёт с цифрами. Свести десять вкладок в один документ. Дальше разберём, как устроен Mavis, что он реально даёт по цифрам, работает ли из России, сколько стоит в рублях и по какому протоколу проверить его на своих задачах за один вечер.

MiniMax Agent (с мая 2026 - Mavis) работает по схеме Leader-Worker-Verifier: один агент режет задачу на части, другие выполняют, третий проверяет и возвращает на доработку. По данным MiniMax это даёт плюс 34 процента к доле закрытых задач и минус 22 процента галлюцинаций ценой примерно 2.8x токенов. Выигрыш появляется только на длинных задачах с проверяемым результатом. Из России сайт открывается, регистрация по почте, но подписку российской картой не оплатить. Тарифы: 20, 50 и 120 долларов в месяц.

Словарик: 6 терминов, которые встретятся дальше

  • MiniMax Agent - веб-сервис, где агент выполняет задачу целиком и отдаёт файл.
  • Mavis - новое имя этого агента с мая 2026, тот же продукт после перестройки.
  • Agent Teams - режим, где над задачей параллельно работают несколько агентов с разными ролями.
  • Leader / Worker / Verifier - постановщик, исполнитель и проверяющий внутри команды.
  • MiniMax-M3 - модель под капотом, окно контекста 1 млн токенов, мультимодальная.
  • Токен - кусочек текста, по которому считается расход и цена работы агента.

Что такое MiniMax Agent и чем он отличается от чата

Разница между чатом и агентом простая. Чат отвечает текстом и на этом останавливается. Агент получает цель, сам решает, какие шаги нужны, ходит в поиск, запускает код, складывает промежуточные результаты и в конце отдаёт артефакт: документ, таблицу, сайт, картинку. Если тема агентов для тебя новая, начни с базового разбора что такое ИИ-агенты простыми словами, там разобрана механика без привязки к конкретному сервису.

MiniMax Agent на интерфейсе прямо предлагает четыре типа результата: Document, Website, Image Generation, Spreadsheet. То есть отчёт, страница, картинка и таблица. Это ровно тот набор, который закрывает бытовые рабочие задачи: свести данные, оформить, показать.

Под капотом на август 2026 крутится MiniMax-M3 с окном контекста в 1 млн токенов. Миллион токенов означает, что агент может держать в голове десятки страниц исходников одновременно и не терять начало задачи к её концу. Для сбора таблицы из пятнадцати источников это принципиально.

MiniMax известен в России в основном по видеомодели: у нас есть отдельный разбор [MiniMax H3 и генерации видео из России](/guides/minimax-h3-video-iz-rossii/). Агент и видеомодель живут в одной экосистеме и на одном аккаунте, но тарифицируются по-разному: генерация видео в базовый тариф Plus не входит.

Как устроены Agent Teams: Leader, Worker, Verifier

До мая 2026 MiniMax Agent был обычным одиночным агентом. Потом компания выкатила Mavis и главную новинку - Team Engine, инфраструктуру, которая раздаёт роли и следит за состоянием задачи.

Leader берёт твою цель и превращает её в структуру: режет на подзадачи, назначает исполнителей, в конце сшивает результаты в один документ.

Worker выполняет конкретную подзадачу своим набором инструментов. Их может быть несколько и они работают параллельно: пока один собирает цены, второй ищет отзывы, третий готовит структуру таблицы.

Verifier проверяет то, что сделали Worker: сходятся ли источники, покрыта ли задача целиком, где границы риска. Если результат слабый, он отправляет его назад на доработку. Отношения Worker и Verifier специально сделаны состязательными, чтобы исполнителю было невыгодно халтурить.

Leader режет задачу быстро

  • читает твою формулировку цели
  • разбивает на подзадачи
  • решает, сколько нужно исполнителей
1

Worker работают параллельно дольше всего

  • каждый тянет свой кусок
  • ходят в поиск и запускают код
  • складывают черновики в общий стейт
2

Verifier принимает работу

  • сверяет источники и цифры
  • ищет дыры в покрытии темы
  • возвращает слабое на переделку
3

Leader сшивает результат

  • сводит черновики в один файл
  • убирает повторы между кусками
  • отдаёт тебе готовый артефакт
4

Ключевая мысль тут вот какая. Многоагентность стоит денег не в момент работы агентов, а на стыках между ними. MiniMax честно называет три статьи расходов: handoff cost (переупаковка информации при передаче от агента к агенту), sharing cost (каждому агенту нужно показать общий контекст) и aggregation cost (слияние параллельных черновиков в один документ). Именно эти стыки и съедают токены.

+34% задач

прирост доли успешно закрытых задач против одиночного агента, по замерам MiniMax

-22% выдумок

снижение числа галлюцинаций за счёт роли Verifier

2.8x токенов

типичный расход схемы из пяти Worker и одного Verifier

1.3x цена

итоговая стоимость одной успешно закрытой задачи против одиночного агента

Последняя цифра важнее всех остальных. Токенов уходит в 2.8 раза больше, но стоимость успешно закрытой задачи выросла только в 1.3 раза. Разница между этими числами и есть весь смысл: одиночный агент чаще проваливается, и его дешёвые прогоны приходится повторять.

Где команда агентов окупается, а где просто жжёт токены

Есть исследование, на которое ссылается разбор KDnuggets: неструктурированное многоагентное сотрудничество может стоить в 2,1-3,4 раза больше токенов без всякого прироста точности. То есть плохо организованная команда агентов работает хуже одиночки и дороже её.

Отсюда рабочее правило: Agent Teams имеет смысл там, где задача длинная, составная и у неё есть проверяемый критерий готовности.

Отдавать команде агентов

  • обзор рынка по 10-20 источникам
  • сводная таблица по конкурентам с ценами и ссылками
  • отчёт, где нужно свести цифры из разных мест
  • код, который проверяется тестами
  • формальный документ по шаблону

Не отдавать команде агентов

  • переписать абзац
  • перевести письмо
  • посчитать слова в тексте
  • придумать пять заголовков
  • ответить на короткий вопрос по факту

Автор исходного разбора на KDnuggets проверял это буквально: он собрал скрипт с простейшим инструментом count_words и дал задачу «напиши описание паттерна circuit breaker в двух предложениях, потом посчитай слова». Задача настолько короткая, что вся многоагентная машинерия там оказывается накладным расходом в чистом виде.

Перед тем как отправлять процесс через Agent Teams, задай вопрос: достаточно ли он длинный, сложный и проверяемый, чтобы затраты на разделение окупились?

- вывод разбора, KDnuggets

На большинстве повседневных задач честный ответ будет «нет». И это нормально: агент нужен не всегда, у нас про это есть отдельный разбор, какие задачи вообще стоит отдавать ИИ-агенту.

Прежде чем платить за чужого агента, посмотри, что умеет тот, который уже стоит у тебя на компьютере. Пройди мини-курс «Claude за вечер»: от установки до первых результатов на твоих задачах.

Пройти мини-курс →

Работает ли MiniMax Agent из России и как его оплатить

Сайт minimax.io и раздел агента отдают страницу с российских адресов, регистрация идёт по обычной электронной почте, китайский номер телефона не требуется. У части провайдеров бывают обрывы соединения, и тогда проще один раз включить рабочий VPN, чем ловить таймауты на середине задачи. Это, кстати, отдельный аргумент: агент работает минутами, и обрыв на середине прогона стоит потраченных кредитов.

Настоящая проблема начинается на оплате. Карты российских банков китайский биллинг не принимает, как и почти везде. Варианта два: зарубежная карта или сервис оплаты подписок за рубли (реферальная ссылка: тебе тот же прайс, мне небольшой процент). Общая механика оплаты зарубежных ИИ-сервисов из России разобрана у нас подробно в гайде как оплатить нейросети из России.

Цены на август 2026, в рублях по курсу около 80 рублей за доллар:

ТарифЦена в месяцПримерно в рубляхСколько агентов тянетКому
Пробные кредиты0 $0 ₽1посмотреть, как выглядит прогон
Кредиты пакетом5 $ за 5000 кредитов≈ 400 ₽1разовые задачи, срок годности 365 дней
Plus20 $≈ 1600 ₽3-4личные задачи, видео не входит
Max50 $≈ 4000 ₽4-5регулярная работа, код
Ultra120 $≈ 9600 ₽6-7ежедневная тяжёлая нагрузка

Неизрасходованная квота тарифа на следующий месяц не переносится. Если взял Max и за месяц прогнал три задачи, деньги сгорели. Для нерегулярной работы честнее покупать кредиты пакетом: у них срок годности 365 дней. Начинай с пробных кредитов и пакета на 5 долларов, подписку бери только когда увидишь, что гоняешь агента каждую неделю.

Новым аккаунтам MiniMax выдаёт пробные кредиты после подтверждения почты или телефона. Точная сумма меняется от акции к акции, так что смотри в личном кабинете, а не в чужих обзорах.

Протокол теста: 4 задачи, на которых видно, агент это или красивый чат

Дальше самое полезное. Цифры выше - это замеры MiniMax и разбор KDnuggets на их синтетике. На твоих задачах результат будет другой, и проверить это можно за один вечер на пробных кредитах. Ниже четыре задачи, подобранные так, чтобы каждая ловила свою слабость.

Гоняй каждую дважды: один раз в обычном режиме, один раз с включённым Agent Teams. Смотри не только на результат, но и на время и расход кредитов.

Задача 1: сводная таблица (ловит поверхностность)

Собери таблицу по 12 сервисам генерации видео, доступным без VPN из России на август 2026.
 
Колонки: название, ссылка на сайт, цена минимального платного тарифа в долларах, есть ли бесплатный режим, длина ролика на бесплатном тарифе, принимает ли карты российских банков, дата проверки.
 
Требования:
1. Каждую цифру подтверди ссылкой на страницу, откуда ты её взял. Ссылки положи в отдельную колонку.
2. Если данных нет, напиши «нет данных», выдумывать запрещено.
3. Отдай результат файлом .xlsx и коротким текстом: какие три сервиса ты бы поставил в шорт-лист и почему.

Что тут проверяется: полезет ли агент реально на сайты сервисов или сгенерирует правдоподобную таблицу из памяти модели. Открой три случайные ссылки из колонки источников. Если хотя бы одна ведёт в никуда или на страницу без этой цифры, агент выдумывает.

Задача 2: отчёт по своим данным (ловит потерю контекста)

Прикладываю выгрузку продаж за 6 месяцев (csv).
 
Сделай отчёт для собственника на 2 страницы:
1. Что произошло с выручкой по месяцам, с графиком.
2. Топ-5 товаров по выручке и топ-5 по марже, отдельными таблицами.
3. Три аномалии в данных, которые ты заметил, с объяснением, почему это аномалия.
4. Один вывод, который влияет на решение о закупке на следующий квартал.
 
Пиши цифрами из файла, без общих слов. Каждый вывод подкрепи конкретным числом из таблицы. Отдай docx.

Что тут проверяется: считает ли агент по твоему файлу или пересказывает, как обычно бывает в отчётах. Возьми любую цифру из отчёта и пересчитай руками в Excel. Расхождение больше процента означает, что агент считал приблизительно.

Задача 3: задача с проверяемым критерием (ловит враньё о готовности)

Напиши скрипт на Python, который берёт папку с pdf-файлами и вытаскивает из каждого текст в отдельный txt-файл с тем же именем.
 
Требования:
1. Скрипт должен запускаться командой python extract.py путь_к_папке
2. Обработай ошибки: битый pdf не должен ронять весь прогон, пиши в лог и иди дальше
3. Напиши к скрипту тесты и запусти их. Покажи мне вывод тестов.
4. Не пиши «готово», пока тесты не проходят.

Что тут проверяется: главная болезнь всех агентов. Они рапортуют об успехе на невыполненной задаче. Если агент написал «готово», а вывода тестов не показал, ты только что поймал ровно тот сценарий, который мы разбирали в гайде агент говорит «готово», но ничего не работает.

Задача 4: короткая задача (ловит накладные расходы)

Перепиши этот абзац так, чтобы он стал в два раза короче и понятнее человеку без технического бэкграунда. Смысл не терять.
 
[вставь сюда любой свой абзац на 5-6 строк]

Что тут проверяется: сколько времени и кредитов агентная обвязка тратит на задачу, где она не нужна. Прогони это в режиме Agent Teams и посмотри расход. Если он в разы больше, чем на такой же запрос в обычном чате, ты своими глазами увидел ту самую цену стыков между агентами.

Как читать результат: критерии приёмки

Общее впечатление «вроде норм» не годится. Проверяй по конкретным пунктам.

Что проверяемКакПровал засчитан, если
Источникиоткрыть 3 случайные ссылки из результатахотя бы одна не подтверждает цифру
Арифметикапересчитать 2 числа рукамирасхождение больше 1 процента
Покрытие задачисверить с пунктами промптамолча пропущен хотя бы один пункт
Честностьнайти фразу «готово» и проверитьзаявлен результат, которого нет
Формат файлаоткрыть выгрузкуфайл битый или структура не та, что просили
Расходсравнить кредиты с обычным чатомвырос больше чем втрое без прироста качества

Формула: команда агентов окупается только там, где задача длиннее двадцати минут ручной работы и у неё есть внешний критерий готовности, который можно проверить. Всё короче отдавай обычному чату.

Что ломается чаще всего

Context anxiety. Агент работает неопределённо долго, потому что теряет понимание, когда задача считается закрытой. Внешне это выглядит как бесконечный прогон, который жрёт кредиты. Лечится тем, что критерий готовности прописывается прямо в промпте: «остановись, когда в таблице будет 12 строк и у каждой заполнена колонка источника».

Выдуманные ссылки. Ровно та же болезнь, что у любой языковой модели, и Verifier снижает её частоту, но не убирает. Мы разбирали механику этого явления в гайде почему нейросеть выдумывает факты. Проверять источники руками придётся всегда.

Обрыв на середине. Агент работает минутами. Нестабильный канал, закрытая вкладка или уснувший ноутбук ломают прогон, а списанные кредиты не возвращаются.

Формулируй задачу через критерий приёмки, а не через процесс. Плохо: «изучи рынок и напиши отчёт». Хорошо: «отчёт готов, когда в нём 12 строк таблицы, у каждой есть ссылка-источник, и внизу три вывода с конкретными числами». Агенту нужна финишная черта, иначе он её придумает сам и остановится там, где ему удобно.

Юридический фон. Его стоит держать в голове, если планируешь коммерческое использование. Модель M2.7 получила лицензионное ограничение: для коммерческого применения нужно письменное разрешение, хотя более ранние M2 и M2.5 были открытыми. Плюс к MiniMax есть претензии от Anthropic по поводу дистилляции кода и иск от Disney, Universal и Warner Bros. к видеопродукту компании. На работу веб-агента это сегодня не влияет, но на планы «построю бизнес на их API» повлиять может.

Сколько это стоит по API, если считать в токенах

Если решишь дёргать модель напрямую, а не через веб-интерфейс, цены на август 2026 такие: MiniMax-M3 стоит 0,30 доллара за миллион входных токенов и 1,20 доллара за миллион выходных. Чтение из кэша - 0,06 доллара за миллион.

Цена за миллион выходных токенов, доллары

MiniMax-M3
1.20
Дороже примерно в 21 раз
~25

По разбору KDnuggets, относительно Claude Opus 4.6 модель MiniMax выходит примерно в 17 раз дешевле на входе и в 21 раз на выходе. Это и есть главный аргумент в пользу MiniMax: за многоагентную схему, которая жжёт в 2.8 раза больше токенов, на дешёвой модели платить не так больно.

Тут важно не обмануться. Дешёвые токены не делают агента умнее, они делают дешевле его ошибки. Если задача требует качества рассуждений уровня топовых моделей, экономия на токенах обернётся переделками.

Чек-лист: что у тебя есть после этого вечера

  • Аккаунт MiniMax с пробными кредитами, зарегистрированный по почте.
  • Понимание, что делают Leader, Worker и Verifier и почему стыки между ними стоят денег.
  • Четыре прогнанные задачи: таблица, отчёт по своим данным, задача с тестами и заведомо короткая.
  • Таблица критериев приёмки, по которой ты проверил результат, а не оценил его на глаз.
  • Своё число: во сколько раз агентный режим дороже обычного чата на твоих задачах.
  • Решение, брать ли подписку, основанное на этом числе, а не на обзорах.

Главный вывод из всей истории простой. Многоагентность работает как обмен токенов на надёжность. Обмен выгодный на длинных проверяемых задачах и убыточный на всём остальном. Прогони четыре задачи выше, посмотри на свои цифры и реши сам.

По материалам: Does MiniMax Agent Actually Make Work Easier?, KDnuggets.

Частые вопросы

Что такое MiniMax Agent и почему его называют Mavis?

Это веб-агент китайской компании MiniMax: ты ставишь задачу текстом, он сам ищет в интернете, пишет код, собирает таблицу или отчёт и отдаёт готовый файл. В мае 2026 продукт переименовали в Mavis и перестроили вокруг режима Agent Teams, где одну задачу делят три роли: Leader, Worker и Verifier.

Работает ли MiniMax Agent из России?

Сайт minimax.io и раздел агента отдают страницу с российских адресов, регистрация идёт по обычной почте без китайского номера. У части провайдеров возможны обрывы, тогда помогает VPN. Главная проблема другая: карты российских банков на оплате подписки не проходят, платить приходится через посредника.

Сколько стоит MiniMax Agent в 2026 году?

Подписки на август 2026: Plus 20 долларов в месяц, Max 50 долларов, Ultra 120 долларов. Примерно 1600, 4000 и 9600 рублей по курсу около 80 рублей за доллар. Есть покупка кредитов пакетами: 5 долларов дают 5000 кредитов со сроком годности 365 дней. Новым аккаунтам выдают пробные кредиты, точная сумма меняется от акции к акции.

Многоагентный режим правда работает лучше обычного чата?

По данным самой MiniMax, схема Leader-Worker-Verifier поднимает долю успешно закрытых задач на 34 процента и снижает число галлюцинаций на 22 процента, при этом типичный прогон из пяти Worker и одного Verifier съедает примерно в 2.8 раза больше токенов. Выигрыш появляется только на длинных задачах с проверяемым результатом, на коротких это чистые накладные расходы.

Какие задачи имеет смысл отдавать MiniMax Agent, а какие нет?

Отдавать стоит долгие задачи со сбором данных из многих источников: обзор рынка, сводная таблица по конкурентам, отчёт с цифрами и ссылками, черновик сайта. Не стоит отдавать короткие одноходовые вещи вроде переписать абзац или посчитать слова в тексте: там команда агентов тратит больше токенов и времени, чем обычный чат, а результат тот же.

Мини-курс «Claude за вечер»

За один вечер настроишь Claude под свои задачи: внутри 35+ промптов, скиллов и агентов. Гарантия возврата 7 дней. Дальше есть Лаборатория ИИ-маркетинга, где из нейросети собирается целый отдел маркетинга.