Инструменты · 19 мин · обновлено 14 сентября 2026 г.

ГигаЧат научился думать: разбор GigaChat 3.5 Reasoning и сравнение с DeepSeek в 2026

10 сентября 2026 Сбер выпустил GigaChat 3.5 Reasoning - первую русскую открытую модель, которая перед ответом рассуждает по шагам. Разбираем, как включить режим рассуждений, что он даёт на реальных задачах, где ГигаЧат обходит DeepSeek, а где честно проигрывает, и сколько всё это стоит в рублях. Обновлено 14 сентября: разбор работы с внешними инструментами и агентными задачами, честный ответ про мультимодальность и сравнение с ChatGPT по деньгам и доступу.

19 мин чтения

ГигаЧат научился думать: разбор GigaChat 3.5 Reasoning и сравнение с DeepSeek в 2026

10 сентября 2026 Сбер выложил GigaChat 3.5 Reasoning - первую модель ГигаЧата, которая перед ответом думает вслух. Она разбивает задачу на шаги, проверяет промежуточный результат и при необходимости меняет ход решения. Включается кнопкой «Рассуждение» в чате, работает из России без VPN, веса открыты под лицензией MIT.

Дальше по порядку: как включить режим за два клика, что реально меняется в ответах, где ГигаЧат обгоняет DeepSeek, где проигрывает без оговорок, какие ограничения вылезают на второй день и сколько всё это стоит в рублях.

Обновлено 14 сентября 2026: добавлен раздел про работу с внешними инструментами и агентные задачи, цифра по SWE-bench Verified, разбор того, что стоит за словом «мультимодальная» в новостях, и сравнение с ChatGPT по деньгам и доступу из России.

GigaChat 3.5 Reasoning вышел 10 сентября 2026: 432 млрд параметров, из которых на каждом токене работают 28 млрд, контекст 262 тысячи токенов, лицензия MIT. По среднему баллу на тестах Сбера модель уступает DeepSeek V4 Flash Preview (68,88 против 72,71), но обходит его в олимпиадной математике и следовании инструкциям и тратит на рассуждения на 37% меньше токенов. В чате режим бесплатный, кнопка «Рассуждение» под полем ввода. Ограничение ответа - 4096 токенов и два PDF.

Словарик: четыре слова, без которых дальше никак

  • Режим рассуждений - модель пишет черновик мысли перед ответом: разбирает условие, считает, проверяет себя. Ты видишь этот черновик отдельным блоком над финальным ответом.
  • Активные параметры - сколько весов модели включается на обработку одного слова. У GigaChat 3.5 Reasoning из 432 млрд работают 28 млрд, остальные лежат тихо. Отсюда скорость и цена.
  • MoE - устройство модели, где вместо одной большой сети внутри сидит набор узких специалистов, и на каждый запрос просыпаются только нужные.
  • Бенчмарк - стандартный набор задач с известными ответами, по которому модели меряют друг с другом. AIME - олимпиадная математика, IFBench - умение выполнить инструкцию буквально, LiveCodeBench - программирование.

Что случилось 10 сентября 2026

До этого релиза у ГигаЧата рассуждений не было в принципе. Модель отвечала сразу, как отвечает любая обычная языковая модель: прочитала вопрос, начала писать ответ. На простых запросах это нормально, на задаче в три условия начинаются промахи в арифметике и потерянные условия.

GigaChat 3.5 Reasoning учили по-другому - через онлайн-обучение с подкреплением, где модель получает награду за правильный итоговый ответ и сама нащупывает, какой ход рассуждений к нему приводит. Тот же принцип стоит за рассуждающими моделями OpenAI и DeepSeek. Подробнее про сам механизм мы разбирали в гайде о чём думает нейросеть перед ответом.

Внутри стоит архитектура MoE на 432 млрд параметров. На каждом токене включаются 28 млрд из них, то есть примерно один параметр из пятнадцати.

432млрд

всего параметров в модели, вес весов на Hugging Face

28млрд

реально работают на обработке одного слова

Второй важный момент: веса выложены на Hugging Face под лицензией MIT, репозиторий ai-sage/GigaChat3.5-432B-A28B-Reasoning. Это первая российская открытая модель с полноценным режимом рассуждений. Лицензия MIT разрешает коммерческое использование, то есть российская компания может поставить модель на свой сервер и не зависеть ни от чьих лимитов.

В новостях релиз называют мультимодальным, и это правда про ГигаЧат как продукт: картинки, голос и документы разбирает сам сервис. У выложенных весов 3.5 Reasoning на Hugging Face тип задачи другой - генерация текста, изображения на вход они не берут. Если собираешься разбирать рассуждениями схемы и скриншоты, проверь этот пункт до того, как закладывать его в проект.

Как включить рассуждения в ГигаЧате

В браузере и приложении

Вход ≈ 1 мин

  • открой giga.chat в браузере или приложение ГигаЧат
  • войди по Сбер ID, номер телефона и код из смс
  • VPN и зарубежная карта не нужны
1

Кнопка Рассуждение

  • под полем ввода найди кнопку Рассуждение
  • нажми её ДО отправки запроса
  • ГигаЧат сам переключится на модель 3.5 Reasoning
2

Запрос ≈ 10-40 сек

  • пиши задачу целиком, со всеми условиями и цифрами
  • модель покажет ход мысли отдельным блоком
  • при необходимости сама полезет в поиск за свежими данными
3

Проверка

  • прочитай ход рассуждений, а не только вывод
  • если модель подставила не то условие, поправь и переспроси
  • для обычных вопросов режим выключай обратно
4

Отдельной подписки кнопка не требует. Если ты раньше не имел дела с ГигаЧатом, все входы и способы регистрации собраны в нашем гайде GigaChat: как пользоваться нейросетью Сбера.

В API

Разработчику режим включается параметром effort в запросе к /chat/completions - он же регулирует глубину рассуждений. Ход мысли приезжает отдельным полем, чтобы его можно было не показывать конечному пользователю.

Если поднимаешь модель у себя, парсер рассуждений включается флагом сервера: --reasoning-parser gigachat35 для SGLang (трассировка ляжет в reasoning_content) и --reasoning-parser gigachat35_thinking для vLLM (поле reasoning). Рекомендованная авторами температура - 0,6.

Кнопку нажать легко, сложнее научиться ставить задачу так, чтобы рассуждения работали на тебя. Пройди мини-курс «Claude за вечер»: от установки до первых результатов на твоих задачах.

Пройти мини-курс →

Что модель показывает на тестах

Сбер опубликовал сравнение с DeepSeek V4 Flash Preview - это версия китайской модели, актуальная на момент релиза. Цифры взяты из карточки модели на Hugging Face и разбора Сбера на Хабре, колонка «без рассуждений» - это тот же ГигаЧат 3.5 в обычном режиме.

ТестГигаЧат 3.5 без рассужденийGigaChat 3.5 ReasoningDeepSeek V4 Flash Preview
AIME 2025 (математика)688988,95
AIME 2026 (математика)679290,4
GPQA-Diamond (наука)61,1182,3287,4
LiveCodeBench v6 (код)56,285,487,87
IFBench (инструкции)43,667773,33
Средний балл по связке-68,8872,71

Первое, что бросается в глаза: разрыв между обычным режимом и рассуждениями. IFBench вырос с 43,66 до 77, программирование с 56,2 до 85,4, планирование на тесте Natural Plan с 64 до 80. Это не косметика, это другая модель по поведению.

Второе: DeepSeek по сумме всё ещё впереди, 72,71 против 68,88. Разрыв идёт из двух мест - научные вопросы уровня аспирантуры и сложное программирование. Авторы модели это признают прямо и обещают закрыть в GigaChat 4.

Формула: ГигаЧат с рассуждениями догнал DeepSeek в математике и инструкциях, отстаёт в коде и науке, зато открывается из России без единой настройки.

Главный козырь: на 37% меньше токенов

Балл на бенчмарке говорит, решила ли модель задачу. Он ничего не говорит о том, сколько она на это потратила. Рассуждающие модели любят думать длинно: пишут страницу черновика там, где хватило бы абзаца, и ты платишь за каждый токен этого черновика.

Сбер померил длину рассуждений на четырёх математических наборах - AIME 2025, AIME 2026, HMMT и IMO Answer Bench. GigaChat 3.5 Reasoning тратит в среднем на 37% меньше токенов рассуждений, чем DeepSeek, на отдельных задачах разрыв доходит до 41%.

Токены рассуждений на олимпиадной математике, за 100 взят DeepSeek

DeepSeek V4 Flash Preview
100
GigaChat 3.5 Reasoning
63

Для человека в чате это означает одно: ответ приходит быстрее. Для того, кто гоняет модель через API на потоке, это прямая экономия денег на каждом запросе.

Экономия работает только на задачах, где рассуждения уместны. Если включить режим на вопросе «переведи этот абзац», модель всё равно построит цепочку мысли и потратит токены впустую. Кнопку стоит включать осознанно, под конкретный тип задачи.

Что модель делает руками: поиск, функции и агентные задачи

Половина релиза, которую в новостях проговорили одной строкой. Рассуждения у ГигаЧата не заперты внутри текста: по дороге модель может сходить за данными, вызвать внешний инструмент и проверить, что оттуда вернулось.

Под это в обучении выделили отдельных специалистов. Онлайн-обучение с подкреплением шло по шести направлениям, и два из них прямо про инструменты. General Agent - вызов функций, работа с памятью о пользователе и поиск. Code Agent - задачи в духе SWE-bench в настоящем репозитории, где после правки прогоняются тесты.

В чате это выглядит буднично: спрашиваешь про свежие цифры, модель сама уходит в поиск, приносит числа и продолжает рассуждение уже с ними. В API это стандартный function calling: описываешь функции в параметре tools, модель возвращает вызов с аргументами, ты его исполняешь и отдаёшь результат обратно.

Теперь честная часть. Агентное программирование - самое слабое место релиза. На SWE-bench Verified модель показывает 64,7, и авторы сами пишут, что в агентном коде уступают DeepSeek V4 Flash Preview. Причину называют там же: Code Agent учили на одной обвязке, mini-SWE-agent. Инфраструктура под другие обвязки готова, но в этот релиз не вошла. Практический вывод: в твоём агенте со своим кодом вокруг модель может вести себя заметно хуже, чем на графиках Сбера.

Работает уже сейчас

  • вызов функций через параметр tools в API
  • поиск по ходу рассуждения прямо в чате
  • память о пользователе между запросами
  • правка кода в репозитории с прогоном тестов

Чего в релизе нет

  • картинок на вход у открытых весов
  • обучения под произвольные агентные обвязки, кроме mini-SWE-agent
  • паритета с DeepSeek в агентном программировании

Сажаешь модель на реальные действия - правки в репозитории, запросы в базу, отправку сообщений - оставляй подтверждение перед каждым шагом, который меняет данные. Рассуждающая модель ошибается реже, но ошибается увереннее: в ходе мысли всё выглядит логично, а в вызов функции уезжает не тот идентификатор.

На каких русских задачах рассуждения реально помогают

Режим окупается там, где в условии больше одного ограничения и есть что считать. Четыре типа задач, где разница видна сразу.

Деньги и расчёты с условиями

«Ипотека на 6,4 млн под 17,9% на 22 года, есть 1,2 млн на досрочное погашение. Что выгоднее: сократить срок или уменьшить платёж, если свободных денег в месяц 30 тысяч». Обычная модель в такой задаче регулярно теряет одно из условий или врёт в арифметике. Режим рассуждений раскладывает оба сценария и считает каждый отдельно, а по дороге видно, где он взял формулу.

Планирование маршрутов и графиков

Тест Natural Plan, где балл вырос с 64 до 80, как раз про это: собрать поездку с пересадками и временными окнами, расписать проект по этапам, свести расписание нескольких людей. Тут важен не объём текста, а способность держать в голове ограничения и не нарушить их к середине ответа.

Разбор чужого кода

LiveCodeBench вырос с 56,2 до 85,4. На практике это значит, что модель стала находить логическую ошибку в скрипте, а не просто переписывать его целиком. DeepSeek по этому направлению всё же сильнее, и для серьёзной работы с кодом мы бы смотрели в его сторону, сравнение свежей версии есть в гайде DeepSeek V4.1 Flash: тест из России.

Инструкции, которые надо выполнить буквально

Самый недооценённый пункт. IFBench проверяет, выполнит ли модель требование «ровно 7 пунктов, каждый начинается с глагола, без слова “эффективный”, последний пункт в скобках». Рост с 43,66 до 77 означает, что ГигаЧат перестал игнорировать половину твоих условий форматирования. Для человека, который гоняет модель по шаблонам под отчёты или карточки товаров, это важнее всей олимпиадной математики.

Когда рассуждения включать не стоит

Режим только мешает

  • перевод и вычитка текста
  • «напиши пост в телеграм на 800 знаков»
  • короткие фактические вопросы
  • любой запрос, где нужен быстрый ответ подряд десять раз

Режим окупается

  • задачи с двумя и более условиями
  • расчёты, где важна каждая цифра
  • планирование с ограничениями по времени
  • жёсткий формат ответа, который надо выдержать
  • поиск ошибки в чужом коде или документе

Простой критерий: если ты сам решил бы задачу в уме за пять секунд, рассуждения не нужны. Если тебе понадобился бы черновик на бумаге, включай.

Ограничения, о которых узнаёшь на второй день

Здесь начинается честная часть. Веб-версия ГигаЧата в режиме рассуждений режет ответ до 4096 токенов. Это примерно 18 000 знаков или десять страниц текста. Приложить к запросу можно максимум два PDF.

На длинных документах лимит бьёт больно. Договор на сорок страниц или выгрузка из 1С в режиме рассуждений просто не поместятся: модель начнёт отвечать и оборвётся на середине. Режь текст на части и задавай вопрос по каждой отдельно, либо иди в API, где контекст модели доходит до 262 тысяч токенов. Проверяй ответ на обрыв перед тем, как нести его дальше.

Второе ограничение мягче: рассуждения занимают время. Обычный ответ прилетает мгновенно, здесь придётся подождать от десяти секунд до минуты в зависимости от задачи. Для работы в диалоге это ощутимо.

Третье: ход мысли, который показывает модель, стоит читать. Там иногда видно, что она подставила не то число или поняла условие иначе. Поправить запрос на этом этапе дешевле, чем разбираться, почему итоговая цифра не сходится.

Сколько это стоит из России

В чате на giga.chat и в приложении кнопка «Рассуждение» бесплатна. Никакой подписки под неё не продают, лимиты общие с обычным ГигаЧатом.

Для тех, кто работает через API, тарифы Сбера для физлиц обновились 1 сентября 2026. Бесплатный пакет - 365 млн токенов на 12 месяцев, разложенных по моделям: 250 млн на Lite, 40 млн на Pro, 25 млн на Max и 50 млн на GigaChat 3 Ultra.

Пакет (генерация текста)ОбъёмЦена с НДСЗа миллион токенов
GigaChat 2 Lite20 млн1 300 ₽65 ₽
GigaChat 2 Pro3 млн1 500 ₽500 ₽
GigaChat 2 Max3 млн1 950 ₽650 ₽
Embeddings50 млн700 ₽14 ₽

Отдельной строки под 3.5 Reasoning в публичной тарифной сетке на 13 сентября 2026 нет, модель поехала в общий доступ вместе с линейкой. Точную цену под свою нагрузку смотри в личном кабинете: с 1 сентября 2026 новые клиенты оплачивают GigaChat API через платформу cloud.ru. Пакеты живут месяц, бесплатные токены - год.

Главное тут даже не цифры. Оплата идёт в рублях с российской карты, без посредников, виртуальных карт и переплат за курс. Сколько стоит тот же объём у зарубежных моделей и как за них платить из России, мы считали в гайде как оплатить нейросети из России.

ГигаЧат, DeepSeek или ChatGPT: что под какую задачу

ЗадачаКуда идтиПочему
Расчёты и логика на русском, срочноГигаЧат с рассуждениямиоткрывается без VPN, ответ короче, оплата в рублях
Жёсткий формат ответа по шаблонуГигаЧат с рассуждениямиIFBench 77, лучший результат в тройке
Серьёзная работа с кодомDeepSeek87,87 против 85,4 на LiveCodeBench, дешёвый API
Научные и узкоспециальные вопросыDeepSeek или ChatGPTGPQA-Diamond 87,4 против 82,32
Длинные документы целикомDeepSeek или ChatGPTв чате ГигаЧата потолок 4096 токенов на ответ
Работа без VPN и зарубежной картыГигаЧатостальные требуют обхода, подборка сервисов без VPN

Вывод простой. ГигаЧат с рассуждениями закрывает бытовую и офисную логику на русском без единой технической настройки. На олимпиадном уровне и в программировании к нему всё ещё есть вопросы, и зарубежные модели там впереди.

А если сравнивать с ChatGPT

Прямых замеров ГигаЧата против GPT на одних и тех же тестах Сбер не публиковал, так что сравнивать баллы было бы гаданием. Зато отлично сравнивается то, что видно из России: деньги, доступ и лимиты.

Что сравниваемГигаЧат 3.5 ReasoningChatGPT с рассуждениями
Цена входа0 ₽, кнопка в чатеPlus $20 в месяц, около 1640 ₽ по курсу ЦБ на 8 августа 2026
Оплата из Россиирублёвая карта, Сбер IDнапрямую нельзя: посредник или агрегатор, сверху 10-20%
VPNне нуженнужен для прямого входа, российский IP OpenAI не обслуживает
Регистрацияномер телефона +7зарубежный номер при прямой регистрации
Лимит ответа4096 токенов в чатезаметно выше, длинные документы идут целиком
Российский контекстродной русский, знает наши реалиирусский отличный, но наши цены и правила часто устаревшие
Агентная работа с кодомслабое место релизасильная сторона, под код есть отдельные тарифы

По деньгам расклад такой: год обычной работы в ГигаЧате стоит ноль, год ChatGPT Plus через посредника выходит примерно в 21-24 тысячи рублей. Для бытовых расчётов, планирования и офисных текстов разница в качестве рассуждений этих денег не стоит. Для кода, исследований и длинных документов стоит, и там переплата окупается. Полная сетка тарифов и способы оплаты разобраны в гайде тарифы ChatGPT в рублях.

Как запустить модель на своём железе

Раз лицензия MIT, веса можно скачать. На Hugging Face лежат две сборки: ai-sage/GigaChat3.5-432B-A28B-Reasoning под инференс в fp8 и ai-sage/GigaChat3.5-432B-A28B-Reasoning-bf16 под дообучение.

Трезво про требования: 432 млрд параметров даже в fp8 - это сотни гигабайт весов. Домашняя видеокарта такое не потянет, речь про серверную стойку или аренду мощностей. Реальный сценарий здесь корпоративный: компания, которой нужно, чтобы данные не покидали контур, ставит модель на свои серверы и не платит за токены вообще.

Для домашних экспериментов смотри в сторону моделей поменьше, как поставить нейросеть на свой компьютер разбирали отдельно.

Чек-лист: что у тебя теперь есть

  • Понимание, что кнопка «Рассуждение» в ГигаЧате переключает на отдельную модель, а не просто добавляет вежливости в ответ.
  • Четыре типа задач, где режим окупается, и список тех, где он только тормозит.
  • Честные цифры сравнения с DeepSeek: где ГигаЧат впереди, где отстаёт и на сколько.
  • Понимание, что рассуждения ходят в поиск и вызывают функции, а агентный код пока слабее, чем у DeepSeek: 64,7 на SWE-bench Verified и обучение под одну обвязку.
  • Ответ на вопрос про мультимодальность: картинки разбирает сам сервис ГигаЧат, открытые веса 3.5 Reasoning работают только с текстом.
  • Знание лимитов, чтобы не наткнуться на обрыв ответа посреди важного документа: 4096 токенов и два PDF.
  • Цены в рублях и понимание, что бесплатного пакета хватит на год обычной работы.
  • Ссылка на веса под MIT, если задача требует держать модель у себя.

Отдельно стоит держать в голове темп. Между обычным ГигаЧатом и рассуждающей версией прошло меньше года, и Сбер уже говорит про GigaChat 4, где обещает закрыть отставание в коде. Проверять модель заново придётся примерно раз в квартал, как и все остальные, за чем удобно следить по нашему разбору как держать пульс новостей про ИИ.

По материалам ppc.world: Сбер выпустил первую модель ГигаЧата с полноценным логическим мышлением. Цифры бенчмарков и характеристики модели сверены с карточкой ai-sage/GigaChat3.5-432B-A28B-Reasoning на Hugging Face и разбором Сбера на Хабре, тарифы - с документацией developers.sber.ru на 13 сентября 2026. Факты про внешние инструменты и агентные сценарии в обновлении от 14 сентября взяты из разбора Сбера на Хабре и заметки yagla.ru: Сбер представил мультимодальную модель GigaChat 3.5 Reasoning с режимом рассуждений.

Частые вопросы

Как включить режим рассуждений в ГигаЧате?

В веб-версии giga.chat и в приложении под полем ввода есть кнопка «Рассуждение». Нажимаешь её перед отправкой запроса, и ГигаЧат переключается на модель GigaChat 3.5 Reasoning: она сначала показывает ход мысли, потом даёт ответ. Кнопка бесплатная, отдельная подписка для неё не нужна. В API режим задаётся параметром effort в запросе к /chat/completions.

GigaChat 3.5 Reasoning лучше DeepSeek?

По среднему баллу Сбера на связке тестов - нет: 68,88 у ГигаЧата против 72,71 у DeepSeek V4 Flash Preview. Но по отдельным направлениям ГигаЧат выигрывает: олимпиадная математика AIME 2026 (92 против 90,4) и следование сложным инструкциям IFBench (77 против 73,33). Проигрывает в сложном программировании и на научном тесте GPQA-Diamond.

Режим рассуждений в ГигаЧате бесплатный?

В чате на giga.chat и в приложении да, кнопка «Рассуждение» доступна всем без подписки. Для разработчиков модель идёт по обычным тарифам GigaChat API, где физлицу с 1 сентября 2026 дают 365 млн бесплатных токенов на 12 месяцев. Веса модели выложены на Hugging Face под лицензией MIT, то есть их можно скачать и запускать у себя без оплаты Сберу.

Нужен ли VPN для GigaChat 3.5 Reasoning?

Нет. Это российский сервис, он открывается из России напрямую - в браузере, в приложении и в Telegram-боте. Вход по Сбер ID по номеру телефона, зарубежная карта не нужна, оплата в рублях. Это главная причина, по которой рассуждающая модель Сбера вообще интересна: у DeepSeek и ChatGPT режим рассуждений сильнее, но до них ещё надо добраться.

Умеет ли GigaChat 3.5 Reasoning работать с поиском и внешними инструментами?

Да. В режиме рассуждений модель строит план, при необходимости уходит в поиск и другие инструменты и проверяет промежуточный результат. В API это обычный function calling через параметр tools. Отдельно её учили агентной работе с кодом в настоящем репозитории: на SWE-bench Verified результат 64,7. Картинки на вход открытые веса не принимают, это текстовая модель.

Мини-курс по Claude

Claude умеет больше, чем ты у него просишь

Мини-курс «Claude за вечер»: 7 уроков про вход из России, настройки, проекты, скилы и агентов. К концу вечера у тебя набор из 35 промптов под свои задачи. Дальше есть Лаборатория ИИ-маркетинга, где из нейросети собирается целый отдел маркетинга.