Инструменты · 17 мин · обновлено 3 августа 2026 г.

Какие нейросети вышли летом 2026 и какими реально пользоваться из России

За июнь-июль 2026 вышло больше десяти новых моделей: Claude Opus 5 и Sonnet 5, GPT-5.6 в трёх версиях, Gemini 3.6 Flash, Grok 4.5, открытые Kimi K3 и Inkling. Разбираем, что каждая умеет, сколько стоит в рублях и какие из них заводятся из России.

Какие нейросети вышли летом 2026 и какими реально пользоваться из России

Лето 2026 стало самым плотным периодом релизов за всю историю ИИ: за июнь и июль четыре крупные лаборатории выкатили новые флагманы, а к ним добавились две открытые модели с выложенными весами. Если коротко, вышли Claude Fable 5, Sonnet 5 и Opus 5 от Anthropic, GPT-5.6 от OpenAI сразу в трёх версиях, Gemini 3.6 Flash от Google, Grok 4.5 от xAI, генератор картинок Qwen-Image-3.0 от Alibaba, а также Kimi K3 от Moonshot и Inkling от новой лаборатории Thinking Machines.

Дальше по порядку: что конкретно умеет каждая, сколько она стоит в рублях, какие из них заводятся с российского IP и какую выбрать под свою задачу. Без хайпа и без пересказа пресс-релизов.

За июнь-июль 2026 вышло больше десяти моделей, и главное изменение не в том, что кто-то стал умнее всех. Гонка за единственный самый мощный флагман закончилась: теперь у каждой лаборатории линейка под разный бюджет. Claude Opus 5 берёт совокупность цены и качества (5 и 25 долларов за миллион токенов), GPT-5.6 Sol лидирует в агентном кодинге, Gemini 3.6 Flash подешевел до 1,5 доллара за миллион входных токенов и закрывает массовые задачи втрое дешевле конкурентов. Из России ни одна западная модель не работает напрямую: нужен либо VPN, либо российский агрегатор за рубли.

Коротко: термины из статьи одной строкой

Какие нейросети вышли летом 2026: общая таблица

Вот весь список одним экраном. Цены указаны за миллион токенов по API, рубли посчитаны по курсу примерно 90 рублей за доллар с учётом комиссии посредника.

МодельКто выпустилДатаКонтекстЦена вход / выходВ рублях (вход)Для чего брать
Claude Fable 5Anthropic9 июня, возврат 1 июля1 млнпо подписке-долгая автономная работа
Claude Sonnet 5Anthropic30 июня1 млнпо подписке-ежедневный кодинг
Claude Opus 5Anthropic25 июля1 млн$5 / $25~450 ₽сложные задачи, лучший баланс
GPT-5.6 SolOpenAI9 июля1 млн$5 / $30~450 ₽агентный кодинг, топ индекса
GPT-5.6 TerraOpenAI9 июля1 млн$2,50 / $15~225 ₽средние задачи
GPT-5.6 LunaOpenAI9 июля1 млн$1 / $6~90 ₽быстрые массовые ответы
Gemini 3.6 FlashGoogle21 июля1 млн$1,50 / $7,50~135 ₽объём и работа с компьютером
Grok 4.5xAIсередина июляне заявленпо подписке-чат и новости из X
Qwen-Image-3.0Alibaba21 июля-не объявлена-картинки с текстом
Kimi K3Moonshot16 июля1 048 576открытые веса-фронтенд, свой сервер
InklingThinking Machines15 июля1 млноткрытые веса-донастройка под компанию

Контекст в миллион токенов летом 2026 стал стандартом: он есть у всех новых моделей от Anthropic, OpenAI, Google и обеих открытых. Ещё год назад это была фишка одной-двух моделей, за которую доплачивали отдельно.

Anthropic: три модели за два месяца

У Anthropic лето получилось самым насыщенным. Три релиза подряд, причём один из них успел уехать и вернуться.

Claude Fable 5 появилась 9 июня и стала первой моделью с постоянно включённым адаптивным рассуждением: она сама решает, сколько думать над задачей, без отдельной галочки в интерфейсе. Контекст миллион токенов. Дальше вышла история, которой раньше в отрасли не было: 12 июня модель приостановили по директиве экспортного контроля США, и она пролежала выключенной почти три недели. Вернули 1 июля с добавленными классификаторами безопасности, которые отправляют подозрительные запросы по темам кибербезопасности и биологии на проверку старой модели Opus 4.8.

Claude Sonnet 5 вышла 30 июня и закрывает середину линейки: результат близко к Opus, а платишь по тарифу Sonnet. Основной сценарий это агентный кодинг и работа с инструментами, то есть когда модель сама лезет в файлы и запускает команды.

Claude Opus 5 приехала 25 июля и стала главным событием месяца. Токены стоят 5 долларов за миллион на входе и 25 на выходе, максимальный ответ 128 тысяч токенов, контекст миллион. Появилась настройка усилия из пяти уровней: можно попросить думать быстро и дёшево или долго и дорого. По ряду тестов Opus 5 обгоняет Fable 5, при этом стоит дешевле. Подробный разбор цен и способов оплаты у нас есть в отдельном гайде про Claude Opus 5 и оплату из России.

3модели

Anthropic выпустила за июнь-июль: Fable 5, Sonnet 5 и Opus 5

19дней

Fable 5 была выключена по директиве экспортного контроля США: с 12 июня по 1 июля

5уровней

настройка усилия в Opus 5: от быстрого дешёвого ответа до долгого размышления

OpenAI: GPT-5.6 в трёх версиях под разный кошелёк

OpenAI 9 июля открыла общий доступ к GPT-5.6 (ограниченный доступ был с 26 июня) и сделала то, к чему отрасль шла весь год: разделила один флагман на три модели с общим контекстом в миллион токенов и одинаковым порогом знаний до февраля 2026.

Максимальный ответ у всех трёх 128 тысяч токенов. Отдельно вышел продукт ChatGPT Work для агентных проектов, которые крутятся часами без человека.

С бенчмарками получилась любопытная картина, которая хорошо показывает, почему нельзя спрашивать «какая модель лучшая» вообще. Sol возглавляет индекс агентного кодинга Artificial Analysis, обходя Claude Fable 5 на 2,8 пункта. На тесте SWE-Bench Pro, где нужно чинить реальные баги в больших репозиториях, картина переворачивается: Fable 5 берёт 80 процентов, Sol только 64,6.

Чего в летних релизах НЕТ

  • Единого победителя во всех тестах сразу
  • Резкого скачка качества, как между поколениями пару лет назад
  • Прямого доступа с российского IP хоть у одной западной модели
  • Возможности запустить топовые открытые веса на домашнем компьютере

Что реально изменилось

  • Линейка под бюджет у каждой лаборатории вместо одного флагмана
  • Падение цен: Gemini 3.6 Flash подешевел с 9 до 7,5 доллара за выход
  • Контекст в миллион токенов стал нормой, а не премиум-опцией
  • Открытые модели догнали закрытые: отставание сжалось с 6-9 до 3-5 месяцев

Google: Gemini 3.6 Flash и ставка на цену

Google 21 июля выпустил сразу три вещи: основную Gemini 3.6 Flash, облегчённую 3.5 Flash-Lite и закрытую 3.5 Flash Cyber с доступом по заявке.

Главная здесь Flash, и она интересна именно ценой. Миллион входных токенов стоит 1,5 доллара, выходных 7,5 доллара, причём выход подешевел с прежних 9 долларов. Контекст миллион токенов, знания до марта 2026. Сверху модель стала экономнее примерно на 17 процентов по числу выходных токенов, то есть на том же ответе ты платишь ещё меньше просто потому, что она говорит короче.

По результатам тоже прибавка: на тесте DeepSWE 49 процентов против прежних 37, на OSWorld-Verified, где модель управляет реальным компьютером, 83 процента против 78,4.

Цена миллиона входных токенов, долларов

Gemini 3.6 Flash
1,5
GPT-5.6 Luna
1,0
GPT-5.6 Terra
2,5
Claude Opus 5
5,0
GPT-5.6 Sol
5,0

Для практики это значит простую вещь: если у тебя поток однотипных задач (разобрать тысячу отзывов, переписать сотню описаний товаров), считать надо не по флагману. Разница между Flash и Opus на объёме в миллионы токенов измеряется десятками тысяч рублей.

Список моделей полезно знать, но деньги приносит привычка пользоваться ими каждый день. Пройди мини-курс «Claude за вечер»: от установки до первых результатов на твоих задачах.

Пройти мини-курс →

xAI Grok 4.5: ставка на массового пользователя

Grok 4.5 вышел в середине июля и стоит в этом списке особняком, потому что метит не в разработчиков. Основная работа сделана над потребительским чатом: ответы стали быстрее, память о разговоре лучше, обработка картинок и файлов сильнее. Главный козырь это встроенность в X: модель тянет свежие посты и обсуждения прямо из ленты, поэтому по горячим новостям отвечает точнее конкурентов.

Полноценных сравнительных бенчмарков по релизу xAI не публиковала, так что ставить Grok 4.5 в один ряд с Opus 5 и GPT-5.6 по цифрам не получится.

Открытые модели: Kimi K3 и Inkling

Самое недооценённое событие лета произошло не у западных гигантов.

Kimi K3 от китайской Moonshot появилась в API 16 июля, а 26 июля лаборатория выложила веса под модифицированной лицензией MIT. Размеры внушительные: 2,8 триллиона параметров всего, 104 миллиарда активных на запрос, контекст 1 048 576 токенов. По слепой оценке фронтенд-кода модель обходит американские, а отставание открытых моделей от закрытых сжалось с прежних 6-9 месяцев до 3-5.

Реакция рынка была резкой: акции Z.ai упали на 30 процентов, MiniMax на 16, Alibaba на 4. Выручка самой Moonshot за это время выросла больше чем в шесть раз.

«Открытые веса» не равно «запущу дома». Kimi K3 даже в четырёхбитной точности требует около 1,4 терабайта быстрой памяти. Это стойка серверов, а не игровой компьютер. Если хочется реально локальную модель, смотри в сторону моделей на 7-30 миллиардов параметров: про это у нас есть гайд про [запуск нейросети на своём компьютере через Ollama](/guides/neyroset-na-kompyutere-ollama).

Inkling от Thinking Machines, лаборатории Миры Мурати, вышла 15 июля и стала дебютом новой команды. Архитектура MoE: 975 миллиардов параметров всего, 41 миллиард активных, контекст миллион токенов, обучение на 45 триллионах токенов текста, картинок, звука и видео. Лицензия Apache 2.0, то есть максимально свободная. Заявленная цель это не первое место в рейтингах, а удобная донастройка под конкретную компанию. Параллельно вышло превью Inkling-Small на 276 миллиардов параметров с 12 миллиардами активных.

Qwen-Image-3.0: картинки, где текст наконец читается

Alibaba 21 июля выпустила Qwen-Image-3.0, и это единственный чисто картиночный релиз лета. Главное изменение в длине промпта: теперь модель принимает 4500 токенов описания, примерно в 4,5 раза больше прежнего. То есть можно расписать композицию по слоям, а не сжимать идею в две строки.

Второе достижение это текст на картинке. Модель умеет плотно расставлять надписи, держит читаемость даже на высоте в 10 пикселей, работает с 12 языками и двумя десятками шрифтов. Для баннеров, обложек и каруселей это ровно та боль, из-за которой раньше приходилось дорисовывать текст руками в редакторе.

Alibaba выложила Qwen-Image-3.0 без таблицы бенчмарков, без числа параметров, без лицензии, без весов и без технического отчёта. Проверить заявления независимо пока невозможно, так что относись к цифрам про «10 пикселей» как к обещанию производителя, а не к измеренному факту.

Какие из новых нейросетей работают из России

Теперь главный вопрос для читателя из РФ. Честный ответ: напрямую с российского IP не работает ни одна из западных моделей этого списка. Anthropic, OpenAI, Google и xAI блокируют доступ на уровне страны, причём блокировка стоит и на регистрации, и на оплате, и на самих запросах к API.

Рабочих путей три.

Через российский агрегатор ≈ 5 мин

  • Регистрируешься в BotHub или MashaGPT обычной почтой
  • Платишь рублями с российской карты
  • Получаешь те же Claude, GPT и Gemini в одном окне
  • VPN не нужен, но переплата за посредничество есть
1

Своя подписка через VPN ≈ 30 мин

  • Поднимаешь зарубежный IP через стабильный VPN
  • Регистрируешься на зарубежный номер или почту
  • Оплачиваешь зарубежной картой или через посредника
  • Получаешь полный интерфейс без ограничений агрегатора
2

Китайские и открытые модели ≈ 10 мин

  • Kimi и Qwen чаще открываются с российского IP
  • Регистрация всё равно просит зарубежный номер
  • Открытые веса можно арендовать на облачном сервере
  • Цена ниже, качество на уровне закрытых с лагом в 3-5 месяцев
3

По второму пути главное это стабильность канала: бесплатные VPN отваливаются на середине длинного ответа и роняют сессию, поэтому нужен рабочий VPN с зарубежным адресом, который держит соединение.

Что из этого выбрать, зависит от объёма. Если ты пользуешься нейросетью несколько раз в день для текста и разбора файлов, агрегатора за рубли хватит с головой, и возиться с VPN смысла нет. Если нужен агентный режим (Claude Code, ChatGPT Work, работа с файлами на своей машине), придётся заводить свою подписку: агрегаторы дают только чат.

Отдельно про способы обойтись вообще без зарубежного IP мы разбирали в гайде какие нейросети работают в России без VPN.

Сколько это стоит в рублях

Подписки у всех крупных игроков сошлись на одной цифре: 20 долларов в месяц за базовый платный уровень. Это Claude Pro, ChatGPT Plus, Google AI Pro и SuperGrok. Через сервис оплаты подписок выходит примерно 1700-1900 рублей в месяц вместе с комиссией (реферальная ссылка: тебе тот же прайс, мне небольшой процент).

По API считать надо от объёма. Возьмём практический пример: обработать 300 страниц документов и получить сводку.

ЗадачаТокенов входМодельЦена
300 страниц в сводку~400 000Gemini 3.6 Flash~55 ₽
300 страниц в сводку~400 000GPT-5.6 Terra~90 ₽
300 страниц в сводку~400 000Claude Opus 5~180 ₽
Месяц агентного кодинга~30 млнClaude Opus 5~13 500 ₽
Месяц агентного кодинга~30 млнGPT-5.6 Sol~13 500 ₽

Если задача повторяется каждый день, начинай с самой дешёвой модели линейки и поднимайся вверх только там, где результат реально не устраивает. На потоке разница между Luna и Sol это разница в пять раз по счёту, а по качеству на простых задачах её часто вообще не видно.

Что выбрать под свою задачу

Формула лета 2026: одной лучшей модели больше нет, есть правильная модель под конкретную работу и бюджет. Выбирай по задаче, а не по месту в рейтинге.

Чек-лист: что у тебя теперь есть

Проверь, что твоя текущая подписка уже даёт доступ к новым моделям. У Anthropic, OpenAI и Google летние релизы вошли в существующие тарифы без доплаты, и многие продолжают работать на прошлом поколении просто потому, что не переключили модель в списке.


По материалам обзора релизов июля 2026 на Analytics Vidhya: July 2026 AI Model Releases. Цены и результаты тестов приведены по состоянию на конец июля 2026, проверяй актуальные на сайтах сервисов.

Рассылка

Подпишись на еженедельную рассылку

Полезные материалы и скиллы, которые усилят твою работу с нейросетями и помогут больше зарабатывать. Раз в неделю, без воды и спама.

Частые вопросы

Какие нейросети вышли летом 2026?

За июнь-июль вышли Claude Fable 5, Sonnet 5 и Opus 5 от Anthropic, GPT-5.6 от OpenAI в трёх версиях Sol, Terra и Luna, Gemini 3.6 Flash от Google, Grok 4.5 от xAI, генератор картинок Qwen-Image-3.0 от Alibaba и две открытые модели с весами: Kimi K3 от Moonshot и Inkling от лаборатории Thinking Machines.

Какая нейросеть сейчас самая сильная?

Единого победителя нет. GPT-5.6 Sol лидирует в индексе агентного кодинга Artificial Analysis на 2,8 пункта, при этом Claude Fable 5 берёт 80 процентов на SWE-Bench Pro против 64,6 у Sol. Claude Opus 5 сильнее всех по совокупности цены и результата, а Gemini 3.6 Flash выигрывает по стоимости массовых задач.

Какие из новых нейросетей работают из России без VPN?

Напрямую с российского IP не работает ни одна из западных: Anthropic, OpenAI, Google и xAI блокируют доступ. Без VPN к ним заходят через российские агрегаторы вроде BotHub и MashaGPT, которые перепродают те же модели за рубли. Китайские Kimi и Qwen открываются из России чаще, но регистрация всё равно требует зарубежный номер.

Сколько стоит новая нейросеть в рублях?

Подписка на уровне Claude Pro или ChatGPT Plus стоит 20 долларов в месяц, это примерно 1700-1900 рублей через сервис-посредник. По API миллион входных токенов Claude Opus 5 и GPT-5.6 Sol стоит около 450 рублей, а Gemini 3.6 Flash дешевле втрое, примерно 135 рублей за тот же миллион.

Стоит ли переходить на новые модели или остаться на старых?

Переходить стоит, если ты уже платишь подписку: новые модели входят в тот же тариф без доплаты. По API переход выгоден почти всегда, потому что летние релизы дали либо ту же цену при большем результате, как у Opus 5, либо прямое снижение цены, как у Gemini 3.6 Flash.

Мини-курс «Claude за вечер»

За один вечер настроишь Claude под свои задачи: внутри 35+ промптов, скиллов и агентов. Гарантия возврата 7 дней. Дальше есть Лаборатория ИИ-маркетинга, где из нейросети собирается целый отдел маркетинга.

Пройти мини-курс