Какие нейросети вышли летом 2026 и какими реально пользоваться из России
За июнь-июль 2026 вышло больше десяти новых моделей: Claude Opus 5 и Sonnet 5, GPT-5.6 в трёх версиях, Gemini 3.6 Flash, Grok 4.5, открытые Kimi K3 и Inkling. Разбираем, что каждая умеет, сколько стоит в рублях и какие из них заводятся из России.
Лето 2026 стало самым плотным периодом релизов за всю историю ИИ: за июнь и июль четыре крупные лаборатории выкатили новые флагманы, а к ним добавились две открытые модели с выложенными весами. Если коротко, вышли Claude Fable 5, Sonnet 5 и Opus 5 от Anthropic, GPT-5.6 от OpenAI сразу в трёх версиях, Gemini 3.6 Flash от Google, Grok 4.5 от xAI, генератор картинок Qwen-Image-3.0 от Alibaba, а также Kimi K3 от Moonshot и Inkling от новой лаборатории Thinking Machines.
Дальше по порядку: что конкретно умеет каждая, сколько она стоит в рублях, какие из них заводятся с российского IP и какую выбрать под свою задачу. Без хайпа и без пересказа пресс-релизов.
За июнь-июль 2026 вышло больше десяти моделей, и главное изменение не в том, что кто-то стал умнее всех. Гонка за единственный самый мощный флагман закончилась: теперь у каждой лаборатории линейка под разный бюджет. Claude Opus 5 берёт совокупность цены и качества (5 и 25 долларов за миллион токенов), GPT-5.6 Sol лидирует в агентном кодинге, Gemini 3.6 Flash подешевел до 1,5 доллара за миллион входных токенов и закрывает массовые задачи втрое дешевле конкурентов. Из России ни одна западная модель не работает напрямую: нужен либо VPN, либо российский агрегатор за рубли.
Коротко: термины из статьи одной строкой
- Токен - кусочек текста примерно в 3-4 символа, единица тарификации. Тысяча русских слов это около 1500-1800 токенов.
- Контекстное окно - сколько текста модель держит в голове за один раз. Миллион токенов это примерно 700-800 страниц.
- Открытые веса - модель можно скачать и запустить у себя, без обращения к чужому серверу. Не путать с бесплатностью: железо под неё стоит дорого.
- MoE (смесь экспертов) - архитектура, где из всех параметров модели на каждый запрос включается только небольшая часть. Отсюда цифры вида «2,8 триллиона всего, 104 миллиарда активных».
- Агентный кодинг - когда модель не подсказывает строчку, а сама правит файлы, запускает тесты и чинит ошибки по кругу.
Какие нейросети вышли летом 2026: общая таблица
Вот весь список одним экраном. Цены указаны за миллион токенов по API, рубли посчитаны по курсу примерно 90 рублей за доллар с учётом комиссии посредника.
| Модель | Кто выпустил | Дата | Контекст | Цена вход / выход | В рублях (вход) | Для чего брать |
|---|---|---|---|---|---|---|
| Claude Fable 5 | Anthropic | 9 июня, возврат 1 июля | 1 млн | по подписке | - | долгая автономная работа |
| Claude Sonnet 5 | Anthropic | 30 июня | 1 млн | по подписке | - | ежедневный кодинг |
| Claude Opus 5 | Anthropic | 25 июля | 1 млн | $5 / $25 | ~450 ₽ | сложные задачи, лучший баланс |
| GPT-5.6 Sol | OpenAI | 9 июля | 1 млн | $5 / $30 | ~450 ₽ | агентный кодинг, топ индекса |
| GPT-5.6 Terra | OpenAI | 9 июля | 1 млн | $2,50 / $15 | ~225 ₽ | средние задачи |
| GPT-5.6 Luna | OpenAI | 9 июля | 1 млн | $1 / $6 | ~90 ₽ | быстрые массовые ответы |
| Gemini 3.6 Flash | 21 июля | 1 млн | $1,50 / $7,50 | ~135 ₽ | объём и работа с компьютером | |
| Grok 4.5 | xAI | середина июля | не заявлен | по подписке | - | чат и новости из X |
| Qwen-Image-3.0 | Alibaba | 21 июля | - | не объявлена | - | картинки с текстом |
| Kimi K3 | Moonshot | 16 июля | 1 048 576 | открытые веса | - | фронтенд, свой сервер |
| Inkling | Thinking Machines | 15 июля | 1 млн | открытые веса | - | донастройка под компанию |
Контекст в миллион токенов летом 2026 стал стандартом: он есть у всех новых моделей от Anthropic, OpenAI, Google и обеих открытых. Ещё год назад это была фишка одной-двух моделей, за которую доплачивали отдельно.
Anthropic: три модели за два месяца
У Anthropic лето получилось самым насыщенным. Три релиза подряд, причём один из них успел уехать и вернуться.
Claude Fable 5 появилась 9 июня и стала первой моделью с постоянно включённым адаптивным рассуждением: она сама решает, сколько думать над задачей, без отдельной галочки в интерфейсе. Контекст миллион токенов. Дальше вышла история, которой раньше в отрасли не было: 12 июня модель приостановили по директиве экспортного контроля США, и она пролежала выключенной почти три недели. Вернули 1 июля с добавленными классификаторами безопасности, которые отправляют подозрительные запросы по темам кибербезопасности и биологии на проверку старой модели Opus 4.8.
Claude Sonnet 5 вышла 30 июня и закрывает середину линейки: результат близко к Opus, а платишь по тарифу Sonnet. Основной сценарий это агентный кодинг и работа с инструментами, то есть когда модель сама лезет в файлы и запускает команды.
Claude Opus 5 приехала 25 июля и стала главным событием месяца. Токены стоят 5 долларов за миллион на входе и 25 на выходе, максимальный ответ 128 тысяч токенов, контекст миллион. Появилась настройка усилия из пяти уровней: можно попросить думать быстро и дёшево или долго и дорого. По ряду тестов Opus 5 обгоняет Fable 5, при этом стоит дешевле. Подробный разбор цен и способов оплаты у нас есть в отдельном гайде про Claude Opus 5 и оплату из России.
Anthropic выпустила за июнь-июль: Fable 5, Sonnet 5 и Opus 5
Fable 5 была выключена по директиве экспортного контроля США: с 12 июня по 1 июля
настройка усилия в Opus 5: от быстрого дешёвого ответа до долгого размышления
OpenAI: GPT-5.6 в трёх версиях под разный кошелёк
OpenAI 9 июля открыла общий доступ к GPT-5.6 (ограниченный доступ был с 26 июня) и сделала то, к чему отрасль шла весь год: разделила один флагман на три модели с общим контекстом в миллион токенов и одинаковым порогом знаний до февраля 2026.
- Sol это флагман: 5 долларов за миллион входных токенов и 30 за миллион выходных.
- Terra это середина: 2,50 и 15 долларов соответственно.
- Luna это самая быстрая и дешёвая версия: 1 и 6 долларов.
Максимальный ответ у всех трёх 128 тысяч токенов. Отдельно вышел продукт ChatGPT Work для агентных проектов, которые крутятся часами без человека.
С бенчмарками получилась любопытная картина, которая хорошо показывает, почему нельзя спрашивать «какая модель лучшая» вообще. Sol возглавляет индекс агентного кодинга Artificial Analysis, обходя Claude Fable 5 на 2,8 пункта. На тесте SWE-Bench Pro, где нужно чинить реальные баги в больших репозиториях, картина переворачивается: Fable 5 берёт 80 процентов, Sol только 64,6.
Чего в летних релизах НЕТ
- Единого победителя во всех тестах сразу
- Резкого скачка качества, как между поколениями пару лет назад
- Прямого доступа с российского IP хоть у одной западной модели
- Возможности запустить топовые открытые веса на домашнем компьютере
Что реально изменилось
- Линейка под бюджет у каждой лаборатории вместо одного флагмана
- Падение цен: Gemini 3.6 Flash подешевел с 9 до 7,5 доллара за выход
- Контекст в миллион токенов стал нормой, а не премиум-опцией
- Открытые модели догнали закрытые: отставание сжалось с 6-9 до 3-5 месяцев
Google: Gemini 3.6 Flash и ставка на цену
Google 21 июля выпустил сразу три вещи: основную Gemini 3.6 Flash, облегчённую 3.5 Flash-Lite и закрытую 3.5 Flash Cyber с доступом по заявке.
Главная здесь Flash, и она интересна именно ценой. Миллион входных токенов стоит 1,5 доллара, выходных 7,5 доллара, причём выход подешевел с прежних 9 долларов. Контекст миллион токенов, знания до марта 2026. Сверху модель стала экономнее примерно на 17 процентов по числу выходных токенов, то есть на том же ответе ты платишь ещё меньше просто потому, что она говорит короче.
По результатам тоже прибавка: на тесте DeepSWE 49 процентов против прежних 37, на OSWorld-Verified, где модель управляет реальным компьютером, 83 процента против 78,4.
Для практики это значит простую вещь: если у тебя поток однотипных задач (разобрать тысячу отзывов, переписать сотню описаний товаров), считать надо не по флагману. Разница между Flash и Opus на объёме в миллионы токенов измеряется десятками тысяч рублей.
Список моделей полезно знать, но деньги приносит привычка пользоваться ими каждый день. Пройди мини-курс «Claude за вечер»: от установки до первых результатов на твоих задачах.
Пройти мини-курс →xAI Grok 4.5: ставка на массового пользователя
Grok 4.5 вышел в середине июля и стоит в этом списке особняком, потому что метит не в разработчиков. Основная работа сделана над потребительским чатом: ответы стали быстрее, память о разговоре лучше, обработка картинок и файлов сильнее. Главный козырь это встроенность в X: модель тянет свежие посты и обсуждения прямо из ленты, поэтому по горячим новостям отвечает точнее конкурентов.
Полноценных сравнительных бенчмарков по релизу xAI не публиковала, так что ставить Grok 4.5 в один ряд с Opus 5 и GPT-5.6 по цифрам не получится.
Открытые модели: Kimi K3 и Inkling
Самое недооценённое событие лета произошло не у западных гигантов.
Kimi K3 от китайской Moonshot появилась в API 16 июля, а 26 июля лаборатория выложила веса под модифицированной лицензией MIT. Размеры внушительные: 2,8 триллиона параметров всего, 104 миллиарда активных на запрос, контекст 1 048 576 токенов. По слепой оценке фронтенд-кода модель обходит американские, а отставание открытых моделей от закрытых сжалось с прежних 6-9 месяцев до 3-5.
Реакция рынка была резкой: акции Z.ai упали на 30 процентов, MiniMax на 16, Alibaba на 4. Выручка самой Moonshot за это время выросла больше чем в шесть раз.
«Открытые веса» не равно «запущу дома». Kimi K3 даже в четырёхбитной точности требует около 1,4 терабайта быстрой памяти. Это стойка серверов, а не игровой компьютер. Если хочется реально локальную модель, смотри в сторону моделей на 7-30 миллиардов параметров: про это у нас есть гайд про [запуск нейросети на своём компьютере через Ollama](/guides/neyroset-na-kompyutere-ollama).
Inkling от Thinking Machines, лаборатории Миры Мурати, вышла 15 июля и стала дебютом новой команды. Архитектура MoE: 975 миллиардов параметров всего, 41 миллиард активных, контекст миллион токенов, обучение на 45 триллионах токенов текста, картинок, звука и видео. Лицензия Apache 2.0, то есть максимально свободная. Заявленная цель это не первое место в рейтингах, а удобная донастройка под конкретную компанию. Параллельно вышло превью Inkling-Small на 276 миллиардов параметров с 12 миллиардами активных.
Qwen-Image-3.0: картинки, где текст наконец читается
Alibaba 21 июля выпустила Qwen-Image-3.0, и это единственный чисто картиночный релиз лета. Главное изменение в длине промпта: теперь модель принимает 4500 токенов описания, примерно в 4,5 раза больше прежнего. То есть можно расписать композицию по слоям, а не сжимать идею в две строки.
Второе достижение это текст на картинке. Модель умеет плотно расставлять надписи, держит читаемость даже на высоте в 10 пикселей, работает с 12 языками и двумя десятками шрифтов. Для баннеров, обложек и каруселей это ровно та боль, из-за которой раньше приходилось дорисовывать текст руками в редакторе.
Alibaba выложила Qwen-Image-3.0 без таблицы бенчмарков, без числа параметров, без лицензии, без весов и без технического отчёта. Проверить заявления независимо пока невозможно, так что относись к цифрам про «10 пикселей» как к обещанию производителя, а не к измеренному факту.
Какие из новых нейросетей работают из России
Теперь главный вопрос для читателя из РФ. Честный ответ: напрямую с российского IP не работает ни одна из западных моделей этого списка. Anthropic, OpenAI, Google и xAI блокируют доступ на уровне страны, причём блокировка стоит и на регистрации, и на оплате, и на самих запросах к API.
Рабочих путей три.
Через российский агрегатор ≈ 5 мин
- Регистрируешься в BotHub или MashaGPT обычной почтой
- Платишь рублями с российской карты
- Получаешь те же Claude, GPT и Gemini в одном окне
- VPN не нужен, но переплата за посредничество есть
Своя подписка через VPN ≈ 30 мин
- Поднимаешь зарубежный IP через стабильный VPN
- Регистрируешься на зарубежный номер или почту
- Оплачиваешь зарубежной картой или через посредника
- Получаешь полный интерфейс без ограничений агрегатора
Китайские и открытые модели ≈ 10 мин
- Kimi и Qwen чаще открываются с российского IP
- Регистрация всё равно просит зарубежный номер
- Открытые веса можно арендовать на облачном сервере
- Цена ниже, качество на уровне закрытых с лагом в 3-5 месяцев
По второму пути главное это стабильность канала: бесплатные VPN отваливаются на середине длинного ответа и роняют сессию, поэтому нужен рабочий VPN с зарубежным адресом, который держит соединение.
Что из этого выбрать, зависит от объёма. Если ты пользуешься нейросетью несколько раз в день для текста и разбора файлов, агрегатора за рубли хватит с головой, и возиться с VPN смысла нет. Если нужен агентный режим (Claude Code, ChatGPT Work, работа с файлами на своей машине), придётся заводить свою подписку: агрегаторы дают только чат.
Отдельно про способы обойтись вообще без зарубежного IP мы разбирали в гайде какие нейросети работают в России без VPN.
Сколько это стоит в рублях
Подписки у всех крупных игроков сошлись на одной цифре: 20 долларов в месяц за базовый платный уровень. Это Claude Pro, ChatGPT Plus, Google AI Pro и SuperGrok. Через сервис оплаты подписок выходит примерно 1700-1900 рублей в месяц вместе с комиссией (реферальная ссылка: тебе тот же прайс, мне небольшой процент).
По API считать надо от объёма. Возьмём практический пример: обработать 300 страниц документов и получить сводку.
| Задача | Токенов вход | Модель | Цена |
|---|---|---|---|
| 300 страниц в сводку | ~400 000 | Gemini 3.6 Flash | ~55 ₽ |
| 300 страниц в сводку | ~400 000 | GPT-5.6 Terra | ~90 ₽ |
| 300 страниц в сводку | ~400 000 | Claude Opus 5 | ~180 ₽ |
| Месяц агентного кодинга | ~30 млн | Claude Opus 5 | ~13 500 ₽ |
| Месяц агентного кодинга | ~30 млн | GPT-5.6 Sol | ~13 500 ₽ |
Если задача повторяется каждый день, начинай с самой дешёвой модели линейки и поднимайся вверх только там, где результат реально не устраивает. На потоке разница между Luna и Sol это разница в пять раз по счёту, а по качеству на простых задачах её часто вообще не видно.
Что выбрать под свою задачу
Формула лета 2026: одной лучшей модели больше нет, есть правильная модель под конкретную работу и бюджет. Выбирай по задаче, а не по месту в рейтинге.
- Тексты, письма, разбор документов каждый день. Любая подписка за 20 долларов закроет всё. Claude Sonnet 5 и GPT-5.6 Terra тут одинаково хороши, спор между ними подробно разобран в гайде Claude против ChatGPT.
- Код и агентные задачи. Claude Opus 5 или GPT-5.6 Sol. Если работа сводится к починке багов в большом проекте, смотри на Claude: разрыв на SWE-Bench Pro в 15 пунктов слишком большой, чтобы его игнорировать.
- Объём и автоматизация. Gemini 3.6 Flash по цене вне конкуренции, плюс лучший результат по управлению компьютером.
- Свежие новости и обсуждения. Grok 4.5 за счёт прямого доступа к ленте X.
- Картинки с русским текстом. Qwen-Image-3.0, если найдёшь доступ, либо привычные ChatGPT Image и Midjourney.
- Свой сервер и приватные данные. Kimi K3 или Inkling, но с трезвым пониманием, что железо под них стоит как хорошая машина.
Чек-лист: что у тебя теперь есть
- Полный список моделей, вышедших за июнь-июль 2026, с датами и авторами.
- Цены по API в долларах и рублях, чтобы прикинуть бюджет до первого платежа.
- Понимание, что ни одна западная модель не открывается с российского IP, и три рабочих пути обойти это.
- Развилка выбора под задачу: текст, код, объём, новости, картинки, свой сервер.
- Понимание, почему сравнение «какая модель лучше» без указания задачи бессмысленно: Sol и Fable 5 меняются местами на разных тестах.
Проверь, что твоя текущая подписка уже даёт доступ к новым моделям. У Anthropic, OpenAI и Google летние релизы вошли в существующие тарифы без доплаты, и многие продолжают работать на прошлом поколении просто потому, что не переключили модель в списке.
По материалам обзора релизов июля 2026 на Analytics Vidhya: July 2026 AI Model Releases. Цены и результаты тестов приведены по состоянию на конец июля 2026, проверяй актуальные на сайтах сервисов.
Рассылка
Подпишись на еженедельную рассылку
Полезные материалы и скиллы, которые усилят твою работу с нейросетями и помогут больше зарабатывать. Раз в неделю, без воды и спама.
человек уже подписались
Готово! Ты в списке.
Первое письмо придёт в ближайшую рассылку. Отписка в один клик.
Частые вопросы
Какие нейросети вышли летом 2026?
За июнь-июль вышли Claude Fable 5, Sonnet 5 и Opus 5 от Anthropic, GPT-5.6 от OpenAI в трёх версиях Sol, Terra и Luna, Gemini 3.6 Flash от Google, Grok 4.5 от xAI, генератор картинок Qwen-Image-3.0 от Alibaba и две открытые модели с весами: Kimi K3 от Moonshot и Inkling от лаборатории Thinking Machines.
Какая нейросеть сейчас самая сильная?
Единого победителя нет. GPT-5.6 Sol лидирует в индексе агентного кодинга Artificial Analysis на 2,8 пункта, при этом Claude Fable 5 берёт 80 процентов на SWE-Bench Pro против 64,6 у Sol. Claude Opus 5 сильнее всех по совокупности цены и результата, а Gemini 3.6 Flash выигрывает по стоимости массовых задач.
Какие из новых нейросетей работают из России без VPN?
Напрямую с российского IP не работает ни одна из западных: Anthropic, OpenAI, Google и xAI блокируют доступ. Без VPN к ним заходят через российские агрегаторы вроде BotHub и MashaGPT, которые перепродают те же модели за рубли. Китайские Kimi и Qwen открываются из России чаще, но регистрация всё равно требует зарубежный номер.
Сколько стоит новая нейросеть в рублях?
Подписка на уровне Claude Pro или ChatGPT Plus стоит 20 долларов в месяц, это примерно 1700-1900 рублей через сервис-посредник. По API миллион входных токенов Claude Opus 5 и GPT-5.6 Sol стоит около 450 рублей, а Gemini 3.6 Flash дешевле втрое, примерно 135 рублей за тот же миллион.
Стоит ли переходить на новые модели или остаться на старых?
Переходить стоит, если ты уже платишь подписку: новые модели входят в тот же тариф без доплаты. По API переход выгоден почти всегда, потому что летние релизы дали либо ту же цену при большем результате, как у Opus 5, либо прямое снижение цены, как у Gemini 3.6 Flash.