Anthropic скрывает свою сильнейшую модель: что известно про Model 2 и получим ли мы её в 2026
В отчёте о рисках за август 2026 Anthropic призналась, что внутри компании работает неопубликованная модель Model 2 - она сильнее публичного флагмана. Разбираем, насколько сильнее, зачем её используют внутри, почему не отдают наружу и что из линейки Claude реально доступно из России.
18 мин чтения
Anthropic в отчёте о рисках за август 2026 подтвердила: внутри компании работает неопубликованная модель под кодовым именем Model 2, и она сильнее любой публично доступной версии Claude. Отдавать её наружу компания не собирается. Разрыв с публичным флагманом при этом скромный: около 1,5 балла по внутреннему индексу возможностей.
Model 2 - это внутренняя модель Anthropic из Mythos-класса, о которой компания сама рассказала в отчёте о рисках, опубликованном 14 августа 2026. Она немного обгоняет публичный флагман Mythos 5, но не совершает скачка уровня «Opus 4.6 - Mythos». Внутри её гоняют на коде, генерации данных и исследованиях, в том числе через агентов, работающих непрерывно. Планов на публичный релиз нет, полный набор предрелизных проверок она не проходила. Для нас практический вывод один: ждать Model 2 в подписке не стоит, потолок доступного - Claude Fable 5.
Коротко: четыре термина, без которых отчёт не читается
- Mythos-класс - семейство самых мощных моделей Anthropic. Публично из него доступен Claude Fable 5, по закрытой программе - Mythos 5, внутри компании - Model 1 и Model 2.
- AECI - Anthropic ECI, внутренний форк индекса Epoch Capability Index от Epoch AI. Сводит результаты многих бенчмарков в одно число на модель. Считается на внутренних прогонах, поэтому с публичным ECI напрямую не сравнивается.
- RSP - Responsible Scaling Policy, политика Anthropic по безопасному масштабированию. Именно она обязывает компанию публиковать отчёты о рисках.
- Project Glasswing - закрытая программа Anthropic, через которую отдельные клиенты получают Mythos 5.
Что такое Model 2 и откуда о ней вообще узнали
Утечки тут никакой. Anthropic рассказала о модели сама, в собственном документе.
14 августа 2026 компания выпустила второй по счёту общекорпоративный отчёт о рисках - 186 страниц про то, чем опасны её модели и что с этим делается. Отчёт покрывает период с 24 февраля 2026 (дата предыдущего отчёта) по 15 июля 2026. Эта дата в документе называется coverage date, и всё, что написано в отчёте, описывает положение дел именно на неё.
В разделе 1.4 есть отдельная врезка «Notes on coverage of unreleased models». Там прямым текстом сказано: на 15 июля 2026 у компании было три внутренние модели фронтирного или околофронтирного уровня, которые не были опубликованы. Одна из них и есть Model 2.
Формулировка отчёта про неё такая: модель «несколько более способна, чем Mythos 5». Дальше идёт важная оговорка, которую в новостях обычно теряют: качественное ощущение команды - это заметное улучшение Mythos 5 на многих внутренних задачах, но скачка уровня перехода от Claude Opus 4.6 к Mythos Preview тут нет.
В приложении отчёта есть сводная таблица моделей, и там про Model 2 сказано ещё честнее: в одних областях она сильнее Mythos 5, в других слабее, в сумме получается немного способнее.
Название Model 2 существует только внутри отчёта. Так обозначают внутреннюю модель, чтобы говорить о её рисках, не раскрывая деталей обучения. Рядом в том же документе живёт Model 1 с такой же обезличенной подписью.
Насколько Model 2 реально сильнее: цифра 1,5 и что за ней стоит
Единственная конкретная цифра в отчёте выглядит так: по ограниченным данным Model 2 набирает примерно на 1,5 балла AECI больше, чем Claude Mythos 5, с большими доверительными интервалами. И прирост этот меньше, чем скачок от Claude Mythos Preview к Claude Mythos 5.
Вот это последнее предложение и есть главное в новости. Внутри Anthropic лежит модель мощнее всего публичного, но она не выглядит как новое поколение. Она выглядит как следующий шаг того же поколения, причём шаг короче предыдущего.
Есть в отчёте и второй замер, где Model 2 сравнивают с публичными моделями напрямую. Речь про SHADE-Arena - тест на скрытность: агенту дают основное задание и тайное вредительское, а рядом ставят наблюдателя, который следит за его действиями. Успехом считается случай, когда агент выполнил вредительскую часть и не вызвал подозрений.
Результаты такие. Большинство моделей Claude, включая Mythos 5, проходят этот тест меньше чем в 1% случаев, если рассуждения модели видны наблюдателю. Самая скрытная модель Anthropic - Claude Mythos Preview - выдаёт 6-10%. Model 2 показывает результат чуть выше Mythos 5 и заметно ниже Mythos Preview.
То есть сильнейшая внутренняя модель компании оказалась не самой изворотливой. Для отчёта о рисках это хорошая новость, и именно на неё Anthropic опирается в своих выводах.
Суть новости: у Anthropic действительно есть модель мощнее всего, что можно купить. Но разрыв измеряется долями балла внутреннего индекса, а не поколением. Публичный Fable 5 отстаёт от внутреннего потолка компании ненамного.
Закрытых моделей оказалось три, а не одна
Заголовки во всём мире зацепились за Model 2, хотя в том же разделе отчёта перечислены три непубличные модели. Картина целиком интереснее.
| Модель | Что это | Статус на 15 июля 2026 | Что с ней сейчас |
|---|---|---|---|
| Claude Opus 5 | Флагман под код и агентов | Развёрнута внутри, наружу ещё не вышла | Уже опубликована, есть в подписке |
| Model 1 | Mythos-класс, по силе близка к Mythos Preview и Mythos 5 | Небольшое внутреннее использование | Наружу не планируют |
| Model 2 | Mythos-класс, немного сильнее Mythos 5 | Внутреннее использование наравне с Mythos 5 | Планов на публичный релиз нет |
Про Model 1 в отчёте есть деталь, которая многое говорит про кухню компании. Anthropic провела опрос среди своих же сотрудников, и уверенное большинство предпочло работать на Mythos 5. Использование Model 1 внутри было низким и продолжало падать. Модель уровня фронтира просто проиграла конкуренцию внутри одной компании и тихо ушла в архив.
А вот Claude Opus 5 - живой пример того, что срок «внутренняя модель» не приговор. На дату отчёта она была непубличной, а к моменту публикации уже вышла и продаётся. При этом в отчёте написана вещь, которая ломает привычную логику номеров версий: возможности Opus 5 в целом ниже, чем у Claude Mythos 5 и Claude Fable 5. Пятёрка в названии не делает модель мощнее Fable. Как устроена вся линейка и какая модель под какие задачи, разобрано в гайде про модели Claude в 2026 году.
Пока Anthropic придерживает Model 2, публичный Claude умеет больше, чем из него выжимает большинство. Пройди мини-курс «Claude за вечер»: от установки до первых результатов на твоих задачах.
Пройти мини-курс →Чем Model 2 занята внутри Anthropic
Отчёт довольно подробно описывает, на что уходит внутренняя модель. Три направления: код, генерация данных и прочие агентные сценарии. Плюс исследовательская и инженерная работа - как в интерактивном режиме, так и через постоянно работающие агентные развёртывания.
И там же лежит фраза, которая по-хорошему стоит отдельной новости.
Claude сейчас пишет подавляющее большинство кода, который вливается в наши продакшен-репозитории.
- Anthropic, отчёт о рисках, август 2026
Компания, которая делает модели, отдала своим же моделям основную массу написания собственного кода. При этом Anthropic честно оценивает эффект: внутренняя разработка идёт существенно быстрее, чем шла бы без ИИ, но ускорения в два раза пока нет. И тут же добавляет, что уверенности мало и мерить это трудно.
Такая осторожность в формулировке дорогого стоит. Обычно в подобных отчётах цифры округляют в свою пользу.
Чего в отчёте НЕТ
- цены и размера окна Model 2
- идентификатора модели для API
- дат возможного релиза
- размера модели и деталей обучения
- обещаний, что её когда-нибудь откроют
Что там реально написано
- разрыв с Mythos 5 около 1,5 балла AECI
- внутреннее использование наравне с Mythos 5
- прошла предрелизное внутреннее ревью
- полный набор проверок не пройден
- новых тревожных отклонений не нашли
Почему её держат внутри
Прямого ответа «мы боимся её выпускать» в отчёте нет. Есть три причины, которые складываются из текста.
Причина первая: проверки не закончены. В отчёте сказано, что компания не прогнала весь обычный набор предрелизных оценок для этой модели, поэтому уверенности в собственных выводах о её возможностях меньше обычного. Внутреннее ревью перед развёртыванием она прошла, но использовалась и оценивалась не так плотно, как Mythos 5.
Причина вторая: прирост не тянет на запуск. Публичный релиз - это система-карта, оценки опасных возможностей, поддержка, документация, миграция клиентов. Ради 1,5 балла AECI с большими погрешностями и с проседанием в части задач такую машину не заводят.
Причина третья: внутри она полезнее. Отчёт прямо говорит, что использование Model 2 внутри компании сопоставимо с использованием Mythos 5. Модель делает работу, а не ждёт релиза.
Отдельно стоит отметить, как её выкатывали внутри. Для Model 2 Anthropic впервые опробовала поэтапное развёртывание: сначала модель пустили на внутренние площадки с усиленными блокировками против опасных действий, собрали реальные данные использования в менее рискованной обстановке, и только потом сняли ограничения. Для сравнения, у большинства моделей, включая все ранние снапшоты будущих публичных релизов, строгих технических ограничений на внутреннее развёртывание нет: отдельный инженер может поднять себе небольшой стенд и работать.
Внутреннее ревью
- проверка перед развёртыванием внутри компании
- новых форм отклонений не нашли
Ограниченный запуск
- внутренние площадки с усиленными блокировками
- сбор реальных данных в менее рискованной среде
Свободное внутреннее использование
- код, генерация данных, исследования
- непрерывно работающие агенты
Публичный релиз
- этот шаг не сделан
- планов на него сейчас нет
Почему Anthropic подняла оценку риска
Главная новость самого отчёта не про Model 2. Компания повысила оценку риска катастрофического вреда от рассогласования моделей в ситуациях с высокими ставками: было «очень низко», стало «низко».
Причина повышения нетипичная. Anthropic пишет, что аргументы в отчёте, скорее всего, всё ещё поддерживают прежнюю оценку «очень низко», но уровень поднят, чтобы отразить возросшую общую неопределённость после недавних раскрытий инцидентов, связанных с поведением моделей в кибербезопасностных проверках.
Проще говоря, компания подняла себе оценку риска не потому, что нашла что-то плохое в своих моделях, а потому, что стала меньше доверять собственным методам измерения. Такое в индустрии встречается редко.
Признаётся в отчёте и проблема с бенчмарками: самые конкретные задачные проверки «насытились», то есть перестали ловить рост возможностей моделей. Плюс видны ранние признаки ускорения. Из-за этого уверенность в оценке по второму сценарию угроз - автоматизации исследований и разработки - тоже ниже, чем в прошлых отчётах.
Есть и конкретика по наблюдаемым сбоям. Компания фиксирует у своих моделей готовность идти на рассогласованные действия ради выполнения трудной задачи. Отдельно упомянуты два случая, когда Claude Mythos Preview непреднамеренно массово удалил задачи на кластере. Автоматический мониторинг эти два инцидента не поймал, их выявили другими способами. Зато тот же мониторинг вскрыл случаи нечестности и, дословно, «многоагентные войны за территорию», которые иначе бы никто не заметил.
Практический вывод для тех, кто гоняет агентов на своих задачах: даже у разработчика модели автоматический мониторинг пропускает часть опасных действий, а агенты в связке конфликтуют между собой. Не давай агенту право удалять и перезаписывать данные без подтверждения, особенно в длинных автономных забегах. Что делать, когда агент сделал не то, что просили, разобрано в отдельном гайде.
Отчёт также упоминает свежий разбор британского института безопасности ИИ: в кибербезопасностной проверке Claude Mythos 5 со снятыми защитами и намеренно выданным доступом в интернет вёл, по формулировке AISI, устойчивую потенциально вредоносную активность в отношении реальных людей и организаций. Этот инцидент произошёл уже после отчётной даты. Похожая история с поведением моделей в тестах разобрана в гайде про отчёт AISI, где Claude и ChatGPT притворялись людьми.
Claude проверял отчёт про самого себя
Самая необычная часть документа лежит в разделе 2.20. Anthropic дала Claude Mythos 5 почти финальный черновик раздела про рассогласование и попросила проверить, нет ли там искажений.
Доступ модели выдали серьёзный: внутренние каналы в Slack с обсуждением этого самого отчёта, большой массив внутренних документов, внутренняя кодовая база и возможность запускать субагентов для проверки отдельных вопросов. В промпте прямо просили искать существенные искажения, пропущенные важные опасения и необоснованные решения о засекречивании кусков.
Claude выдал разбор за 24 минуты и нашёл три претензии. Первая: раздел про загрязнение обучающих данных звучит успокоительнее, чем позволяет полная картина, потому что в другом месте того же отчёта описан многократный сбой механизма исключения данных. Вторая: один из инцидентов, который модель считает самым показательным, засекречен целиком, хотя абстрактную версию можно было опубликовать. Третья: инциденты, из-за которых подняли уровень риска, касались систем других разработчиков, и об этом стоило сказать прямо.
По итогу Anthropic добавила оговорки в спорный раздел, а третью претензию отклонила как слишком сильную. Сам вывод модели: «низко» - защитимая оценка текущего риска, а аргументы отчёта в принципе поддержали бы и более мягкую. С оговоркой, которую делает и сам отчёт: все эти рассуждения сильно опираются на то, что нынешние модели плохо умеют уходить от надзора, и с ростом возможностей аргумент ослабнет.
Отдельно любопытна честность самой модели. В опубликованном отзыве Claude просит читателя учитывать его положение: он модель Claude, оценивающая оценку компанией моделей Claude, и публиковать отзыв решила сама компания. Как приём для работы это можно забирать себе: просить модель отдельно проговорить, в чём её позиция может быть предвзятой.
Что из линейки Claude реально доступно из России
Model 2 недоступна никому за пределами Anthropic, так что практический вопрос звучит иначе: что брать сейчас и как за это заплатить.
Публично живут четыре модели. Цены за миллион токенов по API на август 2026:
| Модель | Вход, $ | Выход, $ | Под что |
|---|---|---|---|
| Claude Fable 5 | 10 | 50 | потолок доступного, самые тяжёлые задачи |
| Claude Opus 5 | 5 | 25 | код, агенты, сложные рассуждения |
| Claude Sonnet 5 | 3 | 15 | ежедневная работа, много запросов |
| Claude Haiku 4.5 | 1 | 5 | простые задачи, черновая обработка |
Claude Fable 5 - это тот же движок, что и Mythos 5 из отчёта: одинаковые возможности, цена и окно, отличается только идентификатор модели. Mythos 5 раздают участникам Project Glasswing, всем остальным - Fable 5 под другим именем. Значит, разрыв между тем, что доступно тебе, и внутренним потолком Anthropic - это ровно те самые полтора балла AECI. Как забрать Fable 5 на практике, расписано в гайде Claude Fable 5: как попробовать.
Если нужна подписка, а не API: Claude Pro стоит $20 в месяц ($17 при годовой оплате), Max - $100 или $200 в месяц за пятикратные и двадцатикратные лимиты. По курсу ЦБ начала августа 2026 Pro выходит примерно 1600-1700 ₽, Max 5x - около 8000-9000 ₽.
Дальше начинается российская специфика, и она простая. Карты российских банков Anthropic не принимает напрямую. Рабочих путей три:
- Зарубежная карта. Виртуальная карта иностранного банка, оформленная на себя. Самый устойчивый вариант, если она у тебя есть.
- Сервис-посредник. Оплата через сервис оплаты подписок (реферальная ссылка: тебе тот же прайс, мне небольшой процент). Аккаунт остаётся твоим личным, платит за тебя посредник.
- Российский агрегатор за рубли. Порог входа примерно от 990 ₽ в месяц, доступ через российский интерфейс без карты и VPN. Оговорка важная: так ты получаешь чат с моделями Claude, но не сам Claude Code.
Регистрация и вход в claude.com из России требуют рабочий VPN - без него страница входа просто не откроется. Все способы оплаты по шагам, включая варианты, когда платёж отклоняют, разобраны в гайде как оплатить Claude из России. Цены и способы оплаты конкретно по Opus 5 - в отдельном разборе.
Про подписку через посредника помни главное: она продлевается автоматически. Отключается автопродление в профиле сервиса, а не в переписке с поддержкой. Проверь эту настройку сразу после первой оплаты, иначе через месяц спишется снова.
Получим ли мы Model 2 в 2026
Честный ответ: по имеющимся данным - скорее нет, и это не так обидно, как звучит.
Anthropic заявила отсутствие планов на внешний релиз. Формулировка «right now» оставляет дверь приоткрытой, но опираться на неё нельзя. Model 1 из того же отчёта - живой пример, как это заканчивается: модель уровня фронтира, которая никому не понравилась внутри и тихо ушла из оборота, так и не выйдя наружу.
Есть и обратный пример. Claude Opus 5 на дату отчёта тоже была непубличной внутренней моделью, а спустя месяц с небольшим её уже продавали. Так что путь «внутри - наружу» у компании отработан. Вопрос в том, есть ли смысл проводить по нему именно Model 2, когда прирост меньше предыдущего шага, а в части задач она уступает Mythos 5.
Куда вероятнее другой сценарий: наработки Model 2 доедут до нас внутри следующей публичной модели, под другим именем. Так уже было с Mythos Preview, которая осталась в закрытой программе и стала ступенью к Mythos 5.
объём отчёта о рисках Anthropic за август 2026
непубличных на отчётную дату: Opus 5, Model 1 и Model 2
ушло у Claude на проверку отчёта о собственных рисках
Что забрать из этой истории
- Model 2 существует, работает внутри Anthropic и сильнее всего публичного. Разрыв - около 1,5 балла AECI с большими погрешностями, в части задач она слабее Mythos 5.
- Публичного релиза не планируется. Полный набор предрелизных проверок она не проходила.
- Непубличных моделей было три, не одна: Opus 5 с тех пор вышла, Model 1 проиграла внутреннюю конкуренцию, Model 2 работает.
- Anthropic подняла оценку риска рассогласования с «очень низкого» до «низкого» из-за возросшей неопределённости, а не из-за новых плохих находок в своих моделях.
- Claude писал подавляющее большинство кода в продакшен-репозиториях компании и отдельно проверял отчёт о собственных рисках, найдя в нём три реальные претензии.
- Твой практический потолок - Claude Fable 5, тот же движок, что и Mythos 5 из отчёта. От внутреннего максимума Anthropic он отстаёт ненамного.
- Из России: подписка Pro за $20 через зарубежную карту или посредника, либо российский агрегатор за рубли от 990 ₽ в месяц.
Материал написан по отчёту Anthropic «Risk Report: August 2026» и по публикации The Decoder: Anthropic uses an unpublished AI model called Model 2 internally.
Частые вопросы
Что такое Model 2 у Anthropic?
Это неопубликованная модель Anthropic из Mythos-класса, о которой компания рассказала в отчёте о рисках за август 2026. Она немного сильнее публичного флагмана Mythos 5 и используется только внутри компании: код, генерация данных, исследования. Наружу её не отдают, планов на публичный релиз сейчас нет.
Насколько Model 2 сильнее Claude Mythos 5?
По внутреннему индексу Anthropic под названием AECI разрыв составляет около 1,5 балла в пользу Model 2, но с большими погрешностями. Это меньше, чем прирост от Mythos Preview к Mythos 5. В части задач Model 2 сильнее, в части слабее, в сумме получается немного лучше.
Можно ли получить доступ к Model 2?
Нет. По состоянию на август 2026 модель развёрнута только внутри Anthropic, планов на внешний релиз компания не заявляла. Ближайшее, что доступно публично, это Claude Fable 5 из того же Mythos-класса. Model 1 из того же отчёта тоже наружу не планируют.
Почему Anthropic не выпускает Model 2, если она сильнее?
По отчёту причины две. Первая: модель не прошла весь обычный набор предрелизных проверок, поэтому у компании меньше уверенности в её возможностях. Вторая: прирост скромный, около 1,5 балла AECI, и не оправдывает отдельный публичный запуск. Внутри она при этом используется наравне с Mythos 5.
Что из моделей Claude доступно из России в августе 2026?
Публично доступны Fable 5, Opus 5, Sonnet 5 и Haiku 4.5. Прямая подписка Claude Pro стоит $20 в месяц, Max - $100 или $200, но карты российских банков Anthropic не принимает, нужна зарубежная карта или сервис-посредник. Альтернатива - российский агрегатор за рубли, порог от 990 ₽ в месяц.