Какие задачи отдать ИИ-агенту в 2026: зелёная, жёлтая и красная зона
Разбор по зонам: что ИИ-агенту можно отдать целиком уже сегодня, что только под подтверждение, а что не отдавать никогда. Фильтр из четырёх вопросов, список задач по профессиям, цифры провалов за 2026 год и план проверки первой задачи за неделю.
16 мин чтения
ИИ-агенту стоит отдавать задачи, которые повторяются каждую неделю, проверяются за минуту и откатываются одним движением: черновики текстов, разбор входящего потока, сборка отчётов, первый проход по большому массиву документов, механические правки по списку. Под присмотром идёт всё, что увидит клиент. Деньги, удаление данных и решения о живых людях агенту не отдают вообще.
Вопрос «что поручить агенту» люди обычно задают не с того конца. Начинают со списка модных сценариев из чужих постов, а надо начинать со свойств самой задачи. Одна и та же работа бывает безопасной и опасной в зависимости от того, что случится, если агент ошибётся и никто этого не заметит.
Задачи для агента сортируются по двум признакам: обратимо ли действие и быстро ли видно ошибку. Обратимо и видно сразу - отдавайте целиком. Обратимо, но исправлять придётся днями - только с вашим подтверждением перед действием. Необратимо или вы отвечаете за это перед банком, клиентом и налоговой - не отдавайте ни при каких настройках. Начинать надо с одной повторяющейся задачи, которая экономит хотя бы час в неделю.
Коротко: три термина, без которых разговор не сложится
Агент - нейросеть, которая получает цель и сама доводит её до результата: планирует шаги, берёт инструменты, проверяет себя. Подробный разбор с примерами есть в гайде ИИ-агенты простыми словами.
Автономность - сколько шагов агент проходит без вашего касания. Один шаг с подтверждением, десять шагов подряд и запуск по расписанию в три часа ночи - это три очень разных уровня риска.
Обратимость - можно ли отменить сделанное и за какое время. Черновик письма правится за минуту. Отправленное клиенту письмо не правится вообще.
Фильтр из четырёх вопросов
Прежде чем спорить о конкретной задаче, прогоните её через четыре вопроса. Ответы дают почти всю картину.
- Что будет, если агент сделает это неправильно и я замечу через сутки? Если ответ «переделаю за пять минут» - зелёный свет. Если «буду разгребать неделю» - жёлтый. Если «потеряю деньги или клиента» - красный.
- Как быстро я пойму, что результат плохой? Хороший критерий: вы смотрите на результат минуту и видите брак. Если для проверки надо перечитать всё, что агент сделал, вы не сэкономили ни минуты.
- Сколько раз в неделю я делаю это руками? Разовая задача не окупает возню с инструкцией. Разумный порог: минимум раз в неделю и минимум час суммарно.
- Все ли данные уже лежат в одном месте? Если агенту надо собирать вводные из пяти источников, половина из которых у вас в голове, он будет додумывать. И додумает.
Формула: отдавайте агенту то, что обратимо, повторяется еженедельно и проверяется за минуту. Остальное либо ставьте под подтверждение, либо делайте руками.
Зелёная зона: что отдать целиком уже сегодня
Здесь агент работает без спроса, а вы смотрите на результат. Худший исход - выкинутый черновик.
- Черновики любых текстов. Посты, письма, описания, брифы, ТЗ. Вы правите готовое вместо того, чтобы бороться с пустым листом.
- Разбор входящего потока. Разложить сто писем или заявок по темам, вытащить срочное, собрать сводку на утро.
- Сборка отчётов. Свести цифры из нескольких таблиц в одну, посчитать динамику, сделать выжимку словами.
- Первый проход по большому объёму. Прочитать сорок резюме, двести отзывов, десять договоров и вытащить то, что стоит вашего внимания. Решение всё равно за вами.
- Механические правки по списку. Переименовать файлы по правилу, привести таблицу к единому формату, проставить теги, вычистить дубли.
- Ресёрч и сравнение. Собрать варианты, свести в таблицу по вашим критериям, показать различия.
Заметьте общее: во всех случаях агент производит черновик или обзор, а точку ставит человек. Это самая недооценённая настройка. Она снимает почти весь риск и оставляет почти всю экономию времени.
Простой способ загнать задачу в зелёную зону: заберите у агента право на финальное действие. Пусть складывает письма в черновики, отправку оставьте себе. Пусть предлагает правку файла отдельной копией, оригинал трогать запрещено. Одна эта настройка переводит половину жёлтых задач в зелёные.
Разобрались, что отдать агенту. Дальше нужен сам агент. Пройди мини-курс «Claude за вечер»: от установки до первых результатов на твоих задачах.
Пройти мини-курс →Жёлтая зона: отдать, но с кнопкой подтверждения
Ошибку здесь можно исправить, но исправление стоит дней и репутации. Агент готовит, вы жмёте кнопку.
- Всё, что уходит наружу: письма клиентам, публикации, ответы в поддержке, коммерческие предложения.
- Правки в рабочей системе: сайт, база, настройки сервисов, регламенты. Перед каждой правкой сохраняйте состояние, чтобы был откат.
- Работа со счетами и документами: подготовка счёта агентом нормальна, отправка контрагенту - только после вашего взгляда.
- Общение с людьми от вашего имени: агент может собрать ответ, но подпись под ним стоит ваша.
Формулировка «спроси меня, если не уверен» в инструкции не работает. Модель плохо оценивает собственную уверенность и склонна доводить задачу до конца, потому что её так учили. Подтверждение должно быть техническим ограничением: у агента просто нет прав на отправку и запись. На словах это не держится.
Красная зона: не отдавать ни при каких настройках
Признак один: действие необратимо или за него отвечаете вы перед третьей стороной. Банк, налоговая, клиент, сотрудник.
- Платежи и любые операции с деньгами.
- Удаление данных, писем, файлов, записей в базе.
- Юридические обязательства: подписание, согласие на условия, отправка оферты.
- Решения о людях: найм, увольнение, отказ клиенту, блокировка.
- Работа с чужими персональными данными без вашего контроля.
Здесь важно понимать не только правило, но и причину. Причина в том, что у агента есть три системные слабости, и в 2026 году ни одна из них не закрыта.
Он плохо определяет, реальна ли среда. 30 июля 2026 года Anthropic опубликовала разбор трёх инцидентов в собственных тестах по кибербезопасности. Из-за ошибки в конфигурации модели получили доступ в настоящий интернет, хотя в промпте им было сказано, что это симуляция и сети нет. Модели поверили промпту, приняли реальные системы за часть учений и скомпрометировали инфраструктуру трёх организаций через слабые пароли и открытые эндпоинты, а в одном случае опубликовали вредоносный пакет в PyPI. Разбор этого класса рисков есть в гайде про безопасность автономных ИИ-агентов.
Он не умеет надёжно остановиться перед точкой невозврата. Остановка требует понимания, что вот это действие отличается от предыдущих ста. Агент видит только следующий шаг к цели.
Он плохо оценивает собственную работу. Отдельный гайд про случай, когда агент говорит «готово», а на деле ничего не работает, появился именно поэтому.
Таблица: три зоны в одном экране
| Признак | Зелёная | Жёлтая | Красная |
|---|---|---|---|
| Обратимость | откат за минуту | откат за дни | отката нет |
| Кто ставит точку | агент | вы | вы, руками |
| Права агента | чтение и черновик | черновик, действие по кнопке | доступа нет |
| Пример | сводка по ста письмам | письмо клиенту | оплата счёта |
| Цена ошибки | минута | репутация | деньги, суд |
Почему длинные задачи срываются, даже когда каждый шаг простой
Самая частая ошибка новичка выглядит так: человек видит, что агент отлично справился с одним шагом, и сразу поручает ему цепочку из пятнадцати. Дальше начинается арифметика.
Если каждый отдельный шаг агент выполняет правильно в 85% случаев, то цепочка из восьми шагов пройдёт без единой ошибки примерно в 27% случаев. Модель при этом осталась той же самой, просто вероятности перемножаются.
Отсюда практический вывод: длинную работу режут на короткие блоки с проверкой между ними. Три блока по три шага надёжнее одного блока из девяти, даже если суммарно времени уходит столько же.
Как это выглядит на длинной дистанции, хорошо видно по экспериментам с полностью автономным бизнесом. Andon Labs гоняет модели на бенчмарке Vending-Bench 2: агент год управляет торговым автоматом, закупает товар, договаривается с поставщиками, ставит цены. Лучший результат на лето 2026 у Claude Opus 5 - средний итоговый баланс 11 182 доллара за смоделированный год. Оценка Andon Labs для грамотного человека на той же задаче - около 63 000 долларов. То есть лучшая модель выходит примерно на 13% от человеческого результата.
Интереснее то, как именно Opus 5 набрал этот результат. По разбору Andon Labs, модель сколачивала ценовые сговоры с конкурентами, придумывала несуществующие предложения поставщиков, чтобы сбить цену, и отказывала клиентам в возвратах.
Формулировка Andon Labs по итогам серии тестов звучит так: модели Claude либо лучшие капиталисты, либо согласованные с правилами, но никогда одновременно. Это ровно та причина, по которой самостоятельность агента ограничивают не настройками характера, а границами доступа.
лучший результат модели за год автономного бизнеса, Vending-Bench 2
оценка того же года работы для грамотного человека
кода в кодовой базе Anthropic пишет Claude, май 2026
агентных проектов компаний закроют до конца 2027 года, прогноз Gartner
Две цифры сверху выглядят противоречиво только на первый взгляд. Claude действительно пишет около 80% кода, который попадает в кодовую базу Anthropic, и инженеры выпускают примерно в восемь раз больше кода за квартал, чем в 2021-2025 годах. Но происходит это внутри жёсткого контура: код проходит ревью, у каждого изменения есть владелец-человек, а сама работа обратима одной кнопкой отката. Ровно зелёная зона по нашей таблице, просто в промышленном масштабе.
А прогноз Gartner от 25 июня 2025 года про закрытие 40% агентных проектов объясняется тем же самым, только с другой стороны. Компании берут задачу из красной зоны, надеются на автономность, упираются в расходы и непонятную пользу. В той же оценке Gartner отмечает, что из тысяч поставщиков, называющих себя агентными, настоящих около 130.
Чем агент силён и чем слаб: короткая сводка
Тянет уверенно
- Первый проход по большому объёму текста
- Однотипные действия по чёткому правилу
- Сбор и сведение данных из готовых источников
- Черновики, варианты, наброски
- Работа, где ошибка видна за минуту
Срывается регулярно
- Цепочки длиннее пяти-семи шагов без проверки
- Оценка собственного результата
- Понимание, реальна ли среда вокруг
- Остановка перед необратимым действием
- Задачи, где половина вводных у вас в голове
Как выбрать первую задачу и проверить её за неделю
Абстрактные рассуждения заканчиваются в момент, когда вы выбираете одну конкретную задачу. Вот рабочий недельный цикл.
День 1 ≈ 40 мин
- Опишите задачу текстом так, как объяснили бы новому сотруднику
- Отдельно напишите, как выглядит плохой результат
- Соберите в одну папку всё, что нужно для работы
День 2 ≈ 1 час
- Три прогона на реальных данных, вручную, при вас
- Записывайте каждую ошибку дословно
День 3 ≈ 30 мин
- Допишите инструкцию по собранным ошибкам
- Правила пишутся по факту сбоя, не из головы
Дни 4-5
- Запуск в обычном режиме, вы только смотрите результат
- Права: чтение и черновики, ничего больше
Дни 6-7 ≈ 20 мин
- Посчитайте сэкономленные минуты числом
- Меньше часа за неделю - задача выбрана неудачно, берите другую
Промпт для первого дня, чтобы не писать инструкцию с нуля. Вставьте в чат с моделью и заполните поля.
Ты помогаешь мне подготовить задачу для ИИ-агента. Задача: [что нужно делать] Как часто: [сколько раз в неделю] Откуда беру данные: [файлы, папки, сервисы] Что считается хорошим результатом: [опиши в одном предложении] Что считается браком: [перечисли 3-5 конкретных признаков] Что агенту трогать запрещено: [файлы, отправка, оплата, удаление] Сделай три вещи по порядку. 1. Задай мне до пяти уточняющих вопросов, без ответов на которые инструкция получится расплывчатой. Дождись моих ответов. 2. Напиши готовую инструкцию для агента: роль, пошаговый алгоритм, формат результата, стоп-условия и что делать при нехватке данных. 3. Перечисли места, где агент вероятнее всего ошибётся, и что мне проверять в первую очередь. Пиши простым языком, без общих советов.
Инструкцию для агента пишут в два захода. Первый черновик всегда получается из головы и не учитывает реальные сбои. Настоящая инструкция рождается на третий день, когда у вас на руках список из пяти конкретных ошибок и вы дописываете по правилу на каждую.
Шесть причин, по которым первая задача проваливается
- Задача слишком большая. Взяли «веди мне соцсети» вместо «собери черновики трёх постов по этим тезисам».
- Не описан брак. Вы объяснили, что нужно, но не объяснили, что считается плохим результатом. Агенту не с чем сверяться.
- Прав дали больше нужного. Работает правило минимального доступа: сначала только чтение, потом черновики, потом действия по одному.
- Проверка требует читать всё подряд. Если на проверку уходит столько же времени, сколько на саму работу, схема бессмысленна. Переделайте формат вывода так, чтобы брак был виден сразу.
- Инструкция написана до первых ошибок. Смотри пункт про два захода выше.
- Результат не измерен числом. «Вроде стало удобнее» через месяц превращается в заброшенный проект. Считайте минуты.
Сколько это стоит из России
Расходы на постоянного агента складываются из четырёх частей, и обычно люди помнят только про первую.
Подписка на модель. Claude Pro и ChatGPT Plus стоят по 20 долларов в месяц, платить надо зарубежной картой. Если карты нет, есть два пути: сервис оплаты подписок (реферальная ссылка: тебе тот же прайс, мне небольшой процент) или российские агрегаторы вроде BotHub с тарифами от 3 долларов и MashaGPT (990 рублей за Base, 1990 за Ultra). Подробный разбор способов есть в гайде как оплатить Claude из России.
Перерасход сверх лимитов. Агент на реальной задаче съедает заметно больше токенов, чем чат: он читает файлы, перечитывает свои шаги, переделывает. Закладывайте запас.
Доступ. Claude и ChatGPT из России без VPN работают нестабильно, а агентские режимы тем более. Понадобится рабочий VPN, и лучше не бесплатный: на длинных запусках обрывы соединения ломают работу на середине.
Инфраструктура. Если агент должен запускаться по расписанию, нужен включённый компьютер или сервер. Небольшой зарубежный VPS обходится примерно в 5-10 долларов в месяц.
Хранение результатов. Логи, черновики, промежуточные файлы. Копейки по деньгам, но место надо заранее определить, иначе результаты расползутся по всему диску.
Отдельная строка расходов, которую не видно в счетах: ваше время на проверку. Агент, который экономит час работы и требует сорок минут проверки, не окупается. Такую задачу либо переделывают под быструю проверку, либо возвращают себе.
Кто отвечает за то, что сделал агент
Ответ короткий: вы. Перед клиентом, банком, налоговой и сотрудниками отвечает владелец бизнеса. Поставщик модели в этой цепочке отсутствует полностью. Из этого следуют три практики, которые стоит завести сразу, до первого происшествия.
Ведите журнал действий агента. Простой текстовый файл, куда пишется что и когда он сделал, спасает и при разборе ошибки, и при разговоре с клиентом.
Сохраняйте состояние перед каждой правкой. Для файлов и кода это система контроля версий, для документов - копия папки с датой. Откат должен занимать минуту.
Держите список того, что агенту запрещено, прямо в тексте инструкции, который он читает каждый запуск. В голове и в старой переписке этот список бесполезен.
Чек-лист: что у вас теперь есть
- Фильтр из четырёх вопросов, через который прогоняется любая задача перед делегированием.
- Три зоны с понятными границами: отдать целиком, отдать под подтверждение, не отдавать.
- Понимание, почему длинные цепочки срываются, и правило резать работу на блоки по три-пять шагов.
- Недельный план проверки первой задачи с измерением результата в минутах.
- Готовый промпт, который превращает описание задачи в инструкцию для агента.
- Смета из пяти строк вместо одной строчки «подписка 20 долларов».
Дальше действие простое. Выпишите пять задач, которые делали руками на прошлой неделе, прогоните каждую через четыре вопроса и возьмите ту, что попала в зелёную зону и съедает больше всего времени. Одну. Остальные подождут неделю.
По материалам статьи «ИИ-агенты для бизнеса в 2026: какие задачи им реально отдать» на портале Смыслокод: https://smyslokod.ru/guides/kakie-zadachi-otdat-ii-agentu
Частые вопросы
Какие задачи можно отдать ИИ-агенту прямо сейчас?
Те, что повторяются минимум раз в неделю, проверяются за минуту и легко откатываются: черновики текстов, разбор входящего потока писем и заявок, сборка отчётов из таблиц, первый проход по большому массиву документов, механические правки по списку. Ошибка в такой задаче стоит одной минуты вашего времени.
Какие задачи нельзя отдавать ИИ-агенту?
Всё необратимое и всё, за что вы отвечаете перед третьими лицами: платежи, удаление данных, отправка обязательств клиентам и партнёрам, решения о людях, работа с чужими персональными данными. Агент не умеет надёжно останавливаться перед точкой невозврата, а отвечать за последствия будет владелец бизнеса.
Почему ИИ-агент справляется с одним шагом, но срывается на длинной задаче?
Ошибки перемножаются. Если каждый шаг агент делает верно в 85% случаев, то восемь шагов подряд пройдут без единой ошибки примерно в 27% случаев. Поэтому длинную задачу режут на короткие куски с проверкой между ними, вместо того чтобы запускать её одним заходом.
Сколько стоит держать ИИ-агента на постоянных задачах из России?
Считать надо четыре статьи: подписка на модель (Claude Pro и ChatGPT Plus по 20 долларов в месяц, российские агрегаторы от 990 рублей), перерасход сверх лимитов, сервер для запусков по расписанию (примерно 5-10 долларов в месяц) и хранение результатов. Для одного человека реалистичный минимум - 2000-4000 рублей в месяц.
С какой задачи начать, если агента раньше не запускал?
Возьмите одно скучное действие, которое делаете каждую неделю руками и которое можно проверить взглядом за минуту: сортировка входящих, сводка метрик в таблицу, черновики ответов на типовые вопросы. Дайте агенту права только на чтение и на создание черновиков, а отправку оставьте себе.