# Long-running Agents: архитектура и ограничения

> Короткий ответ: Длинные задачи умирают от трёх причин: нет чекпоинта, ожидание держит процесс, повторы дают другой путь. Лечится журналами шагов, планом отдельно и идемпотентностью.

Агент, работающий минуты, и агент, работающий дни, — это разные архитектуры, а не разный таймаут. Осенью 2026-го длинные траектории стали мейнстримом: модели с генерацией на сотни тысяч токенов за проход и постоянно работающие агенты с облачным компьютером. Длинные задачи умирают предсказуемо: падение без чекпоинта, ожидание человека с висящим процессом, недетерминированные повторы. Разбираем три причины поломок и четыре ответа на них: журнал шагов, план отдельно от исполнения, супервизор и идемпотентность — плюс честные ограничения каждого.

- Категория: Агенты
- Автор: Редакция NormaHub
- Техническая проверка: Техническая проверка NormaHub
- Опубликовано: 2026-10-01
- Обновлено: 2026-10-01

## Три причины смерти длинных задач

Первая — нет чекпоинта: падение на шестом часе означает повтор с нуля, а повтор означает дубли всех побочных эффектов — писем, записей, платежей. Вторая — ожидание: человеку нужен день на подтверждение, и всё это время процесс висит, держит память и деньги, а его нельзя ни перенести, ни перезапустить. Третья — недетерминизм: повтор запроса к модели даёт другой путь, и «просто повторить» уже не чинит, а ветвится.

Все три чинятся не try-catch, а архитектурой: состояние пишется по ходу, ожидание не держит ресурсов, повторы проектируются идемпотентными. Конец сентября 2026-го подтвердил диагноз с двух сторон: вышла модель с лимитом генерации под миллион токенов за проход именно под длинные задачи, а постоянно работающие агенты получили облачный компьютер с обязательными подтверждениями опасных действий и безопасным режимом только для чтения. Вывод: проектируйте под длинные траектории уже сейчас — журнал, чекпоинты и подтверждения не зависят от конкретной модели и переживут любой релиз. Если задача короче минут и без внешних эффектов — ничего этого не нужно, хватит обычного цикла с лимитом.



- нет чекпоинта — падение означает повтор с дублями

- ожидание держит процесс и деньги

- повтор даёт другой путь, а не чинит

- длинные траектории — мейнстрим: журнал и подтверждения обязательны

## Журнал шагов и план отдельно

Каждый завершённый шаг — в журнал, продолжение — с последнего; частота — компромисс цены и потерь, ключ сессии обязателен. Упавший шаг повторяется один, соседи не тянутся; недетерминированное — только в шагах, не в восстановлении.

Паттерн «план отдельно»: сильная строит план, слабая исполняет, расхождение чинится перепланом хвоста. Окупается на десятках шагов, вредит на коротких. Признак: один план выполняется много раз с разными данными.



- шаг — в журнал, продолжение — с последнего

- недетерминированное — только в шагах

- сильная планирует, слабая исполняет

- условие окупаемости — один план на много данных

- окупается на десятках шагов

## Супервизор, дедлайны и идемпотентность

Супервизор раздаёт спецам только нужное, итоги — сжато, артефакты — в хранилище со ссылками. Ожидание не держит ресурсов; таймаут с запасным путём, heartbeat короче таймаута операции (иначе падение детектится поздно), дедлайн на задачу; отмена — штатный путь.

Ключ идемпотентности на каждый эффект с проверкой до действия — иначе дубли; «ровно один раз» без журнала — миф. Дробить при сотнях шагов, крае окна, выходе из бюджета; снапшот не чинит изменившийся мир.



- спецам — только нужное, итоги — сжато

- ожидание не держит ресурсов

- ключ до действия, иначе дубли

- дробить при сотнях шагов и крае окна

## Источники

- [Гайд по ошибкам API](/guides/errors)
- [Streaming ответов](/guides/streaming)

## Следующие шаги

- [Зачем субагенты](/company/articles/subagents-zachem-odnomu-agentu-drugie)
- [OpenAI Dots: always-on агенты](/company/articles/openai-dots-always-on-agents)
