← Все статьи

Миллион токенов и фоновые субагенты: что поменялось этим летом

Разбор · август 2026

Два обновления конца июня и начала июля выглядят техническими мелочами, а на деле меняют сам способ работы с агентом в терминале. Первое — контекстное окно на миллион токенов стало не опцией, а нормой. Второе — субагенты перестали останавливать разговор и ушли работать в фон.

Окно, в которое влезает проект

Раньше работа с большой кодовой базой сводилась к искусству нарезки. Агенту показывали три файла из сорока, он делал разумную правку в этих трех и ломал что-то в остальных тридцати семи — просто потому, что не знал об их существовании. Половина промптинга была про то, чтобы вовремя подсунуть нужный кусок.

Миллион токенов не отменяет нарезку, но убирает ее из повседневности. Средний сервис целиком помещается в окно вместе с историей обсуждения. Вопрос «а где это еще используется» перестает требовать отдельного захода с поиском по репозиторию.

Что при этом не изменилось: большое окно не делает модель внимательнее. Чем длиннее контекст, тем легче в нем утонуть — и середина длинного разговора по-прежнему помнится хуже начала и конца. Мусор в контексте остается мусором, только теперь его влезает в разы больше.

Субагенты, которые не ждут

Субагент — это отдельный исполнитель со своим контекстом: ему дают задачу, он уходит ее делать и возвращает результат. Удобно тем, что тонны прочитанных файлов остаются у него, а в основной разговор попадает только вывод.

Проблема была в том, что запуск субагента останавливал все. Отправил разбирать логи — сиди и жди, даже если параллельно есть чем заняться. С июля они работают в фоне по умолчанию: основной агент продолжает работать и забирает результаты, когда те готовы. Долгие задачи можно доверить не глядя — и получить уведомление по завершении, вплоть до открытого pull request.

Практическая разница видна на любом разборе: пока один субагент вычесывает историю коммитов, второй проверяет тесты, а вы обсуждаете с основным агентом архитектуру. Раньше это были три последовательных ожидания.

Где это перестает помогать

Соблазн понятный: раз субагентов можно запускать пачками, давайте раскидаем на них все. На практике быстро упираешься в три вещи.

Что стоит поменять в привычках

Первое: перестать экономить контекст там, где это больше не нужно. Показывать проект целиком дешевле, чем угадывать нужные три файла и потом чинить последствия.

Второе: заводить субагента там, где работа требует много чтения и дает короткий ответ. Разбор логов, поиск по репозиторию, сверка версий — идеальные кандидаты: тысячи строк остаются у него, к вам приходит вывод.

Третье: писать задание субагенту как письмо новому человеку, а не как реплику в продолжающемся разговоре. Он читает только то, что вы написали, и ничего не знает о том, что обсуждалось до.