Как только задач становится больше одной, встаёт вопрос не о скорости агента, а о вашем внимании. Окно агентов объединяет несколько сессий, несколько рабочих пространств, рабочие деревья и общий обзор изменений в одном месте. Рядом живут два инструмента управления вниманием: побочный чат для короткого вопроса, который не должен раздувать основной контекст, и поиск по прошлым разговорам. Вместе они превращают набор бесед в управляемую структуру, где у каждой ветки есть своё назначение, а не просто своя вкладка.
Наивная практика - вести всё в одном чате. Он растёт, в нём смешиваются задача, разведка, случайные вопросы и решения, и через час никто уже не помнит, какие предположения были отвергнуты, а какие приняты. Модель тоже: длинная история сжимается, и в сжатие уходит именно то, что казалось очевидным и потому не повторялось. Один бесконечный разговор - это не экономия, а способ потерять и контекст, и след решений: восстанавливать их придётся по diff, то есть по результату, из которого не видно причин.
Правильная модель проще. Основной чат ведёт одну связную задачу. Побочный - разведочный вопрос в стороне, чтобы не сбивать линию. Новый агент - отдельная область работы со своим состоянием. Очередь сообщений - следующий шаг той же задачи, а не параллельная ветка. Поиск по разговорам - способ вернуться к прошлому объяснению, а не гарантия, что старые факты всё ещё верны. Все пять механизмов различаются одним признаком: переживёт ли результат закрытие вкладки и нужен ли ему тот же контекст, что и текущей работе.
Полезно один раз свести эти механизмы в таблицу с колонкой не используйте как. Ниже такая карта. Именно правая колонка полезнее всего: она называет типичные подмены, из-за которых механизм перестаёт работать - бесконечный журнал вместо чата задачи, важное решение, оставленное в побочном разговоре, ожидание, что новый агент сам узнает выводы соседнего.
| Механизм | Использовать для | Не использовать как |
|---|---|---|
| Основной чат | Решение одной связной задачи | Бесконечный журнал проекта |
| Побочный чат | Короткое исследование или уточнение | Место для важного решения без переноса результата |
| Поиск по разговорам |
| Возврат к прошлому объяснению |
| Гарантию, что старые факты всё ещё верны |
| Сообщение в очереди | Следующий шаг той же задачи | Параллельную независимую ветку |
|---|
| Новый агент | Отдельная область и отдельное состояние | Автоматическую синхронизацию выводов между агентами |
|---|
Выбор между очередью и новым агентом решается одним вопросом, и его стоит задавать вслух. Агент правит модуль авторизации, а вы замечаете опечатку в соседнем экране. Если правка опирается на тот же контекст - те же файлы, те же уже принятые решения, - это следующий шаг той же задачи, и ему место в очереди. Если она самостоятельна, ей нужен отдельный агент со своим состоянием, иначе вы разбавите контекст текущей работы посторонним и получите два наполовину сделанных дела вместо одного законченного.
У побочных чатов есть тонкость, которая решает всё. Это полноценные долгоживущие разговоры, и это их достоинство: разведка не засоряет основную линию. Но если результат разведки повлиял на реализацию, его нужно перенести - в основной разговор, в план, в задачу трекера или в документацию репозитория. Иначе решение останется в ветке, которую закроют и заархивируют, и через неделю никто не вспомнит, почему сделано именно так. Переносить стоит не пересказ, а вывод вместе с основанием: что проверяли, что нашли, почему выбрали этот вариант.
Поиск по разговорам полезен ровно как архив, а не как источник истины. Он находит, где вы уже это обсуждали, и экономит повторное исследование. Но найденное объяснение относится к состоянию репозитория и продукта на тот момент. Сверять его с текущим кодом - обязательный шаг, иначе вы принесёте в сегодняшнюю задачу вывод, который был верен три релиза назад. Особенно коварны здесь объяснения устройства системы: они звучат как знание о предметной области, хотя описывают конкретную реализацию, которую с тех пор могли переписать.
У параллельности есть цена, и платит её человек. Пропускная способность ограничена не числом агентов, а вашей способностью читать их результаты: каждая ветка требует просмотра diff, проверки и решения о слиянии. Признак, что вы перешли эту границу, узнаётся легко - готовые изменения копятся непросмотренными, а diff принимаются по объёму и уверенному тону отчёта, а не по содержанию. С этого момента параллельность не ускоряет работу, а откладывает её, и лечится это уменьшением числа одновременных веток, а не более быстрой моделью.
Инженерный вывод про параллельность внимания простой: чем больше окон, тем важнее договориться, что в каком живёт. Одна задача - один основной чат; разведка - в сторону; независимая работа - в отдельного агента со своим состоянием; итоги - наружу, в место, которое переживёт сессию. Эта дисциплина стоит пары минут и экономит часы на восстановлении контекста.
Типичные провалы предсказуемы. Растить один чат до состояния, где в нём смешано всё. Оставить важное решение в побочном разговоре и потерять его вместе с контекстом. Считать найденное в поиске объяснение актуальным без сверки с кодом. Открыть больше веток, чем успеваете просматривать. И ждать, что параллельные агенты сами синхронизируют выводы друг друга.