← Lessons

Запуск эксперимента

Урок ~15 мин после постановки

Постановка готова. Осталось запустить карточку и смотреть ход на дереве.

Коротко: что делать

  1. На доске метода скопируйте путь к отчёту карточки (кнопка «скопировать путь»).
  2. Вставьте путь в чат с помощником и дайте одну из фраз ниже.
  3. На дереве следите за колонкой карточки и живым окном (лупа у метода). Пока идёт прогон — лучше молчать; вмешивайтесь, только если помощник спрашивает или видите явный сбой.

Короткий прогон:

Выполни карточку по пути:
<вставьте путь>

Сценарий koi-execute-card: сразу в работу, по подзадачам, в конце — готово.

Долгий / удалённый прогон:

Системное исследование по карточке:
<вставьте путь>

Сценарий koi-card-autoresearch: руководитель → исследователь → дебаггер.

1. Какой сценарий выбрать

Оба пути работают с одной карточкой на доске метода. Разница — в длине прогона и в том, сколько агентов следят за ходом.

Выполнение карточки Автоисследование
Сценарий koi-execute-card koi-card-autoresearch
Когда Минуты–часы в одной сессии; локальный или короткий прогон Часы–сутки; удалённый прогон (job); нужен мониторинг и разбор сбоев
Кто делает Один помощник: и запуск, и правки, и отчёт Три роли: руководитель, исследователь, дебаггер
Фраза «Выполни карточку …» «Проведи системное исследование по карточке …» / «автоисследование»

Автоисследование не заменяет выполнение карточки. Канбан, подзадачи в отчёте и колонка «готово» по-прежнему ведутся по koi-execute-card. Автоисследование добавляет поверх этого каркаса роли и расписание наблюдения.

2. Короткий прогон: выполнение карточки

Сценарий koi-execute-card — закон доски: статус карточки и галочки в отчёте двигаются вместе с работой, а не «в конце для красоты».

flowchart TD
  A[Найти карточку] --> B[Сразу: очередь → в работе]
  B --> C[Читать постановку и подзадачи]
  C --> D[Делать эксперимент по подзадачам]
  D --> E[Отмечать сделанное в отчёте]
  E --> F[Записать результаты]
  F --> G[В колонку готово]
  G --> H[Сформулировать вывод]
      
  1. Первое действие — в работу. Как только карточка найдена в очереди (backlog), её переносят в колонку «в работе» (running) до чтения отчёта и запуска кода.
  2. По ходу — галочки в §3. Подзадачи живут только в разделе постановки отчёта. Закончили пункт по критерию из строки — сразу отметили и сохранили файл. Не копить галочки «на финиш».
  3. Результаты в §4 и дальше. Таблицы и графики, которые обещали в постановке; явный отказ, если пункт не сделан («не выполнено, потому что …»).
  4. Последнее действие — готово. Когда все подзадачи отмечены и выводы записаны — колонка «готово» (done) до ответа человеку и сценария вывода.

Пример фразы:

Выполни карточку <название или id> в проекте <проект> целиком:
сразу перенеси в работу, сам проведи эксперимент по подзадачам,
отмечай прогресс по ходу, в конце — готово и вывод.

Пока карточка в работе, в интерфейсе у метода есть «лупа»: живое окно. Помощник может указать путь к хвосту лога, папку с графиками и короткую заметку о ходе (live_log, metrics_dir, live_note). Интерфейс (UI) читает это с диска — без отдельного потока событий.

3. Долгий прогон: автоисследование

Сценарий koi-card-autoresearch нужен, когда прогон длинный или удалённый и один хаотичный чат уже не тянет: кто-то должен стартовать карточку, кто-то крутить удалённый прогон (job) и смотреть пульс, кто-то только разбирать сбои — без права тихо править код.

Три роли

Роль Делает Не делает
Руководитель Один раз: карточка в работу, поля живого окна, файл состояния (state), передача исследователю Не запускает обучение, не чинит код
Исследователь Старт прогона (job) через скилл проекта, если есть; наблюдение по расписанию; галочки в §3; вызов дебаггера; в конце — готово Не меняет чужой код без явного одобрения человека
Дебаггер Читает логи и монитор ресурсов; пишет рекомендацию в файл состояния Не правит файлы и не перезапускает прогон (job)

Как это работает по времени

flowchart TD
  U[Запрос пользователя] --> M[Руководитель: в работу + живое окно + state]
  M --> R[Исследователь: старт прогона]
  R --> W[Наблюдение: часто в начале, реже потом]
  R --> D[Дебаггер: плановый разбор]
  W -->|сбой| I[Внеплановый вызов дебаггера]
  I --> D
  D -->|рекомендация в state| W
  W -->|готово| F[Отчёт + готово + вывод]
      
Кто Как часто (по умолчанию) Зачем
Руководитель Один раз в начале Карточка, живое окно, state
Исследователь Каждую минуту × 20, потом каждые 20 минут Пульс прогона (job), заметка о ходе, вызов дебаггера при сбое
Дебаггер Каждые 10 минут + сразу при старте; и по вызову Плановый разбор логов; ранняя ошибка — не ждать таймера

Файл состояния и скилл проекта

Рядом с прогоном лежит небольшой JSON состояния (например state/<проект>-<карточка>.json): статус обучения, последний осмотр исследователя, отложенная рекомендация дебаггера. Исследователь на каждом осмотре читает рекомендацию, применяет или передаёт человеку, затем сбрасывает «ожидает».

Конкретные скрипты запуска, удалённый хост и монитор видеокарты (GPU) задаёт скилл проекта рядом с кодом эксперимента (пример в экосистеме — запуск verl / CrafText). В каталоге ResearcherOS таких скриптов нет: там только роли и расписание. Если скилла проекта нет, исследователь всё равно ведёт расписание вручную и пишет заметку о ходе в карточку или отчёт.

Пример фразы:

Проведи системное исследование по карточке <название или id>
в проекте <проект>: роли руководитель → исследователь → дебаггер,
с мониторингом по ходу.

Запрещено в одном автоисследовании: две карточки сразу; дебаггеру чинить код или перезапускать прогон; руководителю запускать обучение; закрывать «готово» при незакрытых подзадачах без явного отказа в отчёте.

4. После «готово»

  1. Вывод для человека — koi-done-research: вопрос и ответ понятным языком в базу выводов проекта (технические числа — отдельно).
  2. Ревью результатов — koi-report-review на фазе результатов: таблицы и выводы соответствуют обещаниям постановки.
  3. Синхронизация — koi-project-sync, если материалы исследования нужно отправить в репозиторий.
Автоисследование Выполнение карточки Урок: постановка