Запуск эксперимента
Постановка готова. Осталось запустить карточку и смотреть ход на дереве.
Коротко: что делать
- На доске метода скопируйте путь к отчёту карточки (кнопка «скопировать путь»).
- Вставьте путь в чат с помощником и дайте одну из фраз ниже.
- На дереве следите за колонкой карточки и живым окном (лупа у метода). Пока идёт прогон — лучше молчать; вмешивайтесь, только если помощник спрашивает или видите явный сбой.
Короткий прогон:
Выполни карточку по пути:
<вставьте путь>
Сценарий koi-execute-card: сразу в работу, по подзадачам, в конце — готово.
Долгий / удалённый прогон:
Системное исследование по карточке:
<вставьте путь>
Сценарий koi-card-autoresearch: руководитель → исследователь → дебаггер.
1. Какой сценарий выбрать
Оба пути работают с одной карточкой на доске метода. Разница — в длине прогона и в том, сколько агентов следят за ходом.
| Выполнение карточки | Автоисследование | |
|---|---|---|
| Сценарий | koi-execute-card | koi-card-autoresearch |
| Когда | Минуты–часы в одной сессии; локальный или короткий прогон | Часы–сутки; удалённый прогон (job); нужен мониторинг и разбор сбоев |
| Кто делает | Один помощник: и запуск, и правки, и отчёт | Три роли: руководитель, исследователь, дебаггер |
| Фраза | «Выполни карточку …» | «Проведи системное исследование по карточке …» / «автоисследование» |
Автоисследование не заменяет выполнение карточки. Канбан, подзадачи в отчёте и колонка «готово» по-прежнему ведутся по koi-execute-card. Автоисследование добавляет поверх этого каркаса роли и расписание наблюдения.
2. Короткий прогон: выполнение карточки
Сценарий koi-execute-card — закон доски: статус карточки и галочки в отчёте двигаются вместе с работой, а не «в конце для красоты».
flowchart TD
A[Найти карточку] --> B[Сразу: очередь → в работе]
B --> C[Читать постановку и подзадачи]
C --> D[Делать эксперимент по подзадачам]
D --> E[Отмечать сделанное в отчёте]
E --> F[Записать результаты]
F --> G[В колонку готово]
G --> H[Сформулировать вывод]
- Первое действие — в работу. Как только карточка найдена в очереди (backlog), её переносят в колонку «в работе» (running) до чтения отчёта и запуска кода.
- По ходу — галочки в §3. Подзадачи живут только в разделе постановки отчёта. Закончили пункт по критерию из строки — сразу отметили и сохранили файл. Не копить галочки «на финиш».
- Результаты в §4 и дальше. Таблицы и графики, которые обещали в постановке; явный отказ, если пункт не сделан («не выполнено, потому что …»).
- Последнее действие — готово. Когда все подзадачи отмечены и выводы записаны — колонка «готово» (done) до ответа человеку и сценария вывода.
Пример фразы:
Выполни карточку <название или id> в проекте <проект> целиком:
сразу перенеси в работу, сам проведи эксперимент по подзадачам,
отмечай прогресс по ходу, в конце — готово и вывод.
Пока карточка в работе, в интерфейсе у метода есть «лупа»: живое окно.
Помощник может указать путь к хвосту лога, папку с графиками и короткую
заметку о ходе (live_log, metrics_dir, live_note).
Интерфейс (UI) читает это с диска — без отдельного потока событий.
3. Долгий прогон: автоисследование
Сценарий koi-card-autoresearch нужен, когда прогон длинный или удалённый и один хаотичный чат уже не тянет: кто-то должен стартовать карточку, кто-то крутить удалённый прогон (job) и смотреть пульс, кто-то только разбирать сбои — без права тихо править код.
Три роли
| Роль | Делает | Не делает |
|---|---|---|
| Руководитель | Один раз: карточка в работу, поля живого окна, файл состояния (state), передача исследователю | Не запускает обучение, не чинит код |
| Исследователь | Старт прогона (job) через скилл проекта, если есть; наблюдение по расписанию; галочки в §3; вызов дебаггера; в конце — готово | Не меняет чужой код без явного одобрения человека |
| Дебаггер | Читает логи и монитор ресурсов; пишет рекомендацию в файл состояния | Не правит файлы и не перезапускает прогон (job) |
Как это работает по времени
flowchart TD
U[Запрос пользователя] --> M[Руководитель: в работу + живое окно + state]
M --> R[Исследователь: старт прогона]
R --> W[Наблюдение: часто в начале, реже потом]
R --> D[Дебаггер: плановый разбор]
W -->|сбой| I[Внеплановый вызов дебаггера]
I --> D
D -->|рекомендация в state| W
W -->|готово| F[Отчёт + готово + вывод]
| Кто | Как часто (по умолчанию) | Зачем |
|---|---|---|
| Руководитель | Один раз в начале | Карточка, живое окно, state |
| Исследователь | Каждую минуту × 20, потом каждые 20 минут | Пульс прогона (job), заметка о ходе, вызов дебаггера при сбое |
| Дебаггер | Каждые 10 минут + сразу при старте; и по вызову | Плановый разбор логов; ранняя ошибка — не ждать таймера |
Файл состояния и скилл проекта
Рядом с прогоном лежит небольшой JSON состояния
(например state/<проект>-<карточка>.json):
статус обучения, последний осмотр исследователя, отложенная рекомендация дебаггера.
Исследователь на каждом осмотре читает рекомендацию, применяет или передаёт
человеку, затем сбрасывает «ожидает».
Конкретные скрипты запуска, удалённый хост и монитор видеокарты (GPU) задаёт скилл проекта рядом с кодом эксперимента (пример в экосистеме — запуск verl / CrafText). В каталоге ResearcherOS таких скриптов нет: там только роли и расписание. Если скилла проекта нет, исследователь всё равно ведёт расписание вручную и пишет заметку о ходе в карточку или отчёт.
Пример фразы:
Проведи системное исследование по карточке <название или id>
в проекте <проект>: роли руководитель → исследователь → дебаггер,
с мониторингом по ходу.
Запрещено в одном автоисследовании: две карточки сразу; дебаггеру чинить код или перезапускать прогон; руководителю запускать обучение; закрывать «готово» при незакрытых подзадачах без явного отказа в отчёте.
4. После «готово»
- Вывод для человека — koi-done-research: вопрос и ответ понятным языком в базу выводов проекта (технические числа — отдельно).
- Ревью результатов — koi-report-review на фазе результатов: таблицы и выводы соответствуют обещаниям постановки.
- Синхронизация — koi-project-sync, если материалы исследования нужно отправить в репозиторий.