|
All checks were successful
CI Trade-In / changes (pull_request) Successful in 10s
CI Trade-In / backend-tests (pull_request) Has been skipped
CI Trade-In / browser-tests (pull_request) Has been skipped
CI / changes (pull_request) Successful in 12s
CI Trade-In / frontend-checks (pull_request) Has been skipped
CI / backend-tests (pull_request) Has been skipped
CI / frontend-tests (pull_request) Has been skipped
CI / openapi-codegen-check (pull_request) Has been skipped
Два разведчика без потолка ушли на 157 и 178 ходов вместо инвентаризации: один вместо списка веток диффал SQL-миграции и разбирал Caddyfile. Третий собрал 17 739 байт в один StructuredOutput, получил InputValidationError и потерял всю работу целиком. Канон уже говорил «~≤20 tool-calls» и «границы: что НЕ делать» — но как ориентир для оркестратора. Агент этого не видит: лимит, оставшийся в голове вызывающего, не ограничивает никого. Отсюда правка — бюджет обязан быть текстом внутри промпта, вместе со списком запрещённого и правилом деградации «отдай что есть, допиши в notes что не успел». Отдельным пунктом — потолок РАЗМЕРА структурированного ответа. Он не следует из лимита токенов: payload больше ~10k символов не парсится, повтор, и работа теряется. Схему надо проектировать под краткость, длинные detail-поля провоцируют ровно этот отказ. Новая секция «Целость результата workflow»: завершившийся прогон не значит успешный — упавшие агенты возвращают null, parallel() их молча проглатывает, а синтез всё равно пишет уверенный текст с числами. Плюс восстановление через resumeFromRunId, диагностика зависшего агента по возрасту записи в agent-*.jsonl, и грабля Windows: перезапись скрипта через python даёт CRLF, запуск отбивается на control characters. |
||
|---|---|---|
| .. | ||
| agents | ||
| commands | ||
| mcp | ||
| rules | ||
| settings.json | ||