Ручка queue_status обещает в докстроке «worst-case latency ≈ 600 ms even if no
worker is reachable» — ради этого celery inspect уносили в поток под дедлайн
0.8 с, и #2927 починил там executor, который сводил защиту на нет.
Но следом шёл третий шаг — проба глубины очереди — СИНХРОННО и без таймаута
вовсе:
with celery_app.connection_or_acquire() as conn:
with conn.channel() as channel:
queue_depth = channel.client.llen("celery")
По висящему сокету (не «connection refused», а чёрная дыра) это не возвращается
никогда. То есть обещание докстроки ломалось на последнем шаге, и ручка, которую
админ-UI опрашивает по таймеру, висела столько, сколько висел брокер.
Проба уходит в тот же пул под тот же дедлайн. Отправляется ДО чтения результатов
inspect, а не после: иначе к моменту её старта бюджет уже израсходован, и ей
достаётся только нижняя граница max(0.1, ...).
Существующий тест на зависание брокера этот случай не покрывал — в нём `llen`
мгновенный, виснут только inspect'ы.
Двусторонняя проверка ПО ВРЕМЕНИ: на origin/main ручка возвращается за 3.01 с
(ровно длительность искусственного зависания), с правкой — меньше 2 с. Тест
дополнительно требует queue_depth is None: не смогли измерить — отдаём None, а не
выдуманный ноль.
pytest -k "admin_scrape or queue or 2464c": 35 passed, 1 skipped, rc=0
pytest tests/api/v1: 354 passed, 1 skipped, rc=0
Тест перепрогнан после правок pre-commit ruff-format.