fix(ptica): границы правдоподобия у средней цены конкурента (#2464-D) #2863
No reviewers
Labels
No labels
Fable 5 ревью
GG-форсайт
admin
analytics
auth
automation
bug
business
chore
ci
compliance
data
data-moat
docs
duplicate
dx
enhancement
feedback/max
generative
needs-discussion
needs-human
observability
pause-bots
performance
priority/p0
priority/p1
priority/p2
priority/p3
scope/backend
scope/db
scope/devops
scope/frontend
scope/qa
scrapers
security
site-finder
stage/1
stage/2
status/blocked
status/done
status/needs-analysis
status/needs-fix
status/qa
status/ready
status/review
status/wip
tech-debt
tradein
ux
week ревью 1
wontfix
ИРД
вторичка
No milestone
No project
No assignees
1 participant
Notifications
Due date
No due date set.
Dependencies
No dependencies set.
Reference: lekss361/gendesign#2863
Loading…
Add table
Reference in a new issue
No description provided.
Delete branch "fix/2464-price-sanity-bounds"
Deleting a branch is permanent. Although the deleted branch may continue to exist for a short time before it actually gets removed, it CANNOT be undone in most cases. Continue?
Что
obj_pricingвanalyze_parcelсчитаетAVG(price_per_m2_rub)по проекту и отдаётэто в карточку конкурента и дальше в
market_avg_price(среднее средних) — на экран.Границ правдоподобия у среднего не было, хотя в двух соседних запросах по этой же
таблице
objective_lotsони стоят:BETWEEN 30000 AND 600000.Замер на проде 13.08 — через тот же путь, что и продукт
Считал не «по всей таблице», а как считает продакшен: physflat-дедуп (
DISTINCT ONпо
project_name, corpus_name, section, floor, lot_number) + маппинг наdomrf_obj_id.Эффект сегодня малый, и я это не прячу. Раньше в этой ветке я насчитал «26 проектов
из 890, худший в 24 раза» — это был замер по неверной популяции: все
project_nameцеликом, без дедупа и без маппинга, включая 573 проекта, которые до экрана не доходят.
Правильная цифра — 6 из 308 и 2.4%.
Зачем тогда чинить
Потому что ограничения сверху нет по построению. Среднее считается по проекту, поэтому
один лот держит группу: максимум в таблице — 19 198 429 ₽/м², и он вне экрана
исключительно потому, что «Дебют» пока не замаплен. Замаплено 308 имён из 881, список
пополняется. Одна строка маппинга — и это число уезжает в
market_avg_price.Как
AVG(...) FILTER (WHERE ... BETWEEN 30000 AND 600000)— FILTER, а неWHEREна CTE:строки нужны целиком, иначе границы цены молча урезали бы
units_sold/units_available, которые считают ВСЕ лоты.lots_with_priceтеперь считает ту же популяцию, что кормит среднее (было: любыене-NULL цены) — иначе счётчик обещает выборку шире, чем участвовала.
Проверка
Живого прогона SQL по данным в наборе нет: интеграционный харнесс ПТИЦЫ
(
tests/integration/test_analyze_parcels_sql.py) делает только EXPLAIN против прод-PG(parse+plan, без scan). Поэтому проверка двухсторонняя, но на уровне текста запроса —
test_price_avg_has_sanity_bounds. Двусторонность проверена прогоном тех же утвержденийпротив
main:Числовая проверка — прод-A/B выше (старое и новое выражение на одних данных).
pytest tests/api/v1/test_analyze_competitors_status.py— 13 passedruff check— cleangendesign-postgres-1Шум в диффе
Три хунка в тесте — не мои:
pre-commitпинит ruff v0.7.4, а вbackend/.venvruff 0.15.12, и они расходятся в форматировании assert-сообщений. Хук переформатировал
нетронутые строки.
ruff format --checkв CI намеренно не гейт (ci.yml:210), так чтоэто косметика — но пин стоит подтянуть отдельно.
Refs #2464