Формулировка спора и место публикации. [факт] Прямая полемика в Transportation Research Part A: Policy and Practice (2018–2019): Love, P. E. D. & Ahiaga-Dagbui, D. D. (2018, 2019) против Flyvbjerg и 13 соавторов (2018) — «Five things you should know about cost overrun»; обе стороны спора 2018 года теперь прочитаны первичкой живьём (см. ниже); дальнейший раунд (Love & Ahiaga-Dagbui 2019) не добыт. В доме проекта прочитаны первичкой также более ранние и более поздние работы Flyvbjerg (2002, 2006, 2021).
[спорно — сторона 1] Тезис: перерасход мегапроектов объясняется не случайной ошибкой сметы, а сочетанием оптимистического искажения (когнитивное) и стратегического искажения — намеренного занижения (политическое); «cognitive bias is only half the story; political bias is the other half» (Flyvbjerg 2021, абстракт, txt_Flyvbjerg_2021_TopTenBiases.txt, через первичка проекта).
Опора: Flyvbjerg, Holm & Buhl (2002), 258 проектов на $90 млрд, txt_Flyvbjerg_2002_underestimating_costs.txt — заголовок прямо ставит вопрос «Error or Lie?». Средний перерасход 28% (sd 39%), по типам — ж/д 45%, мосты/тоннели 34%, дороги 20%; 9 из 10 проектов недооценены; «70 лет без обучения» — систематика не убывает со временем. Решающий статистический аргумент против гипотезы «просто честная ошибка»: «if the inaccuracy of cost estimates were simply a matter of incomplete information and honest errors... one would expect cost inaccuracies to be random or close to random, with overestimates occurring about as frequently as underestimates. We explicitly tested this thesis and falsified it at an overwhelmingly high level of statistical significance (p < 0.001)» (Flyvbjerg et al. 2002: 286–287).
Что признаёт эта сторона у оппонента — см. ниже, раздел «Ответ первой стороны»: частичное согласие с методологическим возражением о базовой линии измерения.
[факт — первичка прочитана живьём] Love, P.E.D. & Ahiaga-Dagbui, D.D. (2018). Debunking fake news in a post-truth era: The plausible untruths of cost underestimation in transport infrastructure projects. Transportation Research Part A, 113, 357–368 (далее LAD18; авторы — инженеры-строители, Curtin/Deakin, не психологи). Тезис прямо заявлен как критика ложной дихотомии: «The bifurcation of the cost underestimation problem into error or lie presents a false dichotomy — an either/or choice that is practically invalid when juxtaposed with the real-world nature of procuring large infrastructure assets» (LAD18, с. 21 файла).
[претензия к выборке Flyv02] Оспаривают репрезентативность датасета 258 проектов: «The dataset in Flyvbjerg et al. (2002) comprises 258 transport infrastructure projects: 58 rail, 167 roads and 33 bridges and tunnels... drawn from a sample constructed between 1910 and 1998 from 20 countries and five continents» (с. 10) — и заявляют расчёт требуемого объёма выборки: «the optimum sample size should have been 383» (окрестности с. 12–13).
[финальный вывод авторов] «It is quite likely that this status quo will continue unless facts and evidence are used to establish the causal nature of cost underestimation… there is need for these estimates to be based on reality and not on delusion or falsehoods» (с. 23–24) — LAD18 не заявляют, что проблема перерасхода решена их объяснением, а требуют более строгой доказательной базы для причинного вывода в обе стороны.
[факт — первичка прочитана живьём] Flyvbjerg, B. et al. (14 соавторов, включая соавторов оригинальных датасетов). Transportation Research Part A, 118, 174–190 (далее F18b). Тезис абстракта: «Good practice entails: (a) Consistent definition and measurement of overrun… (c) Recognition that cost overrun is systemically fat-tailed… (d) Acknowledgment that the root cause of cost overrun is behavioral bias… (e) De-biasing cost estimates with reference class forecasting… Bad practice is characterized by violating at least one of these five points. Love and Ahiaga-Dagbui violate all five» (с. 1, abstract).
[ответ на претензию к выборке] «Population size does not matter, when the population is considerably larger than the sample size… any sample size will do when significance has been shown… This means that our dataset has a size that is big enough to show what we have shown, with p-values less than 0.05, and even 0.001 and smaller for our main results» (с. 6).
[признание собственной оговорки — важно для баланса] «the lack of representativeness means there is a conservative bias in our data, i.e., cost overrun in the project population is likely to be higher than cost overrun in the sample» (с. 5–6) — Flyvbjerg сам признаёт ограничение выборки, но трактует его как консервативное смещение, не как повод отвергнуть вывод.
[про базовую линию измерения — прямое частичное согласие] «We agree that if you want to measure the performance of contractors... then the baseline at contracting is the right choice. However, this is not what we wanted to measure in our studies» (F18b, файл без маркеров страниц, точный номер не размечен).
Что реально устояло — по обоим первичным текстам. [факт] Базовая линия измерения — методологически обоснована с обеих сторон: Flyvbjerg признаёт правоту LAD18 для вопроса о качестве исполнения контракта, но настаивает на другой базе для вопроса о качестве решения о старте. [факт] Расчёт LAD18 требуемого размера выборки (383) Flyvbjerg называет статистической ошибкой («Population size does not matter», с. 6) — контраргумента по существу LAD18 не приводит. [факт] Ни один текст не отменяет саму полевую закономерность — спор идёт о причине и границах применимости, не о факте недооценки. [гипотеза] Спор в значительной части остаётся спором о периметре измерения, не только о причинах.
Внутреннее противоречие корпуса Flyvbjerg (для баланса стороны 1). [факт] В 2005 году (World Bank WP 3781) Flyvbjerg отвергал оптимизм как главную причину недооценки (по сырью BudgetBusters, раздел 0.2) — позиция менялась во времени, от отрицания оптимизма (2005) к формуле «половина на половину» (2021); это эволюция позиции автора, не слабость текущей версии.
Reference class forecasting как продукт спора. [факт] Flyvbjerg (2006) описывает институциональный ответ — независимую от намерений решающего базу сравнимых проектов (Green Book 2003, DfT с 2004); на 172 дорогах 40% проектов уложились в ≤10% перерасхода, 80% — в ≤32% (с. 11–12). Граница метода — при активном стратегическом искажении «barriers are high» (с. 16–17): чем сильнее политическая составляющая, тем слабее это институциональное противоядие.
(б) Процедура. Единственная процедура с институциональным внедрением — reference class forecasting: надбавка к смете по эмпирическому распределению перерасходов сопоставимых проектов (Flyvbjerg 2006, см. ПР-06 Взгляд извне и reference class forecasting). Граница, названная самим автором: при сильном стратегическом искажении барьеры для честной надбавки высоки (с. 16–17); постфактум-проверка — открытый вопрос (ОВ-03 Сбылся ли reference class forecasting).
(в) Среда. Чем выше ставки и политизированнее одобрение проекта (публичные мегапроекты, конкуренция за бюджет), тем труднее отличить когнитивную ошибку от намеренного занижения. По данным Flyvbjerg (2002) конкурентная борьба за ограниченный бюджет — именно та среда, где занижение систематическое и статистически неслучайное.
(г) Организация. [факт] Из спора о периметре измерения вытекает конкретный вопрос: кто в организации отвечает за то, ЧТО именно измеряется как «перерасход» — бюджет на момент решения о старте или на момент подписания контракта; это определяет, какая часть организации окажется ответственной за цифру перерасхода.
2026-09-12 2026-09-14 обе стороны спора 2018 года переписаны по первичке: Love & Ahiaga-Dagbui (2018) и Flyvbjerg et al. (2018) добыты и сверены по и ; статус повышен 🟡→🟢 обе стороны; по выжимке добытчика, оригинал сверен. Обновлена соответствующая строка в ИС-07 Стратегическое искажение strategic misrepresentation.
отвечено 0 из 3
1. Каким статистическим аргументом сторона Flyvbjerg отвергает гипотезу «перерасход — следствие честных ошибок сметы»?
2. В чём сторона Flyvbjerg прямо признаёт правоту критиков (Love & Ahiaga-Dagbui)?
3. Как менялась позиция Flyvbjerg по вопросу optimism bias между 2005 и 2021 годом, по прочитанным в проекте первичкам?