← ДашбордКаталог узлов

СП-07. Эффект Даннинга–Крюгера: реальный эффект или статистический артефакт метода

Спор · статус: dev · проверен: 2026-09-14 · база «Когнитивные искажения»
Просто: представьте школьный тест, где считают средний балл по четвертям учеников — самые слабые, послабее среднего, посильнее среднего, самые сильные. Если слабые ученики завышают свою самооценку сильнее, чем сильные — это выглядит как «чем хуже знаешь, тем меньше это понимаешь». Но есть и скучное объяснение: если у слабых учеников вообще больше разброс в оценках себя (просто потому, что их измерили не очень точно), то при усреднении по группам возникает точно такая же на вид картинка — без всякой психологии, из одной только статистики. Новое исследование показало: когда меряют по-другому, без этого статистического фокуса, кривая превращается в почти прямую линию.
Тезис: хрестоматийная форма эффекта Даннинга–Крюгера (некомпетентные систематически переоценивают себя куда сильнее компетентных, кривая нелинейна) — по методологической переоценке Gignac & Zajenkowski (2020) на новых полевых данных (N=929) оказывается «в основном статистическим артефактом» способа измерения (квартильные средние путают эффект «лучше среднего» с регрессией к среднему); связь самооценки и объективного интеллекта в их данных линейна, а не куполообразна, как предсказывает исходная гипотеза; статус спора на 2026 год — открытый, не решённый: последующие работы (по заголовкам, не добыты первичкой) частично оспаривают этот вывод.

Содержание

Формулировка спора. [факт] Gignac, G. E. & Zajenkowski, M. (2020). The Dunning-Kruger Effect Is (Mostly) a Statistical Artefact: Valid Approaches to Testing the Hypothesis With Individual Differences Data. Intelligence, 80, 101449 (txt_Gignac_Zajenkowski_2020_DunningKruger.txt, авторская рукопись, пагинация по копии) — не прямая полемика в одном номере журнала, а методологическая критика классического способа тестирования гипотезы, с последующими ответами других авторов.

Сторона «эффект — в основном артефакт метода» (Gignac & Zajenkowski 2020)

[спорно — сторона 1] Тезис: классический способ демонстрации эффекта (сравнение средних самооценок по квартилям объективной способности) смешивает эффект «лучше среднего» (better-than-average) с регрессией к среднему; при корректных статистических тестах на полевых, не студенческих данных эффект в предсказанной криволинейной форме не обнаруживается.

Опора: «On the basis of a sample of 929 general community participants who completed a self-assessment of intelligence and the Advanced Raven's Progressive Matrices, we failed to identify statistically significant heteroscedasticity, contrary to the Dunning-Kruger hypothesis» (рукопись с. 2, абстракт) — выборка «general community participants», не студенческая. Ключевой результат — линейность вместо предсказанной криволинейности: «the association between objectively measured intelligence and self-assessed intelligence was found to be essentially entirely linear, again, contrary to the Dunning-Kruger hypothesis» (с. 2); статистически — «The hierarchical multiple regression failed to identify a statistically significant quadratic effect, R²change < .01, F(1, 926) = .37, p = .545» (с. 18). Корреляция самооценки и объективного интеллекта — «r = .28, which is comparable to the meta-analytically estimated correlations reported in the literature (r = .33; Freund & Kasten, 2012)» (с. 19) — то есть связь есть и сопоставима с литературой, просто она линейна, а не криволинейна, как требует исходная гипотеза.

Оговорка самих авторов (не полное отрицание феномена): «It is concluded that, although the phenomenon described by the Dunning-Kruger hypothesis may be to some degree plausible for some skills, the magnitude of the effect may be much smaller than reported previously» (с. 2). Отдельно авторы прямо ограничивают охват собственного аргумента: «some research interpreted to be supportive of the Dunning-Kruger hypothesis is experimental in nature (e.g., Nguyen, 2018). Consequently, the statistical artefact account... may not apply to those investigations» (с. 24) — критика касается корреляционных дизайнов вроде оригинального Kruger & Dunning (1999), не экспериментальных подтверждений эффекта.

Сторона «эффект недооценён предыдущей критикой» (Dunkel et al. 2023 — по первичке; Hiller 2023 — честно по пересказу пересказа)

[факт — первичка прочитана живьём] Dunkel, C. S., Nedelec, J. L. & van der Linden, D. (2023). Reevaluating the Dunning-Kruger Effect: A Response to and Replication of Gignac and Zajenkowski (2020). Intelligence, 96, 101717 (далее D23). Оригинал Gignac & Zajenkowski (2020) на своей выборке (>50% студентов + сообщество) «более корректными» методами теста на гетероскедастичность не получил значимого эффекта; D23 повторяют ТУ ЖЕ процедуру на репрезентативной выборке Add Health (национальная лонгитюдная выборка США, участники — 7–12 классы в 1994 г., аналитическая подвыборка n=13 977, 46,9% мужчины, объективный IQ по отсечке ≥64 балла). Результат: «our analyses illustrated a statistically significant DK effect. However, the magnitude of the effect was minimal; bringing its meaningfulness into question» (D23, с. 1, abstract) — ANOVA F(3, 13973)=1757,04, p<.0001, ηp²=0,27 по IQ-группам; тест на гетероскедастичность (Glejser) — r=−0,07, p<.0001, 95% ДИ [−0,087, −0,054] (слабая, но значимая корреляция). Претензия к выборке оригинала: «while the sample used by Gignac and Zajenkowski included community members, over 53% of the sample still included undergraduate students. Thus, their sample likely had a positively [skewed distribution]» (с. 4). Оговорка о смысле малого эффекта: добавление кубического члена в регрессию «increased the explained variance in self-assessed intelligence by 1.1%» (с. 4) — эффект статистически значим, но практически ничтожен.

[Hiller 2023 — честно, статус ниже обычного 🟡: пересказ ПЕРЕСКАЗА] Полный текст Hiller недоступен — заблокирован Cloudflare-антибот-проверкой на всех трёх проверенных площадках (PDXScholar, PhilArchive×2), дословных цитат нет. По стороннему пересказу (через ответ Gignac 2023 «Still no Dunning-Kruger effect: A reply to Hiller», не читан напрямую): Hiller утверждает, что гомоскедастичность, которую Gignac & Zajenkowski приняли за признак отсутствия эффекта, вероятно — артефакт их решения перекодировать самооценку сравнительного IQ в линейную шкалу, и предлагает альтернативное преобразование.

Что реально устояло — по доступным материалам. [факт] На репрезентативной выборке (не студенческой) при тех же «более корректных» методах эффект Даннинга–Крюгера статистически значим (D23), но крайне мал по величине (прирост объяснённой дисперсии — 1,1%) — это не опровержение критики Gignac & Zajenkowski, а уточнение: артефакт метода объясняет БОЛЬШУЮ часть эффекта, не весь. [гипотеза, по вторичному изложению] Hiller указывает на отдельную методическую уязвимость самой критики 2020 года (перекодировка шкалы) — но это не проверено первичкой в доме проекта, статус ниже 🟡.

Бриф для ЛПР

(б) Процедура. Прямого противоядия спор не даёт — методологический вопрос статуса эффекта, не интервенция. Расхожая фраза «чем некомпетентнее человек, тем увереннее он в себе» надёжной опоры в хрестоматийной форме не имеет: на репрезентативной выборке эффект есть, но статистически ничтожный (D23) — использовать её как решённый факт в кадровых решениях — брак.

(в) Среда. Критика Gignac & Zajenkowski направлена на корреляционные, не экспериментальные исследования («may not apply to those investigations», с. 24) — если конкретное подтверждение получено экспериментальным дизайном, критика может не относиться напрямую; проверка источника нужна в каждом случае.

(г) Организация. [гипотеза] Организационная практика, часто оправдываемая эффектом Даннинга–Крюгера («самые некомпетентные сотрудники сопротивляются обратной связи сильнее всех»), опирается на спорный эмпирический статус самого феномена — прямого организационного вывода из этого спора вывести нельзя, только предупреждение о хрупкости популярной опоры.

Связан с

Источники

Открытые хвосты

Проверен на дату

2026-09-12 2026-09-14 добавлена и сверена по первичка Dunkel et al. (2023): значимый, но исчезающе малый эффект на N≈14 тыс.; Hiller (2023) остаётся закрыт (честно понижен статус, пересказ пересказа); по выжимке добытчика, оригинал Dunkel сверен.

Вопросы

отвечено 0 из 3

1. В чём, по Gignac & Zajenkowski (2020), заключается методологическая проблема классического способа демонстрации эффекта Даннинга–Крюгера, и что они нашли на выборке N=929?

Ответ: (б). Раздел «Сторона „эффект — в основном артефакт метода“», цитата с. 18–19.

2. Что показал Dunkel et al. (2023), повторив методы критики Gignac & Zajenkowski на репрезентативной выборке Add Health (N≈14 тыс.)?

Ответ: (а). Раздел «Сторона „эффект недооценён…“», D23 с. 1 и 4.

3. Каков статус этого спора в узле — закрыт он или открыт?

Ответ: (в). Раздел «Что реально устояло» и «Открытые хвосты».
Дашборд Каталог узлов Наверх ↑