MyGeneLog 팀 · 수정됨 2026년 9월 8일 · 15 · 학습용
이 자료는. 실제 유전학 데이터로 만든, 바로 쓸 수 있는 통계 수업안입니다. 어느 학교·칼리지·대학에서나 자유롭게 쓰고 고치실 수 있습니다. 저희에게서 살 것도, 계정도, 누구에게서든 수집하는 데이터도 없습니다.
2002년, 유전학에는 입 밖에 내고 싶지 않은 문제가 하나 있었습니다.
연구자들은 십 년 동안 어떤 질환의 그럴듯한 용의자로 보이는 유전자를 고르고, 그 유전자의 변이가 환자에게 더 흔한지 건강한 사람과 비교하고, 답이 통상적인 기준인 p < 0.05 아래로 나오면 발표했습니다. 그렇게 보고된 양성 연관이 600건이 넘었습니다.
그러다 네 명의 연구자가 앉아서 그중 무엇이 살아남았는지 확인했습니다. 독립적인 연구진이 세 번 이상 검증한 연관 166건 가운데, 일관되게 재현된 것은 6건이었습니다.
6건. 166건 중에서.
아무도 속이지 않았습니다. 그 연구들은 전부 통계학 입문 수업이 가르치는 바로 그 기준을, 올바르게 적용했습니다. 문제는 기준 쪽이었고, 앞으로 한 시간은 그 이유에 대한 것입니다.
이 수업에서는 누구의 몸에 대한 것도 수집하지 않으며, 수집해서도 안 됩니다. 이 활동이 동전을 쓰는 것은 의도된 것입니다. 학생 본인의 유전 정보나 건강, 가족에 대해 묻지 마십시오 — 심화 활동으로도, 숙제로도, 익명으로도 안 됩니다. 숫자가 필요하면 교실을 세십시오. 명단은 절대 만들지 마십시오. 학생이 자기 유전 정보를 스스로 이야기한다면 그것은 그 학생의 일이지 학급의 데이터가 아닙니다.
연구 한 건의 기준은 연구 천 건의 기준이 아니고, 애초에 그런 적도 없었습니다. p < 0.05가 실제로 약속하는 것은 이것입니다. 아무 일도 일어나지 않고 있다면, 이 정도로 강한 결과는 스무 번에 한 번쯤 나온다. 한 번 검사한다면 감수할 만한 위험입니다. 100만 번 검사한다면 그것은 5만 개의 틀린 답을 보장하는 것입니다.
이것이 다중검정 문제의 전부이고, 학생들은 그것을 설명으로 들은 것이 아니라 처음부터 직접 만들어 냈습니다.
그래서 유전학에는 숫자가 필요했습니다. 2008년, 두 연구진이 완전히 다른 방식으로 그것을 찾아 냈습니다. 그리고 이 부분은 학생들이 거의 듣지 못하는 이야기입니다.
한쪽은 세었습니다. 유전체에서 가까이 있는 위치들은 함께 유전되기 때문에, 검사한 위치 300만 개는 독립적인 검정 300만 회와는 거리가 멉니다. 국제 HapMap 자료를 바탕으로, 이들은 실제 검정 부담을 유럽계에서 약 100만 회의 독립 검정으로 추정했고 — 아프리카계에서는 그 두 배로 보았습니다. 아프리카계 유전체가 변이를 더 많이 지니고, 그 변이가 덩어리로 함께 움직이는 정도는 덜하기 때문입니다. 0.05를 100만으로 나누면 정확히 5 × 10⁻⁸가 나옵니다.
다른 쪽은 측정했습니다. 이들은 웰컴트러스트 환자-대조군 컨소시엄의 실제 유전형 자료를 가져와, 질환 표지를 무작위로 뒤섞어 어떤 신호가 나오든 잡음일 수밖에 없게 만든 뒤, 그 잡음이 얼마나 강해지는지를 기록하고, 표지 밀도를 높여 가며 답이 더 움직이지 않을 때까지 반복했습니다. 외삽으로 얻은 기준값은 7.2 × 10⁻⁸였습니다.
하나는 이론이고 하나는 실측인 두 방법이, 1.5배 안쪽으로 서로 맞았습니다. 학계는 5 × 10⁻⁸로 반올림했고 그 뒤로 계속 그것을 씁니다.
학생들에게 분명히 말해 줄 값어치가 있습니다. 과학의 관행이란 안에서 보면 이렇게 생겼습니다. 누가 내려 준 것도, 증명된 것도 아니고 — 두 번 따져 본 뒤, 각자 자기 것을 고르는 것보다 합의하는 편이 낫기 때문에 합의된 것입니다.
이 사이트는 공개된 GWAS Catalog에서 유전 연관 정보를 자동으로 수집하고, 5 × 10⁻⁸보다 약한 것은 받지 않습니다. 그 필터가 무슨 일을 했는지, 자체 로그에서 센 숫자입니다.
살펴본 연관 기록 3,510건 가운데 1,669건 — 47.5% — 이 p-값 하나 때문에 거절되었습니다. 또 1,559건은 다른 이유로 거절되었습니다. 대립유전자 자료가 깨끗하지 않았거나, 유전자가 지정되지 않았거나, 이미 여기 있는 기록이었습니다. 282건이 페이지가 되었습니다.
절반 가까이입니다. 거절된 기록 하나하나는 공개 데이터베이스에 들어 있는, 발표되고 동료 심사를 거친 결과입니다. 그런데도 이 사이트는 그것을 싣지 않습니다. 학생들이 방금 끌어낸 그 기준이, 그것은 동전이 다섯 번 연달아 앞면이 나온 것일 수도 있다고 말하기 때문입니다.
이 사이트가 싣고 있는 변이 653건은 서로 다른 논문 182편에서 왔고, 그 하나하나가 모두 5 × 10⁻⁸를 넘었습니다.
위의 그림을 다시 보여 주고 학생들끼리 싸우게 두십시오. 연구자들이 지금도 정확히 그러고 있기 때문입니다.
기준은 모두에게 적용되는 하나의 숫자인데, 검정 부담은 모두에게 같지 않습니다. 유럽계 연구가 정말로 독립 검정 100만 회를 하고 있고 아프리카계 연구가 200만 회를 하고 있다면, 5 × 10⁻⁸는 한쪽에는 맞는 기준이고 다른 쪽에는 너무 느슨한 기준입니다. 아프리카계 연구에 더 엄격한 2.5 × 10⁻⁸를 쓰는 것이 더 옳겠지만, 그것은 유전학이 이미 가장 적게 연구해 온 집단의 발견을 발표하기 더 어렵게 만들기도 합니다. 여기에는 순수하게 통계적인 답이 없습니다.
그리고 이 숫자는 지금 교체되고 있는 기술을 기준으로 계산되었습니다. 독립 검정 100만 회는 흔한 변이를 읽는 유전형 칩에 대한 이야기입니다. 전장유전체 시퀀싱은 드문 변이까지, 훨씬 더 많이 읽고, 그래서 기준을 5 × 10⁻⁹ 이하로 내려야 한다는 주장이 있습니다. 다른 쪽은 안전할 만큼 엄격한 기준은 실제 효과를 어떤 표본 크기로도 찾을 수 없게 만들 만큼 엄격하다고 답합니다.
두 주장 모두 살아 있습니다. 그림과 20분이 있는 학급은, 지금 논쟁하는 사람들과 똑같은 정보를 가지고 있는 것입니다.
1. 기댓값은 (연구 건수 ÷ 16)입니다. 관측값은 그것과 맞지 않을 것이고, 그 차이 자체가 1분쯤 다룰 값어치가 있습니다. 거짓 발견율 위에 표본 변동이 얹혀 있고, 둘이 지금 교실 안에 동시에 있습니다.
2. 기울어진 동전이었다면 실제로 찾을 것이 있었다는 뜻이고, 발견이 전부 거짓은 아니게 됩니다. 이 수업은 귀무가설이 참이라는 것을 안다는 데 기대고 있습니다 — 실제 연구가 결코 알 수 없는 바로 그것이고, 이 지점은 답을 내지 말고 남겨 두십시오.
3. “몇 개를 검사했습니까?” 나머지는 전부 여기서 따라옵니다.
4. 기술적인 답이 아니라 강한 답을 기대하십시오. “스무 번에 한 번 일어나는 일은 100만 번 해 보면 반드시 일어난다.”
5. 교정이 기준을 그 설계가 물리적으로 낼 수 있는 최선의 결과보다 아래로 옮겼기 때문입니다. 학생들이 자주 뒤섞는 두 가지를 여기서 갈라 줍니다. 증거의 강도는 연구의 크기에 의해 위가 막혀 있고, 운은 그 한계를 넘지 못합니다.
6. 2/2ⁿ ≤ 5 × 10⁻⁸이려면 2ⁿ ≥ 4 × 10⁷이어야 하므로 n = 26입니다 (2²⁶ = 67,108,864, 곧 2.98 × 10⁻⁸). 더 많이 던진다는 것은 참여자를 더 모은다는 뜻입니다. 도달 가능한 가장 작은 p-값을 움직이는 지렛대는 표본 크기뿐입니다.
7. 계산은 일반화되고 값이 싸며, 측정은 상관 구조를 포함한 실제 데이터의 지저분함을 담습니다. 가정이 서로 다른 두 방법이 일치하는 것은 어느 한쪽보다 값어치가 큽니다 — 이 사이트의 백반증 페이지와 혈압 페이지가 쓰는 것과 같은 논리입니다.
8. 너무 엄격해집니다. 검정들이 상관되어 있으면 실질 검정 수가 표지 개수보다 적으므로, 표지 개수로 나누면 과하게 교정됩니다. 그래서 독립 검정 수를 추정한 것입니다. 잘하는 학생은 이것이 기준을 기술의 성질이 아니라 집단의 성질로 만든다는 것을 알아챌 수 있습니다 — 그것이 10번 질문입니다.
9. 정답이 하나 있는 질문이 아닙니다. 실제로 누가 피해를 보는지 밀어붙이십시오. 거짓 발견은 연구비를 낭비하고 환자에게까지 갈 수 있으며, 놓친 발견은 치료를 십 년 늦출 수 있습니다. 희귀 질환에서는 놓치는 쪽이 대개 더 나쁜 오류이고, 그래서 기준을 조정하는 분야도 있습니다.
10. 가장 어렵고 가장 좋은 질문입니다. 통계에는 깔끔한 답이 있고 그 결과에는 없습니다. 대신 정리해 주지 마십시오. 아무도 꺼내지 않으면, 검정 부담이 더 큰 집단이 애초에 연구 자체가 가장 적은 집단이라는 점을 짚어 주십시오.
11. 진짜 발견도 분명히 함께 사라졌을 것입니다 — 재현된 6건 중 몇 개는 그 크기의 연구에서 유전체 전체 기준을 넘지 못했을 것입니다. 정직한 답은, 학계가 발견의 수를 신뢰도와 맞바꾸었고 그 거래가 그럴 만했다고 판단했다는 것입니다.
자유롭게 쓰십시오. 인쇄하고, 복사하고, 잘라 쓰고, 학습지에 옮기고, 번역하고, 질문을 바꾸십시오. 허락받을 것도 낼 돈도 없습니다. 출처를 밝히신다면 mygenelog.com이면 충분합니다.
수업에 써 보시고 잘 안 되는 부분이 있으면 알려 주십시오 — 저희에게는 감사 인사보다 그 편이 값집니다.
학생 한 명당 동전 하나, 또는 휴대전화. 칠판, 그리고 마지막 부분에 계산기. 주문할 것도 쓸 돈도 없습니다 — 의도한 것입니다. 무언가를 사야 하는 수업안은 결국 수업에서 쓰이지 않습니다.
아닙니다. 활동은 동전과 산수이고, 유전학에 해당하는 부분은 본문에 전부 설명되어 있습니다. 수학이나 통계 선생님이 생물을 가르쳐 본 적 없이 진행할 수 있고, 생물 선생님이 확률을 가르쳐 본 적 없이 진행할 수 있습니다.
전혀 하지 않고, 해서도 안 됩니다. 이 활동이 동전을 쓰는 것은 의도된 것입니다. 학생 본인의 유전 정보나 건강, 가족에 대해 묻지 마십시오 — 심화 활동으로도, 익명으로도 안 됩니다. 숫자가 필요하면 교실을 세시고, 명단은 만들지 마십시오.
0.05를 100만으로 나눈 값이고, 100만은 유럽계 유전체에서 독립적인 검정 횟수로 추정된 수입니다. 다른 연구진이 실제 데이터에 순열 검정으로 기준을 측정해 7.2 × 10⁻⁸을 얻었습니다. 아주 다른 두 방법이 그만큼 가깝게 나왔다는 것이 이 관행이 자리 잡은 이유입니다.