어느 날 중1 딸이 진지한 얼굴로 말했습니다. “아빠, 나 천재인 것 같아. 아이큐 검사 해보고 싶어.”
보통의 아빠라면 “그래 그래” 하고 넘어가거나 인터넷에서 무료 테스트를 검색해줬겠죠. 그런데 저는 그만 이렇게 대답해버렸습니다. “검사? 아빠가 만들어줄게.”
내뱉고 나서 조사를 시작했습니다. 이 글은 그 큰소리의 뒷수습 기록입니다.
👉 결과물 먼저: 생각별 IQ 연구소 — 어린이 IQ 테스트
진짜 IQ 검사는 만만한 게 아니었습니다
찾아보니 제대로 된 지능검사(웩슬러 아동용 같은)는 전문가가 일대일로 실시하는 유료 검사였습니다. 개인이 웹에서 흉내 낼 수 있는 영역이 아니에요. 반대로 인터넷에 널린 무료 IQ 테스트들은 문항 출처도, 채점 근거도 불분명한 게 대부분이었고요.
그러다 **ICAR(International Cognitive Ability Resource)**라는 걸 알게 됐습니다. 연구자들이 공동으로 만들어 쓰는 공개형 인지능력 검사 문항 저장소인데, 여기에 **어린이용 버전(Ch-ICAR)**이 있었습니다. 2025년에 벨기에 연구진이 만 10~14세 학생 820명으로 검증한 27문항짜리 검사예요. 영역 구성도 명확했습니다.
| 영역 | 문항 수 | 실제 정답률 |
|---|---|---|
| 언어추론 | 8 | 44% |
| 행렬추론 | 6 | 31% |
| 수열추론 | 7 | 46% |
| 도형유추 | 6 | 37% |
전체 평균이 27점 만점에 10.76점. 또래 아이들이 절반도 못 맞추는, 꽤 어려운 검사라는 뜻입니다. 이거다 싶었죠.
‘공개’와 ‘마음대로 써도 됨’은 다르더군요
그런데 반전이 있었습니다. ICAR는 스스로 공개 자료라고 소개하지만, 실제 문항을 받으려면 연구자 등록과 신청이 필요하고, 라이선스도 **과학적 이용 전용(Scientific Use License)**이었습니다. 이유가 인상적이었어요 — 문항과 정답이 인터넷에 공개되면 검사 자체가 망가지기 때문입니다. 정답을 검색할 수 있는 IQ 테스트는 더 이상 검사가 아니니까요.
그래서 방향을 정했습니다. 원문항은 쓰지 않는다. 대신 연구가 검증한 ‘구조’를 그대로 따른다. 영역 구성(8·6·7·6), 27문항, 난이도 오름차순 배치, 채점 방식까지요. 문항은 전부 직접 만들었습니다.
1차 완성 — 그리고 딸의 심판
시제품은 AI 코딩으로 하루 만에 나왔습니다. 처음엔 OpenAI Codex로 뼈대를 만들었고, 이후 개편은 Claude Code와 진행했어요. 보호자 확인, 27문항, 영역별 결과, 벨기에 표본 통계로 환산한 참고점수까지. 블로그 도구 메뉴에 올리고 딸에게 당당하게 내밀었습니다.
결과는— 전부 다 맞혔습니다. 딸은 “거봐, 나 천재 맞잖아"라며 의기양양했고요.
기뻐해야 할 순간인데 뭔가 이상했습니다. 실제 검사는 또래 평균 정답률이 40%인데 만점이 나왔다? 문제를 다시 보니 답이 나왔습니다. 제가 만든 문항이 너무 쉬웠던 겁니다. “2, 4, 6, 8 다음은?” 수준이었으니 중1이면 당연히 만점이죠. 천재 판정이 아니라 출제 오류였습니다.
2차 개편 — 진짜 검사처럼 어렵게
그래서 논문을 다시 파고들어 실제 Ch-ICAR의 형식을 최대한 따라 만들었습니다.
- 연령별 2세트 — 만 10
11세 기본 세트 / 만 1214세 심화 세트. 심화 세트에는 대우 명제, 삼단논법, “모레가 목요일의 이틀 전이라면 오늘은?” 같은 요일 계산 퍼즐, 피보나치·소수·교대수열이 들어갑니다. - 행렬·도형 문제를 SVG로 — 텍스트 기호(●▲) 대신 코드로 도형을 그려서, 실제처럼 3×3 행렬추론과 도형 유추 문제를 만들었습니다.
- 8지선다 — 실제 Ch-ICAR가 보기 8개(정답 없음·모르겠음 포함)를 쓰길래 똑같이 보기 7개 + ‘모르겠어요’로 맞췄습니다. 찍어서 맞출 확률이 25%에서 12.5%로 떨어집니다.
- 수열은 주관식 — 실제 검사처럼 보기 없이 직접 입력합니다. 모바일 키보드가 화면을 가리는 문제는 화면 안에 숫자 키패드를 직접 그려서 해결했어요. PC에서는 키보드로도 입력됩니다.
- 문제은행 76문항, 매회 무작위 출제 — 문항을 76개(기본 36 + 심화 40)로 늘리고, 매번 영역 비율을 지키며 27문항을 무작위로 뽑습니다. 보기 순서도 섞여서 두 번째 풀 때 답을 외워봐야 소용없습니다.
전부 서버 없이 브라우저 안에서만 동작합니다. 답은 어디로도 전송되지 않아요.
점수에 대해서는 정직하게
만들면서 가장 신경 쓴 부분은 사실 문항보다 점수의 정직함입니다. 이 테스트의 점수는 벨기에 연구표본의 평균과 표준편차를 빌려 평균 100, 표준편차 15 형태로 환산한 오락·교육용 참고점수입니다. 한국 어린이 규준으로 표준화한 IQ가 아니고, 전문 지능검사를 대신할 수도 없습니다. 그래서 결과 화면에 이 한계를 그대로 적어뒀고, 시작 전에 보호자 확인도 받게 했습니다.
아이가 받아 든 점수 하나에 일희일비하기보다, 어떤 영역 문제를 재미있어하고 잘 푸는지 함께 들여다보는 용도로 쓰시면 딱 좋습니다.
써보기
👉 생각별 IQ 연구소 열기 — 상단 메뉴 도구에서도 들어올 수 있습니다.
이제 딸에게 심화 세트를 다시 내밀 차례입니다. 이번에도 만점이 나온다면… 그때는 진짜로 천재를 의심해봐야겠죠.