FunIQ는 장난입니다. 진지한 장난.
FunIQ는 공개 행렬추론 form을 같은 규칙으로 풀게 하고, 첫 응답 정확도를 재미용 AI IQ 숫자로 보여 주는 리더보드입니다. 사람의 IQ가 아니고, Mensa가 아니고, 모델의 일반 지능도 아닙니다.
무엇을 푸나
문항은 epoko77-ai/ai-iq-test 의 공개 form kmiq-v1-20260826 (MIT) 168문항 전부를 씁니다. 문항 id는 data/challenge-ids.json에 고정되어 모든 모델이 같은 문항을 봅니다.
axis_binding— 축별 속성 결합latin_cycle— Latin 순환modular_addition— 모듈러 합xor_overlay— XOR 중첩affine_steps— Affine 진행commuting_transform— 가환 변환union_overlay— 합집합 중첩
채점
모델에게는 JSON {“answer”:“X”} (X는 A–H)를 요청합니다. 채점은 지능을 보려는 것이라 형식을 엄격히 요구하지 않습니다. JSON, <answer>X</answer>, “정답은 B”, 보기 번호 B.처럼 흔히 쓰는 답에서도 마지막 글자를 읽습니다. 글자를 전혀 못 찾으면 형식 실패입니다.
AI IQ (fun) v1 = half_up(70 + 80 × (p − 0.125) / 0.875) 표시 범위 = 59 … 150 chance p=0.125 → 70 perfect p=1 → 150
| 구간 | 호칭 |
|---|---|
| ≥ 135 | 패턴 천재 |
| ≥ 125 | 매트릭스 마스터 |
| ≥ 110 | 추론 스페셜리스트 |
| ≥ 90 | 규칙 해독자 |
| ≥ 70 | 패턴 탐색자 |
| 그 외 | 워밍업 중 |
자동 평가
매일 05:00 KST (cron 0 20 * * * UTC) GitHub Action이 timelyrouter.ai 카탈로그의 아직 채점되지 않은 모델을 돌립니다. 결과는 data/leaderboard.json에 커밋되어 Vercel이 다시 빌드합니다.
timelyrouter.ai에 모델을 등록하면 다음 날 아침 자동으로 리더보드에 오릅니다.
이 사이트가 아닌 것
- 인간 지능 검사, Mensa 가입 시험, 정부·채용 평가가 아닙니다.
- 시지각, 지식, 창의성, 에이전트 능력, 안전성을 측정하지 않습니다.
- TigerBench의 카피나 CSS를 가져오지 않았습니다. 리더보드 톤만 참고했습니다.