상세 컨텐츠
멘사 IQ 테스트를 AI가 한다면 IQ는 얼마일까? by voronoiapp.com
본문
IQ(Intelligence Quotient). 지능 발달 정도를 나타내는 검사 결과를 나타내는 수치로 IQ가 100이면 표준 지능을 100 이상이면 표준 이상, 100 이하면 표준 이하를 의미한다고 다음 백과에는 간략하게 설명되어 있던데... 정확한 평가 방식이나 기준에 대해서는 잘 모르고 있더라도 아마 한두 번은 IQ 테스트를 하셨던 기억은 있으실 겁니다. 까마득한 예전이긴 하지만, 저도 테스트했던 기억이 어렴풋이 나는데요. 테스트 방식이 딱 하나가 아니라서 테스트 방식에 따라 결과가 조금씩 다를 수 있지만, 한때는 시험 성적을 받아든 것처럼 테스트 결과에 따라 일희일비하기도 했었는데 지금은 IQ를 바라보는 대중의 시선이 그때만큼 절대적이지는 않으나 상징적인 의미로 바라보게 되는 IQ.
멘사 IQ 테스트를 받은 AI 모델들, 그 결과는...
Tracking AI가 멘사 노르웨이 IQ 테스트(Mensa Norway IQ Test)를 기반으로 주요 AI 모델의 IQ를 비교한 걸 voronoi가 인포그래픽으로 정리했는데 내용이 꽤 흥미롭네요. 바야흐로 AI의 시대에 여러 AI들이 인간의 지능을 검사하는 IQ 테스트, 그중에서도 멘사 테스트를 통해 평가 당한 AI들의 IQ가 어느 정도인지를 비교해 소개하고 있으니까요. 여기서는 100을 평균적인 수준, 130을 천재 수준으로 소개하고 있더군요.
Tracking AI
Tracking AI is a cutting-edge application that unveils the political biases embedded in artificial intelligence systems. Explore and analyze the political leanings of AIs with our intuitive platform, designed to foster transparency in the world of artifici
www.trackingai.org

AI 중 IQ가 가장 높은 건 오픈AI o3(OpenAI o3)로 135의 꽤 높은 IQ를 기록했습니다. 이어서 클로드-4 소넷(Claude-4 Sonnet)이 127, 제미나이 2.0 플래시 싱킹 익스피리언스(Gemini 2.0 Flash Thinking Exp.)가 126, 제미나이 2.5 프로 익스팬드(Gemini 2.5 Pro Exp.)가 124, 오픈AI o4 미니(OpenAI o4 mini)가 122, 클로드-4 오푸스(Claude-4 Opus)가 120, 그록-3 씽크(Grok-3 Think)가 112, 딥씨크 R1(DeepSeek R1)이 106, 라마 4 매버릭(Llama 4 Maverick)이 105, 오픈AI o1 프로(OpenAI o1 Pro)가 102로 상위 10위까지였습니다.
반면 IQ가 낮았던 AI로는 그록-3 씽크 비전(Grok-3 Think Vision)이 60, GPT-4o 비전(GPT-4o Vision)이 63, 라마-3.2 비전(Llama-3.2 Vision)이 70, 오픈AI o3 비전(OpenAI o3 Vision)이 72, 오픈AI o1 프로 비전(OpenAI o1 Pro Vision)이 83 등 텍스트는 물론 이미지도 읽고 처리할 수 있는 멀티 모달 AI 모델들이었다는 게 흥미롭네요. 상대적으로 점수가 높았던 96의 제미나이 2.5 프로 익스피리언스 비전(Gemini 2.5 Pro Exp. Vision)이나 클로드-3.7 비전(Claude-3.7 Vision)도 91인 걸 보면 텍스트에만 대응하는 모델 대비 멀티 모달 AI 모델이 더 똑똑할(?) 거라고 생각했던 제 기대와는 다른 모습이었으니까요.
일부 분야에 한정한 것이긴 하지만, 이미 AI가 인간을 뛰어넘었다는 이야기가 들려오는 상황에서 AI의 IQ 테스트라는 접근은 제법 흥미로운데요. AI 모델 중 상당한 수의 모델이 100 이상의 IQ를 보여준 건 흥미롭지만, 그보다 더 흥미로웠던 건 텍스트 AI 모델이 멀티 모달 AI 모델보다 똑똑해 보인다는 거고 다른 관점에서 보면 멀티 모달로 세상을 인식하는 게 그만큼 어렵다는 얘기일 겁니다. 여기서 조금만 더 나아가면 그걸 다하고 있는 인간의 인지나 추론 능력이 새삼 놀랍다는 거지만, AI 모델의 발전 속도가 빠른 만큼 인간을 뛰어넘는 AI의 출현은 앞으로 더 빈번해지겠죠? 처음엔 일부 분야에서만 뛰어넘겠지만, 언젠가는 포괄적으로 인간을 뛰어넘는 지능을 가진 AI가 등장할 수도 있는데. 그즈음 AI와 인간의 관계는 어떻게 정립될지 흥미롭게 지켜봐야겠네요.
Comparing the IQ of AI Models
What We’re Showing This infographic ranks 24 leading AI models by their performance on the Mensa Norway Intelligence Quotient (IQ) Test, a high-difficult…
www.voronoiapp.com
댓글 영역