fbpx
AI models flub these intelligence tests. Can you fare any better?

AI 모델도 틀리는 지능 테스트, 당신은 더 잘 풀 수 있을까?

퍼즐과 게임은 AI 모델의 허점을 드러내는 좋은 시험대다. AI가 어려워하는 지능 테스트 문제를 직접 풀어보며 인간과 AI의 사고방식이 어떻게 다른지 살펴보자.

퍼즐과 게임은 인공지능(AI) 개발 초기부터 중요한 역할을 해왔다. 우리가 낱말 퍼즐이나 논리 문제를 풀며 사고력을 시험하듯 개발자들도 게임과 퍼즐을 통해 AI 모델이 얼마나 발전했는지 확인한다. 컴퓨터가 데이터를 학습해 스스로 패턴을 찾아내고 판단하는 기술을 뜻하는 ‘머신러닝(machine learning)’이라는 용어도 1959년 IBM 컴퓨터 과학자 아서 새뮤얼(Arthur Samuel)이 보드게임인 ‘체커’를 스스로 학습하는 알고리즘을 소개한 논문을 계기로 널리 알려졌다. 체스와 중국의 바둑 역시 AI의 성능을 시험하는 대표적인 게임으로 활용되고 있다.

퍼즐을 푸는 실력만 놓고 보면 AI는 빠르게 발전하고 있다. 컬럼비아대학교 연구팀은 2024년 말 당시 최고 수준의 AI 모델조차 뉴욕타임스의 인기 단어 퍼즐 ‘커넥션스(Connections)’를 18%밖에 풀지 못한다는 걸 확인했다. 그러나 2025년 초에는 일부 모델이 커넥션스를 거의 매번 완벽하게 풀 정도로 성능이 향상됐다. 커넥션스는 16개의 단어 가운데 서로 관련 있는 단어 4개씩을 찾아 총 4개의 그룹으로 묶는 퍼즐 게임으로, 난도가 높기로 유명하다.

퍼즐은 AI의 발전 속도만 보여주는 것이 아니다. AI가 어떤 문제를 잘 풀고 어떤 문제에 약한지, 그리고 여전히 인간이 AI를 앞서는 영역은 무엇인지 살펴보면 현재 AI 기술의 강점과 한계를 파악할 수 있다. 성능이 크게 좋아졌지만 오늘날의 AI 모델도 의외의 문제에서 실수를 하곤 한다. 익숙한 수수께끼를 조금만 변형해도 쉽게 틀리고 특히 시각적 퍼즐에는 약한 모습을 보인다.

MIT 테크놀로지 리뷰와 함께, 미래를 앞서가세요 !!
한달에 커피 2잔값으로 즐기기
온라인 멤버
지면 매거진 멤버
(온라인+지면) 프리미엄 멤버

유료회원 플랜 보기 회원이면 로그인하기 회원가입

회원 가입 후 유료 구독 신청을 하세요 !!