GPT-5.6 IQ 130 천재선 돌파, 인간 99%보다 똑똑하고 실용적 업무 능력도 뛰어남
Tracking AI의 최신 오프라인 IQ 평가 결과에 따르면, OpenAI의 GPT-5.6 여러 버전이 136점을 기록하여 대규모 언어 모델이 IQ 130 기준을 초과한 첫 사례가 되었습니다. 일반적인 인간 분포에서 IQ 130은 ‘천재’의 문턱을 의미하며, 이는 전 세계 인구의 단 1%만이 달성하는 수준으로, GPT-5.6이 인구의 99%보다 더 지능적임을 효과적으로 입증합니다.

가장 엄격하고 누설 방지 기능이 있는 문제 은행에서 136점을 기록한 GPT-5.6은 경쟁사들을 크게 압도했습니다.
Tracking AI는 두 가지 서로 다른 테스트 프레임워크를 사용했습니다. 하나는 모델이 이미 140점을 초과한 오픈소스 Mensa 노르웨이식 시험이고, 다른 하나는 사전 암기를 방지하기 위해 설계된 비공개 오프라인 문제 은행입니다. GPT-5.6은 이 어려운 오프라인 데이터셋을 성공적으로 처리했으며, SOL 및 TERRA 계열 전체가 시각적 변형을 포함하여 136점을 기록했습니다. Claude-5 Fable은 130점으로 그 뒤를 이었고, GPT-5.6 LUNA Max와 Claude-4.8 Opus는 117점에서 123점 사이에 머물렀습니다. o3부터 다양한 플래그십 시스템에 이르기까지 모델들이 역사적으로 130의 문턱에서 정체되었던 반면, GPT-5.6은 이를 돌파한 첫 번째 모델이 되었습니다.
테스트 점수 외에도 GPT-5.6은 실제 응용 분야에서 뛰어난 성능을 보여줍니다.
높은 테스트 지표만으로는 유용성이 보장되지 않습니다. 개발자들은 놀라운 결과와 함께 실제 시나리오에서 GPT-5.6을 평가했습니다. 개발자 Amir Bohlooli가 Fable5와 GPT-5.6 Sol에 동일한 물리 시뮬레이션 프롬프트를 제출했을 때, 그는 Fable의 우위를 예상했습니다. 그러나 대신 GPT-5.6 Sol은 실시간 물리 기능을 갖춘 입자 유체 시뮬레이션을 실행했으며, CSS, 인터페이스 디자인, 렌더링을 단일 HTML 파일에 포함했습니다. 이는 결과를 공유 가능한 웹 페이지로 자동 호스팅하여 단일 프롬프트에서 완전한 제품을 제공했습니다. 마찬가지로 Ramanpal Singh은 RAG를 사용하여 하나의 프롬프트로 고객 티켓 시스템을 개발했으며, 여기에는 네 가지 서로 다른 역할, 관리 백엔드, 자동 불만 분류 및 감정 인식이 포함되었습니다. 이 복잡한 설정은 Fable5와 관련된 비용의 일부만 필요했습니다.
Claire Vo의 경험은 이러한 실용적 장점을 부각시켰습니다. 그녀는 코드가 충돌했다고 믿었던 지속되는 버그를 마주한 후 GPT-5.6 Sol로 전환하며 “이것에게 패배하지 않겠다”고 말했습니다. Sol은 문제를 즉시 해결하고 다른 모델들이 원활하게 실행되도록 도왔습니다. Vo의 평가는 명확했습니다. Fable의 기술적 정확성에 대한 경직된 초점은 효과성을 저해한 반면, Sol의 실용적인 접근 방식은 구체적인 결과를 가져왔습니다.
관련 기사
Microsoft는 단일 거대 모델 중심의 AI 전략을 다각화하기 위해 MAI 시리즈 모델을 공개했습니다.
사티야 나델라 마이크로소프트 CEO는 최근 분기 실적 통화 회의에서 기업이 다중 모델 아키텍처의 기업용 채택을 가속화하는 동시에 자체 AI 모델, 에이전트, 보안 솔루션에 대한 투자를 확대하여 단일 선도 AI 연구실에 대한 의존도를 최소화하고 있다고 강조했습니다.마이크로소프트는 최근 견고한 재무 결과를 보고했습니다. 6월 30일 종료 회계연도의 총 매출은 3,318억 달러, 순이익은 1,337억 달러에 달했으며, 최신 분기에는 매출 900억 달
세계 모델 기업들이 비밀을 보호한다
지난주, 저는 올 인 컨퍼런스(팟캐스트와 무관)에서 월드 모델에 관한 토론을 진행했으며, 이는 AI의 가장 신비로운 분야 중 하나에 대한 심층적인 탐구를 제공했습니다. Yann LeCun의 AMI Labs와 Fei-Fei Li의 World Labs 같은 업계 리더들은 큰 주목을 받으며 막대한 자금을 확보했지만, 수익화로의 진전은 현저히 느린 상태입니다.월드 모델의 핵심은 공간 지능을 자동화하여 로봇, 인터랙티브 비디오, 고급 자율주행 시스템에
Rival AI 에이전트 Instinct와 Meta의 Muse가 이제 호출 기능을 지원합니다
텍스트 기반 AI 어시스턴트 시장은 치열한 경쟁 상태에 있으며, Instinct, Wajo, Town, Ollie, 그리고 Meta가 새로 출시한 Muse 에이전트가 모두 사용자의 관심과 업무 관리 기능을 놓고 경쟁하고 있습니다. 샌프란시스코에 본사를 둔 Instinct은 주요 경쟁자로 부상했으며, 상당한 투자자의 관심을 끌고 있으며 보고된 바에 따르면 100억 달러의 기업 가치를 달성했습니다.Instinct의 인기는 새로운 전화 걸기 기능의
관련 특별 주제 추천
의견 (0)
0/500
Tracking AI의 최신 오프라인 IQ 평가 결과에 따르면, OpenAI의 GPT-5.6 여러 버전이 136점을 기록하여 대규모 언어 모델이 IQ 130 기준을 초과한 첫 사례가 되었습니다. 일반적인 인간 분포에서 IQ 130은 ‘천재’의 문턱을 의미하며, 이는 전 세계 인구의 단 1%만이 달성하는 수준으로, GPT-5.6이 인구의 99%보다 더 지능적임을 효과적으로 입증합니다.

가장 엄격하고 누설 방지 기능이 있는 문제 은행에서 136점을 기록한 GPT-5.6은 경쟁사들을 크게 압도했습니다.
Tracking AI는 두 가지 서로 다른 테스트 프레임워크를 사용했습니다. 하나는 모델이 이미 140점을 초과한 오픈소스 Mensa 노르웨이식 시험이고, 다른 하나는 사전 암기를 방지하기 위해 설계된 비공개 오프라인 문제 은행입니다. GPT-5.6은 이 어려운 오프라인 데이터셋을 성공적으로 처리했으며, SOL 및 TERRA 계열 전체가 시각적 변형을 포함하여 136점을 기록했습니다. Claude-5 Fable은 130점으로 그 뒤를 이었고, GPT-5.6 LUNA Max와 Claude-4.8 Opus는 117점에서 123점 사이에 머물렀습니다. o3부터 다양한 플래그십 시스템에 이르기까지 모델들이 역사적으로 130의 문턱에서 정체되었던 반면, GPT-5.6은 이를 돌파한 첫 번째 모델이 되었습니다.
테스트 점수 외에도 GPT-5.6은 실제 응용 분야에서 뛰어난 성능을 보여줍니다.
높은 테스트 지표만으로는 유용성이 보장되지 않습니다. 개발자들은 놀라운 결과와 함께 실제 시나리오에서 GPT-5.6을 평가했습니다. 개발자 Amir Bohlooli가 Fable5와 GPT-5.6 Sol에 동일한 물리 시뮬레이션 프롬프트를 제출했을 때, 그는 Fable의 우위를 예상했습니다. 그러나 대신 GPT-5.6 Sol은 실시간 물리 기능을 갖춘 입자 유체 시뮬레이션을 실행했으며, CSS, 인터페이스 디자인, 렌더링을 단일 HTML 파일에 포함했습니다. 이는 결과를 공유 가능한 웹 페이지로 자동 호스팅하여 단일 프롬프트에서 완전한 제품을 제공했습니다. 마찬가지로 Ramanpal Singh은 RAG를 사용하여 하나의 프롬프트로 고객 티켓 시스템을 개발했으며, 여기에는 네 가지 서로 다른 역할, 관리 백엔드, 자동 불만 분류 및 감정 인식이 포함되었습니다. 이 복잡한 설정은 Fable5와 관련된 비용의 일부만 필요했습니다.
Claire Vo의 경험은 이러한 실용적 장점을 부각시켰습니다. 그녀는 코드가 충돌했다고 믿었던 지속되는 버그를 마주한 후 GPT-5.6 Sol로 전환하며 “이것에게 패배하지 않겠다”고 말했습니다. Sol은 문제를 즉시 해결하고 다른 모델들이 원활하게 실행되도록 도왔습니다. Vo의 평가는 명확했습니다. Fable의 기술적 정확성에 대한 경직된 초점은 효과성을 저해한 반면, Sol의 실용적인 접근 방식은 구체적인 결과를 가져왔습니다.
Microsoft는 단일 거대 모델 중심의 AI 전략을 다각화하기 위해 MAI 시리즈 모델을 공개했습니다.
사티야 나델라 마이크로소프트 CEO는 최근 분기 실적 통화 회의에서 기업이 다중 모델 아키텍처의 기업용 채택을 가속화하는 동시에 자체 AI 모델, 에이전트, 보안 솔루션에 대한 투자를 확대하여 단일 선도 AI 연구실에 대한 의존도를 최소화하고 있다고 강조했습니다.마이크로소프트는 최근 견고한 재무 결과를 보고했습니다. 6월 30일 종료 회계연도의 총 매출은 3,318억 달러, 순이익은 1,337억 달러에 달했으며, 최신 분기에는 매출 900억 달
세계 모델 기업들이 비밀을 보호한다
지난주, 저는 올 인 컨퍼런스(팟캐스트와 무관)에서 월드 모델에 관한 토론을 진행했으며, 이는 AI의 가장 신비로운 분야 중 하나에 대한 심층적인 탐구를 제공했습니다. Yann LeCun의 AMI Labs와 Fei-Fei Li의 World Labs 같은 업계 리더들은 큰 주목을 받으며 막대한 자금을 확보했지만, 수익화로의 진전은 현저히 느린 상태입니다.월드 모델의 핵심은 공간 지능을 자동화하여 로봇, 인터랙티브 비디오, 고급 자율주행 시스템에
Rival AI 에이전트 Instinct와 Meta의 Muse가 이제 호출 기능을 지원합니다
텍스트 기반 AI 어시스턴트 시장은 치열한 경쟁 상태에 있으며, Instinct, Wajo, Town, Ollie, 그리고 Meta가 새로 출시한 Muse 에이전트가 모두 사용자의 관심과 업무 관리 기능을 놓고 경쟁하고 있습니다. 샌프란시스코에 본사를 둔 Instinct은 주요 경쟁자로 부상했으며, 상당한 투자자의 관심을 끌고 있으며 보고된 바에 따르면 100억 달러의 기업 가치를 달성했습니다.Instinct의 인기는 새로운 전화 걸기 기능의





집






