모든 작업을 처리할 수 있는 범용 AI를 구축하기 위한 OpenAI의 경쟁
헌터 라이트먼은 2022년 OpenAI의 연구원이 된 직후, 기술 역사상 가장 빠르게 성장하는 제품 중 하나인 ChatGPT가 폭발적으로 출시되는 것을 목격했습니다. 한편, 라이트먼은 엘리트 고등학교 수학 경시대회에 참가하기 위해 OpenAI의 모델을 훈련하는 데 집중했습니다.
현재 그의 팀인 MathGen은 업계를 선도하는 AI 추론 모델을 구축하려는 OpenAI의 노력에서 중추적인 역할을 담당하고 있습니다. 이러한 시스템은 인간과 유사한 컴퓨터 작업을 수행할 수 있는 'AI 에이전트'의 근간을 형성합니다.
"초기에 우리는 모델이 어려움을 겪었던 수학적 추론을 개선하는 것을 목표로 삼았습니다."라고 라이트먼은 MathGen의 기원에 대해 테크크런치와의 인터뷰에서 말했습니다.
발전에도 불구하고 OpenAI의 모델은 여전히 불완전합니다. 최신 시스템조차도 사실을 착각하고 복잡한 작업에서 흔들립니다.
하지만 수학적 추론은 극적으로 향상되었습니다. 한 모델은 최근 세계에서 가장 뛰어난 수학 영재들이 참가하는 국제 수학 올림피아드에서 금메달을 획득했습니다. OpenAI는 이러한 추론 능력이 다른 영역으로 확장되어 오랫동안 구상해 온 범용 AI 에이전트에 힘을 실어줄 것이라고 믿습니다.
ChatGPT의 성공은 우연에 의한 것이었지만, OpenAI의 에이전트 개발은 수년간의 의도적인 노력의 결과물입니다. "머지않아 컴퓨터에게 작업을 처리하도록 요청할 수 있게 될 것입니다."라고 OpenAI의 2023년 개발자 컨퍼런스에서 CEO 샘 알트먼은 예측했습니다. "우리는 이를 '에이전트'라고 부르는데, 그 잠재력은 엄청납니다."
디스럽트 2025에 참여하기로 확정된 기술 대기업들
넷플릭스, 일레븐랩스, 웨이브, 세쿼이아 캐피탈이 테크크런치 디스럽트 20주년의 올스타 라인업을 이끌고 있습니다. 지금 바로 티켓을 확보하고 가격이 인상되기 전에 최대 675달러까지 할인된 가격으로 테크 업계 최고 전문가들로부터 실행 가능한 인사이트를 얻으세요.
디스럽트 2025에 참가가 확정된 기술 거물들
넷플릭스, 일레븐랩스, 웨이브, 세쿼이아 캐피탈이 테크크런치 디스럽트 20주년의 올스타 라인업을 이끌고 있습니다. 지금 바로 티켓을 확보하고 가격이 인상되기 전에 최대 675달러까지 할인된 가격으로 테크 업계 최고 전문가들로부터 실행 가능한 인사이트를 얻으세요.
샌프란시스코 | 2025년 10월 27~29일 | 지금 등록하기

DevDay 2023에서 연설하는 OpenAI CEO 샘 알트먼(사진: 저스틴 설리반/Getty Images) Altman의 비전은 아직 입증되지 않았지만, OpenAI는 2024년에 "o1" 추론 모델로 기술계를 놀라게 했습니다. 몇 달 만에 21명의 연구원이 실리콘밸리에서 가장 탐내는 인재가 되었고, 메타는 5명을 영입하여 9자리 수 연봉 패키지를 제공했습니다.
강화 학습의 부활
OpenAI의 에이전트 혁신은 AI 모델이 시뮬레이션된 시행착오를 통해 학습하는 강화 학습(RL)과 관련이 있습니다. RL은 2016년 알파고의 획기적인 성과로 거슬러 올라가지만, OpenAI는 수년간 컴퓨터 사용 에이전트에 적용하기 위해 노력했습니다.
초기 GPT 모델은 텍스트에는 뛰어났지만 기본적인 수학에는 취약했습니다. 2023년 '스트로베리' 프로젝트는 RL과 테스트 시간 계산을 결합하여 모델이 답변하기 전에 단계를 검증하고 '생각의 연쇄' 추론을 개척했습니다.
"갑자기 모델이 역추적하고 스스로 수정할 수 있게 되었는데, 마치 인간처럼 느껴졌습니다."라고 연구원 엘 키쉬키는 회상합니다.
추론 기능 확장
OpenAI는 학습 후 계산과 응답 시간 할당이라는 두 가지 확장 벡터를 확인했습니다. "우리는 현재를 위해 구축하는 것이 아니라 확장성을 위해 구축합니다."라고 라이트먼은 말합니다.
2023년에 전담 "에이전트" 팀이 등장하여 o1의 기반을 마련했습니다. 제품 수요에 제약을 받는 경쟁사들과 달리 OpenAI는 전략적 이점인 AGI 연구에 우선순위를 두었습니다.
AI 추론의 정의
연구자들은 AI가 진정으로 "추론"을 하는지에 대해 논쟁을 벌입니다. 일부는 계산 효율성을 강조하고, 다른 일부는 인간과 유사한 출력에 초점을 맞춥니다. 비평가들은 존재하지만 비행기는 새와 다른 방식으로 비행하는 것처럼 능력이 가장 중요합니다.
주관적인 작업 과제
현재 상담원들은 코딩은 잘 처리하지만 온라인 쇼핑과 같은 뉘앙스를 다루는 데 어려움을 겪습니다. "이는 근본적으로 데이터의 문제입니다."라고 라이트먼은 설명합니다. 새로운 기술을 통해 검증이 어려운 작업도 훈련할 수 있습니다.
OpenAI의 IMO 솔루션은 다중 에이전트 탐색을 사용했는데, 현재는 Google과 xAI에서 이를 에뮬레이트합니다. 연구원 노암 브라운은 빠른 진전이 계속될 것으로 보고 있습니다: "속도가 느려질 기미는 보이지 않습니다."
GPT-5가 다가옴에 따라 OpenAI는 구글, 앤트로픽, 메타에 맞서 우위를 유지하는 것을 목표로 하고 있습니다. 궁극적인 목표는? 모든 디지털 작업을 직관적으로 실행하는 에이전트, 즉 현재의 ChatGPT를 완전히 능가하는 에이전트입니다.
관련 기사
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
관련 특별 주제 추천
의견 (1)
0/500
헌터 라이트먼은 2022년 OpenAI의 연구원이 된 직후, 기술 역사상 가장 빠르게 성장하는 제품 중 하나인 ChatGPT가 폭발적으로 출시되는 것을 목격했습니다. 한편, 라이트먼은 엘리트 고등학교 수학 경시대회에 참가하기 위해 OpenAI의 모델을 훈련하는 데 집중했습니다.
현재 그의 팀인 MathGen은 업계를 선도하는 AI 추론 모델을 구축하려는 OpenAI의 노력에서 중추적인 역할을 담당하고 있습니다. 이러한 시스템은 인간과 유사한 컴퓨터 작업을 수행할 수 있는 'AI 에이전트'의 근간을 형성합니다.
"초기에 우리는 모델이 어려움을 겪었던 수학적 추론을 개선하는 것을 목표로 삼았습니다."라고 라이트먼은 MathGen의 기원에 대해 테크크런치와의 인터뷰에서 말했습니다.
발전에도 불구하고 OpenAI의 모델은 여전히 불완전합니다. 최신 시스템조차도 사실을 착각하고 복잡한 작업에서 흔들립니다.
하지만 수학적 추론은 극적으로 향상되었습니다. 한 모델은 최근 세계에서 가장 뛰어난 수학 영재들이 참가하는 국제 수학 올림피아드에서 금메달을 획득했습니다. OpenAI는 이러한 추론 능력이 다른 영역으로 확장되어 오랫동안 구상해 온 범용 AI 에이전트에 힘을 실어줄 것이라고 믿습니다.
ChatGPT의 성공은 우연에 의한 것이었지만, OpenAI의 에이전트 개발은 수년간의 의도적인 노력의 결과물입니다. "머지않아 컴퓨터에게 작업을 처리하도록 요청할 수 있게 될 것입니다."라고 OpenAI의 2023년 개발자 컨퍼런스에서 CEO 샘 알트먼은 예측했습니다. "우리는 이를 '에이전트'라고 부르는데, 그 잠재력은 엄청납니다."
디스럽트 2025에 참여하기로 확정된 기술 대기업들
넷플릭스, 일레븐랩스, 웨이브, 세쿼이아 캐피탈이 테크크런치 디스럽트 20주년의 올스타 라인업을 이끌고 있습니다. 지금 바로 티켓을 확보하고 가격이 인상되기 전에 최대 675달러까지 할인된 가격으로 테크 업계 최고 전문가들로부터 실행 가능한 인사이트를 얻으세요.
디스럽트 2025에 참가가 확정된 기술 거물들
넷플릭스, 일레븐랩스, 웨이브, 세쿼이아 캐피탈이 테크크런치 디스럽트 20주년의 올스타 라인업을 이끌고 있습니다. 지금 바로 티켓을 확보하고 가격이 인상되기 전에 최대 675달러까지 할인된 가격으로 테크 업계 최고 전문가들로부터 실행 가능한 인사이트를 얻으세요.
샌프란시스코 | 2025년 10월 27~29일 | 지금 등록하기

Altman의 비전은 아직 입증되지 않았지만, OpenAI는 2024년에 "o1" 추론 모델로 기술계를 놀라게 했습니다. 몇 달 만에 21명의 연구원이 실리콘밸리에서 가장 탐내는 인재가 되었고, 메타는 5명을 영입하여 9자리 수 연봉 패키지를 제공했습니다.
강화 학습의 부활
OpenAI의 에이전트 혁신은 AI 모델이 시뮬레이션된 시행착오를 통해 학습하는 강화 학습(RL)과 관련이 있습니다. RL은 2016년 알파고의 획기적인 성과로 거슬러 올라가지만, OpenAI는 수년간 컴퓨터 사용 에이전트에 적용하기 위해 노력했습니다.
초기 GPT 모델은 텍스트에는 뛰어났지만 기본적인 수학에는 취약했습니다. 2023년 '스트로베리' 프로젝트는 RL과 테스트 시간 계산을 결합하여 모델이 답변하기 전에 단계를 검증하고 '생각의 연쇄' 추론을 개척했습니다.
"갑자기 모델이 역추적하고 스스로 수정할 수 있게 되었는데, 마치 인간처럼 느껴졌습니다."라고 연구원 엘 키쉬키는 회상합니다.
추론 기능 확장
OpenAI는 학습 후 계산과 응답 시간 할당이라는 두 가지 확장 벡터를 확인했습니다. "우리는 현재를 위해 구축하는 것이 아니라 확장성을 위해 구축합니다."라고 라이트먼은 말합니다.
2023년에 전담 "에이전트" 팀이 등장하여 o1의 기반을 마련했습니다. 제품 수요에 제약을 받는 경쟁사들과 달리 OpenAI는 전략적 이점인 AGI 연구에 우선순위를 두었습니다.
AI 추론의 정의
연구자들은 AI가 진정으로 "추론"을 하는지에 대해 논쟁을 벌입니다. 일부는 계산 효율성을 강조하고, 다른 일부는 인간과 유사한 출력에 초점을 맞춥니다. 비평가들은 존재하지만 비행기는 새와 다른 방식으로 비행하는 것처럼 능력이 가장 중요합니다.
주관적인 작업 과제
현재 상담원들은 코딩은 잘 처리하지만 온라인 쇼핑과 같은 뉘앙스를 다루는 데 어려움을 겪습니다. "이는 근본적으로 데이터의 문제입니다."라고 라이트먼은 설명합니다. 새로운 기술을 통해 검증이 어려운 작업도 훈련할 수 있습니다.
OpenAI의 IMO 솔루션은 다중 에이전트 탐색을 사용했는데, 현재는 Google과 xAI에서 이를 에뮬레이트합니다. 연구원 노암 브라운은 빠른 진전이 계속될 것으로 보고 있습니다: "속도가 느려질 기미는 보이지 않습니다."
GPT-5가 다가옴에 따라 OpenAI는 구글, 앤트로픽, 메타에 맞서 우위를 유지하는 것을 목표로 하고 있습니다. 궁극적인 목표는? 모든 디지털 작업을 직관적으로 실행하는 에이전트, 즉 현재의 ChatGPT를 완전히 능가하는 에이전트입니다.
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L





집






