1X, 로봇 시각 학습 발전을 위한 월드 모델 공개

휴머노이드 로봇 ‘네오(Neo)’를 개발한 기업 1X는 실제 환경의 역학을 이해하고 로봇이 스스로 학습할 수 있도록 설계된 새로운 AI 모델을 선보였다.
'1X 월드 모델(1X World Model)'로 명명된 이 물리 기반 모델은 영상 입력과 프롬프트를 활용해 네오 로봇에 새로운 기능을 부여합니다. 1X에 따르면, 이 시스템을 통해 로봇은 초기 훈련 범위를 넘어선 작업도 학습할 수 있게 됩니다.
이번 발표는 1X가 가정용 네오 휴머노이드 출시를 준비 중인 시기와 맞물립니다. 이 회사는 지난 10월부터 사전 주문을 받기 시작했으며, 올해 내 배송을 계획하고 있습니다. 회사 대변인은 구체적인 배송 일정이나 주문 수치를 밝히기를 거부했으나, 사전 주문량이 예상을 뛰어넘었다고만 언급했습니다.
1X의 창립자이자 CEO인 베른트 보르니히(Bernt Børnich)는 "수년간 월드 모델을 개발하고 Neo의 인간형 디자인을 다듬은 끝에, 이제 Neo는 온라인 비디오를 통해 학습하고 그 지식을 현실 세계에 직접 적용할 수 있게 되었습니다"라고 말했습니다. "사전 예시가 없더라도 프롬프트를 새로운 행동으로 변환함으로써, 이는 Neo가 스스로 학습하고 광범위한 작업을 숙달할 수 있는 능력의 시작을 의미합니다."
로봇이 어떤 프롬프트든 행동으로 전환할 수 있다는 주장은 야심차면서도 완전히 정확한 것은 아닙니다. 예를 들어, 단순히 네오에게 차를 운전하라고 지시한다고 해서 즉시 평행 주차를 할 것이라고 기대할 수는 없습니다. 하지만 학습 과정은 확실히 진행되고 있습니다.
회사 대변인은 현재의 월드 모델이 비디오 프롬프트만으로는 네오 로봇이 새로운 작업을 즉시 수행할 수 있게 해주지는 않는다고 설명했다. 대신 특정 프롬프트와 연관된 비디오 데이터가 모델에 의해 처리되고, 그 통찰력이 로봇 네트워크 전반에 배포된다. 이는 물리적 세계에 대한 로봇들의 집단적 이해를 높이고 실용적인 지식을 확장한다.
또한 이 모델은 네오가 주어진 프롬프트를 어떻게 해석하고 대응 방안을 계획하는지 파악할 수 있게 해줍니다. 이러한 행동 데이터는 1X가 모델을 훈련하는 데 도움이 되며, 로봇이 완전히 새로운 지시에도 효과적으로 대응할 수 있는 미래를 향해 나아가는 데 기여합니다.
Disrupt 2026 대기자 명단에 등록하세요
Disrupt 2026 대기자 명단에 등록하여 얼리버드 티켓을 우선 구매할 기회를 확보하세요. 지난 Disrupt 행사에는 Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Elad Gil, Vinod Khosla 등 업계 리더들이 참여했습니다. 이들은 여러분의 성장과 경쟁 우위를 가속화하기 위해 마련된 200개 이상의 세션을 이끄는 250명 이상의 업계 전문가 중 일부입니다. 또한, 모든 분야의 수백 개 혁신 스타트업과 교류할 수 있는 기회를 얻으세요.
Disrupt 2026 대기자 명단에 등록하세요
Disrupt 2026 대기자 명단에 등록하여 얼리버드 티켓을 우선 구매할 수 있는 기회를 확보하세요. 지난 Disrupt 행사에는 Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Elad Gil, Vinod Khosla 등 250명 이상의 업계 전문가들이 참여하여, 여러분의 성장과 경쟁 우위를 가속화하기 위해 마련된 200개 이상의 세션을 이끌었습니다. 또한, 모든 분야의 혁신적인 스타트업 수백 곳과 교류할 수 있는 기회를 놓치지 마세요.
샌프란시스코 | 2026년 10월 13~15일 지금 대기자 명단에 등록하세요
관련 기사
내부 세부 사항 공개: 차세대 Gemini에 대한Computing Power의 긴장, 내부 팀들은 개발 우선순위와 자원 배분에 대해 의견이 갈렸다
보고에 따르면 구글의 높은 기대를 모았던次世代 제미니 모델의 출시가 연기되었다. 개발 우선순위와 자원 배분에 대한 내부 의견 불일치, 제한된 컴퓨팅 용량, 복잡한 승인 절차가 결합되어 2개월의 지연이 불가피해졌다. 자체 맞춤형 TPU 칩을 보유하고 있음에도 불구하고, 모델 학습, 구글 클라우드 서비스, 수많은 소비자 및 기업용 AI 애플리케이션 간의 경쟁적 수요로 인해 구글은 컴퓨팅 자원 부족에 직면해 있다. 최고 경영진은 이제 조직 개편을 통
OpenAI, 성장 둔화 우려 불식…여러 사업부門 가속화
외부로부터의 판매 성장 둔화 및 내부 목표 미달성에 대한 scrutiny에 대응하여, AI 선도 기업 오픈AI는 4월 28일 화요일에 자신감 있는 성명을 발표했다. 이 회사는 소비자 제품과 기업 서비스의 빠른 진전을 명확히 하며, 최근 제기된 사업 둔화에 대한 추측을 직접적으로 반박했다.동사가 "여러 내부 목표를 놓쳤다"는 주장에 대해, 오픈AI는 이러한 보도를 "전형적인 클릭베이트"로 일축했다. 이 회사는 AI 통합에 대한 강력한 기업 수요
알리바바 슈퍼컵: Qwen3.8-Max, 강화된 코딩 및 오피스 도구로 데뷔
Alibaba는 2.4조 개의 파라미터를 갖춘 차세대 기반 대형 모델인 Qwen3.8-Max를 공식적으로 공개했습니다. 이 중요한 AI 기술 발전은 코딩 및 전문 사무 작업 등 핵심 영역에서 상당한 성능 향상을 제공하며, 강력한 기술 역량을 보여줍니다.권위 있는 Arena 대형 모델 랭킹에서 Qwen3.8-Max는 Anthropic의 Claude 시리즈에 이어 우수한 성적을 거두며 업계 선두 그룹에 자리했습니다. 이 성과는 국내 대형 모델이
관련 특별 주제 추천
의견 (2)
0/500
So they're basically giving robots a physics engine in their brains? That sounds cool but also kinda scary. How do they handle all the messy real-world noise that simulators can't capture? 🤔
Interesting approach, but I'm a bit skeptical about how well a physics-based world model can handle the messy unpredictability of real environments. The video input part sounds promising for learning, but I wonder about the computational cost and if it'll lead to robots that are good at specific tasks but lack common sense. The race for humanoid AI is heating up! 🤖

휴머노이드 로봇 ‘네오(Neo)’를 개발한 기업 1X는 실제 환경의 역학을 이해하고 로봇이 스스로 학습할 수 있도록 설계된 새로운 AI 모델을 선보였다.
'1X 월드 모델(1X World Model)'로 명명된 이 물리 기반 모델은 영상 입력과 프롬프트를 활용해 네오 로봇에 새로운 기능을 부여합니다. 1X에 따르면, 이 시스템을 통해 로봇은 초기 훈련 범위를 넘어선 작업도 학습할 수 있게 됩니다.
이번 발표는 1X가 가정용 네오 휴머노이드 출시를 준비 중인 시기와 맞물립니다. 이 회사는 지난 10월부터 사전 주문을 받기 시작했으며, 올해 내 배송을 계획하고 있습니다. 회사 대변인은 구체적인 배송 일정이나 주문 수치를 밝히기를 거부했으나, 사전 주문량이 예상을 뛰어넘었다고만 언급했습니다.
1X의 창립자이자 CEO인 베른트 보르니히(Bernt Børnich)는 "수년간 월드 모델을 개발하고 Neo의 인간형 디자인을 다듬은 끝에, 이제 Neo는 온라인 비디오를 통해 학습하고 그 지식을 현실 세계에 직접 적용할 수 있게 되었습니다"라고 말했습니다. "사전 예시가 없더라도 프롬프트를 새로운 행동으로 변환함으로써, 이는 Neo가 스스로 학습하고 광범위한 작업을 숙달할 수 있는 능력의 시작을 의미합니다."
로봇이 어떤 프롬프트든 행동으로 전환할 수 있다는 주장은 야심차면서도 완전히 정확한 것은 아닙니다. 예를 들어, 단순히 네오에게 차를 운전하라고 지시한다고 해서 즉시 평행 주차를 할 것이라고 기대할 수는 없습니다. 하지만 학습 과정은 확실히 진행되고 있습니다.
회사 대변인은 현재의 월드 모델이 비디오 프롬프트만으로는 네오 로봇이 새로운 작업을 즉시 수행할 수 있게 해주지는 않는다고 설명했다. 대신 특정 프롬프트와 연관된 비디오 데이터가 모델에 의해 처리되고, 그 통찰력이 로봇 네트워크 전반에 배포된다. 이는 물리적 세계에 대한 로봇들의 집단적 이해를 높이고 실용적인 지식을 확장한다.
또한 이 모델은 네오가 주어진 프롬프트를 어떻게 해석하고 대응 방안을 계획하는지 파악할 수 있게 해줍니다. 이러한 행동 데이터는 1X가 모델을 훈련하는 데 도움이 되며, 로봇이 완전히 새로운 지시에도 효과적으로 대응할 수 있는 미래를 향해 나아가는 데 기여합니다.
Disrupt 2026 대기자 명단에 등록하세요
Disrupt 2026 대기자 명단에 등록하여 얼리버드 티켓을 우선 구매할 기회를 확보하세요. 지난 Disrupt 행사에는 Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Elad Gil, Vinod Khosla 등 업계 리더들이 참여했습니다. 이들은 여러분의 성장과 경쟁 우위를 가속화하기 위해 마련된 200개 이상의 세션을 이끄는 250명 이상의 업계 전문가 중 일부입니다. 또한, 모든 분야의 수백 개 혁신 스타트업과 교류할 수 있는 기회를 얻으세요.
Disrupt 2026 대기자 명단에 등록하세요
Disrupt 2026 대기자 명단에 등록하여 얼리버드 티켓을 우선 구매할 수 있는 기회를 확보하세요. 지난 Disrupt 행사에는 Google Cloud, Netflix, Microsoft, Box, Phia, a16z, ElevenLabs, Wayve, Hugging Face, Elad Gil, Vinod Khosla 등 250명 이상의 업계 전문가들이 참여하여, 여러분의 성장과 경쟁 우위를 가속화하기 위해 마련된 200개 이상의 세션을 이끌었습니다. 또한, 모든 분야의 혁신적인 스타트업 수백 곳과 교류할 수 있는 기회를 놓치지 마세요.
샌프란시스코 | 2026년 10월 13~15일 지금 대기자 명단에 등록하세요
내부 세부 사항 공개: 차세대 Gemini에 대한Computing Power의 긴장, 내부 팀들은 개발 우선순위와 자원 배분에 대해 의견이 갈렸다
보고에 따르면 구글의 높은 기대를 모았던次世代 제미니 모델의 출시가 연기되었다. 개발 우선순위와 자원 배분에 대한 내부 의견 불일치, 제한된 컴퓨팅 용량, 복잡한 승인 절차가 결합되어 2개월의 지연이 불가피해졌다. 자체 맞춤형 TPU 칩을 보유하고 있음에도 불구하고, 모델 학습, 구글 클라우드 서비스, 수많은 소비자 및 기업용 AI 애플리케이션 간의 경쟁적 수요로 인해 구글은 컴퓨팅 자원 부족에 직면해 있다. 최고 경영진은 이제 조직 개편을 통
OpenAI, 성장 둔화 우려 불식…여러 사업부門 가속화
외부로부터의 판매 성장 둔화 및 내부 목표 미달성에 대한 scrutiny에 대응하여, AI 선도 기업 오픈AI는 4월 28일 화요일에 자신감 있는 성명을 발표했다. 이 회사는 소비자 제품과 기업 서비스의 빠른 진전을 명확히 하며, 최근 제기된 사업 둔화에 대한 추측을 직접적으로 반박했다.동사가 "여러 내부 목표를 놓쳤다"는 주장에 대해, 오픈AI는 이러한 보도를 "전형적인 클릭베이트"로 일축했다. 이 회사는 AI 통합에 대한 강력한 기업 수요
알리바바 슈퍼컵: Qwen3.8-Max, 강화된 코딩 및 오피스 도구로 데뷔
Alibaba는 2.4조 개의 파라미터를 갖춘 차세대 기반 대형 모델인 Qwen3.8-Max를 공식적으로 공개했습니다. 이 중요한 AI 기술 발전은 코딩 및 전문 사무 작업 등 핵심 영역에서 상당한 성능 향상을 제공하며, 강력한 기술 역량을 보여줍니다.권위 있는 Arena 대형 모델 랭킹에서 Qwen3.8-Max는 Anthropic의 Claude 시리즈에 이어 우수한 성적을 거두며 업계 선두 그룹에 자리했습니다. 이 성과는 국내 대형 모델이
So they're basically giving robots a physics engine in their brains? That sounds cool but also kinda scary. How do they handle all the messy real-world noise that simulators can't capture? 🤔
Interesting approach, but I'm a bit skeptical about how well a physics-based world model can handle the messy unpredictability of real environments. The video input part sounds promising for learning, but I wonder about the computational cost and if it'll lead to robots that are good at specific tasks but lack common sense. The race for humanoid AI is heating up! 🤖





집






