옵션
속보
콘텐츠
MatthewLewis
MatthewLewis
2026년 7월 21일

구글 딥마인드(Google DeepMind)는 알리바바의 Wan2.1 프레임워크를 기반으로 구축된 ‘GenCeption’ 모델을 출시했는데, 이 모델은 영상 생성을 역전시켜 시각 분석 엔진으로 전환합니다. 이 모델은 단일 전방 통과(forward pass) 과정에서 깊이 추정, 분할, 3D 자세 추정 등 5가지 핵심 작업을 동시에 수행합니다. 단 7,500개의 1인 합성 영상으로만 훈련되었음에도 불구하고, 이 모델은 다인, 동물, 로봇이 등장하는 장면까지 일반화하여 처리할 수 있습니다. 소형 모델은 6초 만에 81프레임을 처리하며, 140억 파라미터 규모의 대형 모델은 10초가 소요되지만 고양이의 수염이나 털과 같은 미세한 디테일까지 정확히 재현합니다.

구글 딥마인드(Google DeepMind)는 알리바바의 Wan2.1 프레임워크를 기반으로 구축된 ‘GenCeption’ 모델을 출시했는데, 이 모델은 영상 생성을 역전시켜 시각 분석 엔진으로 전환합니다. 이 모델은 단일 전방 통과(forward pass) 과정에서 깊이 추정, 분할, 3D 자세 추정 등 5가지 핵심 작업을 동시에 수행합니다. 단 7,500개의 1인 합성 영상으로만 훈련되었음에도 불구하고, 이 모델은 다인, 동물, 로봇이 등장하는 장면까지 일반화하여 처리할 수 있습니다. 소형 모델은 6초 만에 81프레임을 처리하며, 140억 파라미터 규모의 대형 모델은 10초가 소요되지만 고양이의 수염이나 털과 같은 미세한 디테일까지 정확히 재현합니다.
의견 (0)
0/300
OR