미스트랄, ‘로보스트랄 네비게이트 8B’ 공개: 단일 카메라 자율 항법 시스템, 다중 카메라 시스템보다 뛰어난 성능 발휘
프랑스의 인공지능 기업 미스트랄(Mistral)이 로봇 내비게이션을 위한 첫 번째 AI 모델인 ‘로보스트랄 네비게이트(Robostral Navigate)’를 출시했다. 80억 개의 매개변수를 갖춘 이 모델을 통해 로봇은 표준 RGB 카메라만으로도 복잡한 환경에서 자율적으로 이동할 수 있어, 깊이 센서나 라이다(LiDAR)가 필요하지 않다.

주로 신체 기반 내비게이션을 위해 설계된 ‘Robostral Navigate’는 사무실, 주거 공간, 상업용 건물, 야외 공간 등 다양한 환경에서 활용될 수 있습니다. 기존의 내비게이션 시스템은 대개 고가의 라이다(LiDAR)나 깊이 센서에 의존하여 하드웨어 비용과 구축 복잡성을 증가시켰습니다. ‘Robostral Navigate’는 표준 카메라와 80억 개의 매개변수를 가진 모델을 활용함으로써 이러한 장벽을 크게 낮추고, 환경 인식부터 경로 계획에 이르는 완전한 폐쇄 루프 시스템을 구축합니다.
단일 렌즈로 멀티 카메라 시스템을 능가하는 이 모델은 새로운 환경에서도 76% 이상의 성공률을 달성합니다.
성능 지표는 매우 인상적입니다. R2R-CE 벤치마크 테스트에서 이 모델은 훈련 데이터에 포함된 장면에서 79.4%, 완전히 새로운 환경에서 76.6%의 성공률을 기록했습니다. 특히, 이 모델은 기존 최고의 단일 카메라 솔루션을 9.7포인트 앞섰으며, 깊이 센서나 다중 카메라를 사용하는 최상위 시스템보다 4.5포인트 높은 성과를 기록했습니다. 이는 단일 카메라 방식이 다중 카메라 솔루션에 필적할 뿐만 아니라, 전반적인 성능 면에서도 획기적인 발전을 이룰 수 있음을 입증합니다.
미스트랄은 이 모델을 전적으로 자체 개발했으며, 6,000개의 서로 다른 가상 공간에 걸쳐 기록된 약 40만 개의 경로를 활용하여 시뮬레이션 환경에서만 훈련을 진행했습니다. 이러한 순수 시뮬레이션 기반 훈련 전략은 실제 데이터 수집의 필요성을 최소화하는 동시에, 가상 환경에서 물리적 환경으로 기술을 이전하는 효과성을 입증합니다.
바퀴형, 다리형, 비행형 로봇과 호환되는 이 오픈소스 생태계는 매우 유망한 전망을 보여줍니다.
호환성 측면에서, Robostral Navigate는 바퀴형, 다리형, 비행형 플랫폼 등 세 가지 주요 로봇 범주를 지원하여 현재의 주류 로봇 형태를 모두 아우릅니다. 바퀴형 물류 로봇, 4족 보행 로봇 개, 드론 등 어떤 분야에 적용하더라도 동일한 내비게이션 모델을 적용할 수 있어 뛰어난 다용도성을 보여줍니다.
관련 기사
텐센트, 비공개 위챗 테스트를 위해 핸디 봇이라는 코드네임의 개인 에이전트 출시
텐센트가 내부적으로 '핸디 봇(Handy Bot)'이라는 명칭으로 개인용 AI 에이전트 제품을 개발 중이며, 이를 독립형 앱으로 출시할 계획인 것으로 알려졌다. 해당 서비스는 이미 위챗에 조용히 등장했으며, 계정 설명에는 '당신의 개인용 AI 에이전트'라고 명시되어 있다.핸디 봇은 기존 챗봇과는 근본적으로 다른 접근 방식을 취한다. 전통적인 봇은 간단한 질문-답변 모델에 기반하여 대화 종료와 함께 작업을 끝내는 반면, 개인 에이전트는 '백그라
OpenAI, 저가형 ChatGPT 버전 출시 예정, 넷플릭스와 경쟁하기 위해 광고 기반 모델 도입 가능성
OpenAI는 현재 서비스 구조를 전면 개편하고 더 저렴한 ChatGPT 구독 등급을 출시함으로써 대상 고객을 확대할 예정입니다. 내부 소식통에 따르면, 이 회사는 넷플릭스의 비즈니스 모델에서 영감을 얻어 할인된 요금제에서 발생하는 수익 부족을 광고를 통합하여 메꿀 것을 목표로 하고 있습니다.이러한 전략적 전환은 OpenAI가 독점 유료 회원제 프레임워크에서 하이브리드 Monetization 전략으로 이동하고 있음을 시사합니다. ChatGPT
위챗 비전 팀, 범용 다중 모달 임베딩 모델 ‘WeMM-Embedding’ 오픈소스 공개… 일일 통화량 100억 건 돌파
텐센트의 위챗 비주얼 팀은 텍스트와 이미지 입력을 모두 지원하도록 설계된 다목적 다모달 임베딩 모델인 ‘WeMM-Embedding’을 공식적으로 오픈소스로 공개했습니다. 이 모델은 첨단 기술 아키텍처와 정교한 훈련 전략을 활용하여 AI 개발자들에게 강력한 지원을 제공함으로써, 다양한 산업 분야에서 인공지능의 혁신적인 응용을 촉진합니다.2B, 4B, 9B의
관련 특별 주제 추천
의견 (0)
0/500
프랑스의 인공지능 기업 미스트랄(Mistral)이 로봇 내비게이션을 위한 첫 번째 AI 모델인 ‘로보스트랄 네비게이트(Robostral Navigate)’를 출시했다. 80억 개의 매개변수를 갖춘 이 모델을 통해 로봇은 표준 RGB 카메라만으로도 복잡한 환경에서 자율적으로 이동할 수 있어, 깊이 센서나 라이다(LiDAR)가 필요하지 않다.

주로 신체 기반 내비게이션을 위해 설계된 ‘Robostral Navigate’는 사무실, 주거 공간, 상업용 건물, 야외 공간 등 다양한 환경에서 활용될 수 있습니다. 기존의 내비게이션 시스템은 대개 고가의 라이다(LiDAR)나 깊이 센서에 의존하여 하드웨어 비용과 구축 복잡성을 증가시켰습니다. ‘Robostral Navigate’는 표준 카메라와 80억 개의 매개변수를 가진 모델을 활용함으로써 이러한 장벽을 크게 낮추고, 환경 인식부터 경로 계획에 이르는 완전한 폐쇄 루프 시스템을 구축합니다.
단일 렌즈로 멀티 카메라 시스템을 능가하는 이 모델은 새로운 환경에서도 76% 이상의 성공률을 달성합니다.
성능 지표는 매우 인상적입니다. R2R-CE 벤치마크 테스트에서 이 모델은 훈련 데이터에 포함된 장면에서 79.4%, 완전히 새로운 환경에서 76.6%의 성공률을 기록했습니다. 특히, 이 모델은 기존 최고의 단일 카메라 솔루션을 9.7포인트 앞섰으며, 깊이 센서나 다중 카메라를 사용하는 최상위 시스템보다 4.5포인트 높은 성과를 기록했습니다. 이는 단일 카메라 방식이 다중 카메라 솔루션에 필적할 뿐만 아니라, 전반적인 성능 면에서도 획기적인 발전을 이룰 수 있음을 입증합니다.
미스트랄은 이 모델을 전적으로 자체 개발했으며, 6,000개의 서로 다른 가상 공간에 걸쳐 기록된 약 40만 개의 경로를 활용하여 시뮬레이션 환경에서만 훈련을 진행했습니다. 이러한 순수 시뮬레이션 기반 훈련 전략은 실제 데이터 수집의 필요성을 최소화하는 동시에, 가상 환경에서 물리적 환경으로 기술을 이전하는 효과성을 입증합니다.
바퀴형, 다리형, 비행형 로봇과 호환되는 이 오픈소스 생태계는 매우 유망한 전망을 보여줍니다.
호환성 측면에서, Robostral Navigate는 바퀴형, 다리형, 비행형 플랫폼 등 세 가지 주요 로봇 범주를 지원하여 현재의 주류 로봇 형태를 모두 아우릅니다. 바퀴형 물류 로봇, 4족 보행 로봇 개, 드론 등 어떤 분야에 적용하더라도 동일한 내비게이션 모델을 적용할 수 있어 뛰어난 다용도성을 보여줍니다.
텐센트, 비공개 위챗 테스트를 위해 핸디 봇이라는 코드네임의 개인 에이전트 출시
텐센트가 내부적으로 '핸디 봇(Handy Bot)'이라는 명칭으로 개인용 AI 에이전트 제품을 개발 중이며, 이를 독립형 앱으로 출시할 계획인 것으로 알려졌다. 해당 서비스는 이미 위챗에 조용히 등장했으며, 계정 설명에는 '당신의 개인용 AI 에이전트'라고 명시되어 있다.핸디 봇은 기존 챗봇과는 근본적으로 다른 접근 방식을 취한다. 전통적인 봇은 간단한 질문-답변 모델에 기반하여 대화 종료와 함께 작업을 끝내는 반면, 개인 에이전트는 '백그라
OpenAI, 저가형 ChatGPT 버전 출시 예정, 넷플릭스와 경쟁하기 위해 광고 기반 모델 도입 가능성
OpenAI는 현재 서비스 구조를 전면 개편하고 더 저렴한 ChatGPT 구독 등급을 출시함으로써 대상 고객을 확대할 예정입니다. 내부 소식통에 따르면, 이 회사는 넷플릭스의 비즈니스 모델에서 영감을 얻어 할인된 요금제에서 발생하는 수익 부족을 광고를 통합하여 메꿀 것을 목표로 하고 있습니다.이러한 전략적 전환은 OpenAI가 독점 유료 회원제 프레임워크에서 하이브리드 Monetization 전략으로 이동하고 있음을 시사합니다. ChatGPT
위챗 비전 팀, 범용 다중 모달 임베딩 모델 ‘WeMM-Embedding’ 오픈소스 공개… 일일 통화량 100억 건 돌파
텐센트의 위챗 비주얼 팀은 텍스트와 이미지 입력을 모두 지원하도록 설계된 다목적 다모달 임베딩 모델인 ‘WeMM-Embedding’을 공식적으로 오픈소스로 공개했습니다. 이 모델은 첨단 기술 아키텍처와 정교한 훈련 전략을 활용하여 AI 개발자들에게 강력한 지원을 제공함으로써, 다양한 산업 분야에서 인공지능의 혁신적인 응용을 촉진합니다.2B, 4B, 9B의





집






