애플, 성능 우려 속 이미지 설명을 위한 ‘루비캡(RubiCap)’ AI 공개
컴퓨터 비전 분야에서 AI가 인간과 같은 정밀도로 이미지의 모든 세부 사항을 관찰하고 묘사할 수 있도록 하는 것은 오랫동안 핵심 과제로 여겨져 왔습니다. 최근 애플은 위스콘신-매디슨 대학교와 협력하여 RubiCap 이라는 새로운 AI 훈련 프레임워크를 공식 출시했습니다.
이 프레임워크는 '고밀도 이미지 캡셔닝(dense image captioning)'을 위해 특별히 설계되었으며, AI가 단순히 일반적인 요약만 제공하는 것이 아니라 "나무 탁자 위의 빨간 사과"나 "멀리 있는 보행자"와 같은 세밀한 세부 사항을 정확하게 포착하고 표현할 수 있도록 하는 것을 목표로 합니다.

큰 파장을 일으킨 강화 학습: '심판' 역할을 하는 Qwen2.5
기존의 이미지 캡셔닝은 비용이 많이 드는 수동 라벨링이나 환각 현상에 취약한 대규모 모델에 의존하는 경우가 많아 데이터 품질이 일관되지 않은 문제가 있었습니다. 애플 연구팀은 혁신적인 강화 학습 접근법을 통해 이 문제를 해결했습니다. 이 시스템은 먼저 GPT-4와 Gemini 1.5 Pro를 사용하여 후보 설명을 생성합니다. 그런 다음 Gemini 1.5 Pro가 평가 기준을 정교화하는 동안, Qwen2.5 모델이 심판 역할을 수행하며 점수와 피드백을 제공합니다.
이러한 체계적이고 정밀한 피드백을 통해 훈련 모델은 오류를 명확히 식별하고 수정할 수 있어, 더 적은 매개변수 수로도 더 높은 설명 정확도를 달성합니다.
소형 모델의 장점: 1조 파라미터 모델을 능가하는 낮은 환각 발생률
이 프레임워크로 훈련된 RubiCap 시리즈 모델(20억~70억 파라미터)은 평가에서 탁월한 효율성을 보여주었습니다. 실험 데이터에 따르면, 70억 파라미터의 RubiCap 모델은 블라인드 테스트에서 최고 점수를 기록했으며, 환각 오류율은 선도적인 7,200억 파라미터 대형 모델보다 낮았습니다. 놀랍게도, 30억 파라미터의 미니 버전은 특정 지표에서 70억 파라미터 버전보다 더 뛰어난 성능을 보였습니다.
관련 기사
인도 기술 거대기업이 마이크로소프트 오피스의 AI 경쟁사에 3000만 달러 투자
시리즈 창업가 바힌 투라크히아는 3,000만 달러의 자금을 자신의 자본으로 투자하며, 엔터프라이즈 AI 분야에 여전히 신규 진입자에게 기회가 남아 있다고 믿고 있다. 그의 최신 스타트업 ‘Neo’는 핵심 신념을 바탕으로 운영된다: 기존 직장용 소프트웨어는 채팅봇으로 단순히 패치할 수 없으며, 아키텍처의 완전한 재설계가 필요하다는 것이다.46세의 투라크히아는 야심 찬 엔터프라이즈 테크 벤처를 지원해 온 이력이 있다. 지난 20년간 그는 Dire
전 OpenAI 수석 과학자 일리아의 SSI가 첫 모델을 공개하다
AI는 또 다른 주요 이정표를 달성했습니다. 오픈AI를 떠난 전 수석 과학자 일야 수트케버는 세이프 슈퍼인텔리전스 인크.(SSI)를 설립했으며, 이 회사는 최근 첫 번째 모델에 대한 세부 사항을 공개했습니다. 해외 소셜 미디어의 보도에 따르면, 이 팀은 안전한 슈퍼인텔리전스 추구를 위한 중요한 진전인 TTT(테스트 중 학습)를 활용한 컴팩트한 추론 엔진을 개발하고 있습니다.이 새로운 아키텍처는 모델이 '학습 방법을 학습'할 수 있도록 하는 데
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026년 5월 14일, AI 애플리케이션 개발 플랫폼 라블러블(Lovable)은 덴마크 하드웨어 스타트업 Atech의 80만 달러 시드 투자 라운드 참여를 발표했습니다. 라블러블이 주도한 이번 투자에는 a16z 스카우트 펀드, 시에리야 스카우트 펀드, 노르딕 메이커스(Nordic Makers) 등 최상위 벤처캐피탈 기업들이 참여했습니다. 이번 투자는 라블러블이 순수 소프트웨어 개발을 넘어 하드웨어 엔지니어링 영역으로 '바이브 코딩(Vibe C
관련 특별 주제 추천
의견 (0)
0/500
컴퓨터 비전 분야에서 AI가 인간과 같은 정밀도로 이미지의 모든 세부 사항을 관찰하고 묘사할 수 있도록 하는 것은 오랫동안 핵심 과제로 여겨져 왔습니다. 최근 애플은 위스콘신-매디슨 대학교와 협력하여
이 프레임워크는 '고밀도 이미지 캡셔닝(dense image captioning)'을 위해 특별히 설계되었으며, AI가 단순히 일반적인 요약만 제공하는 것이 아니라 "나무 탁자 위의 빨간 사과"나 "멀리 있는 보행자"와 같은 세밀한 세부 사항을 정확하게 포착하고 표현할 수 있도록 하는 것을 목표로 합니다.

큰 파장을 일으킨 강화 학습: '심판' 역할을 하는 Qwen2.5
기존의 이미지 캡셔닝은 비용이 많이 드는 수동 라벨링이나 환각 현상에 취약한 대규모 모델에 의존하는 경우가 많아 데이터 품질이 일관되지 않은 문제가 있었습니다. 애플 연구팀은 혁신적인 강화 학습 접근법을 통해 이 문제를 해결했습니다. 이 시스템은 먼저 GPT-4와 Gemini 1.5 Pro를 사용하여 후보 설명을 생성합니다. 그런 다음 Gemini 1.5 Pro가 평가 기준을 정교화하는 동안, Qwen2.5 모델이 심판 역할을 수행하며 점수와 피드백을 제공합니다.
이러한 체계적이고 정밀한 피드백을 통해 훈련 모델은 오류를 명확히 식별하고 수정할 수 있어, 더 적은 매개변수 수로도 더 높은 설명 정확도를 달성합니다.
소형 모델의 장점: 1조 파라미터 모델을 능가하는 낮은 환각 발생률
이 프레임워크로 훈련된 RubiCap 시리즈 모델(20억~70억 파라미터)은 평가에서 탁월한 효율성을 보여주었습니다. 실험 데이터에 따르면, 70억 파라미터의 RubiCap 모델은 블라인드 테스트에서 최고 점수를 기록했으며, 환각 오류율은 선도적인 7,200억 파라미터 대형 모델보다 낮았습니다. 놀랍게도, 30억 파라미터의 미니 버전은 특정 지표에서 70억 파라미터 버전보다 더 뛰어난 성능을 보였습니다.
인도 기술 거대기업이 마이크로소프트 오피스의 AI 경쟁사에 3000만 달러 투자
시리즈 창업가 바힌 투라크히아는 3,000만 달러의 자금을 자신의 자본으로 투자하며, 엔터프라이즈 AI 분야에 여전히 신규 진입자에게 기회가 남아 있다고 믿고 있다. 그의 최신 스타트업 ‘Neo’는 핵심 신념을 바탕으로 운영된다: 기존 직장용 소프트웨어는 채팅봇으로 단순히 패치할 수 없으며, 아키텍처의 완전한 재설계가 필요하다는 것이다.46세의 투라크히아는 야심 찬 엔터프라이즈 테크 벤처를 지원해 온 이력이 있다. 지난 20년간 그는 Dire
전 OpenAI 수석 과학자 일리아의 SSI가 첫 모델을 공개하다
AI는 또 다른 주요 이정표를 달성했습니다. 오픈AI를 떠난 전 수석 과학자 일야 수트케버는 세이프 슈퍼인텔리전스 인크.(SSI)를 설립했으며, 이 회사는 최근 첫 번째 모델에 대한 세부 사항을 공개했습니다. 해외 소셜 미디어의 보도에 따르면, 이 팀은 안전한 슈퍼인텔리전스 추구를 위한 중요한 진전인 TTT(테스트 중 학습)를 활용한 컴팩트한 추론 엔진을 개발하고 있습니다.이 새로운 아키텍처는 모델이 '학습 방법을 학습'할 수 있도록 하는 데
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026년 5월 14일, AI 애플리케이션 개발 플랫폼 라블러블(Lovable)은 덴마크 하드웨어 스타트업 Atech의 80만 달러 시드 투자 라운드 참여를 발표했습니다. 라블러블이 주도한 이번 투자에는 a16z 스카우트 펀드, 시에리야 스카우트 펀드, 노르딕 메이커스(Nordic Makers) 등 최상위 벤처캐피탈 기업들이 참여했습니다. 이번 투자는 라블러블이 순수 소프트웨어 개발을 넘어 하드웨어 엔지니어링 영역으로 '바이브 코딩(Vibe C





집






