연구자들은 OpenAi의 $ 50 '추론'모델에 대한 오픈 소스 라이벌을 50 달러 미만으로 개발합니다.

지난 금요일, 스탠포드와 워싱턴 대학교의 AI 전문가들이 발표한 획기적인 연구 논문이 공개되며, 그들이 클라우드 컴퓨팅 크레딧으로 50달러 미만의 비용으로 AI "추론" 모델인 s1을 개발했다는 사실이 밝혀졌다. 이 소식은 AI 세계를 뒤흔들고 있으며, s1은 수학 및 코딩 과제에서 OpenAI의 o1이나 DeepSeek의 R1 같은 최상위 모델들과 경쟁할 수 있는 성능을 보여준다.
s1 모델과 그 훈련 데이터 및 코드의 모든 세부 사항은 이제 GitHub에서 누구나 이용할 수 있다. 연구팀은 평범한 기본 모델에서 시작해 증류라는 기술을 통해 모델을 강화했다. 이 과정은 다른 AI 모델의 응답을 훈련 데이터로 사용하여 "추론" 능력을 추출하는 것을 포함한다. 이 경우, s1은 Google의 Gemini 2.0 Flash Thinking Experimental 모델에서 지능을 얻었다. 이는 버클리 연구자들이 지난 달 약 450달러로 자체 AI 추론 모델을 개발할 때 사용한 것과 유사한 전략이다.
일부 사람들에게는 소규모 연구팀이 거대한 예산 없이도 AI 분야에서 파장을 일으킬 수 있다는 사실이 흥미롭다. 하지만 s1의 등장은 AI 모델 개발의 미래에 대한 심각한 질문을 불러일으킨다. 수백만 달러로 구축된 모델과 경쟁할 수 있는 모델이 저렴한 예산으로 복제될 수 있다면, 모두가 똑같이 하지 못할 이유가 있을까?
당연히 AI 업계의 거대 기업들은 이에 대해 기뻐하지 않는다. 예를 들어, OpenAI는 DeepSeek이 그들의 API 데이터를 사용하여 모델 증류를 했다고 비난했다. 한편, s1 팀은 견고한 추론 성능과 "테스트 시간 스케일링"이라는 것을 달성하는 가장 간단한 방법을 찾는 데 집중했다. 이는 AI 모델이 답변 전에 더 많은 시간을 "생각"하도록 하는 것으로, OpenAI의 o1 모델이 도입한 혁신과 동일하며, DeepSeek 같은 다른 기업들이 자체 방식으로 모방하려 한 바 있다.
s1 논문은 비교적 작은 데이터셋을 사용하여 지도 미세 조정(SFT)이라는 기술로 추론 모델을 증류할 수 있다고 제안한다. 이는 AI 모델이 데이터셋에서 특정 행동을 모방하도록 훈련시키는 것으로, DeepSeek이 OpenAI의 o1과 경쟁하는 R1 모델에 사용한 대규모 강화 학습보다 비용이 적게 든다.
Google은 Gemini 2.0 Flash Thinking Experimental을 Google AI Studio 플랫폼을 통해 무료로 제공하지만, 일일 사용 제한이 있다. 하지만 한 가지 제약이 있다—Google의 약관은 경쟁 서비스를 만들기 위해 모델을 역설계하는 것을 허용하지 않는다. 이에 대해 Google의 답변을 기다리고 있다.
s1 모델 자체는 알리바바의 Qwen 연구소에서 제공하는 평범한 오프-더-셸프 AI 모델로 시작되었으며, 누구나 무료로 다운로드할 수 있다. s1을 훈련시키기 위해 연구팀은 Google의 Gemini 2.0에서 제공한 1,000개의 신중히 선별된 질문과 답변, 그리고 각 답변 뒤의 "사고" 과정을 데이터셋으로 구성했다. 전체 훈련 과정은 16개의 Nvidia H100 GPU에서 30분도 채 걸리지 않았다. 프로젝트에 참여한 스탠포드 연구원 Niklas Muennighoff에 따르면, 오늘날 약 20달러의 컴퓨팅 비용으로 이를 수행할 수 있다.
연구팀은 또한 s1이 자신의 작업을 다시 확인하고 "사고" 시간을 연장하도록 하는 영리한 방법을 사용했다—그저 "기다려"라고 지시한 것뿐이다. 논문에 따르면, s1의 추론 과정에서 이 단어를 추가하면 약간 더 정확한 답변을 도출하는 데 도움이 되었다.
2025년을 내다보면, Meta, Google, Microsoft 같은 기술 대기업들은 AI 인프라에 수천억 달러를 투자할 준비가 되어 있으며, 그 대부분은 차세대 AI 모델 훈련에 사용될 것이다. 증류가 저렴한 비용으로 AI 능력을 재현하는 효과적인 방법임이 입증되었지만, 당분간 완전히 새로운 획기적인 AI 모델을 만드는 데는 이르지 않을 것이다.
관련 기사
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
관련 특별 주제 추천
의견 (11)
0/500
스탠포드랑 워싱턴 대학 팀이 50달러 코스트로 만들어낸 s1 리서치, 진짜 충격이에요. 🤯 오픈소스 개발이랑 저비용 학습 실험 덕분에 AI 대중화가 더 가까워진 느낌인데, 저비용 고성능 모델이 점점 많아지면 AI 기술 격차도 줄어들까요?
Это просто невероятно! 🔥 Открытые модели вроде s1 могут полностью изменить правила игры в ИИ. Если команда из двух университетов смогла создать конкурента OpenAI за $50, представьте, что произойдет, когда такие инструменты станут доступны всем исследователям. Может, скоро увидим взрыв инноваций в малом бюджете? Правда, интересно, как это повлияет на бизнес-модели крупных компаний...
¡Qué pasada! Un modelo de razonamiento por menos de 50 dólares... La verdad es que demuestra cómo el código abierto puede cambiar las reglas del juego en IA. ¿Cuánto tiempo pasará antes que OpenAI tenga que bajar sus precios? 🔥
Это просто невероятно! 🚀 Создать аналог OpenAI за $50 — это настоящий прорыв. Интересно, какие возможности откроются для небольших стартапов и исследователей? Может, скоро мы увидим взлет новых AI-проектов без гигантских бюджетов.
Wow, $50 to rival OpenAI’s model? That’s wild! Makes me wonder how many garage startups are gonna jump on this to build their own AI. Super cool, but I’m curious if it’s as reliable as they claim. 🤔

지난 금요일, 스탠포드와 워싱턴 대학교의 AI 전문가들이 발표한 획기적인 연구 논문이 공개되며, 그들이 클라우드 컴퓨팅 크레딧으로 50달러 미만의 비용으로 AI "추론" 모델인 s1을 개발했다는 사실이 밝혀졌다. 이 소식은 AI 세계를 뒤흔들고 있으며, s1은 수학 및 코딩 과제에서 OpenAI의 o1이나 DeepSeek의 R1 같은 최상위 모델들과 경쟁할 수 있는 성능을 보여준다.
s1 모델과 그 훈련 데이터 및 코드의 모든 세부 사항은 이제 GitHub에서 누구나 이용할 수 있다. 연구팀은 평범한 기본 모델에서 시작해 증류라는 기술을 통해 모델을 강화했다. 이 과정은 다른 AI 모델의 응답을 훈련 데이터로 사용하여 "추론" 능력을 추출하는 것을 포함한다. 이 경우, s1은 Google의 Gemini 2.0 Flash Thinking Experimental 모델에서 지능을 얻었다. 이는 버클리 연구자들이 지난 달 약 450달러로 자체 AI 추론 모델을 개발할 때 사용한 것과 유사한 전략이다.
일부 사람들에게는 소규모 연구팀이 거대한 예산 없이도 AI 분야에서 파장을 일으킬 수 있다는 사실이 흥미롭다. 하지만 s1의 등장은 AI 모델 개발의 미래에 대한 심각한 질문을 불러일으킨다. 수백만 달러로 구축된 모델과 경쟁할 수 있는 모델이 저렴한 예산으로 복제될 수 있다면, 모두가 똑같이 하지 못할 이유가 있을까?
당연히 AI 업계의 거대 기업들은 이에 대해 기뻐하지 않는다. 예를 들어, OpenAI는 DeepSeek이 그들의 API 데이터를 사용하여 모델 증류를 했다고 비난했다. 한편, s1 팀은 견고한 추론 성능과 "테스트 시간 스케일링"이라는 것을 달성하는 가장 간단한 방법을 찾는 데 집중했다. 이는 AI 모델이 답변 전에 더 많은 시간을 "생각"하도록 하는 것으로, OpenAI의 o1 모델이 도입한 혁신과 동일하며, DeepSeek 같은 다른 기업들이 자체 방식으로 모방하려 한 바 있다.
s1 논문은 비교적 작은 데이터셋을 사용하여 지도 미세 조정(SFT)이라는 기술로 추론 모델을 증류할 수 있다고 제안한다. 이는 AI 모델이 데이터셋에서 특정 행동을 모방하도록 훈련시키는 것으로, DeepSeek이 OpenAI의 o1과 경쟁하는 R1 모델에 사용한 대규모 강화 학습보다 비용이 적게 든다.
Google은 Gemini 2.0 Flash Thinking Experimental을 Google AI Studio 플랫폼을 통해 무료로 제공하지만, 일일 사용 제한이 있다. 하지만 한 가지 제약이 있다—Google의 약관은 경쟁 서비스를 만들기 위해 모델을 역설계하는 것을 허용하지 않는다. 이에 대해 Google의 답변을 기다리고 있다.
s1 모델 자체는 알리바바의 Qwen 연구소에서 제공하는 평범한 오프-더-셸프 AI 모델로 시작되었으며, 누구나 무료로 다운로드할 수 있다. s1을 훈련시키기 위해 연구팀은 Google의 Gemini 2.0에서 제공한 1,000개의 신중히 선별된 질문과 답변, 그리고 각 답변 뒤의 "사고" 과정을 데이터셋으로 구성했다. 전체 훈련 과정은 16개의 Nvidia H100 GPU에서 30분도 채 걸리지 않았다. 프로젝트에 참여한 스탠포드 연구원 Niklas Muennighoff에 따르면, 오늘날 약 20달러의 컴퓨팅 비용으로 이를 수행할 수 있다.
연구팀은 또한 s1이 자신의 작업을 다시 확인하고 "사고" 시간을 연장하도록 하는 영리한 방법을 사용했다—그저 "기다려"라고 지시한 것뿐이다. 논문에 따르면, s1의 추론 과정에서 이 단어를 추가하면 약간 더 정확한 답변을 도출하는 데 도움이 되었다.
2025년을 내다보면, Meta, Google, Microsoft 같은 기술 대기업들은 AI 인프라에 수천억 달러를 투자할 준비가 되어 있으며, 그 대부분은 차세대 AI 모델 훈련에 사용될 것이다. 증류가 저렴한 비용으로 AI 능력을 재현하는 효과적인 방법임이 입증되었지만, 당분간 완전히 새로운 획기적인 AI 모델을 만드는 데는 이르지 않을 것이다.
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
스탠포드랑 워싱턴 대학 팀이 50달러 코스트로 만들어낸 s1 리서치, 진짜 충격이에요. 🤯 오픈소스 개발이랑 저비용 학습 실험 덕분에 AI 대중화가 더 가까워진 느낌인데, 저비용 고성능 모델이 점점 많아지면 AI 기술 격차도 줄어들까요?
Это просто невероятно! 🔥 Открытые модели вроде s1 могут полностью изменить правила игры в ИИ. Если команда из двух университетов смогла создать конкурента OpenAI за $50, представьте, что произойдет, когда такие инструменты станут доступны всем исследователям. Может, скоро увидим взрыв инноваций в малом бюджете? Правда, интересно, как это повлияет на бизнес-модели крупных компаний...
¡Qué pasada! Un modelo de razonamiento por menos de 50 dólares... La verdad es que demuestra cómo el código abierto puede cambiar las reglas del juego en IA. ¿Cuánto tiempo pasará antes que OpenAI tenga que bajar sus precios? 🔥
Это просто невероятно! 🚀 Создать аналог OpenAI за $50 — это настоящий прорыв. Интересно, какие возможности откроются для небольших стартапов и исследователей? Может, скоро мы увидим взлет новых AI-проектов без гигантских бюджетов.
Wow, $50 to rival OpenAI’s model? That’s wild! Makes me wonder how many garage startups are gonna jump on this to build their own AI. Super cool, but I’m curious if it’s as reliable as they claim. 🤔





집






