AI 스케일링 획기적인 전문가가 의문을 제기했습니다

소셜 미디어에서 연구자들이 새로운 AI "스케일링 법칙"을 발견했다는 소식이 화제가 되었지만, 전문가들은 이를 신중히 받아들이고 있습니다. AI 스케일링 법칙은 비공식적 지침에 가까우며, 더 많은 데이터와 컴퓨팅 파워를 투입할수록 AI 모델이 향상되는 방식을 보여줍니다. 약 1년 전까지만 해도 주요 트렌드는 "사전 훈련"이었는데, 이는 더 큰 데이터셋으로 더 큰 모델을 훈련시키는 것이었습니다. 이는 여전히 유효하지만, 이제 두 가지 새로운 스케일링 법칙이 추가되었습니다: 모델의 행동을 조정하는 사후 훈련 스케일링과 추론 시 더 많은 컴퓨팅 파워를 사용해 모델의 "추론" 능력을 향상시키는 테스트 타임 스케일링(예: R1 모델).
최근 Google과 UC Berkeley의 연구자들이 발표한 논문은 온라인에서 일부 사람들이 네 번째 법칙으로 부르는 "추론 시 검색"에 관한 것입니다. 이 방법은 모델이 한 번의 질의에 대해 여러 가능한 답변을 생성한 뒤 최적의 답변을 선택하도록 합니다. 연구자들은 이 방법이 Google의 Gemini 1.5 Pro 같은 오래된 모델의 성능을 향상시켜 OpenAI의 o1-preview "추론" 모델을 과학 및 수학 벤치마크에서 능가할 수 있다고 주장합니다.
Google의 박사 펠로우이자 논문 공동 저자인 Eric Zhao는 X에서 200개의 응답을 무작위로 샘플링하고 모델이 자체 검증하도록 하면, 그가 농담으로 "2024년 초의 고대 모델"이라 부른 Gemini 1.5가 o1-preview를 능가하고 심지어 o1에 근접할 수 있다고 밝혔습니다. 그는 스케일이 커질수록 자체 검증이 더 쉬워진다고 지적했는데, 이는 직관에 반하지만 흥미롭습니다.
하지만 모두가 이에 동의하는 것은 아닙니다. 알버타 대학의 AI 연구자이자 조교수인 Matthew Guzdial은 TechCrunch에 이 접근법은 답변을 판단할 확실한 방법이 있을 때 가장 효과적이라고 말했습니다. 하지만 대부분의 질문은 그렇게 명확하지 않습니다. 그는 "우리가 원하는 것을 코드로 정의할 수 없다면, [추론 시] 검색을 사용할 수 없습니다. 일반적인 언어 상호작용 같은 경우에는 이를 할 수 없습니다... 이는 대부분의 문제를 실제로 해결하는 데 좋은 접근법이 아닙니다."라고 말했습니다.
이에 Zhao는 그들의 논문이 답변을 판단할 명확한 방법이 없는 경우를 실제로 다루며, 모델이 스스로 이를 파악해야 한다고 응답했습니다. 그는 명확한 판단 기준이 있는 경우와 없는 경우의 격차가 스케일이 커질수록 줄어들 수 있다고 주장했습니다.
킹스 칼리지 런던의 연구 펠로우인 Mike Cook은 Guzdial의 견해를 지지하며, 추론 시 검색은 모델의 추론 능력을 실제로 향상시키지 않는다고 말했습니다. 이는 모델이 자신 있게 잘못된 답변을 내놓는 경향을 우회하는 방법에 가깝습니다. 그는 모델이 5%의 시간 동안 실수한다면, 200번의 시도를 확인하면 그 실수를 더 쉽게 발견할 수 있다고 지적했습니다.
이 소식은 모델의 "추론" 능력을 비용을 들이지 않고 향상시키려는 AI 산업에 다소 실망스러운 소식일 수 있습니다. 논문 저자들은 추론 모델이 단 하나의 수학 문제를 해결하는 데에도 수천 달러의 컴퓨팅 비용이 들 수 있다고 언급했습니다.
새로운 스케일링 기술에 대한 탐색은 아직 끝나지 않은 것 같습니다.
업데이트: 3월 20일 오전 5:12 태평양 표준시: 연구 공동 저자인 Eric Zhao의 코멘트를 추가했으며, 그는 독립 연구자의 비판에 대해 반박했습니다.
관련 기사
바이엘, Iambic AI를 활용해 신약 개발 속도 높여
유르겐 에크하르트(Juergen Eckhardt) 박사는 바이엘 제약(Bayer Pharmaceuticals)의 사업 개발 및 라이선싱 부문 책임자로 재직 중이다.바이엘은 스페인 공장에서 진행 중인 대규모 탈탄소화 프로젝트와 더불어, 신약 개발을 위한 최첨단 AI 모델을 도입하기 위해 아이암빅 테라퓨틱스(Iambic Therapeutics)와 협력하고 있습
최적화 주도형 AI, 범용 모델을 향한 새로운 길로 부상하다
일리노이 대학교 어바나-샴페인 캠퍼스와 버지니아 대학교 연구진이 추론 능력을 강화한 더 탄력적인 AI 시스템의 길을 열 수 있는 새로운 모델 아키텍처를 개발했다.에너지 기반 트랜스포머(EBT)로 명명된 이 아키텍처는 복잡한 문제를 해결하기 위해 추론 시간 확장성을 자연스럽게 활용합니다. 기업에게는 이는 특수한 미세 조정 모델 없이도 새로운 시나리오에 적응할
인공지능 붐, 닷컴 시대 버블 우려를 재현하다
인공지능(AI) 분야에 수십억 달러 규모의 투자가 쏟아지면서 뜨거운 논쟁이 벌어지고 있다: 이 산업이 닷컴 버블과 같은 거품 현상으로 치닫고 있는 것인가?투자자들은 열기가 식거나 칩 및 인프라에 대한 막대한 지출이 기대 수익을 내지 못하고 있다는 징후를 경계하고 있다. 최근 BofA 글로벌 리서치 설문조사에서 펀드 매니저의 54%가 AI 주식이 이미 버블
관련 특별 주제 추천
의견 (37)
0/500
I heard there's a new AI scaling law discovered, but experts are skeptical? It feels like another case of hype overshadowing reality—maybe we should wait for solid experiments before jumping to conclusions. 😅
Interessant, aber ich bin skeptisch. Diese 'Skalierungsgesetze' klingen oft nach einer selbsterfüllenden Prophezeiung der großen Tech-Firmen. Mehr Daten, mehr Rechenleistung – klar wird das Modell 'besser', aber zu welchem Preis? Die Umweltkosten sind enorm, und am Ende bekommen wir vielleicht nur bessere Halluzinationen. Die Experten haben recht, vorsichtig zu sein. 🤔
This AI scaling law thing sounds cool, but it's hard to get excited when experts are so skeptical. It's like they're saying, 'Sure, it's interesting, but let's not get carried away.' I guess we'll see if it's the real deal or just another hype train. 🤔
Essa história de lei de escalabilidade de IA parece legal, mas é difícil se empolgar quando os especialistas são tão céticos. Parece que eles estão dizendo, 'Sim, é interessante, mas não vamos nos empolgar muito'. Vamos ver se é verdade ou só mais um hype. 🤔

소셜 미디어에서 연구자들이 새로운 AI "스케일링 법칙"을 발견했다는 소식이 화제가 되었지만, 전문가들은 이를 신중히 받아들이고 있습니다. AI 스케일링 법칙은 비공식적 지침에 가까우며, 더 많은 데이터와 컴퓨팅 파워를 투입할수록 AI 모델이 향상되는 방식을 보여줍니다. 약 1년 전까지만 해도 주요 트렌드는 "사전 훈련"이었는데, 이는 더 큰 데이터셋으로 더 큰 모델을 훈련시키는 것이었습니다. 이는 여전히 유효하지만, 이제 두 가지 새로운 스케일링 법칙이 추가되었습니다: 모델의 행동을 조정하는 사후 훈련 스케일링과 추론 시 더 많은 컴퓨팅 파워를 사용해 모델의 "추론" 능력을 향상시키는 테스트 타임 스케일링(예: R1 모델).
최근 Google과 UC Berkeley의 연구자들이 발표한 논문은 온라인에서 일부 사람들이 네 번째 법칙으로 부르는 "추론 시 검색"에 관한 것입니다. 이 방법은 모델이 한 번의 질의에 대해 여러 가능한 답변을 생성한 뒤 최적의 답변을 선택하도록 합니다. 연구자들은 이 방법이 Google의 Gemini 1.5 Pro 같은 오래된 모델의 성능을 향상시켜 OpenAI의 o1-preview "추론" 모델을 과학 및 수학 벤치마크에서 능가할 수 있다고 주장합니다.
Google의 박사 펠로우이자 논문 공동 저자인 Eric Zhao는 X에서 200개의 응답을 무작위로 샘플링하고 모델이 자체 검증하도록 하면, 그가 농담으로 "2024년 초의 고대 모델"이라 부른 Gemini 1.5가 o1-preview를 능가하고 심지어 o1에 근접할 수 있다고 밝혔습니다. 그는 스케일이 커질수록 자체 검증이 더 쉬워진다고 지적했는데, 이는 직관에 반하지만 흥미롭습니다.
하지만 모두가 이에 동의하는 것은 아닙니다. 알버타 대학의 AI 연구자이자 조교수인 Matthew Guzdial은 TechCrunch에 이 접근법은 답변을 판단할 확실한 방법이 있을 때 가장 효과적이라고 말했습니다. 하지만 대부분의 질문은 그렇게 명확하지 않습니다. 그는 "우리가 원하는 것을 코드로 정의할 수 없다면, [추론 시] 검색을 사용할 수 없습니다. 일반적인 언어 상호작용 같은 경우에는 이를 할 수 없습니다... 이는 대부분의 문제를 실제로 해결하는 데 좋은 접근법이 아닙니다."라고 말했습니다.
이에 Zhao는 그들의 논문이 답변을 판단할 명확한 방법이 없는 경우를 실제로 다루며, 모델이 스스로 이를 파악해야 한다고 응답했습니다. 그는 명확한 판단 기준이 있는 경우와 없는 경우의 격차가 스케일이 커질수록 줄어들 수 있다고 주장했습니다.
킹스 칼리지 런던의 연구 펠로우인 Mike Cook은 Guzdial의 견해를 지지하며, 추론 시 검색은 모델의 추론 능력을 실제로 향상시키지 않는다고 말했습니다. 이는 모델이 자신 있게 잘못된 답변을 내놓는 경향을 우회하는 방법에 가깝습니다. 그는 모델이 5%의 시간 동안 실수한다면, 200번의 시도를 확인하면 그 실수를 더 쉽게 발견할 수 있다고 지적했습니다.
이 소식은 모델의 "추론" 능력을 비용을 들이지 않고 향상시키려는 AI 산업에 다소 실망스러운 소식일 수 있습니다. 논문 저자들은 추론 모델이 단 하나의 수학 문제를 해결하는 데에도 수천 달러의 컴퓨팅 비용이 들 수 있다고 언급했습니다.
새로운 스케일링 기술에 대한 탐색은 아직 끝나지 않은 것 같습니다.
업데이트: 3월 20일 오전 5:12 태평양 표준시: 연구 공동 저자인 Eric Zhao의 코멘트를 추가했으며, 그는 독립 연구자의 비판에 대해 반박했습니다.
바이엘, Iambic AI를 활용해 신약 개발 속도 높여
유르겐 에크하르트(Juergen Eckhardt) 박사는 바이엘 제약(Bayer Pharmaceuticals)의 사업 개발 및 라이선싱 부문 책임자로 재직 중이다.바이엘은 스페인 공장에서 진행 중인 대규모 탈탄소화 프로젝트와 더불어, 신약 개발을 위한 최첨단 AI 모델을 도입하기 위해 아이암빅 테라퓨틱스(Iambic Therapeutics)와 협력하고 있습
최적화 주도형 AI, 범용 모델을 향한 새로운 길로 부상하다
일리노이 대학교 어바나-샴페인 캠퍼스와 버지니아 대학교 연구진이 추론 능력을 강화한 더 탄력적인 AI 시스템의 길을 열 수 있는 새로운 모델 아키텍처를 개발했다.에너지 기반 트랜스포머(EBT)로 명명된 이 아키텍처는 복잡한 문제를 해결하기 위해 추론 시간 확장성을 자연스럽게 활용합니다. 기업에게는 이는 특수한 미세 조정 모델 없이도 새로운 시나리오에 적응할
인공지능 붐, 닷컴 시대 버블 우려를 재현하다
인공지능(AI) 분야에 수십억 달러 규모의 투자가 쏟아지면서 뜨거운 논쟁이 벌어지고 있다: 이 산업이 닷컴 버블과 같은 거품 현상으로 치닫고 있는 것인가?투자자들은 열기가 식거나 칩 및 인프라에 대한 막대한 지출이 기대 수익을 내지 못하고 있다는 징후를 경계하고 있다. 최근 BofA 글로벌 리서치 설문조사에서 펀드 매니저의 54%가 AI 주식이 이미 버블
I heard there's a new AI scaling law discovered, but experts are skeptical? It feels like another case of hype overshadowing reality—maybe we should wait for solid experiments before jumping to conclusions. 😅
Interessant, aber ich bin skeptisch. Diese 'Skalierungsgesetze' klingen oft nach einer selbsterfüllenden Prophezeiung der großen Tech-Firmen. Mehr Daten, mehr Rechenleistung – klar wird das Modell 'besser', aber zu welchem Preis? Die Umweltkosten sind enorm, und am Ende bekommen wir vielleicht nur bessere Halluzinationen. Die Experten haben recht, vorsichtig zu sein. 🤔
This AI scaling law thing sounds cool, but it's hard to get excited when experts are so skeptical. It's like they're saying, 'Sure, it's interesting, but let's not get carried away.' I guess we'll see if it's the real deal or just another hype train. 🤔
Essa história de lei de escalabilidade de IA parece legal, mas é difícil se empolgar quando os especialistas são tão céticos. Parece que eles estão dizendo, 'Sim, é interessante, mas não vamos nos empolgar muito'. Vamos ver se é verdade ou só mais um hype. 🤔





집






