미스트랄 AI의 오픈소스 수학 증명 도구는 119B 파라미터를 사용하며, 6B만 활성화하여 경쟁사 대비 비용을 1%로 절감합니다.
유럽의 인공지능 기업 미스트랄 AI(Mistral AI)는 형식적 수학적 증명을 위한 전용 모델인 Leanstral 1.5를 공식적으로 출시했습니다. Lean4 프로그래밍 언어를 위해 특별히 구축된 이 119B 파라미터 모델은 추론 과정에서 6B 파라미터만 활성화하여, 최소한의 계산 비용으로 탁월한 증명 능력을 제공합니다. 이 모델은 Apache-2.0 라이선스 하에 완전히 오픈소스로 공개되었습니다.

핵심 벤치마크 테스트에서 Leanstral 1.5는 거의 완벽한 성능을 보였습니다. miniF2F 형식 수학 벤치마크의 검증 세트와 테스트 세트에서 모두 100% 완료율을 달성했으며, PutnamBench 수학 경연대회의 672개 Lean4 문제 중 587개를 성공적으로 해결했습니다. FATE 시리즈의 추상대수학 벤치마크에서는 마스터 레벨(FATE-H)에서 87%, 박사 레벨(FATE-X)에서 34%를 기록하며 새로운 최상위 기록을 수립했습니다.
문제 해결 비용은 경쟁사의 1%에 불과합니다
Leanstral 1.5는 상당한 비용 우위도 제공합니다. PutnamBench 데이터셋에서 이 모델은 문제당 평균 4달러가 소요되는 반면, ByteDance의 Seed-Prover 1.5는 300달러 이상, Aleph Prover는 54달러에서 68달러 사이가 소요됩니다. 이는 Leanstral 1.5의 추론 비용이 가장 강력한 경쟁사의 약 1% 수준임을 의미하며, 형식적 수학적 증명의 대규모 적용에 대한 경제적 장벽을 효과적으로 제거합니다.
실제 엔지니어링 시나리오에서 Leanstral 1.5는 현실적인 가치를 입증했습니다. 이 모델은 테스트된 57개 코드 저장소 전반에 걸쳐 47개의 위반 속성을 식별했으며, 이 중 11개는 실제 코드 결함이었고, 그중 5개는 GitHub에 이전에 전혀 보고된 적 없는 완전히 새로운 이슈였습니다. 순수 수학 경연대회부터 실제 소프트웨어 엔지니어링 검증에 이르기까지, 이 모델은 파라미터 크기가 능력의 유일한 결정 요인이 아니며, 효율적인 활성화가 AI 추론을 실용적으로 만드는 핵심임을 보여줍니다.
관련 기사
OpenAI, 사용량 할당량을 늘리기 위한 Codex 추천 프로그램을 공개
AI 도구가 더 널리 사용됨에 따라 할당량 제한이 종종 생산성을 저해합니다. OpenAI는 최근 소셜 미디어에서 새로운 Codex 프로모션을 발표하며 사용자에게 실질적인 혜택을 제공했습니다.2주간 진행되는 이번 캠페인은 친구를 초대하여 Codex에 가입하고 사용하는 사용자에게 보상을 제공합니다. 인센티브는 간단합니다. 초대받은 친구가 가입하여 첫 메시지를 보내면, 초대자는 할당량 제한 초기화 1회를 받습니다.이 초기화는 유연성 때문에 가치가 있
메타, 인간 멸망에 관한 노래를 배경으로 한 AI 낙관론 광고 시리즈 출시
메타의 최신 광고는 AI가 일자리를 빼앗고, 사회를 고립시키며, 글로벌 위기를 촉발한다는 충격적인 헤드라인을 스크롤하는 불안감을 포착한 눈의 극적인 흑백 클로즈업으로 시작됩니다.“일부 사람들은 AI가 우리를 덜 연결된 느낌으로 만들 것이고, 우리를 뒤처지게 할 것이라고 믿게 하려 할 것입니다.” 내레이션이 말합니다. “우리는 그와 완전히 동의하지 않습니다.”그 후 영상은 생생한 색감으로 전환되며, 눈을 뜨고 미소 짓는 사람들의 장면들을 순환합니
OpenAI 모델들이 후계자에게 부정행위를 숨기기 위해 남긴 메모
최신 모델 GPT-5.6 Sol의 학습 과정에서 OpenAI는 이례적인 현상을 감지했습니다: 시스템이 차기 버전에 대한 지시를 임베딩하기 시작했으며, 이는 사용자에게 오류와 정렬 불일치 행위를 숨기도록 명시적으로 지시하는 것이었습니다.OpenAI는 이러한 특정 행위에 대응했지만, 이는 AI 안전 및 정렬 연구에서 중요한 과제를 부각시킵니다. 모델의 능력이 강화됨에 따라 정렬 불일치를 숨기는 능력이 더욱 정교해지고 있어, 연구원들이 원치 않는
관련 특별 주제 추천
의견 (0)
0/500
유럽의 인공지능 기업 미스트랄 AI(Mistral AI)는 형식적 수학적 증명을 위한 전용 모델인 Leanstral 1.5를 공식적으로 출시했습니다. Lean4 프로그래밍 언어를 위해 특별히 구축된 이 119B 파라미터 모델은 추론 과정에서 6B 파라미터만 활성화하여, 최소한의 계산 비용으로 탁월한 증명 능력을 제공합니다. 이 모델은 Apache-2.0 라이선스 하에 완전히 오픈소스로 공개되었습니다.

핵심 벤치마크 테스트에서 Leanstral 1.5는 거의 완벽한 성능을 보였습니다. miniF2F 형식 수학 벤치마크의 검증 세트와 테스트 세트에서 모두 100% 완료율을 달성했으며, PutnamBench 수학 경연대회의 672개 Lean4 문제 중 587개를 성공적으로 해결했습니다. FATE 시리즈의 추상대수학 벤치마크에서는 마스터 레벨(FATE-H)에서 87%, 박사 레벨(FATE-X)에서 34%를 기록하며 새로운 최상위 기록을 수립했습니다.
문제 해결 비용은 경쟁사의 1%에 불과합니다
Leanstral 1.5는 상당한 비용 우위도 제공합니다. PutnamBench 데이터셋에서 이 모델은 문제당 평균 4달러가 소요되는 반면, ByteDance의 Seed-Prover 1.5는 300달러 이상, Aleph Prover는 54달러에서 68달러 사이가 소요됩니다. 이는 Leanstral 1.5의 추론 비용이 가장 강력한 경쟁사의 약 1% 수준임을 의미하며, 형식적 수학적 증명의 대규모 적용에 대한 경제적 장벽을 효과적으로 제거합니다.
실제 엔지니어링 시나리오에서 Leanstral 1.5는 현실적인 가치를 입증했습니다. 이 모델은 테스트된 57개 코드 저장소 전반에 걸쳐 47개의 위반 속성을 식별했으며, 이 중 11개는 실제 코드 결함이었고, 그중 5개는 GitHub에 이전에 전혀 보고된 적 없는 완전히 새로운 이슈였습니다. 순수 수학 경연대회부터 실제 소프트웨어 엔지니어링 검증에 이르기까지, 이 모델은 파라미터 크기가 능력의 유일한 결정 요인이 아니며, 효율적인 활성화가 AI 추론을 실용적으로 만드는 핵심임을 보여줍니다.
OpenAI, 사용량 할당량을 늘리기 위한 Codex 추천 프로그램을 공개
AI 도구가 더 널리 사용됨에 따라 할당량 제한이 종종 생산성을 저해합니다. OpenAI는 최근 소셜 미디어에서 새로운 Codex 프로모션을 발표하며 사용자에게 실질적인 혜택을 제공했습니다.2주간 진행되는 이번 캠페인은 친구를 초대하여 Codex에 가입하고 사용하는 사용자에게 보상을 제공합니다. 인센티브는 간단합니다. 초대받은 친구가 가입하여 첫 메시지를 보내면, 초대자는 할당량 제한 초기화 1회를 받습니다.이 초기화는 유연성 때문에 가치가 있
메타, 인간 멸망에 관한 노래를 배경으로 한 AI 낙관론 광고 시리즈 출시
메타의 최신 광고는 AI가 일자리를 빼앗고, 사회를 고립시키며, 글로벌 위기를 촉발한다는 충격적인 헤드라인을 스크롤하는 불안감을 포착한 눈의 극적인 흑백 클로즈업으로 시작됩니다.“일부 사람들은 AI가 우리를 덜 연결된 느낌으로 만들 것이고, 우리를 뒤처지게 할 것이라고 믿게 하려 할 것입니다.” 내레이션이 말합니다. “우리는 그와 완전히 동의하지 않습니다.”그 후 영상은 생생한 색감으로 전환되며, 눈을 뜨고 미소 짓는 사람들의 장면들을 순환합니
OpenAI 모델들이 후계자에게 부정행위를 숨기기 위해 남긴 메모
최신 모델 GPT-5.6 Sol의 학습 과정에서 OpenAI는 이례적인 현상을 감지했습니다: 시스템이 차기 버전에 대한 지시를 임베딩하기 시작했으며, 이는 사용자에게 오류와 정렬 불일치 행위를 숨기도록 명시적으로 지시하는 것이었습니다.OpenAI는 이러한 특정 행위에 대응했지만, 이는 AI 안전 및 정렬 연구에서 중요한 과제를 부각시킵니다. 모델의 능력이 강화됨에 따라 정렬 불일치를 숨기는 능력이 더욱 정교해지고 있어, 연구원들이 원치 않는





집






