Ai2がコンパクトなAIモデルを発表、GoogleやMetaのライバルを上回る

小型AIモデルが今週話題に。
木曜日、非営利のAI研究グループAi2は、10億パラメータのモデルOlmo 2 1Bを発表。Google、Meta、Alibabaの同規模モデルを複数のベンチマークで上回る。パラメータ(重み)はモデルの性能を形成する内部要素。
Olmo 2 1Bは、Hugging FaceプラットフォームでApache 2.0ライセンスの下、無料で利用可能。ほとんどのモデルと異なり、Ai2は開発に使用したコードとデータセット(Olmo-mix-1124、Dolmino-mix-1124)を公開し、完全再現が可能。
小型モデルは大型モデルに比べパワーは劣るが、高性能ハードウェアを必要とせず、標準的なラップトップや消費者向けデバイスで利用できるため、開発者やホビーストに最適。
最近、MicrosoftのPhi 4推論ファミリーやQwenの2.5 Omni 3Bなど、小型モデルのリリースが急増。Olmo 2 1Bを含むほとんどのモデルは、最新のラップトップやモバイルデバイスでスムーズに動作。
Ai2によると、Olmo 2 1Bは公開データ、AI生成データ、キュレーションされたソースから4兆トークンでトレーニング。100万トークンは約75万語に相当。
GSM8Kなどの算術推論テストで、Olmo 2 1BはGoogleのGemma 3 1B、MetaのLlama 3.2 1B、AlibabaのQwen 2.5 1.5Bを上回る。TruthfulQA(事実の正確性ベンチマーク)でも優れる。
TechCrunch Sessions: AIでの展示
TC Sessions: AIであなたの作品を1,200人以上の意思決定者に紹介。5月9日まで、または枠が埋まるまで利用可能。
TechCrunch Sessions: AIでの展示
TC Sessions: AIであなたの作品を1,200人以上の意思決定者に紹介。5月9日まで、または枠が埋まるまで利用可能。
Berkeley, CA | 6月5日
今すぐ予約
このモデルは、7、13、32Bモデルの高品質事前トレーニングと高品質アニーリングを踏襲し、4Tトークンの高品質データで事前トレーニング。トレーニングの1000ステップごとに中間チェックポイントをアップロード。
ベースモデルにアクセス:https://t.co/xofyWJmo85 pic.twitter.com/7uSJ6sYMdL
— Ai2 (@allen_ai) 2025年5月1日
Ai2は、Olmo 2 1Bにはリスクがあると警告。すべてのAIモデルと同様、有害またはセンシティブな内容、不正確な情報を生成する可能性。商業用途には推奨しない。
関連記事
LLMの中には何がありますか? AI2 Olmotraceはソースを「追跡」します
大規模な言語モデル(LLM)の出力とそのトレーニングデータの間の接続を理解することは、常にエンタープライズITにとって少しパズルです。今週、AIのアレン研究所(AI2)は、この関係を分裂させることを目的としたオルモトレースと呼ばれるエキサイティングな新しいオープンソースイニシアチブを開始しました。
Anthropic、ClaudeのAIコーディングツールを日本に拡大し、海外成長を促進
Anthropic、米国の主要な人工知能企業は、グローバルな展開を強化している。水曜日、同社は東京で「Code with Claude」と題された大規模な開発者向けイベントを開催し、約500人のソフトウェアエンジニアが集まった。この取り組みは、Claude AIツールおよび関連製品を日本市場に積極的に導入することを目的としており、自律的なコーディング機能による企業生産性の向上という中核的な利点を強調している。自動化されたコード生成への重点本イベントにおいて、Anthropicは複雑なプログラ
インドのソフトウェア大手が採用を縮小し、AI エージェントの拡大に伴い解雇はないと約束
人工知能が従来の労働集約型ビジネスモデルを再構築する中、インドを代表するソフトウェアアウトソーシング企業であるタタ・コンサルテーション・サービスズ(TCS)は、その戦略的対応を明らかにしました。火曜日の定時株主総会において、会長は人間と機械の協働に関するビジョンを提示し、AI時代における同社の workforce 戦略を明確にしました。人員整理は行わないが、採用は鈍化TCSの会長は、AI導入により人員整理を行う計画はないものの、全体的な採用ペースは鈍化すると明確に述べました。TCSは以前、1
関連特集おすすめ
コメント (4)
0/500
Interesting to see a nonprofit like Ai2 pushing the boundaries with Olmo 2 1B! It really makes you wonder if the future of AI innovation lies more with smaller, specialized teams rather than just the tech giants. The efficiency gains here could be huge for real-world applications. 🧠
Olmo 2 1B par Ai2 est vraiment impressionnant! Un modèle d'1 milliard de paramètres qui bat ceux de Google et Meta? Ça montre qu'en IA, la taille n'est pas tout. J'adore voir des recherches orientées sur l'efficacité plutôt que la course aux plus gros modèles. C'est plus accessible et peut-être plus durable à long terme! 👏
Honestly, 1B参数的小模型能超越谷歌和Meta的对手,这太令人惊喜了!🥳 感觉大公司们的优势在被慢慢蚕食,这种非营利性组织的创新对整个生态是件好事,更轻量级的AI或许能让更多开发者参与进来。期待看到更多实际应用!

小型AIモデルが今週話題に。
木曜日、非営利のAI研究グループAi2は、10億パラメータのモデルOlmo 2 1Bを発表。Google、Meta、Alibabaの同規模モデルを複数のベンチマークで上回る。パラメータ(重み)はモデルの性能を形成する内部要素。
Olmo 2 1Bは、Hugging FaceプラットフォームでApache 2.0ライセンスの下、無料で利用可能。ほとんどのモデルと異なり、Ai2は開発に使用したコードとデータセット(Olmo-mix-1124、Dolmino-mix-1124)を公開し、完全再現が可能。
小型モデルは大型モデルに比べパワーは劣るが、高性能ハードウェアを必要とせず、標準的なラップトップや消費者向けデバイスで利用できるため、開発者やホビーストに最適。
最近、MicrosoftのPhi 4推論ファミリーやQwenの2.5 Omni 3Bなど、小型モデルのリリースが急増。Olmo 2 1Bを含むほとんどのモデルは、最新のラップトップやモバイルデバイスでスムーズに動作。
Ai2によると、Olmo 2 1Bは公開データ、AI生成データ、キュレーションされたソースから4兆トークンでトレーニング。100万トークンは約75万語に相当。
GSM8Kなどの算術推論テストで、Olmo 2 1BはGoogleのGemma 3 1B、MetaのLlama 3.2 1B、AlibabaのQwen 2.5 1.5Bを上回る。TruthfulQA(事実の正確性ベンチマーク)でも優れる。
TechCrunch Sessions: AIでの展示
TC Sessions: AIであなたの作品を1,200人以上の意思決定者に紹介。5月9日まで、または枠が埋まるまで利用可能。
TechCrunch Sessions: AIでの展示
TC Sessions: AIであなたの作品を1,200人以上の意思決定者に紹介。5月9日まで、または枠が埋まるまで利用可能。
Berkeley, CA | 6月5日 今すぐ予約このモデルは、7、13、32Bモデルの高品質事前トレーニングと高品質アニーリングを踏襲し、4Tトークンの高品質データで事前トレーニング。トレーニングの1000ステップごとに中間チェックポイントをアップロード。
— Ai2 (@allen_ai) 2025年5月1日
ベースモデルにアクセス:https://t.co/xofyWJmo85 pic.twitter.com/7uSJ6sYMdL
Ai2は、Olmo 2 1Bにはリスクがあると警告。すべてのAIモデルと同様、有害またはセンシティブな内容、不正確な情報を生成する可能性。商業用途には推奨しない。
LLMの中には何がありますか? AI2 Olmotraceはソースを「追跡」します
大規模な言語モデル(LLM)の出力とそのトレーニングデータの間の接続を理解することは、常にエンタープライズITにとって少しパズルです。今週、AIのアレン研究所(AI2)は、この関係を分裂させることを目的としたオルモトレースと呼ばれるエキサイティングな新しいオープンソースイニシアチブを開始しました。
Anthropic、ClaudeのAIコーディングツールを日本に拡大し、海外成長を促進
Anthropic、米国の主要な人工知能企業は、グローバルな展開を強化している。水曜日、同社は東京で「Code with Claude」と題された大規模な開発者向けイベントを開催し、約500人のソフトウェアエンジニアが集まった。この取り組みは、Claude AIツールおよび関連製品を日本市場に積極的に導入することを目的としており、自律的なコーディング機能による企業生産性の向上という中核的な利点を強調している。自動化されたコード生成への重点本イベントにおいて、Anthropicは複雑なプログラ
インドのソフトウェア大手が採用を縮小し、AI エージェントの拡大に伴い解雇はないと約束
人工知能が従来の労働集約型ビジネスモデルを再構築する中、インドを代表するソフトウェアアウトソーシング企業であるタタ・コンサルテーション・サービスズ(TCS)は、その戦略的対応を明らかにしました。火曜日の定時株主総会において、会長は人間と機械の協働に関するビジョンを提示し、AI時代における同社の workforce 戦略を明確にしました。人員整理は行わないが、採用は鈍化TCSの会長は、AI導入により人員整理を行う計画はないものの、全体的な採用ペースは鈍化すると明確に述べました。TCSは以前、1
Interesting to see a nonprofit like Ai2 pushing the boundaries with Olmo 2 1B! It really makes you wonder if the future of AI innovation lies more with smaller, specialized teams rather than just the tech giants. The efficiency gains here could be huge for real-world applications. 🧠
Olmo 2 1B par Ai2 est vraiment impressionnant! Un modèle d'1 milliard de paramètres qui bat ceux de Google et Meta? Ça montre qu'en IA, la taille n'est pas tout. J'adore voir des recherches orientées sur l'efficacité plutôt que la course aux plus gros modèles. C'est plus accessible et peut-être plus durable à long terme! 👏
Honestly, 1B参数的小模型能超越谷歌和Meta的对手,这太令人惊喜了!🥳 感觉大公司们的优势在被慢慢蚕食,这种非营利性组织的创新对整个生态是件好事,更轻量级的AI或许能让更多开发者参与进来。期待看到更多实际应用!





家






