オプション
ニュース
ByteDanceのオープンソースSeed-OSS-36Bモデルが512Kトークンコンテキストをサポート

ByteDanceのオープンソースSeed-OSS-36Bモデルが512Kトークンコンテキストをサポート

2025年11月29日
152

ByteDanceのオープンソースSeed-OSS-36Bモデルが512Kトークンコンテキストをサポート

ホワイトハウスがこの人気ソーシャルメディア・プラットフォームに参加したことで再び話題になっているTikTokだが、その親会社である中国の大手テック企業ByteDanceもまた、驚きの発表を行った。

同社のAI研究部門であるシード・チームは本日、AIコード・リポジトリHugging FaceでSeed-OSS-36Bを発表したのだ。

Seed-OSS-36Bは、洗練された推論と開発者フレンドリーな使用のために構築されたオープンソースの大規模言語モデル(LLM)の新シリーズで、OpenAIやAnthropicの主要なものを含む多くの競合する米国で開発されたモデルよりも長いトークンコンテキストを特徴としています。

このコレクションには3つの主要なバリエーションがあります:

  • 合成データを含むSeed-OSS-36B-Base
  • 合成データなしのSeed-OSS-36B-Base
  • Seed-OSS-36B-インストラクト

Seed-OSS-36B-Baseモデルの合成バージョンと非合成バージョンの両方をリリースすることで、Seedチームは実世界のパフォーマンスと研究適応性のバランスをとることを目指しました。

補助的な命令データで学習させた合成データバージョンは、確立されたベンチマークでより強力な結果を達成し、より高性能な汎用モデルとして意図されています。

対照的に、非合成モデルは、これらの機能拡張を取り除き、合成命令データによる潜在的なバイアスを低減する明確なベースを提供します。

両方のバリエーションを提供することで、研究者がトレーニング後のテクニックを研究するための偏りのないベースラインを提供する一方で、実用的なユーザーに改善された結果を提供しています。

一方、Seed-OSS-36B-Instructモデルは、インストラクションデータを使用してポストトレーニングされ、ベースモデルとしてのみ機能するのではなく、タスクの実行とインストラクションの遵守に焦点を当てている。

3つのモデルはすべてApache-2.0の下でライセンスされており、企業の研究者や開発者による自由な利用、変更、共有が可能です。

これは、ByteDanceがライセンス料やAPI使用料を請求することなく、社内業務や顧客向けサービスに関わらず、商用アプリケーションに統合できることを意味する。

これは、中国企業が先進的なオープンソースモデルを立ち上げるという2025年半ばのトレンドに続くもので、OpenAIは最近リリースしたオープンソースのgpt-oss duetと歩調を合わせている。

SeedチームはSeed-OSSをグローバルに使用できるように設計し、推論における適応性、タスク指向の機能、多言語環境を強調した。

2023年に設立されたSeed Teamは、研究と実用的なアプリケーションの両方に適した基礎的なモデルを作成することに重点を置いています。

設計とコア機能

Seed-OSS-36Bの構造には、因果言語モデリング、グループ化クエリーアテンション、SwiGLU活性化、RMSNorm、RoPE位置エンコーディングなど、認知された設計要素が組み込まれている。

各モデルには、64層に分散された360億のパラメータが含まれ、155,000のトークンの語彙をサポートしている。

特徴的なのは、固有のロングコンテクスト容量で、長い文書や論理シーケンスを劣化なく処理するために、最大512,000トークンをサポートしている。

これはOpenAIの新しいGPT-5ファミリーの2倍の容量であり、およそ1600ページのテキストの長さに相当する。

もうひとつの際立った特徴は思考バジェットで、開発者はモデルが答えを生成する前に適用する推論の量を定義することができる。

同様の仕組みは、NvidiaのNemotron-Nano-9B-v2など、最近のオープンソースリリースにも見られる。

実用的な面では、これによってチームは、タスクの複雑さと展開効率の必要性に基づいてパフォーマンスを調整することができる。

バジェット値は512トークンの倍数で表示され、0に設定するとダイレクト・レスポンス・モードになります。

サードパーティベンチマークでの競争力

公開されているベンチマーク結果では、Seed-OSS-36Bはオープンソースの大規模モデルの中でもトップクラスの性能を持っています。特にInstructバージョンは、いくつかのドメインで最先端の結果を達成しています。

  • 数学と推論Seed-OSS-36B-Instructは、AIME24で91.7%、BeyondAIMEで65を記録し、それぞれオープンソースの最先端(SOTA)のパフォーマンスを示しています。
  • コーディング:LiveCodeBench v6で、Instructモデルは67.4を達成し、これもSOTAマークです。
  • ロング・コンテキスト・ケイパビリティ:128Kのコンテキスト長を持つRULERにおいて、94.6を達成。
  • ベースモデルの性能:合成データによるBaseモデルは、MMLU-Proで65.1、MATHで81.7を記録し、両カテゴリーでトップクラスの成績を収めた。

非合成のBaseモデルは、いくつかの指標でやや劣るものの、単独では競争力を保っています。

GPQA-Dでは合成モデルを上回り、研究者に、よりクリーンでインストラクションに中立なテスト用ベースラインを提供している。

オープンな代替案を評価する企業にとって、これらの結果は、Seed-OSSが、研究シナリオの柔軟性を維持しながら、数学集約的、コーディング、およびロングコンテキストのアプリケーションに強い有望性を持っていることを示しています。

アクセスと展開

性能だけでなく、Seed Teamは開発者のアクセシビリティも重視しています。モデルはハギング・フェイス・トランスフォーマーを介して展開可能であり、メモリ使用量を最小化するために4ビットおよび8ビットフォーマットで量子化されています。

また、スケーラブルなサービングのためにvLLMと統合され、セットアップ例とAPIサーバーガイドラインが完備されています。

導入をさらに簡単にするために、チームは推論、プロンプトのカスタマイズ、ツールの統合のためのスクリプトを提供している。

小規模なチームを管理したり、限られた予算で運営しているテクニカル・リードにとって、これらのリソースは、360億パラメータ・モデルの実験をより現実的なものにするのに役立つ。

企業の意思決定者のためのライセンスと考慮事項

Apache-2.0で利用可能なこれらのモデルは、制限のあるライセンスなしで採用することができます。

オープンソースのエコシステムを評価するリーダーにとって、このリリースは3つの重要なポイントを強調しています:

  • 数学、コーディング、およびロングコンテキストの推論におけるトップクラスのベンチマーク結果。
  • 高性能な合成学習済みモデルと、偏りのない研究ベースラインとのバランス。
  • 、合理化されたエンジニアリングユニットの運用の複雑さを軽減するアクセシビリティ機能。

ByteDanceのシードチームは、オープンライセンスのもとで高いパフォーマンスと適応性のあるデプロイメントを組み合わせることで、企業、研究者、開発者が利用できる選択肢を広げました。

関連記事
AIがニュースコンテンツに潜む隠された意図を明らかにする AIがニュースコンテンツに潜む隠された意図を明らかにする ChatGPTスタイルのモデルは現在、ニュース記事の根底にある視点を解明するよう訓練されている——たとえその視点が引用文やフレームワーク、あるいは(時に不誠実な)中立性の覆いの下に隠されていても。見出し、リード文、引用文といったセグメントに記事を分割することで、新たなシステムは長文のプロフェッショナルなジャーナリズムにおいても偏りを識別することを学習する。 執筆者や発言者の真の立場を把握する能力—
TikTok、フィードのAI生成コンテンツを制限する切り替え機能を公開 TikTok、フィードのAI生成コンテンツを制限する切り替え機能を公開 TikTokは、もともとユーザー作成動画のハブとして始まったプラットフォームだが、新たに「For You」フィードに表示されるAI生成コンテンツの量をユーザーが調整できる機能を導入する。また、AI生成コンテンツをより精緻に識別する技術も導入している。この新たなAI生成コンテンツ(AIGC)制御機能は、ユーザーのフィード体験をカスタマイズする「トピック管理」ツールに追加される。 TikTok
AnthropicのClaude 4.1、GPT-5発表前にコーディングベンチマークで優れた性能を発揮 AnthropicのClaude 4.1、GPT-5発表前にコーディングベンチマークで優れた性能を発揮 アンソロピックは月曜日、主力AIモデルの強化版を発表し、ソフトウェアエンジニアリングタスクにおける性能の新たな基準を打ち立てた。この展開により、AIスタートアップは収益性の高いコーディング分野での強固な地位を防衛する態勢を整え、OpenAIからの新たな競争を予期している。新モデル「Claude Opus 4.1」は、AIシステムの現実的なソフトウェア課題解決能力を評価する主要ベンチマーク「SWE-
関連特集おすすめ
書き込み 長文執筆のためのAI記事構成ツール
長文執筆のためのAI記事構成ツール

2026年最新・最高評価のAIアウトラインツール:長文執筆に最適!この厳選コレクションには、執筆効率を大幅に向上させる、実証済みのテストを経て正確かつ構造化されたアウトラインを生成する、強力で画期的なツールが紹介されています。XIX.AIもこの厳選されたツールの一つです。 無料版と有料版の比較表を入手して、最適なツールの選択に役立ててください。今すぐチェックして、AIの力を最大限に活用しましょう!

9 ツール
xix.ai
チャットボット 言語練習、面接対策、そして日常の流暢さのための最高のAIロールプレイチャットアプリ
言語練習、面接対策、そして日常の流暢さのための最高のAIロールプレイチャットアプリ

2026年最新版・最高評価のAIロールプレイチャットアプリ|語学練習、面接対策、日常会話の流暢さ向上に!XIX.AIは、無料と有料の比較、実世界でのテスト、毎週更新されるランキングを提供する革新的なコレクションを厳選しています。これらの必須ツールは、ライティングスキルの向上、流暢さの課題克服、そしてあらゆる日常シナリオにおけるコミュニケーション効率の改善をサポートします。今すぐ探索して、あなたの言語成長に最適なツールを見つけましょう!

10 ツール
xix.ai
作曲 リミックス制作、サンプリングの準備、カラオケマスター作成のためのAIステム分離ツール
リミックス制作、サンプリングの準備、カラオケマスター作成のためのAIステム分離ツール

2026年最新・最高評価のAIステム分離ツール。リミックス制作、サンプリング準備、カラオケマスター向けに厳選されました。これらの強力で画期的なツールは、実環境でのテストを経て、正確なオーディオ分離を実現し、生産性を大幅に向上させます。 XIX.AIでは、ニーズに合った「必試」のソリューションを見つけるお手伝いをするため、無料版と有料版の比較ガイドを毎週更新して提供しています。今すぐチェックして、AIの力を最大限に活用しましょう。

8 ツール
xix.ai
データ分析 収益ダッシュボード、ファネル分析、および製品指標向けのAI SQLコピロット
収益ダッシュボード、ファネル分析、および製品指標向けのAI SQLコピロット

2026年最新かつ最も優れたAI SQLコピロットが最高評価でランクイン!XIX.AIは、毎週更新される実際の環境でのテストに対応した、強力で革新的なツール群を厳選しています。これらの必見ツールを使えば、正確な収益ダッシュボードの作成や販売プロセスの分析、製品指標の迅速な追跡が可能となり、生産性を大幅に向上させることができます。今すぐチェックして、データに基づいた意思決定に最適なツールを見つけましょう!238文字

9 ツール
xix.ai
作曲 曲のドラフト作成に最適なAIメロディ作成ツール
曲のドラフト作成に最適なAIメロディ作成ツール

2026年最新版 高評価のAIメロディ作成ツールで曲のドラフト作成!XIX.AIは、厳格な実世界テストを経て最高の作成体験を提供する、革新的な強力なコレクションを厳選しました。詳細な無料版と有料版の比較、正確なランキング、そして素晴らしい曲のドラフトを楽に作成し、創造的な生産性を大幅に向上させるためにぜひ試すべきオプションが見つかります。今すぐ探索して、あなたに最適なツールを見つけましょう!

8 ツール
xix.ai
チャットボット 面接練習用のベストなAI会話トレーニングツール
面接練習用のベストなAI会話トレーニングツール

2026年最新版・最高評価のAI会話トレーニングツールが、面接練習に最適です。XIX.AIにてご提供しています!この厳選コレクションには、現実世界での厳格なテストを経て正確なフィードバックを提供する強力なツールが含まれています。無料版と有料版の比較や詳細なランキングをご覧いただき、自信とスキルを高めるための必須オプションをお選びください。今すぐ探索して、面接成功に最適なツールを見つけましょう!

12 ツール
xix.ai
コメント (0)
0/500
OR