DeepSeek-V4.1-FlashがQwen AIプラットフォームに登場、APIとトークンプランの提供を開始
DeepSeek-V4.1-FlashがQwen AIプラットフォームで公開されました。APIアクセスと柔軟なトークンプランの両方が利用可能です。 開発者は、標準APIを介してこのモデルをワークフローにシームレスに統合できるほか、Qoder、Qwenアプリ、Codexなどのツール内で直接トークンプランを活用し、コーディング、ドキュメント作成、視覚的分析、エージェント駆動型タスクなどに利用できます。

DeepSeekの新しい軽量フラッグシップモデルと称されるこのモデルは、総パラメータ数552BのMoEアーキテクチャを採用しています。因果エンコーダー・デコーダー(Causal-Encoder-Decoder)という非対称構造を採用しており、入力時には約8B、出力時には約16Bのパラメータのみを活性化させます。 テキストと画像の理解をネイティブにサポートし、最大100万トークンのコンテキストウィンドウを処理し、約39.3万トークンの出力を生成します。公式ベンチマークによると、エージェントおよびコードのパフォーマンスが大幅に向上しており、活性化コストの削減にもかかわらず、高いスループットと低遅延を実現しています。
コスト効率の高さが大きな特長です。高度なキャッシュ圧縮により、KVキャッシュHBMの要件を前世代比25%に、SSDストレージの要件を12.5%に削減し、長いコンテキストやマルチターン対話のためのリソースを最適化しています。 Qwenプラットフォームの料金体系は段階制となっており、オフピーク時間帯の入力コストは100万トークンあたり1人民元(ピーク時は2人民元)、出力コストは100万トークンあたり4人民元(ピーク時は8人民元)です。 レート制限はRPM 15,000およびTPM 100万に設定されており、プレフィックス補完、関数呼び出し、キャッシュ、構造化出力、バッチ処理、オンライン検索をサポートしています。
Alibaba Cloud BaiLianは、vLLMオープンソースコミュニティと提携し、北京、シンガポール、米国、ドイツ、日本、香港を含む中国国内および海外地域での広範な展開を実現しています。 このモデルは、マルチターン会話、関数呼び出し、オンライン検索、コンテキストキャッシュ、構造化出力をサポートしており、max_tokensの上限は約393,216です。これにより、長文の解析、カスタマーサービスのナレッジベース、コードリポジトリのQ&A、マルチモーダルな注文レビューなどを統一されたインターフェースに移行する企業にとって理想的です。
業界アナリストによると、Qwenエコシステムに「大規模パラメータ、小規模な活性化、堅牢なキャッシュ」を統合することで、長文コンテキストを扱うエージェントの試行錯誤にかかるコストを低減できるとのことです。小規模チームにとっては、オフピーク時の低価格と柔軟なトークンプランの組み合わせにより、より俊敏なバッチ推論と迅速なプロトタイプの検証が可能になります。
関連記事
GitHub Copilot、GPT-5.4を数時間で統合
GitHub Copilotは再びその迅速な対応能力を実証しました。OpenAIが最新フラッグシップモデル「GPT-5.4」をリリースしてから数時間後、GitHubは完全な統合を発表し、この先進的な技術によるインテリジェントなコーディング支援を世界中の開発者に提供しました。GitHubによると、内部テストでは、GPT-5.4が「エージェント的」なソフトウェア開発タスクにおいて優れていることが示されており、前任モデルと比較してタスクの成功率が顕著に向上しています。Codex系統のコード生成専門知
AnthropicがIPOで先導し、AI業界は兆円規模の収益という新時代へ突入する
世界のAIセクターは、新たな大きなマイルストーンに到達しました。最近の市場データによると、AIスタートアップのAnthropicは6月1日付で非公開のIPO申請書を提出しました。承認されれば、AnthropicはAIラボ分野で最大の上場企業になる準備が整っています。業界の推計では、Anthropicは今年第3四半期までに10億ドル以上の利益を生成すると見込まれています。AnthropicとOpenAIの年間継続収益(ARR)の合計は1000億ドルに近づいています。OpenAIがIPOを2027年
Google JapanおよびYahoo JapanのSEOを最適化する方法は?
接続された都市はすでに存在しているが、その外見は平凡である最も有用なIoTインフラストラクチャは、未来派的な外観をほとんど持たない。それは、満杯のタイミングを知るゴミ箱、故障する前にエンジン異常を報告するバン、駐車可能なスペースがある場所をドライバーに知らせる駐車スペース、または技術者の訪問なしで消費量を記録する電気メーターのように見える。変化は、すべての物体が知的になったことではない。変化は、物理的な資産が現在、計測可能で、接続され、大規模な管理が容易になったことである。この区別は、企業、
関連特集おすすめ
コメント (0)
0/500
DeepSeek-V4.1-FlashがQwen AIプラットフォームで公開されました。APIアクセスと柔軟なトークンプランの両方が利用可能です。 開発者は、標準APIを介してこのモデルをワークフローにシームレスに統合できるほか、Qoder、Qwenアプリ、Codexなどのツール内で直接トークンプランを活用し、コーディング、ドキュメント作成、視覚的分析、エージェント駆動型タスクなどに利用できます。

DeepSeekの新しい軽量フラッグシップモデルと称されるこのモデルは、総パラメータ数552BのMoEアーキテクチャを採用しています。因果エンコーダー・デコーダー(Causal-Encoder-Decoder)という非対称構造を採用しており、入力時には約8B、出力時には約16Bのパラメータのみを活性化させます。 テキストと画像の理解をネイティブにサポートし、最大100万トークンのコンテキストウィンドウを処理し、約39.3万トークンの出力を生成します。公式ベンチマークによると、エージェントおよびコードのパフォーマンスが大幅に向上しており、活性化コストの削減にもかかわらず、高いスループットと低遅延を実現しています。
コスト効率の高さが大きな特長です。高度なキャッシュ圧縮により、KVキャッシュHBMの要件を前世代比25%に、SSDストレージの要件を12.5%に削減し、長いコンテキストやマルチターン対話のためのリソースを最適化しています。 Qwenプラットフォームの料金体系は段階制となっており、オフピーク時間帯の入力コストは100万トークンあたり1人民元(ピーク時は2人民元)、出力コストは100万トークンあたり4人民元(ピーク時は8人民元)です。 レート制限はRPM 15,000およびTPM 100万に設定されており、プレフィックス補完、関数呼び出し、キャッシュ、構造化出力、バッチ処理、オンライン検索をサポートしています。
Alibaba Cloud BaiLianは、vLLMオープンソースコミュニティと提携し、北京、シンガポール、米国、ドイツ、日本、香港を含む中国国内および海外地域での広範な展開を実現しています。 このモデルは、マルチターン会話、関数呼び出し、オンライン検索、コンテキストキャッシュ、構造化出力をサポートしており、max_tokensの上限は約393,216です。これにより、長文の解析、カスタマーサービスのナレッジベース、コードリポジトリのQ&A、マルチモーダルな注文レビューなどを統一されたインターフェースに移行する企業にとって理想的です。
業界アナリストによると、Qwenエコシステムに「大規模パラメータ、小規模な活性化、堅牢なキャッシュ」を統合することで、長文コンテキストを扱うエージェントの試行錯誤にかかるコストを低減できるとのことです。小規模チームにとっては、オフピーク時の低価格と柔軟なトークンプランの組み合わせにより、より俊敏なバッチ推論と迅速なプロトタイプの検証が可能になります。
GitHub Copilot、GPT-5.4を数時間で統合
GitHub Copilotは再びその迅速な対応能力を実証しました。OpenAIが最新フラッグシップモデル「GPT-5.4」をリリースしてから数時間後、GitHubは完全な統合を発表し、この先進的な技術によるインテリジェントなコーディング支援を世界中の開発者に提供しました。GitHubによると、内部テストでは、GPT-5.4が「エージェント的」なソフトウェア開発タスクにおいて優れていることが示されており、前任モデルと比較してタスクの成功率が顕著に向上しています。Codex系統のコード生成専門知
AnthropicがIPOで先導し、AI業界は兆円規模の収益という新時代へ突入する
世界のAIセクターは、新たな大きなマイルストーンに到達しました。最近の市場データによると、AIスタートアップのAnthropicは6月1日付で非公開のIPO申請書を提出しました。承認されれば、AnthropicはAIラボ分野で最大の上場企業になる準備が整っています。業界の推計では、Anthropicは今年第3四半期までに10億ドル以上の利益を生成すると見込まれています。AnthropicとOpenAIの年間継続収益(ARR)の合計は1000億ドルに近づいています。OpenAIがIPOを2027年





家






