高品質のAIツールを発見します
世界をリードする人工知能ツールを集めて、作業効率を向上させるのに役立ちます
AlbertKingによって公開された記事
XPeng Groupは、低コストで最先端(SOTA)のビジュアルトランスフォーマーを実現するため、アーキテクチャ、データ、学習手法を再構築した高効率なビジュアルエンコーダー「TuringViT」を発表しました。本モデルは、自動運転、コックピット、ヒューマノイドロボットに対応しています。 わずか0.85Bの画像・テキストペアのみを使用し、6つのベンチマークで83.6%のゼロショット精度を達成。10Bのデータで学習されたモデルを上回る性能を発揮するとともに、高解像度環境において3倍の推論スループットを実現しています。
XPeng Groupは、低コストで最先端(SOTA)のビジュアルトランスフォーマーを実現するため、アーキテクチャ、データ、学習手法を再構築した高効率なビジュアルエンコーダー「TuringViT」を発表しました。本モデルは、自動運転、コックピット、ヒューマノイドロボットに対応しています。 わずか0.85Bの画像・テキストペアのみを使用し、6つのベンチマークで83.6%のゼロショット精度を達成。10Bのデータで学習されたモデルを上回る性能を発揮するとともに、高解像度環境において3倍の推論スループットを実現しています。
SenseTimeは、OpenAIのGPT-Image2に対抗するため、共同創業者の林大華氏が率いる「U1Pro」というコードネームの、デザインに特化したマルチモーダル大規模モデルを秘密裏に開発している。このモデルは、長期サイクルでのデザイン生成・レビューに対応し、8K解像度をサポートしている。 社内テストの結果、GPT-Image2に迫る性能を示しており、一部の側面では優位性が見られる。7月から招待制の社内テストが開始される見込みだ。
SenseTimeは、OpenAIのGPT-Image2に対抗するため、共同創業者の林大華氏が率いる「U1Pro」というコードネームの、デザインに特化したマルチモーダル大規模モデルを秘密裏に開発している。このモデルは、長期サイクルでのデザイン生成・レビューに対応し、8K解像度をサポートしている。 社内テストの結果、GPT-Image2に迫る性能を示しており、一部の側面では優位性が見られる。7月から招待制の社内テストが開始される見込みだ。
AI音声エージェント開発プラットフォーム「VoiceRun」は、Flybridge Capitalをリード投資家とするシード資金調達で550万ドルを調達した。Nicholas LeonardとDerek Canejaが共同創業した同社は、企業開発者を対象に、ビジュアルベースのノーコードインターフェースではなく、コードを通じて直接音声エージェントを構築・拡張する機能を提供している。このアプローチにより柔軟性と制御性が向上すると主張し、簡易なノーコードデモビルダーと高度に複雑な開発者ツールの中間に位置づけられている。
AI音声エージェント開発プラットフォーム「VoiceRun」は、Flybridge Capitalをリード投資家とするシード資金調達で550万ドルを調達した。Nicholas LeonardとDerek Canejaが共同創業した同社は、企業開発者を対象に、ビジュアルベースのノーコードインターフェースではなく、コードを通じて直接音声エージェントを構築・拡張する機能を提供している。このアプローチにより柔軟性と制御性が向上すると主張し、簡易なノーコードデモビルダーと高度に複雑な開発者ツールの中間に位置づけられている。
The Information Anthropicによると、2028年の売上高は700億ドル、キャッシュフローは170億ドルに達すると予測している。
The Information Anthropicによると、2028年の売上高は700億ドル、キャッシュフローは170億ドルに達すると予測している。





