NVIDIAは、本番環境向けのRAG、コード検索、エージェントメモリ向けの埋め込みモデル「Nemotron-3-Embed」シリーズをリリースしました。 8B BF16バージョンは、RTEBベンチマークにおいてNDCG@10で78.46を記録し、1位を獲得しました。このシリーズには1B BF16および1B NVFP4(4ビット)バージョンが含まれており、いずれもMistralアーキテクチャをベースとし、34言語と32Kトークンに対応しています。 1Bモデルは、プルーニングと知識蒸留によって作成されました。NVFP4バージョンは、Blackwell上で2倍のスループットを維持しつつ、99.5%の精度を保持しています。vLLMのデプロイに対応しており、BF16バージョンはTransformersおよびSentence Transformersに対応しています。





家
