本文へ移動

重要なAIニュースを、速く、わかりやすく。

運営:AIMA

NVIDIA「Nemotron 3 Embed」公開、8B版がRTEB首位

NVIDIA「Nemotron 3 Embed」公開、8B版がRTEB首位
3行でわかる
  • NVIDIAが、企業検索やRAG、AIエージェント向けの埋め込みモデル3種を公開した
  • 8B版はNVIDIAの評価でRTEBスコア78.5%を記録し、公開時点の総合順位で首位になった
  • モデルの重みと学習レシピが公開され、Hugging FaceやNVIDIA NIMなどで利用できる

何が発表されたか

NVIDIAは2026年7月16日、文章の意味を数値に変換する埋め込みモデル群「NVIDIA Nemotron 3 Embed」を公開しました。埋め込みモデルは、社内文書やWebページの中から質問に関係する情報を探すときに使われます。企業内検索、RAG、コード検索、AIエージェントの記憶などが主な用途です。

公開されたのは、高い検索精度を重視する8B版、速度と費用のバランスを重視する1B版、NVIDIA Blackwell向けに軽量化した1B NVFP4版の3種類です。モデルの重み、データセット、学習レシピが公開され、自社の環境へ置いたり、業務データに合わせて調整したりできます。

公式発表によると、8B版の「Nemotron-3-Embed-8B-BF16」は、実際の検索課題を集めた評価指標RTEBで78.5%を記録し、2026年7月15日時点の総合順位で1位になりました。これはNVIDIAが示した評価結果であり、すべての会社のデータで同じ順位や精度を保証するものではありません。

3種類のモデルは何が違うのか

8B版は約80億個のパラメータを持ち、正確さを重視する企業検索やRAG向けです。最大3万2768トークンの入力に対応し、長い文書、複数ファイルにまたがるコード、AIエージェントの長い会話履歴を検索対象にできます。出力するベクトルは4096次元です。

1B BF16版は約11億個のパラメータで、8B版より小さく、応答速度や運用費を抑えたい用途を想定しています。NVIDIAの評価ではRTEBで72.4%、MMTEB Retrievalで71.0%を記録しました。

1B NVFP4版は、NVIDIA Blackwellの4ビット形式に合わせたモデルです。公式発表では、BF16版と比べて検索精度の99%以上を保ちながら、条件によって最大2倍の処理量を実現したと説明しています。性能は使用する機器、入力の長さ、同時処理数などで変わるため、自社環境での確認が必要です。

AIエージェントの検索をどう変えるのか

AIエージェントが社内資料を使って仕事をするとき、最初の検索で関係の薄い文書を拾うと、その後の回答や判断にも不要な情報が混ざります。見つからなければ検索を何度もやり直し、処理時間とAIの利用量が増えます。

NVIDIAは、より正確な埋め込みモデルで必要な根拠を早く取り出せれば、検索のやり直しや余分な推論を減らせると説明しています。同社の評価では、8B版が比較対象の中で最も高い平均検索精度と、最も低い推定後工程トークン費用を示しました。ただし、費用の計算はNemotron 3 Ultraの入出力トークン数とGPT-5.5の料金式を使った推定です。

利用方法は、自社サーバーでの実行だけではありません。Hugging Faceでモデルを取得できるほか、NVIDIA NIMのマイクロサービス、vLLM、複数のAIクラウドや推論サービスにも対応するとしています。

なぜ仕事や会社に重要なのか

会社がRAGやAIエージェントを導入すると、回答を作るAI本体に目が向きがちです。しかし、その前にある「正しい資料を探す仕組み」が弱ければ、AIは古い規程や関係のない文書を根拠に使う可能性があります。埋め込みモデルは目立ちにくい部品ですが、回答の土台を左右します。

Nemotron 3 Embedは、正確さを重視する8B版と、速度や費用を重視する1B版を同じシリーズで選べる点が実務上の特徴です。重みと学習レシピが公開されているため、機密文書を外部サービスへ送らずに使う構成や、自社用語に合わせた調整も検討できます。

導入を考える企業は、公開ランキングだけで選ばず、自社の質問と正解文書を使った小さなテストを行うことが大切です。検索の正解率、応答時間、必要なGPUメモリー、1件あたりの費用を同じ条件で比べると、8B版と1B版のどちらが合うか判断しやすくなります。

※ 本記事は公開時点の一次情報にもとづいています。最新の状況は出典をご確認ください。

AI検索・LLMO対策

月額5万円で、AIに引用される会社へ

AIの進化が速いほど、自社の情報がAIにどう読まれるかも変わります。ChatGPTやGoogleのAI検索で正しく引用される状態を、AIMAが月額5万円でつくります。相談はチャットで回数の制限なし。記事・FAQの制作から公開・保守まで、本数・回数の上限なし。最低契約期間はありません。

SUPERVISOR
監修者 水間 雄紀

監修者:水間 雄紀

株式会社AIMA 代表取締役

1986年和歌山県生まれ、近畿大学卒。金融機関、経営コンサルティング会社を経て、2018年にコンテンツ制作の専門会社である株式会社circlizeを創業。2024年、ラグザス株式会社に事業譲渡。現在は株式会社AIMAにてAI×マーケティング事業に従事し、株式会社ラグザス・クリエイトでコンテンツの品質管理責任者を務める。

監修者・運営会社について
← AI深報トップへ