Nemotron 3 Nano Omni は、NVIDIA が開発したオープンソース型の次世代マルチモーダルAIモデルです。
高度な推論、画像・動画理解、音声処理、テキスト解析、AI Agentワークフローを1つのモデルで実現することを目的に設計されています。
NVIDIA Nemotron シリーズの一つとして、言語理解だけでなく、視覚情報、音声情報、動画コンテンツを統合的に処理できる点が特徴です。
本モデルは MoE(Mixture-of-Experts)アーキテクチャを採用し、Nemotron 3 Nano 30B-A3B をベースに、視覚エンコーダーと音声エンコーダーを組み合わせることで、テキスト・画像・動画・音声を統合したマルチモーダル処理を実現しています。
総パラメータ数は約 300億(30B)、アクティブパラメータは約 **30億(3B)**で、スパース計算によって高い性能を維持しながら効率的な推論を可能にしています。
従来のように用途ごとに複数のAIモデルを組み合わせる必要がなく、1つの統合モデルで複数形式のデータを処理できるため、実際のビジネス環境における複雑なAI活用に適しています。
また、NVIDIA のオープンAIエコシステムに対応しており、ローカル環境への導入、モデル調整(Fine-tuning)、企業向けAIシステム開発にも活用できます。
Nemotron 3 Ultra
50 NVIDIA Nemotron 3 Ultra は、NVIDIAのオープン推論モデルです。総パラメータ550B(アクティブ55B)、100万トークンのコンテキストウィンドウを備え、多段階推論とエージェントオーケストレーションに優れています。
NVIDIA
コメント(0件)