NVIDIA Nemotron 3 Ultra
ストックにはログインが必要です
エージェント向けに設計された、初のオープンフロンティアモデル
Artificial Intelligence
Developer Tools
GitHub
Open Source
概要
- NVIDIAの5500億パラメータのMixture-of-Expertsモデルを、ハイブリッドMamba-Attentionで実装。
- 1Mトークンの長文脈と300トークン/秒超を実現。
- エージェントループ向けに最適化。オープンソース経済圏での frontier 推論が鍵。
- Hugging Face/OpenRouter/ModelScope/build.nvidia.comのNIMマイクロサービスとして提供。
特徴と用途
- 高速性と長文脈の両立。マルチステップのエージェントワークフローに適用。
- オープンウェイトの信頼性とエージェント適性を両立。
著者コメントの要点
- 現場の費用対効果を重視。OpenRouter経由とNIMでの運用比較が議論の焦点。ポストトレーニングデータセットの公開情報にも関心。
投票数: 6