プライベートAI
オープンソースのAIモデルを探して、自分のパソコンで実行できます。APIキーもクラウドも利用制限もありません。データを外部に送らず、オフラインで動作し、ずっと無料で使えます。
NVIDIA Nemotron 3.5 Lightningは、総パラメータ数30B、有効パラメータ数3BのMamba-2ハイブリッドMoEで、コンテキスト長は1Mトークンに達します。
NVIDIAの9B Mamba2-Transformerハイブリッド推論モデルです。思考のオン・オフ切り替え、128Kのコンテキスト長、ツール呼び出しに対応しています。
NVIDIAの49B推論・チャットLLMです。Neural Architecture Searchを通じてLlama-3.3-70Bから蒸留され、128Kのコンテキスト長に対応しています。