K2 Horizon MoVA-36B-A4Bとは?
K2 Horizon MoVA 36B-A4Bは、Mixture-of-ExpertsモデルとIFMのMixture-of-Valuesアテンションを組み合わせたモデルです。IFMによると、総パラメータ数は36B、トークンあたりのアクティブパラメータ数は約4Bで、コンテキスト長は512Kです。最終チェックポイントは、テキスト推論とエージェントワークフロー向けに公開されています。
| 仕様 | K2 Horizon MoVA-36B-A4B |
|---|---|
| パラメータ数 | 総パラメータ数36Bクラス、トークンあたりのアクティブパラメータ数4B |
| アーキテクチャ | Mixture-of-Valuesアテンションを備えたMixture-of-Experts |
| レイヤー数 | 48 |
| コンテキスト長 | 524,288トークン、中間学習段階からネイティブ対応 |
| モダリティ | テキスト入力・出力 |
| リリース状況 | 最終チェックポイント公開済み |
| ライセンス | Apache-2.0(モデルカードによる) |
接尾辞のA4Bは、計算に使われるパラメータ数を表しており、ダウンロードするモデルが4Bであることを意味しません。保存されているパラメータ全体は約37.445Bです。構成は48レイヤー、ルーティング対象のエキスパート100個で、トークンごとに8個が選択され、これに共有エキスパートが加わります。MoVAはアテンション内でもバリューエキスパートを選択します。これは追加のアーキテクチャ上の特徴であり、MoEの別名ではありません。
K2 Horizon MoVA-36B-A4Bのベンチマーク
IFMは、これらのパーセント表示のスコアを、Artificial Analysisの参考スコアとともに公開しています。モデルカードによると、Muse Glimmer-30Bは高い推論強度を使用し、比較対象のほかのオープンモデルは推論モードを使用しています。これらは、量子化したモデルをAtomic Chatで実行した際のベンチマークではありません。出典:公式モデルカード。
| ベンチマーク | K2-Horizon-MoVA-36B-A4B | Nemotron 3 Ultra | Nemotron 3 Super | G9v3-39A5B | Qwen3.6-35B-A3B | Muse Glimmer-30B | Gemma 4 31B-it |
|---|---|---|---|---|---|---|---|
tau3-Banking 銀行業務エージェント | 26.8 | 14.2 | 10.3 | 22.1 | 9.3 | 23.5 | 14.8 |
Terminal-Bench 2.1 ターミナル操作エージェント | 58.6 | 53.9 | 38.6 | 32.6 | 44.9 | 51.7 | 43.4 |
SciCode 科学分野のコーディング | 38.9 | 39.9 | 36.0 | 34.0 | 35.8 | 43.6 | 43.4 |
Humanity's Last Exam(ツールなし) 専門的な設問 | 25.2 | 28.4 | 20.8 | 17.5 | 22.2 | 22.0 | 23.6 |
GPQA Diamond 専門的な科学知識 | 80.8 | 86.7 | 80.0 | 80.5 | 84.1 | 83.5 | 85.7 |
AA-LCR 長いコンテキストでの推論 | 66.3 | 71.0 | 60.3 | 62.0 | 66.7 | 80.0 | 68.3 |
MoVAは、tau3-BankingとTerminal-Bench 2.1で、掲載されている比較対象を上回っています。一方、GPQA Diamondと長いコンテキストでの推論では、比較対象のいくつかを下回っています。アクティブパラメータ数4Bという数値はアーキテクチャの理解に役立ちますが、スループットを測定しなければ、お使いのハードウェアで速度面の優位性があるとは判断できません。
K2 Horizon MoVA-36B-A4Bのハードウェア要件
元の重みの分割ファイルは合計74.89 GB、公式BF16 GGUFは合計74.92 GBです。このGGUFのファイル名はK2-Horizon-36B-BF16.ggufで、リポジトリではMoVA 36B-A4Bを変換したものとされています。どちらも、特定のトークンで選択されないエキスパートを含め、重み全体を収録しています。
| 精度 | 配布元 | ディスク上のサイズ |
|---|---|---|
| BF16 Safetensors | IFM/K2-Horizon-MoVA-36B-A4B | 74.89 GB |
| BF16 GGUF(公式) | IFM/K2-Horizon-MoVA-36B-A4B-GGUF K2-Horizon-36B-BF16.gguf | 74.92 GB |
BF16の重み全体は64 GBを超えます。IFMは、モデル固有のルーター設定の上書きを含む、H200を2基使用したSGLangの構成手順を検証しています。数値的な挙動を確認する際は、その構成手順に合わせてください。この構成は必要最小限のGPU数を示すものではなく、512Kのコンテキスト用キャッシュはディスク上の合計サイズとは別に必要です。
サイズは10進表記のGBで、重みのみを対象としています。形式の違いについては、GGUFとはをご覧ください。これらのビルドでは実行時に必要な最小メモリ容量が測定されていないため、メモリ容量の区分は記載していません。
Atomic ChatでK2 Horizon MoVA-36B-A4Bを実行する方法
このチェックポイントをAtomic Chatで実行できるかは、まだ確認されていません。IFMの公式GGUFモデルカードでは、K2 Horizonアーキテクチャに対応したllama.cppビルドが必要とされ、IFMの開発用フォークが案内されています。これらのファイルをダウンロードする前に、アーキテクチャへの対応を確認してください。通常の検索、ダウンロード、チャット開始という流れは、このモデルではまだ検証済みの手順ではありません。ほかのチェックポイントと、文書化されたダウンロード方法については、モデルカタログをご覧ください。
K2 Horizon MoVA-36B-A4Bのライセンス
IFMは公式モデルカードで、このチェックポイントのライセンスをApache-2.0と記載しています。ライセンスの確認には公開元のリリース情報を参照し、実際に再配布するビルドに付属する追加の通知事項も確認してください。コミュニティによる変換版は、Atomic Chatのリリースではありません。
出典とファイル一覧の確認日:2026年9月15日。
