K2 Horizon 375B-A23Bとは?
K2 Horizon 375B-A23Bは、複数ステップのエージェント作業に向けたIFMのフラッグシップ・テキストモデルです。最終リリースはMixture-of-Expertsアーキテクチャを採用し、トークンごとに23Bのパラメータがアクティブになり、512Kのコンテキスト長に対応します。セルフホスティングでは重みと推論提供用のソフトウェア構成を自分で管理できますが、サーバー規模のストレージとメモリが必要です。
| 仕様 | K2 Horizon 375B-A23B |
|---|---|
| パラメータ数 | 総パラメータ数は375Bクラス、トークンごとに23Bがアクティブ |
| アーキテクチャ | Mixture-of-Experts |
| 層数 | 61 |
| コンテキスト長 | 524,288トークン、中間学習段階からネイティブ対応 |
| モダリティ | テキストの入力と出力 |
| リリース状況 | 最終チェックポイントを公開済み |
| ライセンス | Apache-2.0(モデルカードの記載による) |
このモデルは、トークンごとに192個のルーティング対象エキスパートから8個を選択し、共有エキスパートも備えています。61層の構成で、隠れ状態の次元数は6,144です。アップロード済みファイルの内訳では、パラメータ数は379.167Bです。A23Bはアクティブになる部分集合を示しており、保存したり、ランタイムから利用できる状態にしたりする必要があるモデルデータの量ではありません。
K2 Horizon 375B-A23Bのベンチマーク
これらはIFMのリリース表に掲載されたパーセント単位のスコアであり、当社の測定結果ではありません。SWE Bench Proは、モデルカードに記載されたstrict(インターネット接続なし)の設定を使用しています。他のレポートと比較する際も、このラベルを残してください。ダッシュは結果がないことを示します。異なる表の結果を比較して何かを主張する前に、他の評価設定も確認する必要があります。出典:公式モデルカード。
| ベンチマーク | K2-Horizon-375B-A23B | Nemotron 3 Ultra | Inkling (xhigh) | MiniMax-M3 | GLM 5.2 (max) | GPT 5.6 Luna (max) | GPT 5.6 Terra (high) | Claude Sonnet5 (max) |
|---|---|---|---|---|---|---|---|---|
Toolathlon Verified 長期タスクでのツール利用 | 65.3 | 34.3 | 45.5 | 53.7 | 59.9 | 67.5 | 64.8 | 71.6 |
MCPMark MCPツール | 67.7 | 45.7 | 51.2 | 48.8 | 72.4 | 66.9 | 74.0 | 65.3 |
Terminal-Bench 2.1 ターミナル操作エージェント | 70.2 | 53.9 | 55.1 | 65.2 | 77.9 | 80.9 | 75.7 | 80.5 |
SWE Bench Pro (strict) より難度の高い開発課題 | 42.6 | 38.7 | 43.1 | 43.8 | 46.7 | 48.8 | -- | -- |
GPQA Diamond 専門レベルの科学 | 87.3 | 86.7 | 87.2 | 92.9 | 89.5 | 91.1 | 89.6 | 91.1 |
AA-LCR 長いコンテキストでの推論 | 76.0 | 71.0 | 73.3 | 80.3 | 76.7 | 78.3 | 73.3 | 77.0 |
K2 HorizonはMCPMarkで67.7を記録し、この表ではClaude Sonnet5を上回りますが、GPT 5.6 Terraを下回ります。Terminal-Bench 2.1では70.2を記録し、掲載されているGLMおよびGPTの比較対象を下回ります。これらの結果は、評価すべき具体的なエージェントタスクを示すものであり、このモデルがホスト型の最先端モデルサービスを置き換えられると一概に主張するものではありません。
K2 Horizon 375B-A23Bのハードウェア要件
元のBF16シャードの合計サイズは758.34 GBです。第三者のBaekpicaによる変換版では、BF16とQ8_0のGGUFが、それぞれ全30シャードのセットで提供されており、変換元のリビジョンとコンバーターのコミットが固定されています。表のサイズは全シャードの合計です。最初のファイルだけをダウンロードしても、モデル全体をダウンロードしたことにはなりません。
| 精度 | 提供元 | ディスク上のサイズ |
|---|---|---|
| BF16 Safetensors | IFM/K2-Horizon-375B-A23B | 758.34 GB |
| BF16 GGUF(コミュニティ版) | Baekpica/K2-Horizon-375B-A23B-GGUF 全30シャード | 758.48 GB |
| Q8_0 GGUF(コミュニティ版) | Baekpica/K2-Horizon-375B-A23B-GGUF 全30シャード | 403.08 GB |
Baekpicaが報告しているのは構造とファイルの完全性のチェックであり、最小メモリ要件の検証やAtomic Chatでの推論テストではありません。Q8_0でも、ランタイムによるメモリ割り当てを考慮する前の段階で、ディスク上で403.08 GBを占めます。IFMの公式SGLang実行手順では、8基のH200 GPUを使用します。これは検証済みの構成例であり、互換性のあるすべての実行環境で必ず8基のGPUが必要だと証明するものではありません。
サイズは10進法のGB表記で、重みのみを対象としています。形式の違いについては、GGUFとは何かをご覧ください。これらのビルドでは実行時に必要な最小メモリ容量が測定されていないため、メモリ容量別の区分は掲載していません。
Atomic ChatでK2 Horizon 375B-A23Bを実行する方法
このチェックポイントのAtomic Chatでの実行は確認されていません。コミュニティによるGGUF変換には、IFMのK2 Horizon用llama.cppブランチが使われています。変換の監査だけでは、アプリに同梱されたランタイムとの互換性は確認できません。これらのファイルをダウンロードする前に、アーキテクチャへの対応状況を確認してください。通常の検索、ダウンロード、チャット開始という流れは、このモデルで検証済みの手順にはまだなっていません。他のチェックポイントと、それぞれについて記載されているダウンロードの選択肢は、モデルカタログで確認できます。
K2 Horizon 375B-A23Bのライセンス
IFMは公式モデルカードで、このチェックポイントのライセンスをApache-2.0と記載しています。ライセンスの情報源には公開元のリリース情報を使用し、再配布するビルドそのものに付属する追加の通知事項も確認してください。コミュニティによる変換版は、Atomic Chatによるリリースではありません。
出典とファイル一覧の確認日:2026年9月15日。
