Qwen3.8-27Bとは?
Qwen3.8-27Bは、AlibabaのQwenチームが開発したマルチモーダルな27.8Bデンスモデルで、Qwen 3.8としてリリースされた3モデルの中で最小です。また、24 GBのGPUを搭載したデスクトップや、32 GBのユニファイドメモリを搭載したMacBookなど、一般的なマシンで動くのも、この3モデルの中では唯一です。Alibabaは2026年8月14日に、Apache 2.0のもとで重みを公開しました。
| 仕様 | Qwen3.8-27B |
|---|---|
| 総パラメータ数 | 27.8B |
| アーキテクチャ | デンスモデル、ハイブリッドアテンション(Gated DeltaNet + Gated Attention) |
| 層数 | 64 |
| コンテキスト長 | 262,144トークン |
| モダリティ | テキスト、画像、動画の入力 |
| 推論 | 思考モードはデフォルトで有効、推論強度を選択可能、無効化も可能 |
| マルチトークン予測 | 対応、チェックポイントに予測ヘッドを同梱 |
| リリース日 | 2026年8月14日 |
| ライセンス | Apache 2.0 |
64層のうち48層はGated DeltaNetを使用しています。これは、会話がどれだけ長くなってもメモリ使用量が変わらないアテンションの一種です。通常のKVキャッシュを保持するのは、残りの16層だけです。KVキャッシュは通常、トークンが増えるたびに大きくなる部分です。そのため、長いチャットや大きな文書でも、一般的な27Bモデルよりはるかに少ないメモリで処理できます。また、このモデルはマルチトークン予測の学習も行っているため、1回の順伝播で複数の候補トークンを生成できます。これは、投機的デコーディングを支えるのと同じ仕組みです。
Qwen3.8-27Bのベンチマーク
モデルカードに掲載されたAlibabaのリリース時の数値では、27Bを前世代のQwen3.6-27B、Qwen3.7-Plus、Muse Glimmer 30B、Claude Opus 4.6 Maxと比較しています。
| ベンチマーク | Qwen3.8-27B | Qwen3.6-27B | Qwen3.7-Plus | Muse Glimmer 30B | Claude Opus 4.6 Max |
|---|---|---|---|---|---|
Terminal Bench 2.1 ターミナル操作エージェント | 73.0 | 63.4 | 64.0 | 51.7 | 78.2 |
SWE-bench Pro 高難度のソフトウェア開発 | 61.7 | 53.5 | 57.6 | 51.2 | 53.4 |
LiveCodeBench v6 競技プログラミング | 90.3 | 83.9 | 89.6 | - | 88.8 |
GPQA Diamond 専門的な科学知識 | 89.2 | 87.8 | 90.3 | 83.5 | 91.3 |
Humanity's Last Exam 専門分野の問題 | 30.8 | 24.0 | 34.7 | 22.0 | 40.0 |
OSWorld-Verified コンピューター操作 | 84.3 | 63.9 | 73.3 | 65.9 | 72.7 |
SWE-MM マルチモーダルなソフトウェア開発 | 38.6 | 25.7 | 30.0 | - | 27.1 |
27Bは、7つのベンチマークのうち4つでClaude Opus 4.6 Maxを上回っています。Opusに匹敵するモデルが、今や24 GBのGPUカード1枚で動きます。
Qwen3.8-27Bのハードウェア要件
システム要件で確認すべきなのはメモリ容量です。私たちは元の重みからモデルを量子化し、そのビルドをAtomicChat/Qwen3.8-27B-GGUFとして公開しました。
| メモリ | 選ぶビルド | ファイルサイズ |
|---|---|---|
| 12 GB | AD-IQ2_S | 11.1 GB |
| 16 GB | AD-IQ3_S | 13.8 GB |
| 24 GB | AD-Q4_K_M | 17.1 GB |
| 32 GB | AD-Q5_K_M | 20.2 GB |
| 48 GB以上 | AD-Q6_K | 25.0 GB |
隣り合うファイルのサイズ差は1〜2 GB程度なので、2つのビルドがどちらもメモリに収まるなら、大きい方を選んでください。特に14 GB未満では品質の低下が最も急なため、この選択が重要です。GGUF形式に馴染みがなければ、まずGGUFとは何かをお読みください。ほかにどのモデルがメモリに収まるかは、16 GBのMacに最適なローカルLLMをご覧ください。
Atomic ChatでQwen3.8-27Bを実行する方法
Atomic Chatは、macOS、Windows、Linux向けの無料ローカルアプリです。Hugging Faceのモデルブラウザーとチャット機能を内蔵しており、llama.cppを手動でビルドする必要はありません。
- お使いのプラットフォーム向けのAtomic Chatをダウンロードして開きます。
- モデルブラウザーでQwen3.8-27Bを検索し、Download Optionsを開きます。
- お使いのメモリ容量に収まるビルドを選び、チャットを開始します。
量子化ビルドの一覧表とllama.cppのコマンドを含む詳しい手順は、私たちのQwen 3.8 27Bをローカルで実行するためのガイドをご覧ください。
ほかのラインアップについては、ローカルで実行できるQwenモデルの全一覧、または兆単位のパラメータ数を持つ同系列モデルQwen3.8-2.4T-A95Bをご覧ください。
Qwen3.8-27Bのライセンス
Qwen3.8-27BはApache 2.0のもとで公開されています。商用利用、改変、再配布がロイヤリティなしで認められているため、このモデルを使った製品を開発し、自分のハードウェア上で使用料なしで実行できます。
