Qwen3-8Bとは?
Qwen3-8Bは、AlibabaのQwenチームが開発したパラメータ数8.2Bの因果言語モデルで、Qwen3世代の一部として2025年4月に公開されました。最大の特徴は、回答前に段階的に推論する思考モードと、高速な一般対話向けの非思考モードを、単一のモデル内で切り替えられることです。Q4_K_Mビルドは5.03 GBなので、メモリ8 GBのマシンに収まります。
| 仕様 | Qwen3-8B |
|---|---|
| 総パラメータ数 | 8.2B(埋め込みを除くと6.95B) |
| 層数 | 36 |
| アテンション | GQA、クエリ用32ヘッド、KV用8ヘッド |
| コンテキスト長 | 標準で32,768トークン、YaRN使用時は131,072トークン |
| モダリティ | テキストの入力と出力 |
| 推論 | 思考モードはデフォルトで有効、ターンごとに切り替え可能 |
| 言語 | 100以上の言語と方言 |
| 公開日 | 2025年4月 |
| ライセンス | Apache 2.0 |
思考モードはデフォルトで有効になっており、最終回答の前に推論内容をthinkブロックで囲みます。ハードスイッチで完全に無効化することも、プロンプトに/thinkまたは/no_thinkを追加してターンごとに切り替えることもできます。モデルは会話内の最新の指示に従います。Qwenはモードごとに異なるサンプリング設定を推奨しており、思考モードではtemperature 0.6とtop-p 0.95、非思考モードではtemperature 0.7とtop-p 0.8を使用します。また、際限のない繰り返しを引き起こす可能性があるため、貪欲デコーディングを避けるよう警告しています。Top-k 20とmin-p 0は両方のモードに適用され、Qwenはほとんどのクエリで出力長を32,768トークンにすることを推奨しています。
Qwen3-8Bが得意なこと
Qwenはモデルカード自体にはベンチマーク表を掲載していませんが、具体的な性能を主張しています。開発チームの報告によると、Qwen3-8Bは思考モードで数学、コード生成、常識に基づく論理的推論において以前のQwQを上回り、非思考モードでは同じタスクでQwen2.5の指示チューニング済みモデル群を上回ります。ツール呼び出しも重点分野として明示されています。モデルカードではQwen-Agentフレームワークを推奨しており、MCP設定ファイルでツールを定義できます。また、Qwenは複雑なエージェントタスクにおけるこのモデルの性能を、オープンソースモデルの中でトップクラスと説明しています。
このモデルは100を超える言語と方言をサポートし、多言語での指示追従と翻訳に対応しています。事後学習では、創作、ロールプレイ、複数ターンの対話も対象としています。標準のコンテキスト長は32,768トークンです。QwenはYaRNによる拡張で最大131,072トークンまで検証していますが、静的なYaRNは短いテキストで品質を低下させる可能性があるため、実際に長い入力が必要な場合にのみ有効にするよう勧めています。メモリに余裕があれば、同じファミリーで次に大きいモデルはQwen3-14Bです。
Qwen3-8Bのハードウェア要件
システム要件で確認すべきなのはメモリです。Qwenは独自の公式GGUFビルドをQwen/Qwen3-8B-GGUFとして公開しており、以下のファイルサイズはそのリポジトリにある実際のサイズです。
| メモリ | 選ぶビルド | ファイルサイズ |
|---|---|---|
| 8 GB | Q4_K_M | 5.03 GB |
| 12 GB | Q6_K | 6.73 GB |
| 16 GB以上 | Q8_0 | 8.71 GB |
Q5_0(5.72 GB)とQ5_K_M(5.85 GB)はその中間に位置するため、両方のビルドがメモリに収まる場合は、大きい方を選んでください。GGUF形式に馴染みがなければ、まずGGUFとは何かをお読みください。同じメモリ容量で動かせるほかのモデルについては、メモリ16 GBのMacに最適なローカルLLMをご覧ください。
Atomic ChatでQwen3-8Bを動かす方法
Atomic Chatは、macOS、Windows、Linux向けの無料のローカルアプリです。Hugging Faceのモデルブラウザーとチャット機能を内蔵しており、llama.cppを手動でビルドする必要はありません。
- お使いのプラットフォーム向けのAtomic Chatをダウンロードして起動します。
- モデルブラウザーでQwen3-8Bを検索し、Download Optionsを開きます。
- お使いのメモリ容量に収まるビルドを選び、チャットを開始します。
同じファミリーのほかのモデルについては、ローカルで動かせるQwenモデルの一覧をご覧ください。
Qwen3-8Bのライセンス
Qwen3-8BはApache 2.0で公開されており、リポジトリにライセンスファイルが含まれています。このライセンスではロイヤリティなしで商用利用、改変、再配布が認められているため、モデルを基にした製品を提供し、自分のハードウェアで使用料なしで動かせます。
