Qwen3-14Bとは?
Qwen3-14Bは、AlibabaのQwenチームが開発した14.8Bパラメータのデンスモデルです。デンスモデルと混合エキスパートモデルを並行して提供するQwen3世代に属します。最大の特徴は、思考モードの切り替えです。同じチェックポイントで、難しい問題には段階的な推論を行い、通常のチャットには素早く直接回答します。この2つの動作はメッセージごとに切り替えられます。Hugging Faceでのリポジトリのダウンロード数は2,000,000回を超え、重みはApache 2.0で公開されています。
| 仕様 | Qwen3-14B |
|---|---|
| 総パラメータ数 | 14.8B(埋め込みを除くと13.2B) |
| アーキテクチャ | 因果言語モデル(デンスモデル) |
| 層数 | 40 |
| アテンション | GQA、クエリヘッド40個、KVヘッド8個 |
| コンテキスト長 | 標準で32,768トークン、YaRN使用時は131,072トークン |
| モダリティ | テキストの入力と出力 |
| 推論 | 思考モードはデフォルトで有効、/thinkと/no_thinkでターンごとに切り替え可能 |
| リリース日 | 2025年4月 |
| ライセンス | Apache 2.0 |
思考モードでは、最終回答の前にモデルの推論過程がthinkブロックに格納されます。チャットテンプレートで完全に無効化することも、メッセージの末尾に/thinkまたは/no_thinkを付けてターンごとに制御することもできます。モデルは会話内の最新の指示に従います。Qwenはモードごとに異なるサンプリング設定も推奨しています。思考モードが有効な場合はtemperature 0.6とtop-p 0.95、無効な場合はtemperature 0.7とtop-p 0.8です。また、無限に繰り返し続ける原因になり得るため、貪欲デコーディングは一切使わないよう推奨しています。
Qwen3-14Bが得意なこと
Qwenはモデルカード自体にベンチマーク表を掲載していないため、ここでは開発元の説明を紹介します。中心となる主張は推論能力です。思考モードのQwen3は、数学、コード生成、常識に基づく論理的推論で従来の推論モデルQwQを上回り、思考モードを無効にした場合も、同じ分野でQwen2.5の指示チューニング済みモデルを上回るとしています。チームは、人間の好みに合わせた応答も特徴として挙げています。具体的には、創作、ロールプレイ、複数ターンの対話、指示への追従です。
実用面では、開発元が挙げるほかの2つの特徴も重要です。Qwen3はエージェント用途を想定して設計されています。どちらのモードでも外部ツールを呼び出せます。モデルカードには、ツール呼び出し用のテンプレートとパーサーを処理するQwen-Agentフレームワークを通じて、MCPサーバーに接続する例が示されています。また、100以上の言語と方言に対応し、多言語での指示への追従と翻訳を強みとして挙げています。
Qwen3-14Bのハードウェア要件
システム要件で確認すべきなのはメモリです。QwenはQwen/Qwen3-14B-GGUFで公式のGGUFビルドを公開しています。実際のファイルサイズは次のとおりです。
| メモリ | 選ぶビルド | ファイルサイズ |
|---|---|---|
| 12 GB | Q4_K_M | 9.00 GB |
| 16 GB | Q5_K_M | 10.51 GB |
| 24 GB | Q6_K | 12.12 GB |
| 32 GB以上 | Q8_0 | 15.70 GB |
隣り合うビルドのサイズ差は小さいため、両方ともメモリに収まるなら大きい方を選びます。コンテキストには、ファイルサイズに加えてメモリが必要です。標準のコンテキスト長は32,768トークンで、131,072トークンのモードにはYaRNによるropeスケーリングが必要です。llama.cppでは、サーバーフラグまたは再生成したGGUFで有効にします。この形式に初めて触れる場合は、まずGGUFとは何かをご覧ください。16 GBのMacではQ5_K_Mビルドを実行できます。16 GBのMacに最適なローカルLLMでは、同じクラスのハードウェアで動くほかのモデルも紹介しています。
Atomic ChatでQwen3-14Bを実行する方法
Atomic Chatは、macOS、Windows、Linux向けの無料のローカルアプリです。Hugging Faceのモデルブラウザーとチャット機能を内蔵しており、llama.cppを手動でビルドする必要はありません。
- お使いのプラットフォーム向けのAtomic Chatをダウンロードし、起動します。
- モデルブラウザーでQwen3-14Bを検索し、Download Optionsを開きます。
- お使いのメモリ容量に収まるビルドを選び、チャットを始めます。
同じファミリーのほかのモデルについては、ローカルで実行できるQwenモデルの一覧をご覧ください。同時にリリースされた姉妹モデルQwen3-30B-A3Bも含まれています。
Qwen3-14Bのライセンス
Qwen3-14BはApache 2.0で公開されています。このライセンスでは、ロイヤリティなしで商用利用、改変、再配布が認められています。そのため、このモデルを基にした製品を提供でき、自分のハードウェア上で利用料なしで実行できます。
