Qwen2.5-14B-Instructとは?
Qwen2.5-14B-Instructは、Alibaba CloudのQwenチームが開発した、14.7Bの指示チューニング済みデンスモデルです。0.5Bから72Bのパラメータ規模をそろえるQwen2.5シリーズの中規模チャットモデルとして、2024年9月16日にリリースされました。ローカルでの実行に実用的なサイズで、公式のQ4_K_M GGUFビルドは合計約9 GBです。そのため、12 GBのGPUまたは16 GBのMacで、コンテキスト用の余裕を残して実行できます。重みはApache 2.0で公開されています。
| 仕様 | Qwen2.5-14B-Instruct |
|---|---|
| 総パラメータ数 | 14.7B(埋め込みを除くと13.1B) |
| ベースモデル | Qwen2.5-14B |
| 学習段階 | 事前学習と事後学習 |
| アーキテクチャ | RoPE、SwiGLU、RMSNorm、アテンションのQKVバイアスを備えたデンス型Transformer |
| 層数 | 48 |
| アテンションヘッド数(GQA) | クエリ用40、キーとバリュー用8 |
| コンテキスト長 | 131,072トークン |
| 最大生成長 | 8,192トークン |
| モダリティ | テキストの入力と出力 |
| リリース日 | 2024年9月16日 |
| ライセンス | Apache 2.0 |
長文ドキュメントを扱う前に、知っておきたい点があります。配布されているconfig.jsonでは、コンテキスト長の上限が32,768トークンに設定されています。設定にYaRNのrope_scalingブロックを追加すると、131,072トークンのコンテキスト長をすべて利用できます。ただし、静的なYaRNは短いテキストで品質を多少低下させる可能性があるため、Qwenは長い入力が実際に必要な場合にのみ追加するよう勧めています。ローカルアプリ以外で推論を提供する場合、QwenチームはvLLMを推奨しています。
Qwen2.5-14B-Instructが得意なこと
Qwenはこのモデルカードにベンチマーク表を掲載しておらず、詳細な評価結果はQwen2.5のブログ記事に掲載されています。ただし、Qwen2からの変更点はモデルカードに具体的に記載されています。知識が大幅に増え、コーディングと数学の能力が大きく向上したとされており、チームはこれを両分野で学習させた専門モデルの成果と説明しています。
モデルカードには、これらに加えて、指示追従性、8Kトークンを超える長文の生成、表などの構造化データの理解、特にJSONを中心とした構造化出力の生成も改善点として挙げられています。また、多様なシステムプロンプトに対して、より安定して対応できるようになったと説明されています。これは、ロールプレイの設定や、固定の条件に従うチャットボットで重要です。中国語、英語、フランス語、スペイン語、ポルトガル語、ドイツ語、イタリア語、ロシア語、日本語、韓国語、ベトナム語、タイ語、アラビア語を含む、29を超える言語に対応しています。
Qwen2.5-14B-Instructのハードウェア要件
システム要件で確認すべきなのはメモリです。QwenはQwen/Qwen2.5-14B-Instruct-GGUFで公式のGGUFビルドを公開しています。各ビルドは最大4 GBのファイルに分割して配布されており、以下のサイズはそれらの合計です。
| メモリ | 選択するビルド | ファイルサイズ |
|---|---|---|
| 8 GB | Q2_K | 5.8 GB |
| 12 GB | Q4_K_M | 9.0 GB |
| 16 GB | Q6_K | 12.1 GB |
| 24 GB | Q8_0 | 15.7 GB |
| 32 GB以上 | FP16 | 29.6 GB |
2つのビルドがどちらもメモリに収まる場合は、大きいほうを選んでください。上の表の中間にあたる選択肢が必要なら、Q3_K_M(7.3 GB)とQ5_K_M(10.5 GB)があります。この形式に馴染みがなければ、まずGGUFとは何かを参照してください。同じメモリ容量で動くほかのモデルについては、16 GBのMacに最適なローカルLLMをご覧ください。
Atomic ChatでQwen2.5-14B-Instructを実行する方法
Atomic Chatは、macOS、Windows、Linuxに対応した無料のローカルアプリです。Hugging Faceのモデルブラウザーとチャット機能を内蔵しており、llama.cppを手動でビルドする必要はありません。
- お使いのプラットフォームに対応するAtomic Chatをダウンロードして起動します。
- モデルブラウザーでQwen2.5-14B-Instructを検索し、Download Optionsを開きます。
- お使いのメモリ容量に収まるビルドを選び、チャットを開始します。
同じファミリーのほかのモデルについては、ローカルで実行できるQwenモデルの一覧をご覧ください。メモリに余裕があれば、Qwen2.5-32B-Instructにステップアップすることもできます。
Qwen2.5-14B-Instructのライセンス
Qwen2.5-14B-InstructはApache 2.0で公開されており、リポジトリからライセンス本文へのリンクを参照できます。このライセンスでは、ロイヤリティなしで商用利用、改変、再配布が認められています。このモデルを使った製品を開発し、利用料なしで自分のハードウェア上で実行できます。
