WindowsでローカルLLMを動かす

Qwen、Gemma、Llamaをはじめ1,000以上のモデルから選び、TurboQuantで最適化してWindows PC上で動かせます。

Windows版をダウンロード
使い方
Atomic Chat running local LLMs on device
LlamaQwenMistralDeepSeekGemmaOllamaPhiHugging Facegpt-ossCommand RYiGrokKimiGLMNemotronStableLMGraniteMiniMaxInternLMFalconDBRX
LlamaQwenMistralDeepSeekGemmaOllamaPhiHugging Facegpt-ossCommand RYiGrokKimiGLMNemotronStableLMGraniteMiniMaxInternLMFalconDBRX

WindowsでローカルLLMを動かすのに必要なもの

いちばん速いのはGPUですが、CPUでも動きます。VRAMが8GBあれば、3Bモデルが文章を読む速さで応答します。

Windows

10 / 11

64ビット

GPUメモリ

8GB+

グラフィックスカードで動かす場合

セットアップ

1クリック

インストーラー1つ

WindowsでLLMを動かす手順

3ステップ、およそ10分。そのほとんどはモデルのダウンロード時間です。

インストーラーをダウンロード

Windows用の.exeファイルが1つ。実行すればすぐ使えます。WSLもDockerも必要ありません。

The Atomic Chat installer file for Windows

モデルを選択

1,000以上のオープンモデルから、手元のメモリに収まるものを選びます。ダウンロードは一度だけ。あとはドライブから読み込まれ、自分のCPUやGPUで動きます。

Row of overlapping documents with a blue padlock on the front one — sensitive files stay locked on your device

チャットを開始

モデルは自分のPC上で動き、オフラインでも使い続けられます。質問の回数に上限はありません

On-device only, no cloud connection

手元のハードウェアに合うローカルLLMを選ぶ

グラフィックスカードのVRAMを選んでください。

WindowsでのTurboQuantの仕組み

TurboQuantは収まるコンテキストの量を変えるので、RAMを増やさずにコンテキストウィンドウを広げられます。

メモリを食うのはコンテキスト

キャッシュはメッセージのたびに大きくなり、会話が長くなるとモデル本体より大きくなることもあります。

ステップ1

そのキャッシュを圧縮

Atomic Chatのビルドでは、そのキャッシュを通常の16ビットではなく3ビットか4ビットで保持します。サイズは最大4.3分の1になります。

ステップ2

PC上で何が変わるか

メモリが尽きるまでに交わせる会話が長くなり、モデルを動かしたままブラウザやエディタも開いておけます。

ステップ3

詳しく見る →

Atomic Chat vs ローカルLLMツール

この中で5つのプラットフォームすべてで動かせるのはAtomic Chatだけです。

OS

Atomic Chat
LM Studio
Ollama
AnythingLLM
Mac
Apple Silicon
Apple Silicon
Apple Silicon
Apple Silicon
Windows
.exe
.exe
.exe
.exe
Linux
AppImage
AppImage
CLIのみ
AppImage
iPhone & iPad
App Store
App Store
非対応
非対応
Android
Google Play
非対応
非対応

Google Play

よくある質問

WindowsでローカルLLMを動かす前によく聞かれること。

不要です。カードがなければ、モデルはプロセッサ上で動きます。チャットや文章作成、簡単なコードであれば3Bや7Bのモデルで十分です。

16GBです。3Bモデルなら8GB、13Bモデルなら32GBが必要です。Windows自体もメモリを使うので、少し余裕を持たせてください。

動きます。普通のWindowsプログラムです。​.exeファイルを1つ実行すればインストールは完了します。

動きません。インストーラーはx64のみなので、Snapdragon搭載のノートPCにはまだ対応していません。

できます。契約書や取引明細、スプレッドシートを開いて、そのまま質問してください。ファイルはPCに残り、アップロードされることはありません。

QwenとDeepSeekのコーダーモデルが定番です。どちらもコードを説明し、バグを見つけます。書いた内容がPCの外に出ることはありません。

あります。Atomic ChatはOpenAIと同じように使えるローカルAPIを開きます。Kilo CodeやCline、OpenAI SDKから接続できます。キーも請求もありません。

不要です。ほかのWindowsプログラムと同じようにインストールして、普通のウィンドウで使えます。

プライベートです。サーバーには何も送信されません。アカウントは不要で、クラウドに保存されるものもありません。

小さいモデルなら動かせます。Atomic ChatはApp StoreとGoogle Playにあるので、小さめのモデルをスマートフォンに入れて機内モードでも使えます。

ニュースレターを購読

Atomicの最新情報とローカルAIのニュースをメールでお届けします。

スパムは送りません。購読解除はワンクリックです。

登録が完了しました
次号からメールでお届けします。
!
問題が発生しました
メールアドレスを確認して、もう一度お試しください。

Windows版をダウンロード

デスクトップ
macOS
(Intel・Apple Silicon)
ダウンロード
Windows
(x64)
ダウンロード
Linux
(x86_64)
ダウンロード
モバイル
iOS
ダウンロード
Android
ダウンロード

AIへの課金は、もう終わり。
自分のものに。

ダウンロード
Windows版をダウンロード
Linux版をダウンロード
Mac版をダウンロード
macOS 13.6以降のIntel・Apple Silicon Macに対応
App Storeで入手
Google Playで入手
✕
Atomic Chat
まもなく公開

公開まであと少しです。メールアドレスをご登録いただければ、リリースと同時にお知らせします。

Checkmark icon

ご登録ありがとうございます!

フォローして最新情報をチェック
Discordに参加
フォームの送信中に問題が発生しました。