LinuxでローカルLLMを動かす

Qwen、Gemma、Llamaをはじめ1,000以上のモデルから選び、TurboQuantの最適化を効かせてお使いのLinuxマシンで動かせます。

Linux版をダウンロード
使い方
Atomic Chat running a local LLM on an Ubuntu Linux desktop
LlamaQwenMistralDeepSeekGemmaOllamaPhiHugging Facegpt-ossCommand RYiGrokKimiGLMNemotronStableLMGraniteMiniMaxInternLMFalconDBRX
LlamaQwenMistralDeepSeekGemmaOllamaPhiHugging Facegpt-ossCommand RYiGrokKimiGLMNemotronStableLMGraniteMiniMaxInternLMFalconDBRX

LinuxでローカルLLMを動かすのに必要なもの

GPUがあればいちばん速いですが、CPUでも動きます。VRAMが8GBあれば、8Bモデルを人が文章を読む速さで動かせます。

インストール

AppImage

かんたんセットアップ

GPUメモリ

8GB+

推奨

LinuxでLLMを動かす手順

3ステップ、およそ10分。そのほとんどはモデルのダウンロード時間です。

AppImageをダウンロード

ファイルはx86_64版が1つだけです。実行権限を付けて起動します。パッケージマネージャーもroot権限も要りません。

The Atomic Chat AppImage file, a single 86 MB download

モデルを選択

1,000以上のオープンモデルから、メモリに収まるものを選びます。ダウンロードは一度だけです。あとはドライブから読み込まれ、手元のCPUやGPUで動きます。

Row of overlapping documents with a blue padlock on the front one — sensitive files stay locked on your device

チャットを開始

モデルは手元のマシンで動き、オフラインでもそのまま使えます。質問の回数に上限はありません。

On-device only, no cloud connection

手元のハードウェアに合うローカルLLMを選ぶ

グラフィックスカードのVRAMを選んでください。

LinuxでのTurboQuantの仕組み

TurboQuantは収まるコンテキストの量を変えるので、RAMを増やさずにコンテキストウィンドウを広げられます。

メモリを食うのはコンテキスト

キャッシュはメッセージのたびに大きくなり、会話が長くなるとモデル本体より大きくなることもあります。

ステップ1

そのキャッシュを圧縮

Atomic Chatのビルドでは、そのキャッシュを通常の16ビットではなく3ビットか4ビットで保持します。サイズは最大4.3分の1になります。

ステップ2

デバイス上で何が変わるか

メモリが尽きるまでに長く話せて、モデルを動かしながらエディタもブラウザも開いたままにできます。

ステップ3

詳しく見る →

Atomic Chatと他のLinux向けLLMアプリの比較

LinuxのOllamaにはウィンドウがまったくありません。LM StudioとAnythingLLMにはありますが、どちらもデスクトップアプリをオープンソースでは公開していません。Atomic Chatは、ウィンドウとヘッドレスサーバー、そしてApache-2.0のコードを揃えています。

OS

Atomic Chat
LM Studio
Ollama
AnythingLLM

macOS

Apple Silicon
Apple Silicon
Apple Silicon
Apple Silicon
Windows
.exe
.exe
.exe
.exe
Linux
AppImage
AppImage
CLIのみ
AppImage
iPhone & iPad
App Store
App Store
非対応
非対応
Android
Google Play
非対応
非対応
Google Play

よくある質問

LinuxでローカルLLMを動かす前に、よく聞かれることをまとめました。

はい、いくつかあります。Atomic Chat、LM Studio、AnythingLLMはいずれもLinuxでウィンドウを持っています。Ollamaは違います。Linuxではコマンドラインツールとバックグラウンドサービスとして動き、デスクトップアプリはmacOSとWindowsだけです。

はい。ローカルサーバーを有効にして、OpenAI互換のAPIから呼び出します。デスクトップセッションは必要ありません。

はい。Atomic ChatはCUDAではなくVulkanを使うので、AMDのカードでも動きます。動作するVulkanドライバーは必要です。GPUがない場合はプロセッサで動きますが、その分だけ遅くなります。

glibc 2.35以降なら動きます。Ubuntu 22.04以降、Debian 12以降、Fedora 40以降、Arch、Mint、Pop!_OSが該当します。

はい。契約書やログファイル、表計算ファイルを開いて、その中身について質問できます。ファイルはディスクに残ったままで、アップロードされることはありません。

コードならQwen CoderやDeepSeekが候補です。RAMが許すかぎり大きいものを選んでください。書いた内容がマシンの外に出ることはありません。

はい。OpenAI互換のローカルエンドポイントがあります。Kilo CodeやCline、任意のOpenAI SDKを向けるだけです。キーも料金もありません。

いいえ。AppImageファイル1つだけです。実行権限を付けて起動します。.debも.rpmもありません。

はい。ケーブルを抜いても、ファイアウォールで塞いでも構いません。モデルをダウンロードしたあとは、Atomic Chatがネットワークを必要とすることは二度とありません。

はい。App StoreとGoogle Playにありますが、小さいモデル専用です。スマートフォンの3Bは、デスクトップの13Bとは別物です。オフラインで役に立ちますが、置き換えにはなりません。

ニュースレターを購読

Atomicの最新情報とローカルAIのニュースをメールでお届けします。

スパムは送りません。購読解除はワンクリックです。

登録が完了しました
次号からメールでお届けします。
!
問題が発生しました
メールアドレスを確認して、もう一度お試しください。

Linux版をダウンロード

デスクトップ
macOS
(Intel・Apple Silicon)
ダウンロード
Windows
(x64)
ダウンロード
Linux
(x86_64)
ダウンロード
モバイル
iOS
ダウンロード
Android
ダウンロード

AIへの課金は、もう終わり。
自分のものに。

ダウンロード
Windows版をダウンロード
Linux版をダウンロード
Mac版をダウンロード
macOS 13.6以降のIntel・Apple Silicon Macに対応
App Storeで入手
Google Playで入手
✕
Atomic Chat
まもなく公開

公開まであと少しです。メールアドレスをご登録いただければ、リリースと同時にお知らせします。

Checkmark icon

ご登録ありがとうございます!

フォローして最新情報をチェック
Discordに参加
フォームの送信中に問題が発生しました。