
1,000以上のモデルを自分でホスト
セルフホスト型LLMとは
セルフホスト型LLMとは、プロバイダーのクラウドではなく、自分のコンピュータや自宅のサーバーで動く言語モデルのことです。重みを一度ダウンロードしてローカルのエンドポイントから配信すれば、プロンプトはすべて手元のマシンにとどまります。
API料金なし
サブスクリプションもトークン単価もありません。1か月たっぷり使っても、かかるコストは電球1個分ほどです。
どんなハードウェアでも
小さなモデルはスマートフォンに収まり、普通のノートPCのCPUでも数兆パラメータの巨大モデルが動きます。
すべてを自分で管理
モデルの重みは自分のディスク上にあるファイルです。どれを動かすか、いつ更新するかは自分で決められます。
自分のハードウェアで動かすセルフホスト型AI
サーバーもモデルライブラリもツールも、1つのアプリにまとまっています。
モデルが手元のアプリを操作
Notion、GitHub、Google DriveはMCPで接続します。頼めばモデルがページを読み、ファイルを編集し、検索を実行します。

ワンクリックでエージェントを起動
OpenClaw、Hermes、ClineはIntegrationsタブから起動でき、自分でホストしているモデルで動きます。
TurboQuantでより大きなモデルに対応
KVキャッシュは最大6分の1まで小さくなり、空いたRAMは長いコンテキストや重いLLMに回せます。

Atomic Chat vs ほかのセルフホスト型LLMアプリ
Ollamaはターミナル派に、AnythingLLMは文書中心の使い方に向いています。インストールは1回、デスクトップでもスマートフォンでも、そのすべてをカバーします。セットアップは不要です。



セルフホスト型AI vs クラウドAI
モデルそのものを手元に持ち、自分のマシンでプライベートに動かせます。

- オープンソース(Apache-2.0)
- ずっと無料
- クローズドソース
3ステップで始めるセルフホスト型LLM

ダウンロードしてインストール
macOS、Windows、Linux、iOS、Androidで無料です。アカウントは不要です。

モデルを選択
1,000以上のモデルから選べます。ディスクへのダウンロードは一度だけです。

チャット、またはサーバー公開
内蔵UIでそのまま話しかけるか、LLMサーバーをオンにして、ツールの接続先をlocalhost:1337に向けます。
ニュースレターを購読
Atomicの最新情報とローカルAIのニュースをメールでお届けします。
Atomic Chatをダウンロード
よくある質問
セットアップからハードウェア、接続まで、自分のマシンでモデルを動かすために知っておきたいことをまとめました。
そのものは存在しません。OpenAIのモデルはクローズドで、同社のクラウドでしか動きません。セルフホスト版ChatGPTにあたるのは、Qwen、Llama、DeepSeekのようなオープンモデルを自分のマシンで動かす方法です。Atomic Chatは、そこに使い慣れたチャット画面とローカルAPIを加えます。
そのためにGPUサーバーを買う必要があるなら、たいていは割に合いません。RAMが8 GB以上のコンピュータをすでに持っているなら、答えはイエスです。モデルのダウンロードは無料で、トークンごとの請求もありません。かつては何時間もかかるセットアップが足を引っ張っていましたが、その部分はインストール1回で終わります。
必要ありません。最近のCPUでもローカルLLMは動きます。量子化した小規模・中規模のモデルは十分に答えてくれますし、RAMは8 GBから16 GBあれば始められます。GPUを使えば応答が速くなり、TurboQuantがKVキャッシュを圧縮するので、長いセッションでもRAMに収まります。
決め手はRAMです。16 GB未満ならQwenやGemmaの小さいサイズが定番で、16 GBから32 GBなら12Bから32Bのモデルが動きます。TurboQuantを使えば、長いチャットでRAMを食いつぶすこともありません。Atomic Chatは1,000以上のモデルをサイズ付きで一覧できます。いくつかダウンロードして比べてみてください。
ローカルLLMは、目の前のデバイスで動いているモデル全般を指します。セルフホスト型AIはそこにサーバーの視点が加わり、モデルは自分で管理するエンドポイントの裏側に置かれ、ほかのアプリやマシンがそこに接続します。Atomic Chatはその両方をカバーします。チャットアプリとLLMサーバーが、インストール1回で手に入ります。
できます。localhost:1337のOpenAI互換APIは、OpenCode、Goose、Kilo Code、Mastra、そしてOpenAI SDKを使うあらゆるツールからの接続を受け付けます。ツールのベースURLを自分のマシンに向ければ、そのまま手元のモデルで動きます。
開発はすべてオープンに
プロジェクトをフォローし、Issueを立て、Atomic Chatを作っている人たちと話せます。


