
オラマ
Ollama
の使い方・機能・解決する業務課題
ブックマークする
Ollama(オラマ)とは?
米Ollama Inc.が提供する、Gemma・Qwen・DeepSeek・gpt-ossなどのオープンモデルを自分のPC(Mac・Windows・Linux)でダウンロードして動かせるローカルLLM実行ツール。「ollama run」の1コマンドで使え、OpenAI互換のAPIサーバーとしても動く。ローカル実行は無料・無制限。大きなモデルをクラウドで動かす有料プランは Pro 月$20、Max 月$100。画面は英語。
解決する業務課題
「Ollama」のサービス詳細
Ollamaとは
Ollama(オラマ)は、Gemma・Qwen・DeepSeek・gpt-oss などのオープンなAIモデルを、自分のパソコンにダウンロードして動かせるツールです。Mac・Windows・Linux に対応し、インストール後は ollama run gemma4 のようにモデル名を1つ指定するだけで、ダウンロードからチャットの開始までが済みます。本体はオープンソース(MITライセンス)で、GitHub のスターは約18万(2026年10月10日時点)。公式サイトでは、月900万回以上のインストール、10億回以上のモデルのダウンロードと表記されています。
起動すると、パソコンの中に API サーバー(http://localhost:11434)が立ち上がります。OpenAI 互換の API にも対応しているため、ChatGPT の API 向けに書いたアプリや、Cline・Kilo Code のようなコーディング支援ツールの接続先を、手元のモデルに切り替えられます。ローカルで動かしている間、入力した文章が Ollama 社に送られることはありません。
ローカル実行は無料・無制限です。このほか、手元のパソコンでは動かしきれない大きなモデルを Ollama のクラウドで動かす有料プラン(Pro・Max・Team・Enterprise)もあります。
使い方
- インストールする
公式サイトの「Download」から、macOS・Windows のインストーラーを入手します。ターミナルからなら、macOS・Linux は
curl -fsSL https://ollama.com/install.sh | sh、Windows は PowerShell でirm https://ollama.com/install.ps1 | iexでも入れられます。 - モデルを動かす
アプリを開くか、ターミナルで
ollamaを実行して、表示に従ってモデルを選びます。ollama run gemma4のようにモデル名を指定すると、初回はダウンロードしてからそのまま対話が始まります。モデルは数GBから数百GBあるため、空き容量が必要です。 - モデルを管理する
ollama pull(ダウンロード)、ollama ls(一覧)、ollama ps(実行中のモデル)、ollama rm(削除)で管理します。Modelfile にシステムプロンプトなどを書けば、自分用にカスタマイズしたモデルも作れます。 - アプリやコーディングエージェントから使う
ollama launch claude・ollama launch codex・ollama launch opencodeで、Claude Code などのコーディングエージェントを Ollama のモデルで起動できます。自作のアプリからはhttp://localhost:11434の API(OpenAI 互換の/v1/chat/completionsなど)を呼び出します。 - クラウドのモデルを使う(任意)
ollama signinでサインインすると、gemma4:cloudのような名前でクラウドのモデルを呼び出せます。APIキーを発行すれば、Ollama をインストールしていない環境からでもhttps://ollama.com/v1に直接リクエストできます。
主な機能
01ローカル実行
- 1コマンドで実行 — モデル名を指定するだけで、ダウンロード・読み込み・対話まで進みます
- GPUの自動利用 — Apple M シリーズの GPU、NVIDIA、AMD Radeon の GPU を使って動かせます(Intel Mac は CPU のみ)
- モデルライブラリ — テキスト、画像を読めるモデル(Vision)、ツール呼び出し、推論(Thinking)、埋め込みなどの用途で絞り込んで探せます
- Modelfile — ベースのモデルにシステムプロンプトや設定を加えた、自分用のモデルを作れます
02API・連携
- ローカルAPIサーバー — `localhost:11434` で動く独自の API に加え、OpenAI 互換・Anthropic 互換の API(いずれも一部の機能)に対応しています
- ollama launch — Claude Code・Codex・OpenCode などを、Ollama のモデルにつないだ状態で起動します
- デスクトップアプリとの接続 — macOS では、Claude Desktop や ChatGPT のデスクトップアプリ(Codex モード)から Ollama のモデルを使う設定ができます
03クラウド
- クラウドモデル — 手元では動かしにくい大きなモデルを、ダウンロードせずに Ollama のクラウドで動かせます
- データの扱い — クラウドでのプロンプトと応答は保存・記録せず、学習にも使わないと公式に明記されています。サーバーは主に米国にあり、需要に応じて欧州を使うことがあります
- クラウド機能の無効化 — 環境変数 `OLLAMA_NO_CLOUD=1` などで、ローカルのモデルだけを使う設定にできます
料金
パソコンでモデルを動かすのは無料で、回数の制限もありません。有料なのは、クラウドでモデルを動かす場合だけです。料金は米ドル建てで、2026年10月10日時点の公式料金ページの表記にもとづきます。
| プラン | 料金 | 毎月のクレジット | 同時実行数 | 主な内容 |
|---|---|---|---|---|
| Free | $0 | お試し分(一部のモデルのみ) | 1 | ローカル実行、お試し用のクラウドモデル。クレジットを買うと全モデルを使える |
| Pro | 月$20(年払い$200) | $60分 | 3 | より大きなモデル、複数モデルの同時実行 |
| Max | 月$100 | $300分 | 10 | 新しいモデルの先行利用 |
| Team(早期提供) | 月$500 | $1,000分(チームで共有) | 10 | ユーザー数無制限、請求・管理の一元化、優先サポート |
| Enterprise | 個別見積もり | — | — | 使えるモデルの制限、ユーザー・APIキーごとの予算上限、専任サポート |
クレジットの仕組み: クラウドの利用量は、モデルごとの単価(100万トークンあたり)で計算されます。プランに含まれるクレジットが先に使われ、足りない分は購入したクレジットから引かれます。含まれるクレジットは毎月の更新日にリセットされ、翌月への繰り越しはありません。購入したクレジットの有効期限は、追加してから1年です(利用規約より)。有料プランでは、含まれる分の90%に達するとメールで知らせてくれます。
クラウドモデルの単価の例(100万トークンあたり、公式料金ページより)
| モデル | 入力 | 出力 |
|---|---|---|
| gpt-oss:20b | $0.07 | $0.30 |
| gemma4 | $0.14 | $0.40 |
| deepseek-v4.1-flash | $0.30 | $1.20 |
| mistral-large-4 | $0.68 | $2.09 |
| kimi-k3 | $3.00 | $15.00 |
一部のモデル(DeepSeek など)には、平日の UTC 12:00〜18:00 以外と週末終日に適用される、割安なオフピーク料金があります。同時実行数を超えたリクエストは順番待ちになり、待ち行列がいっぱいのときは受け付けられません。
動かすのに必要な環境
- macOS — Sonoma(14)以降。Apple M シリーズは CPU と GPU の両方、Intel(x86)の Mac は CPU のみで動きます。
- Windows — Windows 10 22H2 以降(Home・Pro)。NVIDIA の GPU はドライバー 551.61 以降が必要です。AMD Radeon も ROCm または Vulkan で使えます。本体のインストールに4GB以上の空きが必要です。
- Linux — インストールスクリプトのほか、手動インストールや AMD GPU 向け・ARM64 向けのパッケージがあります。
- モデルの容量 — モデルは1つで数十GBから数百GBになるものもあります。大きなモデルほど、多くのメモリ(GPUのメモリ)が必要です。
日本語対応
- 画面・ドキュメント — 公式サイトとドキュメントは英語です。
- 日本語での会話 — 日本語で使えるかどうかは、モデルしだいです。Qwen や Gemma のように多言語に対応したモデルを選ぶと、日本語でやりとりできます。
- 料金 — 米ドル建てで、円建ての表示はありません。
メリット・デメリット
メリット
- ローカル実行は無料・無制限で、入力した内容が外部に送られない
- 1コマンドでモデルを動かせ、ローカルLLMを試すまでの手間が小さい
- OpenAI 互換の API があり、既存のアプリやコーディングツールの接続先を手元のモデルに切り替えられる
- 手元で動かない大きなモデルは、同じ使い方のままクラウドで動かせる
デメリット
- ローカルで快適に動かすには、性能の高い GPU や大きなメモリを積んだパソコンが要る
- 画面とドキュメントが英語
- 既定のコンテキスト長(一度に扱える文章の長さ)は4,096トークンで、長い文章を扱うには設定の変更が必要
- クラウドの有料プランは米ドル建てで、返金の条件が公式に示されていない
評判・口コミ
GitHub のスターは約18万、公式サイトでは月900万回以上インストールされていると表記されており、ローカルでLLMを動かす手段として広く使われています。当サイトで紹介している Cline・Kilo Code・Vanna AI などのページでも、ローカルモデルの接続先として Ollama が登場します。データを社外に出したくない用途や、APIの利用料をかけずに試したい用途で選ばれやすいツールです。一方で、手元のパソコンの性能によっては大きなモデルが動かない、または遅いという制約があり、その不足を補う形でクラウドの有料プランが用意されています。
よくある質問(FAQ)
Q. Ollamaは無料で使えますか? A. はい。自分のパソコンでモデルを動かす使い方は、無料で回数の制限もありません。有料になるのは、Ollama のクラウドでモデルを動かす場合で、Pro(月$20)などのプランか、購入したクレジットで支払います。
Q. 入力した内容は外部に送られますか? A. ローカルのモデルを使っている間は、Ollama 社にプロンプトやデータは送られません。クラウドのモデルを使った場合は、応答のために処理されますが、保存・記録や学習への利用はしないと公式に明記されています。
Q. 日本語で使えますか? A. 画面とドキュメントは英語です。会話は、Qwen や Gemma など日本語に対応したモデルを選べば日本語でできます。
Q. どのくらいの性能のパソコンが必要ですか? A. 動かすモデルの大きさによります。Apple M シリーズの Mac や、NVIDIA・AMD の GPU を積んだパソコンなら GPU で高速に動かせます。大きなモデルほど多くのメモリが必要なので、まずは小さなモデルから試すのがおすすめです。
Q. OpenAIのAPI向けに作ったアプリで使えますか?
A. 使えます。接続先を http://localhost:11434/v1/ に変えると、OpenAI のクライアントからローカルのモデルを呼び出せます(APIキーの値は必要ですが、ローカルでは無視されます)。対応しているのは OpenAI API の一部の機能です。
Q. 有料プランを解約したら返金されますか? A. 解約はアカウント設定からできますが、利用規約・料金ページには返金についての記載がありません(2026年10月10日時点)。
他のAIツールとの違い
| サービス | 種類 | 向いている使い方 |
|---|---|---|
| Ollama | オープンモデルをローカルで動かす実行ツール+クラウド推論 | モデルを手元で動かしたい、アプリの接続先をローカルLLMにしたい |
| Hugging Face | モデル・データセットの共有プラットフォーム+推論API | さまざまなモデルを探して入手したい、自分のモデルを公開したい |
| Qwen | Alibaba の LLM(チャット・API・オープンウェイト) | 公開されているモデルそのものを使いたい |
| Cline | VS Code で動くコーディングエージェント | Ollama などのモデルにつないで、コードを書かせたい |
Qwen や Mistral は「モデル」、Hugging Face はモデルを配布・共有する「場所」、Ollama はそのモデルを手元で動かす「実行環境」にあたります。Cline のようなツールは、Ollama で動かしたモデルを接続先として使えます。
本ページの情報は2026年10月10日時点で、Ollama の公式サイト(トップページ・料金ページ・モデルライブラリ・利用規約・プライバシーポリシー)と公式ドキュメント(クイックスタート、CLI、OpenAI 互換、クラウド、macOS・Windows・Linux、FAQ)にもとづきます。料金・機能は変更されることがあるため、最新の情報は公式サイトをご確認ください。
