国内最大級の掲載数 × 最短1分で探せるAI検索

▶︎ 情報掲載をご希望の方へ

メルマガに登録(無料)
  1. AI BEST SEARCH
  2. Ollama
Ollama

オラマ
Ollama
の使い方・機能・解決する業務課題

ブックマークする

Ollama(オラマ)とは?

米Ollama Inc.が提供する、Gemma・Qwen・DeepSeek・gpt-ossなどのオープンモデルを自分のPC(Mac・Windows・Linux)でダウンロードして動かせるローカルLLM実行ツール。「ollama run」の1コマンドで使え、OpenAI互換のAPIサーバーとしても動く。ローカル実行は無料・無制限。大きなモデルをクラウドで動かす有料プランは Pro 月$20、Max 月$100。画面は英語。

解決する業務課題

「Ollama」のサービス詳細

Ollamaとは

Ollama(オラマ)は、Gemma・Qwen・DeepSeek・gpt-oss などのオープンなAIモデルを、自分のパソコンにダウンロードして動かせるツールです。Mac・Windows・Linux に対応し、インストール後は ollama run gemma4 のようにモデル名を1つ指定するだけで、ダウンロードからチャットの開始までが済みます。本体はオープンソース(MITライセンス)で、GitHub のスターは約18万(2026年10月10日時点)。公式サイトでは、月900万回以上のインストール、10億回以上のモデルのダウンロードと表記されています。

起動すると、パソコンの中に API サーバー(http://localhost:11434)が立ち上がります。OpenAI 互換の API にも対応しているため、ChatGPT の API 向けに書いたアプリや、Cline・Kilo Code のようなコーディング支援ツールの接続先を、手元のモデルに切り替えられます。ローカルで動かしている間、入力した文章が Ollama 社に送られることはありません。

ローカル実行は無料・無制限です。このほか、手元のパソコンでは動かしきれない大きなモデルを Ollama のクラウドで動かす有料プラン(Pro・Max・Team・Enterprise)もあります。

提供元
Ollama Inc.(米国。利用規約の準拠法はカリフォルニア州法)
分類
オープンモデルをローカルで動かす実行ツール+クラウドでモデルを動かす推論サービス
対応OS
macOS(Sonoma 14 以降)、Windows(10 22H2 以降)、Linux
モデル
公式ライブラリに245モデル(ローカル対応232・クラウド対応17。確認時点)
日本語
サイト・ドキュメントは英語。日本語での応答の質は、選ぶモデルによる
料金
ローカル実行は無料。クラウドは Free(お試し分のクレジット付き)、Pro 月$20、Max 月$100、Team 月$500、Enterprise 個別見積もり。米ドル建て
利用条件
サービスの利用は18歳以上(利用規約より)

使い方

  1. インストールする 公式サイトの「Download」から、macOS・Windows のインストーラーを入手します。ターミナルからなら、macOS・Linux は curl -fsSL https://ollama.com/install.sh | sh、Windows は PowerShell で irm https://ollama.com/install.ps1 | iex でも入れられます。
  2. モデルを動かす アプリを開くか、ターミナルで ollama を実行して、表示に従ってモデルを選びます。ollama run gemma4 のようにモデル名を指定すると、初回はダウンロードしてからそのまま対話が始まります。モデルは数GBから数百GBあるため、空き容量が必要です。
  3. モデルを管理する ollama pull(ダウンロード)、ollama ls(一覧)、ollama ps(実行中のモデル)、ollama rm(削除)で管理します。Modelfile にシステムプロンプトなどを書けば、自分用にカスタマイズしたモデルも作れます。
  4. アプリやコーディングエージェントから使う ollama launch claude・ollama launch codex・ollama launch opencode で、Claude Code などのコーディングエージェントを Ollama のモデルで起動できます。自作のアプリからは http://localhost:11434 の API(OpenAI 互換の /v1/chat/completions など)を呼び出します。
  5. クラウドのモデルを使う(任意) ollama signin でサインインすると、gemma4:cloud のような名前でクラウドのモデルを呼び出せます。APIキーを発行すれば、Ollama をインストールしていない環境からでも https://ollama.com/v1 に直接リクエストできます。

主な機能

01ローカル実行

  • 1コマンドで実行 — モデル名を指定するだけで、ダウンロード・読み込み・対話まで進みます
  • GPUの自動利用 — Apple M シリーズの GPU、NVIDIA、AMD Radeon の GPU を使って動かせます(Intel Mac は CPU のみ)
  • モデルライブラリ — テキスト、画像を読めるモデル(Vision)、ツール呼び出し、推論(Thinking)、埋め込みなどの用途で絞り込んで探せます
  • Modelfile — ベースのモデルにシステムプロンプトや設定を加えた、自分用のモデルを作れます

02API・連携

  • ローカルAPIサーバー — `localhost:11434` で動く独自の API に加え、OpenAI 互換・Anthropic 互換の API(いずれも一部の機能)に対応しています
  • ollama launch — Claude Code・Codex・OpenCode などを、Ollama のモデルにつないだ状態で起動します
  • デスクトップアプリとの接続 — macOS では、Claude Desktop や ChatGPT のデスクトップアプリ(Codex モード)から Ollama のモデルを使う設定ができます

03クラウド

  • クラウドモデル — 手元では動かしにくい大きなモデルを、ダウンロードせずに Ollama のクラウドで動かせます
  • データの扱い — クラウドでのプロンプトと応答は保存・記録せず、学習にも使わないと公式に明記されています。サーバーは主に米国にあり、需要に応じて欧州を使うことがあります
  • クラウド機能の無効化 — 環境変数 `OLLAMA_NO_CLOUD=1` などで、ローカルのモデルだけを使う設定にできます

料金

パソコンでモデルを動かすのは無料で、回数の制限もありません。有料なのは、クラウドでモデルを動かす場合だけです。料金は米ドル建てで、2026年10月10日時点の公式料金ページの表記にもとづきます。

プラン料金毎月のクレジット同時実行数主な内容
Free$0お試し分(一部のモデルのみ)1ローカル実行、お試し用のクラウドモデル。クレジットを買うと全モデルを使える
Pro月$20(年払い$200)$60分3より大きなモデル、複数モデルの同時実行
Max月$100$300分10新しいモデルの先行利用
Team(早期提供)月$500$1,000分(チームで共有)10ユーザー数無制限、請求・管理の一元化、優先サポート
Enterprise個別見積もり——使えるモデルの制限、ユーザー・APIキーごとの予算上限、専任サポート

クレジットの仕組み: クラウドの利用量は、モデルごとの単価(100万トークンあたり)で計算されます。プランに含まれるクレジットが先に使われ、足りない分は購入したクレジットから引かれます。含まれるクレジットは毎月の更新日にリセットされ、翌月への繰り越しはありません。購入したクレジットの有効期限は、追加してから1年です(利用規約より)。有料プランでは、含まれる分の90%に達するとメールで知らせてくれます。

クラウドモデルの単価の例(100万トークンあたり、公式料金ページより)

モデル入力出力
gpt-oss:20b$0.07$0.30
gemma4$0.14$0.40
deepseek-v4.1-flash$0.30$1.20
mistral-large-4$0.68$2.09
kimi-k3$3.00$15.00

一部のモデル(DeepSeek など)には、平日の UTC 12:00〜18:00 以外と週末終日に適用される、割安なオフピーク料金があります。同時実行数を超えたリクエストは順番待ちになり、待ち行列がいっぱいのときは受け付けられません。

支払い
決済は Stripe で処理されます
更新
サブスクリプションは、更新日までに解約しない限り自動で更新されます
解約
アカウント設定から、または Ollama への問い合わせで解約できます
返金
利用規約・料金ページには、返金についての記載がありません(確認時点)

動かすのに必要な環境

  • macOS — Sonoma(14)以降。Apple M シリーズは CPU と GPU の両方、Intel(x86)の Mac は CPU のみで動きます。
  • Windows — Windows 10 22H2 以降(Home・Pro)。NVIDIA の GPU はドライバー 551.61 以降が必要です。AMD Radeon も ROCm または Vulkan で使えます。本体のインストールに4GB以上の空きが必要です。
  • Linux — インストールスクリプトのほか、手動インストールや AMD GPU 向け・ARM64 向けのパッケージがあります。
  • モデルの容量 — モデルは1つで数十GBから数百GBになるものもあります。大きなモデルほど、多くのメモリ(GPUのメモリ)が必要です。

日本語対応

  • 画面・ドキュメント — 公式サイトとドキュメントは英語です。
  • 日本語での会話 — 日本語で使えるかどうかは、モデルしだいです。Qwen や Gemma のように多言語に対応したモデルを選ぶと、日本語でやりとりできます。
  • 料金 — 米ドル建てで、円建ての表示はありません。

メリット・デメリット

メリット

  • ローカル実行は無料・無制限で、入力した内容が外部に送られない
  • 1コマンドでモデルを動かせ、ローカルLLMを試すまでの手間が小さい
  • OpenAI 互換の API があり、既存のアプリやコーディングツールの接続先を手元のモデルに切り替えられる
  • 手元で動かない大きなモデルは、同じ使い方のままクラウドで動かせる

デメリット

  • ローカルで快適に動かすには、性能の高い GPU や大きなメモリを積んだパソコンが要る
  • 画面とドキュメントが英語
  • 既定のコンテキスト長(一度に扱える文章の長さ)は4,096トークンで、長い文章を扱うには設定の変更が必要
  • クラウドの有料プランは米ドル建てで、返金の条件が公式に示されていない

評判・口コミ

GitHub のスターは約18万、公式サイトでは月900万回以上インストールされていると表記されており、ローカルでLLMを動かす手段として広く使われています。当サイトで紹介している Cline・Kilo Code・Vanna AI などのページでも、ローカルモデルの接続先として Ollama が登場します。データを社外に出したくない用途や、APIの利用料をかけずに試したい用途で選ばれやすいツールです。一方で、手元のパソコンの性能によっては大きなモデルが動かない、または遅いという制約があり、その不足を補う形でクラウドの有料プランが用意されています。

よくある質問(FAQ)

Q. Ollamaは無料で使えますか? A. はい。自分のパソコンでモデルを動かす使い方は、無料で回数の制限もありません。有料になるのは、Ollama のクラウドでモデルを動かす場合で、Pro(月$20)などのプランか、購入したクレジットで支払います。

Q. 入力した内容は外部に送られますか? A. ローカルのモデルを使っている間は、Ollama 社にプロンプトやデータは送られません。クラウドのモデルを使った場合は、応答のために処理されますが、保存・記録や学習への利用はしないと公式に明記されています。

Q. 日本語で使えますか? A. 画面とドキュメントは英語です。会話は、Qwen や Gemma など日本語に対応したモデルを選べば日本語でできます。

Q. どのくらいの性能のパソコンが必要ですか? A. 動かすモデルの大きさによります。Apple M シリーズの Mac や、NVIDIA・AMD の GPU を積んだパソコンなら GPU で高速に動かせます。大きなモデルほど多くのメモリが必要なので、まずは小さなモデルから試すのがおすすめです。

Q. OpenAIのAPI向けに作ったアプリで使えますか? A. 使えます。接続先を http://localhost:11434/v1/ に変えると、OpenAI のクライアントからローカルのモデルを呼び出せます(APIキーの値は必要ですが、ローカルでは無視されます)。対応しているのは OpenAI API の一部の機能です。

Q. 有料プランを解約したら返金されますか? A. 解約はアカウント設定からできますが、利用規約・料金ページには返金についての記載がありません(2026年10月10日時点)。

他のAIツールとの違い

サービス種類向いている使い方
Ollamaオープンモデルをローカルで動かす実行ツール+クラウド推論モデルを手元で動かしたい、アプリの接続先をローカルLLMにしたい
Hugging Faceモデル・データセットの共有プラットフォーム+推論APIさまざまなモデルを探して入手したい、自分のモデルを公開したい
QwenAlibaba の LLM(チャット・API・オープンウェイト)公開されているモデルそのものを使いたい
ClineVS Code で動くコーディングエージェントOllama などのモデルにつないで、コードを書かせたい

Qwen や Mistral は「モデル」、Hugging Face はモデルを配布・共有する「場所」、Ollama はそのモデルを手元で動かす「実行環境」にあたります。Cline のようなツールは、Ollama で動かしたモデルを接続先として使えます。

本ページの情報は2026年10月10日時点で、Ollama の公式サイト(トップページ・料金ページ・モデルライブラリ・利用規約・プライバシーポリシー)と公式ドキュメント(クイックスタート、CLI、OpenAI 互換、クラウド、macOS・Windows・Linux、FAQ)にもとづきます。料金・機能は変更されることがあるため、最新の情報は公式サイトをご確認ください。

Ollamaを使ってみる

よく比較されるサービス