Ollamaの使い方|ローカルLLMをMac・Windowsで無料で動かす手順【2026年最新・初心者向け】
ChatGPTのようなAIを、クラウドに頼らず自分のPCの中だけで動かせたら——そう思ったことはありませんか。それを一番かんたんに実現できるのが Ollama(オラマ) です。コマンドを2つ打つだけで、無料のAIモデルがあなたのPCで動き出します。
本記事では、Ollamaの使い方をインストールから日本語モデルの実行まで、初心者向けにやさしく解説します。
この記事でわかること
- Ollamaとは何か、何がうれしいのか
- Mac / Windows / Linux でのインストール手順
- 「たった2ステップ」で動かす基本の使い方
- 日本語に強いおすすめモデルと選び方
- 必要なPCスペックと、つまずきやすいポイント
- OpenAI互換APIで自分の開発に組み込む方法
Ollamaとは?
Ollama は、ローカル環境(自分のPC)でLLM(大規模言語モデル)を手軽に実行するためのツールです。2023年の登場以降ユーザーを急速に伸ばし、2026年現在はローカルLLMのデファクトスタンダードと言える存在になっています。
最大の魅力は、環境構築の難しさを肩代わりしてくれること。難しい設定なしに、ワンコマンドでAIモデルをダウンロード&実行できます。
Ollamaの主な特徴
- ワンコマンド実行:
ollama run モデル名だけでダウンロードから起動まで完了 - 豊富なモデルライブラリ:用途や日本語対応で選べる
- OpenAI互換API:既存のツールやコードにつなぎやすい
- クロスプラットフォーム:Mac / Windows / Linux 対応
- GPU自動認識:対応GPUがあれば自動で高速化
必要なPCスペック(先に確認)
快適に使うための最低ラインは16GBのメモリ(RAM)です。メモリが足りないと、推論が極端に遅くなったり、モデルが起動しないことがあります。
- 8GB:小さなモデルなら動くが窮屈
- 16GB:中型モデル(7B〜14B級)が実用的
- 32GB以上+GPU:より大きなモデルも快適
「まず試す」なら16GBを目安に、モデルサイズを小さめから始めるのが安全です。
インストール手順(Mac / Windows / Linux)
お使いのOSに合わせて入れてください。
- macOS:Homebrewで
brew install ollama(または公式サイトのインストーラー) - Windows:
winget install Ollama.Ollama(または公式インストーラー) - Linux:公式のインストールスクリプトを実行
インストール後、ターミナル(Windowsはコマンドプロンプト/PowerShell)で ollama --version が表示されれば準備完了です。
基本の使い方(たった2ステップ)
使い方の核はとてもシンプルです。
- Ollamaをインストールする
ollama run qwen3のように打つ
これだけで、モデルが自動でダウンロードされ、対話が始まります。
ollama run qwen3プロンプトが出たら、日本語で質問を入力すればOK。会話を終えるときは /bye と入力します。一度ダウンロードしたモデルは次回から即起動できます。
日本語に強いおすすめモデル
日本語用途の堅実な初手はQwen3シリーズです。日本語の読み書きに強く、サイズの選択肢も豊富。目安として、Qwen3-14B を Q4_K_M(量子化) で使うと、日本語の実用性と動作の軽さのバランスが取りやすいです。
- 軽さ重視:より小さいサイズ(数B規模)から
- 品質重視:14B級を、メモリに余裕があれば
※「量子化(Q4_K_M など)」は、モデルを軽くして動かしやすくする仕組み、と考えればOKです。
よく使うコマンド
コマンド | 何をする |
|---|---|
| モデルを実行(無ければDL) |
| モデルを事前ダウンロード |
| 入れたモデル一覧を表示 |
| 動作中のモデルを確認 |
| モデルを削除(容量の節約) |
OpenAI互換APIで開発に組み込む
OllamaはOpenAI互換のAPIを備えており、ローカルで動くサーバー(既定で localhost:11434)に対して、OpenAIとほぼ同じ形式でリクエストできます。つまり、「AIの部分だけ自前のPCに置き換える」ことが可能。試作やコスト削減、社外に出せないデータの処理に向いています。
つまずきやすいポイント
- 動作が重い/起動しない → ほぼメモリ不足。モデルサイズを下げる、または軽い量子化を選ぶ
- 日本語がいまいち → 日本語に強いモデル(Qwen3系など)に変える
- モデル選びで迷う → まず小さいモデルで動作確認 → 慣れたら大きめへ
Open Notebook や NotebookLM代替と組み合わせる
Ollamaで動かしたローカルLLMは、セルフホスト型のAIノートの頭脳としても使えます。データを外に出さず、AIノートを完全ローカルで運用したい人は、あわせてチェックしてみてください。
よくある質問(FAQ)
Q. 本当に無料ですか?
Ollama本体も、配布されているモデルの多くも無料で使えます。かかるのは電気代とPCのスペック(メモリ・GPU)くらいです。
Q. ネットがなくても使えますか?
一度モデルをダウンロードすれば、オフラインでも動作します(初回DL時のみ通信が必要)。
Q. 商用利用できますか?
Ollama自体は問題ありませんが、モデルごとにライセンスが異なります。業務で使う場合は各モデルの利用規約を必ず確認してください。
Q. プログラミングができなくても使えますか?
はい。ollama run で対話するだけなら、コマンドを1〜2行打つだけです。APIで開発に組み込む場合はある程度の知識が必要になります。
まとめ
Ollamaを使えば、無料・ローカル・オフラインでAIを動かせます。まずは16GBメモリを目安に、ollama run qwen3 から始めてみましょう。「クラウドに出せないデータを扱いたい」「AIのコストを抑えたい」人にとって、心強い選択肢になります。
関連記事
※コマンド・対応モデル・必要環境は更新が速いため、導入時は公式サイト(ollama.com)等で最新情報をご確認ください。
最後までお読みいただきありがとうございます
この記事が参考になりましたら、ぜひシェアや他の記事もご覧ください。
AIの関連記事
もっと見る →Google NotebookLMの代替を探す人へ。データを手元に置ける無料・オープンソースのセルフホスト型5選(Open Notebook / SurfSense / Khoj / Notex / InsightsLM)を、特徴・向き不向き・選び方の比較表つきで2026年最新版で解説。手軽なクラウド代替も紹介します。
7分Claude CodeのPro、Max 5x、Max 20xとAPI従量課金を比較。月額料金、利用上限の考え方、利用頻度別の選び方、トークン消費を抑える方法を2026年6月時点の公式情報に基づいて解説します。
6分OpenMontageは、AIコーディングアシスタントを動画制作スタジオに変えるオープンソースのエージェント駆動システム。1クリップ生成で終わらず、リサーチ→脚本→素材生成→編集→合成という実際の制作工程を自動化します。12のパイプライン・52ツール・500以上のスキル、無料ローカル完結から有料API連携までを公式情報に基づいて解説します。
8分新着記事
一覧を見る →Redisのライセンス変更を機にLinux Foundationが立ち上げたOSS「Valkey」を解説します。フォークの経緯、Redisとの互換性とライセンスの違い、Valkey 9.0の新機能、移行時に確認すべき判断材料を整理します。
7分Mac miniを複数台使ってClaude CodeやローカルLLMを並列運用する際の判断基準を解説。1台目の選び方、メモリ・ネットワーク構成、総保有コスト、常時稼働のセキュリティを整理します。
6分
TursoはSQLiteをRustで一から書き直した、SQLite互換のインプロセスSQLデータベース。BEGIN CONCURRENTによる並行書き込み、ネイティブなベクトル検索、io_uringによる非同期I/Oなど、SQLiteの制約を超える機能を備えています。本記事ではlibSQLとの関係、注目機能、導入方法、成熟度までを公式情報に基づいて解説します。
5分