MENU

ローカルLLMに必要なPCスペックは?メモリ・GPU・VRAMを初心者向けに解説

本サイトではAmazonアソシエイトを含むアフィリエイト広告を利用しています。

           ┌─────────────────────────────┐
                🛒 Amazonで最新ガジェットをチェック

             PC・タブレット・ゲーミングデバイス・周辺機器を探す

           └─────────────────────────────┘

ローカルLLMを始めたいと思ったとき、最初に気になるのがパソコンの性能です。

「普通のノートパソコンでも動くのか」

「GPUがなければ使えないのか」

「メモリとVRAMは何が違うのか」

「何GBあれば実用的なのか」

スペック表にはCPU、GPU、メモリ、VRAM、SSDなど、多くの項目が並んでいます。

しかし、ローカルLLMを動かすうえで、すべての部品が同じ重要度というわけではありません。

最初に結論をお伝えすると、初心者がLM Studioで小型モデルを試すなら、次の環境が一つの基準になります。

  • メモリ:16GB以上
  • GPU:なくても動く場合がある
  • VRAM:専用GPUがあるなら4GB以上
  • SSD空き容量:最低20~50GB程度
  • CPU:比較的新しく、対応命令を備えたもの

LM Studio公式も、Windowsでは16GB以上のRAMと、4GB以上の専用VRAMを推奨しています。

ただし、これは「ローカルLLMを快適に使える万能スペック」ではありません。

使用するモデルの大きさ、量子化、文章の長さ、画像対応の有無によって、必要なメモリは大きく変わります。

目次

この記事でわかること

  • ローカルLLMで重要なPC部品
  • CPU・GPU・NPUの違い
  • メモリとVRAMの違い
  • GPUなしでも動かせるのか
  • モデルサイズと必要メモリの目安
  • 16GB・32GB・64GBメモリでできること
  • PCを買い替えるべきか
  • 初心者におすすめの構成

AIを動かすなら、とにかく高いGPUを買えばいいの?

GPUは重要だが、メモリ、VRAM、SSDとのバランスが必要だ。まずは何Bのモデルを動かしたいかを決めよう

ローカルLLMの性能を決める5つの部品

部品主な役割重要度
CPUAIの計算、全体の処理高い
メモリ・RAMモデルや処理データを置く非常に高い
GPUAIの計算を高速化する非常に高い
VRAMGPU側でモデルを保持する非常に高い
SSDモデルファイルを保存する高い

ローカルLLMでは、モデルファイルをSSDから読み込み、メモリまたはVRAM上に展開して計算します。

そのため、SSDにモデルが保存できても、メモリやVRAMへ読み込めなければ実行できません。

メモリとVRAMの違い

初心者が最も混乱しやすいのが、メモリとVRAMの違いです。

メモリ・RAM

パソコン全体が使用する作業スペースです。

  • Windows
  • Webブラウザー
  • LM Studio
  • AIモデル
  • 会話履歴
  • 読み込ませた文書

などがメモリを使用します。

VRAM

GPU専用の作業スペースです。

AIモデルをVRAMへ多く載せられるほど、GPUで高速に処理しやすくなります。

例えるなら

  • SSD:資料を保管する本棚
  • メモリ:机の広さ
  • VRAM:AI作業専用の机
  • CPU:一般業務を行う担当者
  • GPU:同じ計算を高速で処理する専門チーム

本棚が大きくても、机が狭ければ大きな資料を広げられません。

同じようにSSD容量が多くても、メモリやVRAMが不足すると、大きなAIモデルは読み込めません。

GPUなしでもローカルLLMは動く?

GPUがなくても、小型モデルならCPUだけで動かせる場合があります。

LM StudioではGPUへの割り当てを無効にしてCPU処理を選べます。また、モデルの一部だけをGPUへ割り当て、残りをシステムメモリで処理する設定も可能です。

ただし、CPUのみでは回答速度が遅くなりやすくなります。

CPUだけでも試しやすい用途

  • 1B~4B程度の小型モデル
  • 短い質問
  • 簡単な文章作成
  • 要約
  • 動作確認
  • ローカルLLMの学習

GPUが欲しくなる用途

  • 7B以上を快適に動かす
  • 長文を扱う
  • 回答を速く表示する
  • 画像対応モデルを使う
  • 複数の処理を並行する
  • 自動化から頻繁に呼び出す

GPUなしでも“動く”ことはある。ただし、“毎日快適に使える”とは限らない。この2つは分けて考えた方がいい

CPUはどのくらい必要?

ローカルLLMでは、GPUを使う場合でもCPUが不要になるわけではありません。

CPUは次の処理を担当します。

  • ソフトの起動
  • モデルの読み込み
  • 入力文章の処理
  • GPUに載せられない部分の計算
  • ファイル処理
  • OSや他アプリの動作

LM StudioのWindows x64版では、CPUにAVX2命令への対応が必要です。

初心者が確認するポイントは、CPU名の細かなベンチマークよりも次の3点です。

  1. LM Studioの動作要件を満たしている
  2. 極端に古いCPUではない
  3. メモリやGPUとのバランスが取れている

CPUだけで推論する場合は、コア数、メモリ帯域、消費電力も回答速度に影響します。

ただし、ローカルLLM用PCでは、CPUを最上位にするより、メモリ容量やVRAMを増やした方が効果を感じやすい場合があります。

メモリは何GB必要?

8GB

ローカルLLM用としては厳しい容量です。

Windowsやブラウザーだけでもメモリを消費するため、AIへ使える容量が限られます。

1B~3B程度の小型モデルを動作確認することはできても、他のアプリと同時に使うと不安定になる可能性があります。

16GB

ローカルLLM入門の最低ラインです。

LM Studio公式も16GB以上を推奨しています。

小型モデルや7B前後の量子化モデルを試せる可能性がありますが、モデル、コンテキスト長、GPUの有無によって余裕は変わります。

32GB

初心者が実用を目指す場合に、最もバランスのよい容量です。

  • 7B~14B程度の量子化モデル
  • ブラウザーとの同時利用
  • 文書を読み込ませる
  • CPUとGPUを併用する
  • LM Studioと他の作業を並行する

といった使い方をしやすくなります。

64GB

大きめのモデルや長文処理を試したい人向けです。

  • 20B~32Bクラス
  • GPUに載らない部分をRAMへ置く
  • 複数モデルの検証
  • 長いコンテキスト
  • RAGや自動化
  • 画像対応モデル

などで余裕を持ちやすくなります。

128GB以上

70Bクラスなど、大規模モデルをCPUまたはGPUとの分割で試す人向けです。

ただし、メモリに入ることと、実用的な速度で動くことは別です。

大容量メモリを搭載しても、メモリ帯域やCPU性能が不足すると、回答が非常に遅くなる可能性があります。

VRAMは何GB必要?

VRAMは、多いほど大きなモデルをGPUへ載せやすくなります。

以下は、4bit前後に量子化したテキストモデルを想定したAI Motion Labの目安です。

VRAM主な対象モデル想定する使い方
4GB1B~4B入門・動作確認
6~8GB7B~8B軽量モデルの日常利用
12GB7B~14B文章作成・要約・コード補助
16GB14B~20B大きめモデル・長文
24GB20B~32B本格的なローカルLLM
48GB以上70B前後大規模モデル・開発用途

この表は保証値ではありません。

必要VRAMは、次の条件によって変わります。

  • モデルの構造
  • 量子化方式
  • コンテキスト長
  • 画像対応の有無
  • 同時処理数
  • KVキャッシュ
  • GPUへ割り当てるレイヤー数

Ollama公式も、コンテキスト長を増やすほど必要なVRAMが増えると説明しています。

「7B」「14B」とは何?

モデル名にあるBは、Billion、つまり10億を表します。

  • 3B:約30億パラメータ
  • 7B:約70億パラメータ
  • 14B:約140億パラメータ
  • 32B:約320億パラメータ
  • 70B:約700億パラメータ

一般的には、パラメータ数が多いモデルほど必要なメモリも増えます。

ただし、パラメータ数が大きければ必ず賢いとは限りません。

学習データ、モデル設計、用途、追加学習などによって性能は変わります。

初心者は、最初から大きなモデルを選ぶより、3B~8B程度のモデルから試す方が導入しやすいでしょう。

量子化とは?

量子化は、AIモデルを圧縮し、必要なメモリや保存容量を減らす技術です。

LM Studioでは、同じモデルに次のようなファイルが表示されます。

  • Q3
  • Q4
  • Q5
  • Q6
  • Q8

数字が小さいほど軽量になる傾向がありますが、圧縮によって回答品質が低下する場合があります。

LM Studio公式は、可能であれば4bit以上から選ぶことを案内しています。

初心者の基本

最初は、モデル名に次のような表記があるものを候補にします。

Q4_K_M

これは、容量、速度、回答品質のバランスを取りやすい量子化として多くのGGUFモデルで用意されています。

ただし、モデルによって最適なファイルは異なります。

モデルサイズと必要容量の目安

4bit前後の量子化モデルでは、重みだけを単純計算すると、1パラメータあたり約0.5バイトが基準になります。

実際にはメタデータ、キャッシュ、実行時メモリなどが加わるため、さらに余裕が必要です。

モデル規模Q4モデルファイルの大まかな目安推奨する総メモリの目安
1B~3B約1~3GB8~16GB
7B~8B約4~6GB16GB以上
12B~14B約8~10GB24~32GB以上
20B前後約12~16GB32~64GB以上
32B前後約20~24GB48~64GB以上
70B前後約40~50GB64~128GB以上

これはあくまで目安です。

LM Studioには、モデルを実際に読み込む前に、GPUメモリと総メモリの推定値を確認する機能があります。コンテキスト長やGPU割り当ても含めて推定できるため、最終的にはソフト上の表示を確認してください。

コンテキスト長が増えるとメモリも増える

コンテキスト長は、AIが一度に参照できる文章量に関係します。

コンテキストを長くすると、

  • 長い文書を読み込める
  • 過去の会話を多く保持できる
  • 大きなコードを扱える

という利点があります。

一方で、必要なメモリやVRAMが増えます。

最初から最大値へ設定せず、4K~8K程度の小さめのコンテキストから始め、必要に応じて増やす方が安全です。

SSDは何GB必要?

LM Studio本体よりも、AIモデルが多くの容量を使用します。

Ollama公式では、アプリ本体とは別に、モデル保存用として数十GBから数百GBが必要になる場合があると案内されています。

容量の目安

利用方法推奨空き容量
小型モデルを1~2個試す20~50GB
複数の7B~14Bモデルを比較100GB以上
20B以上や画像モデルも試す250GB以上
モデルを多数保存する500GB~1TB

HDDでも保存はできますが、モデルの読み込み時間を考えるとSSDが適しています。

複数モデルを試す予定なら、ローカルLLM用に500GB以上の空き容量を確保すると管理しやすくなります。

NPUは必要?

最近のAI PCには、AI処理専用のNPUが搭載されています。

しかし、ローカルLLMでは、NPUの性能値が高ければ自動的に高速化するわけではありません。

使用するソフトとモデルが、そのNPUへ対応している必要があります。

現状では、LM StudioやOllamaによる一般的なローカルLLM運用では、CPU、GPU、メモリ、VRAMの方が分かりやすい判断材料です。

ローカルLLMだけを目的にPCを選ぶなら、NPUのTOPS値よりも、次を先に確認してください。

  1. メモリ容量
  2. VRAM容量
  3. 使用ソフトのGPU対応
  4. SSD容量
  5. 冷却性能

NVIDIA・AMD・Appleはどれがよい?

NVIDIA

ローカルAI関連の対応情報が多く、初心者が導入事例を探しやすい選択肢です。

専用GPUを選ぶ場合は、GPUの処理性能だけでなくVRAM容量を重視します。

AMD

対応するGPUやドライバーを確認する必要があります。

OllamaはAMD GPUへ対応していますが、WindowsとLinuxで対応製品や必要なドライバースタックが異なります。

購入前に、自分が使う予定のLM StudioやOllamaが、対象GPUへ対応しているか確認してください。

Apple Silicon

MacではCPUとGPUがユニファイドメモリを共有します。

LM StudioはApple Silicon搭載Macに対応し、16GB以上のメモリを推奨しています。8GBでも小型モデルと短いコンテキストなら動作する可能性があります。

OllamaもApple GPUのMetalアクセラレーションへ対応しています。

Macではメモリを後から増設できない機種が中心なので、購入時の容量選びが重要です。

用途別のおすすめ構成

入門:まず動かしたい

  • メモリ:16GB
  • VRAM:なし~4GB
  • SSD空き:50GB以上
  • 対象:1B~4B、小型7Bモデル
  • 用途:質問、要約、文章作成、学習

今のPCで試す段階です。

新しくPCを買う前に、ローカルLLMが自分に必要か確認できます。

標準:日常的に使いたい

  • メモリ:32GB
  • VRAM:8~12GB
  • SSD空き:200GB以上
  • 対象:7B~14B
  • 用途:ブログ、資料要約、コード補助、文書処理

初心者が長く使う構成として、バランスが取れています。

本格:大きめモデルや自動化

  • メモリ:64GB
  • VRAM:16~24GB
  • SSD空き:500GB以上
  • 対象:14B~32B
  • 用途:長文、RAG、自動化、複数モデル比較

AIを趣味だけでなく、副業や開発へ組み込みたい人向けです。

上級:大型モデルを試す

  • メモリ:128GB以上
  • VRAM:48GB以上、または複数GPU
  • SSD:1TB以上
  • 対象:70Bクラス
  • 用途:研究、開発、大規模な文書処理

一般的な会社員が最初から目指す構成ではありません。

消費電力、発熱、騒音、価格も大きくなります。

ノートPCとデスクトップはどちらがよい?

ノートPC

メリット

  • 持ち運べる
  • 省スペース
  • すぐ使える
  • バッテリーで動く

デメリット

  • GPUの選択肢が限られる
  • 同じ名称のGPUでも性能差がある
  • VRAMを増設できない
  • 高負荷時に発熱しやすい
  • メモリ増設不可の機種がある

デスクトップ

メリット

  • 大容量VRAMのGPUを選びやすい
  • メモリやSSDを増設しやすい
  • 冷却性能を確保しやすい
  • GPU交換が可能

デメリット

  • 持ち運べない
  • 設置場所が必要
  • 電力消費が大きくなりやすい
  • 本体以外の周辺機器が必要

自宅でローカルLLMを本格運用するなら、デスクトップの方が拡張性に優れます。

持ち運びや普段使いを重視するなら、32GB以上のメモリを搭載した高性能ノートPCも選択肢です。

PCを買い替える前に試すこと

新しいPCを購入する前に、次の手順で現在のPCを確認します。

  1. メモリ容量を確認する
  2. GPUとVRAMを確認する
  3. SSDの空き容量を確認する
  4. LM Studioをインストールする
  5. 1B~4Bモデルをダウンロードする
  6. Q4量子化モデルを読み込む
  7. 回答速度とメモリ使用量を確認する
  8. 次に7Bモデルを試す

LM Studioでは、モデルを読み込む前に必要メモリを推定できます。

現在のPCで不満を感じてから、次の改善を検討しましょう。

  • メモリ増設
  • SSD追加
  • GPU追加・交換
  • 新しいPCへの買い替え
  • 小さなモデルへの変更
  • コンテキスト長の縮小

よくある失敗

GPU性能だけで選ぶ

処理性能が高くても、VRAMが少ないと大きなモデルを載せられません。

ローカルLLMでは、ゲーム性能の順位だけでなく、VRAM容量を確認してください。

メモリ16GBで十分だと思う

16GBは入門には使えますが、Windows、ブラウザー、LM Studioを同時に動かすと余裕が少なくなります。

長く使うなら32GB以上を検討します。

SSD容量を見落とす

モデルを数個ダウンロードするだけで、数十GBを消費します。

モデルの保存先を変更できるようにするか、十分な空き容量を用意します。

最大コンテキストへ設定する

長いコンテキストは便利ですが、メモリを消費します。

最初は短めに設定し、必要な場合だけ増やします。

最初から巨大モデルを選ぶ

大きなモデルを無理に動かすより、小型モデルが高速に回答する方が、日常利用では便利なことがあります。

久遠レイジの結論

初めてローカルLLMを試すなら、16GBメモリと小型モデルからでいい。本格的に使うと決めてから、32GBメモリと8~12GB以上のVRAMを検討しよう

ローカルLLMに必要なスペックは、使用するモデルによって変わります。

初心者向けの目安は次のとおりです。

  • 体験する:メモリ16GB
  • 日常的に使う:メモリ32GB・VRAM8~12GB
  • 大きめモデルを使う:メモリ64GB・VRAM16~24GB
  • 70Bクラス:メモリ128GBまたは大容量VRAM環境

ただし、高性能なPCを買えば必ずローカルLLMを使い続けるとは限りません。

まずは手持ちのPCへLM Studioを導入し、小型モデルを動かしてください。

そのうえで、

  • 回答が遅い
  • 使いたいモデルが読み込めない
  • 長い文章を扱いたい
  • 自動化へ組み込みたい
  • 画像対応モデルを使いたい

という具体的な不満が出てから、PCの増強や買い替えを検討するのが失敗しにくい方法です。

この記事が気に入ったら
フォローしてね!

よかったらシェアしてね!
  • URLをコピーしました!
  • URLをコピーしました!

この記事を書いた人

AI Motion Lab編集部のローカルLLM・技術担当。Ollama、LM Studio、llama.cpp、ComfyUIなど、自宅のパソコンでAIを動かす方法を解説します。プライバシー、必要なPC性能、導入手順まで実践的に検証します。

コメント

コメントする

目次