メモリ8GBのPC(GPUなし)で動くローカルLLM【実測】

GPUなし・メモリ8GBのPCで動くローカルLLM(文章AI)と、その速さを実測データでまとめました。 OSやブラウザに約4GB使う前提で、残りに収まるモデルを「動く」としています。

動くモデル

  • qwen3.5:4b使用メモリ 3.1GB・約19.3トークン/秒😊 快適
  • gemma3:4b使用メモリ 2.8GB・約21.5トークン/秒😊 快適
  • qwen3.5:2b使用メモリ 2.3GB・約27.7トークン/秒😊 快適
  • llama3.2:3b使用メモリ 2.3GB・約27.3トークン/秒😊 快適
  • gemma3:1b使用メモリ 0.9GB・約61.7トークン/秒⚡ 一瞬

メモリが足りないモデル

よくある質問

メモリ8GBのPC(GPUなし)で動くローカルLLMは?

このサイトの実測では 5個のモデルが動きました。そのうち会話が快適な速さ(15トークン/秒以上)は5個です。いちばん大きいのは qwen3.5:4b(約19.3トークン/秒)です。

GPUがないとローカルAIは使えない?

使えます。小さめのモデルならCPUだけでも会話に使える速さが出ます。大きなモデルほど遅くなるので、速さが欲しいならGPUのVRAMに収まるかを確認してください。

ほかの容量: メモリ16GB / メモリ32GB / GPUあり(VRAM別)

このサイトの運営PC(Ryzen 7 9800X3D / メモリ31GB / RTX 4080(VRAM 16GB))での実測値です。「VRAM 8GB/12GB相当」は、RTX 4080 のまま使えるVRAMの量を制限して測った値です。実際の 8GB・12GB のGPUは、4080より処理が遅いぶん速さが下がることがあります。測り方