メモリ8GBのPC(GPUなし)で動くローカルLLM【実測】
GPUなし・メモリ8GBのPCで動くローカルLLM(文章AI)と、その速さを実測データでまとめました。 OSやブラウザに約4GB使う前提で、残りに収まるモデルを「動く」としています。
動くモデル
- qwen3.5:4b使用メモリ 3.1GB・約19.3トークン/秒😊 快適
- gemma3:4b使用メモリ 2.8GB・約21.5トークン/秒😊 快適
- qwen3.5:2b使用メモリ 2.3GB・約27.7トークン/秒😊 快適
- llama3.2:3b使用メモリ 2.3GB・約27.3トークン/秒😊 快適
- gemma3:1b使用メモリ 0.9GB・約61.7トークン/秒⚡ 一瞬
メモリが足りないモデル
- qwen3.5:9b(使用メモリ約6.0GB)
- gemma4:12b-it-q8_0(使用メモリ約14.2GB)
よくある質問
メモリ8GBのPC(GPUなし)で動くローカルLLMは?
このサイトの実測では 5個のモデルが動きました。そのうち会話が快適な速さ(15トークン/秒以上)は5個です。いちばん大きいのは qwen3.5:4b(約19.3トークン/秒)です。
GPUがないとローカルAIは使えない?
使えます。小さめのモデルならCPUだけでも会話に使える速さが出ます。大きなモデルほど遅くなるので、速さが欲しいならGPUのVRAMに収まるかを確認してください。
ほかの容量: メモリ16GB / メモリ32GB / GPUあり(VRAM別)
このサイトの運営PC(Ryzen 7 9800X3D / メモリ31GB / RTX 4080(VRAM 16GB))での実測値です。「VRAM 8GB/12GB相当」は、RTX 4080 のまま使えるVRAMの量を制限して測った値です。実際の 8GB・12GB のGPUは、4080より処理が遅いぶん速さが下がることがあります。測り方