ローカルAI 実測データ一覧

同じPC・同じ質問で、文章を書き出す速さ(トークン/秒)と使用メモリを測りました。測り方と体感の目安はこちら。

あなたのPCで動く?チェッカー

PCのメモリとGPUを選ぶと、このサイトで実測したモデルのうち動かせそうなものと、速さの目安を表示します。

    ※速さはこのサイトの運営PC(Ryzen 7 9800X3D / メモリ31GB / RTX 4080(VRAM 16GB))での実測値です。GPUやCPUが違えば速さも変わります。OSなどに使うメモリとして約4GB、GPUには約1GBの余裕を見込んでいます。

    速さの比較

    生成速度(トークン/秒)GPUあり(RTX 4080)CPUのみgemma3:1bメモリ 0.9GB216.961.7llama3.2:3bメモリ 2.3GB189.727.3qwen3.5:2bメモリ 2.3GB170.427.7gemma3:4bメモリ 2.8GB142.021.5qwen3.5:4bメモリ 3.1GB132.119.3qwen3.5:9bメモリ 6.0GB96.411.2gemma4:12b-it-q8_0メモリ 14.2GB43.54.6
    このサイトの運営PC(Ryzen 7 9800X3D / メモリ31GB / RTX 4080(VRAM 16GB))で、同じ質問に答える速さを実測。測り方

    全データ

    測定環境: Ryzen 7 9800X3D / メモリ31GB / RTX 4080(VRAM 16GB)。トークンはAIが文章を扱う単位で、日本語ではおおよそ1〜2文字です。
    モデル使用メモリGPUあり体感CPUのみ体感測定日
    gemma3:1b0.9 GB216.9⚡ 一瞬61.7⚡ 一瞬2026-10-04
    llama3.2:3b2.3 GB189.7⚡ 一瞬27.3😊 快適2026-10-04
    qwen3.5:2b2.3 GB170.4⚡ 一瞬27.7😊 快適2026-10-04
    gemma3:4b2.8 GB142.0⚡ 一瞬21.5😊 快適2026-10-04
    qwen3.5:4b3.1 GB132.1⚡ 一瞬19.3😊 快適2026-10-04
    qwen3.5:9b6.0 GB96.4⚡ 一瞬11.2🙂 少し待つ2026-10-04
    gemma4:12b-it-q8_014.2 GB43.5⚡ 一瞬4.6🐢 待つ2026-10-04

    数字は「1秒あたりに書けるトークン数」。実測のやり方と体感の目安 →