このサイトの「実測」とは
同じPCで、AIに同じ質問をして、回答の文章を書き出す速さと、使ったメモリの量を測っています。
ひとことで言うと
「このPCで、このAIに質問したら、どのくらいの速さで答えが出てくるか」を数字にしたものです。
測り方
- 同じ質問をする「ローカルでAIを動かすメリットとデメリットを、初心者向けに日本語で説明してください。」
- 2通りの条件で動かすGPUを使う場合(RTX 4080)と、GPUを使わずCPUだけで動かす場合
- 回答を書かせて時間を計る約256トークン分の回答を書かせ、1秒あたりに書けたトークン数を計算
- 2回測って2回目を使う1回目はモデルの読み込みの時間が混ざるため。読み込みの時間は別に記録
測っているもの
| 項目 | 意味 |
|---|---|
| 生成速度(トークン/秒) | 1秒あたりに書ける文章の量。大きいほど速い |
| 使用メモリ(GB) | そのAIを動かすのに必要なメモリ。PCのメモリ(GPUならVRAM)より小さくないと動かない |
| 読み込み時間(秒) | AIを使い始めるまでの準備時間 |
「トークン」とは
AIが文章を扱うときの区切りの単位です。日本語ではおおよそ1〜2文字が1トークンになります。つまり「20トークン/秒」は、だいたい毎秒20〜40文字のペースで文章が出てくる速さです。
体感の目安(このサイトの基準)
| 速さ | 目安 | 感覚 |
|---|---|---|
| 30以上 | ⚡ 一瞬 | 文章が一瞬で出てくる |
| 15〜30 | 😊 快適 | 読むより速い。会話がスムーズ |
| 5〜15 | 🙂 少し待つ | 少し待つが、十分使える |
| 5未満 | 🐢 待つ | 待ち時間が気になる |
実際の回答の例
gemma4:12b-it-q8_0 がGPUありで書いた回答の冒頭です。この長さの文章を、1秒あたり約43トークン(⚡ 一瞬)の速さで書き出しました。
AI(人工知能)をクラウドサービス(ChatGPTなど)を使うのではなく、自分のパソコンやサーバーなどの「ローカル環境」で動かすことには、大きなメリットとデメリットの両方があります。 初心者の方にもわかりやすく、ポイントを絞って解説します。 1. ローカルで動かすメリット(良いところ) ① プライバシーとセキュリティの安心感 最大のメリットです。クラウドを使う場合、入力したデータは運営会社のサーバーに送信されます。一方、ローカルならデータは自分の手元から外に出ません。 * 例:社外秘の文書や、個人的な日記、機密性の高い情報をAIに読み込ませたい場合に非常に安全です。 ② 料金がかからない(無料) 一度必要な機材(高性能なPCなど)を揃えてしまえば、AIを動かすたびに料金が発生することはありません。 * 例:ChatGPTのように「月…
測定環境
- CPU: AMD Ryzen 7 9800X3D(8コア)
- メモリ: 31GB
- GPU: NVIDIA GeForce RTX 4080(VRAM 16GB)
- ソフト: Ollama
同じモデルでも、GPUやCPU、メモリの速さ、ソフトのバージョンによって結果は変わります。あくまで「同じ条件で比べた目安」としてご覧ください。