GGUFファイル名の読み方|Q4_K_M・Instruct・Chat・mmproj・MTPを初心者向けに整理

公開日
2026-07-05
更新日
2026-07-05
情報確認日
2026-07-05
編集・運営
Local AI Compass

GGUFファイル名は、全部を完璧に解析するための暗号ではありません。初心者は、モデル名、サイズ、用途、量子化、補助ファイルかどうかの5点だけ先に見れば、LM Studioでの最初の選択ミスを減らせます。

導入前に確認すること

  • Windowsのバージョン、メモリ容量、GPU/VRAM、空き容量を確認する
  • 最初は軽量モデル、短い質問、少ない同時作業から始める
  • 公式サイトの対応OS、利用規約、モデルのライセンスを確認する

まず結論:全部読めなくてよい

ggmlのGGUF仕様には命名規則の説明がありますが、実際の配布ファイル名は完全に機械的に読めるとは限りません。重要なのは、会話用の本体モデルなのか、どのくらい大きいのか、どの量子化なのか、自分のPCに無理がないかです。

まず結論:全部読めなくてよいの表
見る順番初心者の判断
モデル名Qwen / Llama / Mistral など何系のモデルかを確認する
用途Instruct / Chat / Base会話用途ならInstruct/Chatを優先する
サイズ7B / 8B / 14B / 32B大きいほど重くなりやすい
量子化Q4_K_M / Q5_K_M / Q8_0最初はQ4_K_M前後から試す
sidecarmmproj / mtp単体会話モデルと混同しない

Q4_K_M / Q5_K_M / Q8_0の見方

Q4_K_M、Q5_K_M、Q8_0は、初心者には「軽さと品質のバランスを見る目印」として扱うと分かりやすいです。Q4は軽め、Q5は少し品質寄り、Q8は重くなりやすい候補として見ます。ただし、モデルやPC環境で体感は変わります。

Instruct / Chat / Base の違い

Instruct / Chat / Base の違いの表
表記ざっくりした意味初心者向けの扱い
Instruct指示応答向けに調整されたことが多い最初の会話・文章作成候補
Chat対話向けに調整されたことが多いチャット用途の候補
Base基盤モデル寄り最初の会話用には難しい場合がある

表記だけで品質は決まりません。Model Cardの用途、推奨プロンプト、チャットテンプレート、日本語対応の説明も確認してください。

7B / 8B / 14B / 32B の見方

7B、8B、14B、32Bはモデル規模の目安です。大きいほど賢い可能性はありますが、必要メモリ、VRAM、読み込み時間、発熱も増えやすくなります。Windows初心者は、まず7B/8B級の軽めの量子化から始めるほうが切り分けしやすいです。

mmprojやMTPなどのsidecarに注意

GGUF仕様では、mmprojやmtpのようなsidecarが説明されています。mmprojはマルチモーダル用の補助部品、mtpは投機的デコードなどで使う補助モジュールの文脈があります。これらは単体の会話モデル本体ではない場合があります。

LM StudioやHugging Faceで見かけたときは、「このファイルだけでチャットできる本体か」「別のベースモデルと一緒に使う補助ファイルか」をREADMEで確認します。

読み取り例

読み取り例の表
ファイル名の一部見るポイント次の判断
Qwen3-8B-Instruct-Q4_K_M.gguf8B / Instruct / Q4_K_M16GB前後の入門候補になり得るがModel Card確認
Model-32B-Chat-Q8_0.gguf32B / Chat / Q8かなり重い可能性があるため初心者の最初の1本には慎重
mmproj-Model-VL-F16.ggufmmproj sidecar本体モデルではない可能性を確認
mtp-Model-27B-Q4_K_M.ggufmtp sidecar単体ロード用ではない可能性を確認

読めない時に確認する順番

  1. ファイル拡張子が.ggufか確認する。
  2. Instruct / Chat / Baseなど用途を探す。
  3. 7B/8B/14B/32Bなどサイズを見る。
  4. Q4_K_M / Q5_K_M / Q8_0など量子化を見る。
  5. mmproj / mtp / LoRA / vocabなど補助ファイルらしき表記を確認する。
  6. 最後にModel CardとREADMEで用途、license、推奨ツールを確認する。

よくある質問

Q4_K_Mとは何ですか?

GGUFでよく見る量子化表記のひとつです。初心者は軽めで試しやすい候補として見ますが、品質や速度はモデルとPC環境で変わります。

InstructとChatは違いますか?

どちらも会話や指示応答向けの調整を示すことが多いですが、厳密な意味はモデルごとに違います。Model Cardで用途を確認してください。

mmprojとは何ですか?

マルチモーダル系モデルで使う補助ファイルを指す場合があります。単体の会話モデル本体と混同しないよう、READMEを確認してください。

MTPとは何ですか?

Multi-Token Predictionの補助モジュールを示す場合があります。単体ロード用かどうかは配布ページの説明を確認してください。

ファイル名だけで性能は分かりますか?

分かりません。サイズや量子化の目安は読めますが、日本語性能、制限、license、推奨設定はModel Cardで確認する必要があります。

次に読むおすすめルート

初めてローカルAIを触る人

まず全体像をつかみ、LM StudioとOllamaの違い、モデルサイズの考え方を順番に確認します。

  1. クラウドAIとローカルAIの使い分け
  2. ローカルLLMとは
  3. ローカルAIを入れる前に確認すること
  4. WindowsでローカルAIを始める完全ガイド
  5. Windows ARMでローカルAIを使う前の確認
  6. WindowsでOllamaをインストールする
  7. Windowsでローカル音声認識を始める
  8. WindowsでローカルOCRを始める
  9. Windowsで話者分離を始める
  10. WindowsでローカルAI翻訳を始める
  11. LM Studioとは
  12. GGUFとは
  13. GGUF版とは
  14. LM StudioでGGUFを入れる方法
  15. LM Studioで画像を読み込む方法
  16. LM Studioのモデル保存場所と移動
  17. 小型LLM・量子化の現実
  18. GGUF量子化安全とRAG/NPU研究
  19. Quant.npuとNPU向け静的量子化
  20. LENSで見るNPUレイテンシ予測
  21. Copilot+ PCのNPU期待値
  22. Hugging Face安全チェック
  23. PDF/RAG/引用確認の現実
  24. LM Studioで最初に選ぶモデル
  25. GGUFモデル選び診断
  26. Hugging FaceでGGUFモデルを探す方法
  27. Q4/Q5/Q8の違いと選び方
  28. 日本語GGUFモデルの選び方
  29. Q4/Q5/Q8研究ガイド
  30. Hermes Desktopとは
  31. Hermes DesktopとLM Studio接続
  32. Hermes DesktopとOllama接続
  33. Hermes Desktop接続トラブル
  34. Hermes AgentとDesktopの違い
  35. ローカルLLMツール比較
  36. ローカルAI更新メモ
  37. 診断ページ

あなたはどのタイプ?

関連チェック先

関連ツール

比較表を見る / 最初に検討しやすいツールを確認する