GGUFファイル名の読み方|Q4_K_M・Instruct・Chat・mmproj・MTPを初心者向けに整理
- 公開日
- 2026-07-05
- 更新日
- 2026-07-05
- 情報確認日
- 2026-07-05
- 編集・運営
- Local AI Compass
GGUFファイル名は、全部を完璧に解析するための暗号ではありません。初心者は、モデル名、サイズ、用途、量子化、補助ファイルかどうかの5点だけ先に見れば、LM Studioでの最初の選択ミスを減らせます。
導入前に確認すること
- Windowsのバージョン、メモリ容量、GPU/VRAM、空き容量を確認する
- 最初は軽量モデル、短い質問、少ない同時作業から始める
- 公式サイトの対応OS、利用規約、モデルのライセンスを確認する
まず結論:全部読めなくてよい
ggmlのGGUF仕様には命名規則の説明がありますが、実際の配布ファイル名は完全に機械的に読めるとは限りません。重要なのは、会話用の本体モデルなのか、どのくらい大きいのか、どの量子化なのか、自分のPCに無理がないかです。
| 見る順番 | 例 | 初心者の判断 |
|---|---|---|
| モデル名 | Qwen / Llama / Mistral など | 何系のモデルかを確認する |
| 用途 | Instruct / Chat / Base | 会話用途ならInstruct/Chatを優先する |
| サイズ | 7B / 8B / 14B / 32B | 大きいほど重くなりやすい |
| 量子化 | Q4_K_M / Q5_K_M / Q8_0 | 最初はQ4_K_M前後から試す |
| sidecar | mmproj / mtp | 単体会話モデルと混同しない |
- GGUFとは?親記事 - 読み方、GGUF版、Q4/Q5/Q8、モデル選びの全体像へ戻る
- GGUFモデル選び診断 - メモリ、GPU、用途から最初の候補を絞る
Q4_K_M / Q5_K_M / Q8_0の見方
Q4_K_M、Q5_K_M、Q8_0は、初心者には「軽さと品質のバランスを見る目印」として扱うと分かりやすいです。Q4は軽め、Q5は少し品質寄り、Q8は重くなりやすい候補として見ます。ただし、モデルやPC環境で体感は変わります。
- Q4/Q5/Q8の違い - 量子化の詳しい見方へ進む
Instruct / Chat / Base の違い
| 表記 | ざっくりした意味 | 初心者向けの扱い |
|---|---|---|
| Instruct | 指示応答向けに調整されたことが多い | 最初の会話・文章作成候補 |
| Chat | 対話向けに調整されたことが多い | チャット用途の候補 |
| Base | 基盤モデル寄り | 最初の会話用には難しい場合がある |
表記だけで品質は決まりません。Model Cardの用途、推奨プロンプト、チャットテンプレート、日本語対応の説明も確認してください。
7B / 8B / 14B / 32B の見方
7B、8B、14B、32Bはモデル規模の目安です。大きいほど賢い可能性はありますが、必要メモリ、VRAM、読み込み時間、発熱も増えやすくなります。Windows初心者は、まず7B/8B級の軽めの量子化から始めるほうが切り分けしやすいです。
- ローカルAIのモデルサイズ早見表 - 8GB/16GB/32GBの一般的な目安を見る
mmprojやMTPなどのsidecarに注意
GGUF仕様では、mmprojやmtpのようなsidecarが説明されています。mmprojはマルチモーダル用の補助部品、mtpは投機的デコードなどで使う補助モジュールの文脈があります。これらは単体の会話モデル本体ではない場合があります。
LM StudioやHugging Faceで見かけたときは、「このファイルだけでチャットできる本体か」「別のベースモデルと一緒に使う補助ファイルか」をREADMEで確認します。
読み取り例
| ファイル名の一部 | 見るポイント | 次の判断 |
|---|---|---|
| Qwen3-8B-Instruct-Q4_K_M.gguf | 8B / Instruct / Q4_K_M | 16GB前後の入門候補になり得るがModel Card確認 |
| Model-32B-Chat-Q8_0.gguf | 32B / Chat / Q8 | かなり重い可能性があるため初心者の最初の1本には慎重 |
| mmproj-Model-VL-F16.gguf | mmproj sidecar | 本体モデルではない可能性を確認 |
| mtp-Model-27B-Q4_K_M.gguf | mtp sidecar | 単体ロード用ではない可能性を確認 |
読めない時に確認する順番
- ファイル拡張子が.ggufか確認する。
- Instruct / Chat / Baseなど用途を探す。
- 7B/8B/14B/32Bなどサイズを見る。
- Q4_K_M / Q5_K_M / Q8_0など量子化を見る。
- mmproj / mtp / LoRA / vocabなど補助ファイルらしき表記を確認する。
- 最後にModel CardとREADMEで用途、license、推奨ツールを確認する。
よくある質問
Q4_K_Mとは何ですか?
GGUFでよく見る量子化表記のひとつです。初心者は軽めで試しやすい候補として見ますが、品質や速度はモデルとPC環境で変わります。
InstructとChatは違いますか?
どちらも会話や指示応答向けの調整を示すことが多いですが、厳密な意味はモデルごとに違います。Model Cardで用途を確認してください。
mmprojとは何ですか?
マルチモーダル系モデルで使う補助ファイルを指す場合があります。単体の会話モデル本体と混同しないよう、READMEを確認してください。
MTPとは何ですか?
Multi-Token Predictionの補助モジュールを示す場合があります。単体ロード用かどうかは配布ページの説明を確認してください。
ファイル名だけで性能は分かりますか?
分かりません。サイズや量子化の目安は読めますが、日本語性能、制限、license、推奨設定はModel Cardで確認する必要があります。
次に読むおすすめルート
初めてローカルAIを触る人
まず全体像をつかみ、LM StudioとOllamaの違い、モデルサイズの考え方を順番に確認します。
- クラウドAIとローカルAIの使い分け
- ローカルLLMとは
- ローカルAIを入れる前に確認すること
- WindowsでローカルAIを始める完全ガイド
- Windows ARMでローカルAIを使う前の確認
- WindowsでOllamaをインストールする
- Windowsでローカル音声認識を始める
- WindowsでローカルOCRを始める
- Windowsで話者分離を始める
- WindowsでローカルAI翻訳を始める
- LM Studioとは
- GGUFとは
- GGUF版とは
- LM StudioでGGUFを入れる方法
- LM Studioで画像を読み込む方法
- LM Studioのモデル保存場所と移動
- 小型LLM・量子化の現実
- GGUF量子化安全とRAG/NPU研究
- Quant.npuとNPU向け静的量子化
- LENSで見るNPUレイテンシ予測
- Copilot+ PCのNPU期待値
- Hugging Face安全チェック
- PDF/RAG/引用確認の現実
- LM Studioで最初に選ぶモデル
- GGUFモデル選び診断
- Hugging FaceでGGUFモデルを探す方法
- Q4/Q5/Q8の違いと選び方
- 日本語GGUFモデルの選び方
- Q4/Q5/Q8研究ガイド
- Hermes Desktopとは
- Hermes DesktopとLM Studio接続
- Hermes DesktopとOllama接続
- Hermes Desktop接続トラブル
- Hermes AgentとDesktopの違い
- ローカルLLMツール比較
- ローカルAI更新メモ
- 診断ページ
あなたはどのタイプ?
- 初めてローカルAIを触る人 - まず全体像をつかみ、LM StudioとOllamaの違い、モデルサイズの考え方を順番に確認します。
- LM Studio・Ollamaの症状別トラブルを解決したい人 - 起動、モデルロード、Prompt Processing、generation、API接続、GPU確認をツール別に分けて読みます。
- GPUなし・低スペックPCの人 - 軽量モデル、メモリ別の目安、重いときの確認ポイントを先に見ます。
- PDFや資料を読ませたい人 - 先に基本を押さえ、モデル単体の確認後にAnythingLLMへ進みます。
- ローカルAIエージェントを試したい人 - Bionic、Ollama、AnythingLLM、Hermesを役割別に分け、local/cloud、tool、保存、PC負荷を順番に確認します。
- 開発・API連携したい人 - LM StudioとOllamaの違いを確認し、API、長文処理、RAGまで段階的に進みます。
関連チェック先
- ggml GGUF specification - GGUFの仕様、推論向けファイル形式、メタデータ、命名規則、sidecarの考え方を確認できます。
- Hugging Face Hub GGUF documentation - Hub上でGGUFファイルを探す方法、GGUF tag、変換・量子化の公式説明を確認できます。
- Hugging Face GGUF usage with LM Studio - Hugging FaceからLM StudioへGGUF/MLXモデルを送る方法、アプリ内ダウンロード、量子化選択を確認できます。