ローカルAI更新メモ
- 公開日
- 2026-06-06
- 更新日
- 2026-08-25
- 情報確認日
- 2026-08-25
ローカルAI、LM Studio、Ollama、Jan、AnythingLLM、GGUF、GPU、API、MCPなどに関係する新しい情報を、初心者向けに短く整理します。
記事の確認日、情報源、実測値と一般的な目安の区別はこのサイトについてにまとめています。
更新メモを読んだあとに見る基本記事
新モデルやツール更新は、GGUF、モデルサイズ、量子化、PC負荷とあわせて見ると判断しやすくなります。
- GGUF量子化安全とRAG/NPU研究 - 知らないGGUF、Hugging Face確認、オンデバイスRAG/NPUをまとめて読む
- GGUFとは? - 量子化モデルやLM Studio向けファイル形式を確認する
- モデルサイズ早見表 - 7B/8B/14B/32B/巨大モデルの違いを見る
- Q4/Q5/Q8の違い - 軽さと品質の見方を確認する
- LM Studioで最初に選ぶモデル - 最初の1本を選ぶ基準を見る
- GPUオフロードとは? - VRAMと速度の関係を確認する
- Ollamaのローカルとcloudの違い - 推論場所、通信、サインイン、local-onlyを確認する
- ローカルAIのコンテキスト長とは - 1M contextなど長文脈をPC負荷と分けて考える
- ローカルAIエージェント比較 - Bionic、Ollama、AnythingLLM、Hermesの役割を比較する
- Qwen3.8-27Bをローカルで使う前に - Ollamaタグ、GGUF・MLX、weight、RAM・VRAM・contextの境界を確認する
- Nemotron 3.5 Lightningのメモリ整理 - 30B total・3B active、Ollamaタグ、KV cache、agent負荷を分けて確認する
更新メモ一覧
- 公式確認 LM Studio・Ollamaのトラブル解決記事を症状別に拡張しました - 公開日 2026-08-01 / 更新日 2026-08-01 / 情報確認日 2026-08-01。親ハブからLM StudioとOllamaのPrompt Processing、生成途中停止、起動、GPU、localhost/APIへ分岐できるようにしました。 実測速度や特定PCの動作保証ではなく、公式Docsと読者自身の確認項目を症状別に整理しています。
- 公式確認 LM Studio Bionic・AnythingLLM・Ollama更新に合わせてローカルAIエージェント記事を追加 - 公開日 2026-07-28 / 更新日 2026-07-29 / 情報確認日 2026-07-29。新規7記事と既存のLM Studio、Ollama、AnythingLLM、privacy、PC負荷記事を、ローカルAIエージェントの実用クラスターとして接続しました。 BionicとLM Studio本体、open modelとlocal model、AnythingLLMのon-deviceとprovider通信、Ollama v0.32.2 withdrawnを分けて整理しています。
- 公式確認 Ollama 0.32.0〜0.32.15の変更点|Qwen3.8・agent・cloud・Windows - 公開日 2026-07-15 / 更新日 2026-08-25 / 情報確認日 2026-08-25。Ollama v0.32.0〜v0.32.15のagent、Qwen3.8、Nemotron 3.5、OpenAI互換API、Muse Glimmer、cloudモデルの変更と、Windowsで更新前に確認する境界をまとめました。 v0.32.0〜v0.32.15のRelease Notes、現行CLI/Cloud/Windows/FAQ、Qwen3.8とNemotron 3.5 Lightningの公式モデルページを2026-08-25に確認。v0.32.2はWithdrawn、v0.32.15はLatestの安定版として扱い、Windowsの実機アップデート、画面表示、料金・利用枠は未確認です。
- 更新 Qwen3.6-27BをColabで試すGGUF・MTP比較手順を追加 - 公開日 2026-07-15 / 更新日 2026-07-15 / 情報確認日 2026-07-15。旗艦のColab手順、MTPの仕組み、T4 16GBのOOM対策を3記事に分け、実行用notebook、3枚のSVG、既存記事への導線を追加しました。 無料ColabのGPU・利用時間、T4でのQ4搭載、MTPの速度向上は保証せず、実行条件と比較手順を分けています。
- 更新 Quant.npu・LENS・Copilot+ PCのNPU期待値をLocal AI Compassに反映 - 公開日 2026-06-30 / 更新日 2026-06-30 / 情報確認日 2026-06-30。NPU/RAG/量子化の既存クラスターを更新し、Quant.npu、LENS、Copilot+ PC向けの子記事を追加しました。 NPU搭載だけでローカルLLMが必ず速くなるとは書かず、対応runtime・量子化形式・モデル・入出力長・実測を分けています。
- 追加 GGUF量子化安全とオンデバイスRAG/NPU研究クラスターを追加 - 公開日 2026-06-28 / 更新日 2026-06-28 / 情報確認日 2026-06-28。GGUF量子化安全、知らないGGUFを動かす前の確認、オンデバイスRAG/NPUの読み方を新規クラスターとして追加しました。 研究プレプリントは防御的な確認観点として整理しています。
- 追跡中 GLM-5.2はローカルAIで使える?753Bモデル・量子化・LM Studio対応を確認する - 公開日 2026-06-18 / 更新日 2026-08-12 / 情報確認日 2026-08-12。Z.AIのGLM-5.2を、Windows PCでローカルAIとして追跡する前に見るべきポイントに絞って整理します。 初心者向け導入手順ではなく、量子化・対応ツール確認メモです。
- Gemma 4 12Bとは?ローカルPCで使える中型マルチモーダルモデルを初心者向けに整理 - 公開日 2026-06-06 / 更新日 2026-08-12 / 情報確認日 2026-08-12。Googleが公開したGemma 4 12Bを、Windows PCでローカルAIとして試す前に見るべきポイントに絞って整理します。
掲載するもの
- ローカルAI向けの新モデル
- LM Studio / Ollama / Jan / AnythingLLM に関係する更新
- GGUF / llama.cpp / 量子化 / ローカルAPI / MCP / RAG に関係する更新
- Windows PC、ミニPC、GPU、VRAM、メモリに関係する話題
- 個人でも試せる可能性がある話題
掲載しないもの
- ChatGPT一般ニュースだけの話題
- 企業向けクラウド専用の発表
- 巨大GPUクラスタ前提のモデル
- ベンチマークだけの話題
- 検証不能な噂
- 毎日追わないといけない細かすぎるニュース