ローカルAI週報(AMD統合GPU・NPU)

今週のローカルAI(AMD編) 2026-10-05

/確認した候補 32 件

直近 14 日の更新 32 件から、統合GPU・NPU でローカルAIを動かす構成に関係するものを 4 件選びました。

Lemonadeが統合GPUのGTTに対応

ストリーミングモデルが、固定VRAM枠ではなくAPUのGTTプールを基準にサイズを決めることで、AMD統合GPU上で動作するようになった。これにより以前は未対応だったハードウェアでもモデルストリーミングが可能になる。JetBrainsのJunieがlemonade launch junieで追加され、system-infoのAMD GPU表示が製品名になった。

この構成での影響: 統合GPUで、固定VRAMではなくGTTプールを前提にストリーミングモデルを動かせるようになる。

出典: Lemonade リリース(2026-09-30)

FastFlowLMがNPUで投機的デコード

qwen3.8-mtp:27bが追加され、FastFlowLMがこれまでに出荷した最大のdenseモデルとなった。組み込みのMTPドラフトヘッドにより、NPU上で初めて投機的デコードを実行する。ツール呼び出し対応の27B推論モデルで、hy-mt2:1.8bのリネームやコミュニティ修正も含まれる。

この構成での影響: NPU上のFastFlowLMで、27Bモデルと投機的デコードが使えるようになる。

出典: FastFlowLM リリース(2026-09-30)

Ryzen AI Max+ 395でVLAを実行

ビジョン・ランゲージ・アクションモデルMolmoAct2を、AMD Ryzen AI Max+ 395(Strix Halo)ミニPC上のROCmで動かす例が紹介されている。場面を見て英語の指示を読み、ロボットアームを動かす処理を、クラウドや外部アクセラレータなしの1台で行うと述べている。

この構成での影響: 同じRyzen AI Max+ 395ミニPCとROCmで、クラウドなしのVLA実行事例が示される。

出典: AMD ROCm Blogs(2026-09-30)

ComfyUIがQwen Image処理を改善

Qwen 2.1のKVキャッシュ配置の改善、Qwen Image 2.1トランスフォーマーブロックのコンパイル、ブロックごとのattention指定、JsonExtractStringの拡張、torchaudio依存の削除が入った。ace step 1.5向けのCuda graphs、H3 VAEタイルのブレンド、高速ディスク検出も含まれる。

この構成での影響: 利用中のComfyUIに機能追加が入るが、統合GPUでの効果は本文からは不明。

出典: ComfyUI リリース(2026-09-29)


各項目の要約は上記の出典ページの記載に基づいています。速度や消費電力の数値は、出典に書かれていない限り載せていません。

週報の一覧へ