16GB VRAM上限

ComfyUI

Krea 2をローカルで動かす要件とライセンス|12B画像モデルの必要VRAMと量子化(ComfyUI)

Krea 2は12Bのオープンウェイト画像モデル(RAW/Turbo)。無量子化のBF16は本体26.3GBと大きく24GBにも収まらず、現実的な下限は32GBのRTX 5090級。16GBはFP8量子化で対応。ライセンスは年商100万ドル未満なら商用可など条件付き。
GPU・グラフィックボード

RTX 5060 Ti 16GBでどこまでできる?ローカルLLM・AIコーディングの実用域とVRAM 16GBの選び方

RTX 5060 Ti 16GBでローカルAIはどこまでできるか。7B〜14BのローカルLLMは快適に動き、量子化した中型モデルも16GBにギリギリ収まる。Claude CodeなどクラウドAIはGPU不要。CUDA環境で低コストに16GBを確保できる入門GPUの実用域と選び方を実測ベースで解説します。
GPU・グラフィックボード

16GB VRAMで38%あふれる qwen3.5:35b-a3b、2枚目でオフロード解消し約1.9倍に|RTX 5080+5060 Ti(Oculink)実測

RTX 5080単体では35B MoE(qwen3.5:35b-a3b)の約38%がCPUへあふれ65.99 tok/s。Oculink接続の2枚目GPUで全量VRAM化(オフロード0%)し、125.87 tok/sへ約1.9倍に。効く決め手はVRAM容量(あふれの解消)という当サイトの実測を解説します。
PC構成

AIエージェント自動化のメモリ消費|VRAMだけでは足りない4つの詰まりどころ

AIエージェント自動化で詰まるのはVRAMだけではない。実際に効いてくるのはVRAM・システムRAM・ストレージI/O・電源とバス帯域の4か所で、前の2つは容量、後ろの2つは構成条件がそろった時に表面化する。96GB環境の実測でフェーズ別の消費を分解し、RAMを比率ではなく積み上げで決める考え方を示す。
GPU・グラフィックボード

RTX 5080 16GB VRAMの壁に関するよくある疑問7選|27B・32Bは起動するが6〜10 tok/sまで落ちる

RTX 5080 16GBでQwen3.5 27B・Gemma 4 31B・Qwen3 32Bを実測。既定タグでは全レイヤーが載らずCPU側へ回り6.2〜10.3 tok/sまで低下する一方、14Bクラスは75〜77 tok/s。MoEのGemma 4 26B A4Bは58.6 tok/sを維持した。