16GB VRAM上限

AI音楽・音声

F5-TTSをローカルで動かす必要スペック|RTX 5080・5060 TiでVRAMと生成時間を実測

F5-TTSをローカルで動かすのに要るGPUメモリと生成時間を、RTX 5080とRTX 5060 Tiで実測した。VRAMを一番使うのは生成中ではなくモデルの読み込み中で、既定のチェックポイントでは約1,990 MiB。生成時間は2枚で1.73倍から1.99倍の差がついた。
GPU・グラフィックボード

RTX PRO 5500 Blackwellの84GBは何を載せられるか|公称スペックで読む容量・帯域・演算の増え方

NVIDIA RTX PRO 5500 Blackwell の84GB。同世代の RTX PRO 5000 から容量と CUDAコアは上がるのに、メモリ帯域は約4%しか増えていない。公称スペックの増え方を項目ごとに分け、当サイトの16GB・32GB実測との位置関係まで並べる。
AI動画生成

LTX 2.5 を 16GB VRAM で回す|モデル一式28GiBが収まらない状態の所要・RAM・2段構成を実測(RTX 5080 / 5060 Ti 16GB)

LTX 2.5 を 16GB の GPU で回すと、モデル一式 28.06GiB は VRAM に載らず段ごとに載せ替わる。4秒から30秒まで完走したが、増えたのは VRAM でなくシステムRAM だった。公式の2段構成との比較とデコード分割の痕跡も実測。
AI音楽・音声

MiniMax Music 3をVRAM 16GBで動かす|RTX 5080実測、ピークVRAMは必要量ではない

MiniMax Music 3をRTX 5080 16GBのComfyUI構成で実測。4条件はいずれも60秒指定の生成を完走したが、観測されたピークVRAMは必要量ではない。使えるVRAMを削る掃引、1曲の所要時間の内訳、日本語ボーカルの歌詞追従までを測定値で示す。
AI画像生成

Krea 2をローカルで動かす要件とライセンス|12B画像モデルの必要VRAMと量子化(ComfyUI)

Krea 2は12Bのオープンウェイト画像モデル(RAW/Turbo)。無量子化のBF16は本体26.3GBで24GBにも全量は載らず、常駐させるなら32GBのRTX 5090級が目安。16GBはFP8量子化とオフロードで対応。ライセンスは年商100万ドル未満なら商用可など条件付き。
GPU・グラフィックボード

RTX 5060 Ti 16GBでどこまでできる?ローカルLLM・AIコーディングの実用域とVRAM 16GBの選び方

RTX 5060 Ti 16GBでローカルAIはどこまでできるか。7B〜14BのローカルLLMは快適に動き、量子化した中型モデルも16GBにギリギリ収まる。Claude CodeなどクラウドAIはGPU不要。CUDA環境で低コストに16GBを確保できる入門GPUの実用域と選び方を実測ベースで解説します。
GPU・グラフィックボード

16GB VRAMで38%あふれる qwen3.5:35b-a3b、2枚目でオフロード解消し約1.9倍に|RTX 5080+5060 Ti(Oculink)実測

RTX 5080単体では35B MoE(qwen3.5:35b-a3b)の約38%がCPUへあふれ65.99 tok/s。Oculink接続の2枚目GPUで全量VRAM化(オフロード0%)し、125.87 tok/sへ約1.9倍に。効く決め手はVRAM容量(あふれの解消)という当サイトの実測を解説します。
PC構成

AIエージェント自動化のメモリ消費|VRAMだけでは足りない4つの詰まりどころ

AIエージェント自動化で詰まるのはVRAMだけではない。実際に効いてくるのはVRAM・システムRAM・ストレージI/O・電源とバス帯域の4か所で、前の2つは容量、後ろの2つは構成条件がそろった時に表面化する。96GB環境の実測でフェーズ別の消費を分解し、RAMを比率ではなく積み上げで決める考え方を示す。
GPU・グラフィックボード

RTX 5080 16GB VRAMの壁に関するよくある疑問7選|今回測った27B〜32B(Dense型)は6.2〜10.3 tok/s

RTX 5080 16GBでQwen3.5 27B・Gemma 4 31B・Qwen3 32Bを実測。既定タグでは全レイヤーが載らずCPU側へ回り6.2〜10.3 tok/sまで低下する一方、14Bクラスは75〜77 tok/s。MoEのGemma 4 26B A4Bは58.6 tok/sを維持した。