RTX 5080

AI音楽・音声

F5-TTSをローカルで動かす必要スペック|RTX 5080・5060 TiでVRAMと生成時間を実測

F5-TTSをローカルで動かすのに要るGPUメモリと生成時間を、RTX 5080とRTX 5060 Tiで実測した。VRAMを一番使うのは生成中ではなくモデルの読み込み中で、既定のチェックポイントでは約1,990 MiB。生成時間は2枚で1.73倍から1.99倍の差がついた。
ComfyUI

Qwen-Image-2.1をVRAM 16GBで動かす|30GiBのbf16も動く、量子化版はPyTorch cu130なら速い実測

Qwen-Image-2.1 のファイル一式は組み合わせで13.27〜30.21GiB。合計30.21GiB の bf16 同士も16GBのカードで生成できた。PyTorch cu130 版では量子化版が bf16 同士より1.7〜2.3倍速く、cu128 版では逆に遅かった理由もまとめた。
ComfyUI

Anima 3.8BをVRAM 16GBで動かす|52ブロックへの拡張で増えた分と、一式15GBが収まる理由を実測

Anima 3.8B を VRAM 16GB の RTX 5080・5060 Ti で実測した。ファイル合計 15.03GB でもピークは 12,918MiB に収まる。52 ブロックへの拡張で生成時間・VRAM・RAM がどれだけ増えるか、導入に要る 4 ファイルとノードもまとめた。
AI動画生成

LTX 2.5 を 16GB VRAM で回す|モデル一式28GiBが収まらない状態の所要・RAM・2段構成を実測(RTX 5080 / 5060 Ti 16GB)

LTX 2.5 を 16GB の GPU で回すと、モデル一式 28.06GiB は VRAM に載らず段ごとに載せ替わる。4秒から30秒まで完走したが、増えたのは VRAM でなくシステムRAM だった。公式の2段構成との比較とデコード分割の痕跡も実測。
AI動画生成

MiniMax H3の条件付けを使い回すと速くなるか|VRAM 16GB実測、縮むのはプロセスを立て直したときだけ

MiniMax H3の条件付けをディスクに保存して使い回すと所要時間がどう変わるかを、RTX 5080とRTX 5060 Tiで実測。同じカードで作った条件付けなら出力は1フレームも変わらないが、別のカードのものを読ませると全フレームが変わった。
ローカルLLM

Qwen3.8-27BをVRAM 16GBで実測|量子化3種の必要VRAMと起動オプションの差

Qwen3.8-27B の必要VRAMを、重み・KVキャッシュ・線形アテンション状態・計算バッファの内訳まで実測。量子化3種を16GBで動かし、起動オプションひとつで必要量が449MiB動くこと、載ったかどうかは生成速度と消費電力の組でしか判別できなかったことを RTX 5060 Ti・5080 で確かめた。
AI音楽・音声

MiniMax Music 3をVRAM 16GBで動かす|RTX 5080実測、ピークVRAMは必要量ではない

MiniMax Music 3をRTX 5080 16GBのComfyUI構成で実測。4条件はいずれも60秒指定の生成を完走したが、観測されたピークVRAMは必要量ではない。使えるVRAMを削る掃引、1曲の所要時間の内訳、日本語ボーカルの歌詞追従までを測定値で示す。
GPU・グラフィックボード

TTFTとは何を測っているのか|内訳を分けて2枚のGPUで実測すると、動く部分と動かない部分が分かれる

TTFT(Time To First Token)は、リクエストから最初のトークンが返るまでの時間。ただしローカルLLMでは、何を「最初」と数えるか、未ロードから測ったかで値が桁で変わる。RTX 5060 Tiと5080で7モデルを実測すると、初回は95〜99%がモデルの読み込みだった。
PC構成

Muse Glimmer 30BをVRAM 16GBで動かす|全52層が載る条件とDFlashの効き方をRTX 5080・5060 Tiで実測

Meta の Muse Glimmer 30B を VRAM 16GB クラスで実測。公式想定は24GBだが、表示に使っていない16GB 1枚では全層を載せる指定で毎秒24.61トークン。層数・総コンテキスト指定・DFlash の効き方を llama.cpp b10356 で測った記録。
AI動画生成

MiniMax H3 Turbo LoRA(step600 EMA)とは|ComfyUIの置き場所・推奨ステップ数と速さをRTX 5080/5060 Tiで実測

MiniMax H3のTurbo LoRA(ComfyUI変換版 v4 step600 EMA)の置き場所と推奨ステップ数を整理し、RTX 5080・5060 Tiで総時間と画質を実測。配布元の約5倍はサンプリング部分の話で、RTX 5080の総時間では条件しだいで1.47〜4.18倍。ライセンスの地域制限も確認する。