ローカルLLM Qwen3.8-27BのNVFP4 GGUFをRTX 5080・5060 Tiで実測|UD-IQ4_XSより速いのか、VRAM 16GBで文脈40Kまで比較
Qwen3.8-27BのNVFP4 GGUF 3本をRTX 5080・5060 Ti(VRAM 16GB)で実測。UD-IQ4_XSと生成・入力処理の速さ、共有メモリへのあふれを文脈40Kまで比べ、選び方をまとめた。RTX 4070 SUPERとClaude Codeでの結果も載せる。
ローカルLLM
ローカルAI環境
ローカルLLM
ローカルLLM