Oculink

ローカルAI環境

Ollamaが2枚目のGPUを使わない理由|nvidia-smiでは認識済みなのにVRAMが増えないとき

Ollamaはモデルが1枚のGPUに収まる場合はその1枚へ載せる(公式FAQ)。nvidia-smiで2枚とも見えているのに2枚目のVRAMが増えないのは、この既定動作によるもの。RTX 5080+Oculink接続のRTX 5060 Tiで、CUDA_VISIBLE_DEVICES/OLLAMA_SCHED_SPREAD/num_gpuそれぞれの役割と本検証での結果、切り分け手順をまとめた。