ローカルLLM

ComfyUI

DiffusionGemmaとは|拡散方式の高速LLMをRTXローカルで動かす要件

DiffusionGemmaとは、テキストをブロック単位で並列に生成する拡散方式のオープンな言語モデルです。Google DeepMindが実験的モデルとして公開し、NVIDIAがGeForce RTX・DGX Spark向けに最適化。従来の逐次生成とは異なる高速なテキスト生成をローカルPCで実現する仕組みと要件を解説します。
GPU・グラフィックボード

ローカルLLM推論エンジン比較|Ollama・llama.cpp・LM Studio・vLLMの選び方

Ollama, llama.cpp, LM Studio, vLLMの4大ローカルLLM推論エンジンを、速度・手軽さ・マルチGPU対応の3軸で徹底比較。RTX 5080+5060 Ti環境での実測データも交え、LM Studioのテンソル並列対応がもたらす影響や、あなたの環境に最適なエンジンの選び方を解説します。
GPU・グラフィックボード

M5 MacBook Air は AI とゲーム両方で何ができるか|実測ベース総合レビュー

2026 年 3 月 11 日に発売された M5 MacBook Air は、 「軽量ノートで AI もゲームもどこまでできるか」 を考えるうえで、 かなり分かりやすい基準になるモデルだ。10 コア CPU + 最大 10 コア GPU の...
GPU・グラフィックボード

RTX 5080でTTFTが速いLLM 8モデル実測|phi4-mini 1194msが最速、リアルタイム対話の選定基準

TTFTとは、ユーザー送信から最初のトークンが返るまでの時間である。 チャットUIで「送信ボタンを押してから最初の文字が画面に出るまで」を短縮したいなら、見るべき指標はtok/sではなくTTFT (Time to First Token)。...