GPUタスクはGPU Workerへ — Redisキュー分離とcapability routingで能力ベースのLLM振り分けを実装する
この記事では、RedisキューをGPU用・CPU用…
家庭内AIクラスタとローカルLLMの研究室
家庭内AIクラスタとローカルLLMの研究室
この記事では、RedisキューをGPU用・CPU用…
この記事では、OpenWebUIのPipe Function…
この記事では、WSL2上のOllamaをLAN内の他…
この記事では、1BパラメータのLFM2.5モデ…
この記事では、複数のローカルLLMモデルを…
この記事では、OllamaへのAI推論タスクをR…
この記事では、自宅の余っているPCにOllam…