Date: 07/02/2026 21:30 Status : IMPLEMENTEE
Quand la RTX 3090 est occupée (comfyui, fooocus, wan21...), les petites demandes Ollama (codegen, mistral:7b, llama3.1:8b...) sont redirigées automatiquement vers une 2e instance Ollama sur la RTX 2070 Super.
ollama-gpu1 : 2e instance Ollama, port 11435, GPU 1taskkill /IM (tuerait les 2) → kill par portprocess_single_job : si tool_id="ollama" ET GPU 0 occupé ET modèle petit → reroute vers ollama-gpu1Le start_cmd génère les bonnes variables d'environnement :
CUDA_VISIBLE_DEVICES=1 + OLLAMA_HOST=0.0.0.0:11435
→ pas de .bat à créer sur win11