mirror of
https://github.com/R0m1k3/Loki.git
synced 2026-10-11 17:26:57 +02:00
Si Ollama tourne sur une autre machine, le conteneur Loki ne voit aucun GPU : l'auto-réglage prenait alors un chemin 'CPU' et fixait num_ctx=8192, ce qui forçait Ollama à charger une instance distincte du modèle qui débordait sur le CPU (lenteur). Désormais, GPU non détecté -> num_ctx=0 (défaut du modèle), donc Ollama réutilise l'instance déjà sur GPU. Déclarer GPU_VRAM_MB active le vrai réglage. Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01SVay7z3y7q2gEe54ByAE6N