mirror of
https://github.com/R0m1k3/Loki.git
synced 2026-10-11 17:26:57 +02:00
Relecture du bouton « Libérer la VRAM » (009b585) — six défauts, tous
sur la même feature :
- gpuUsedSettled comptait une lecture ratée de nvidia-smi comme « 0 Mo »
(pilote en réinitialisation juste après l'arrêt) : freed = before, et
l'interface annonçait 14 Gio rendus alors que rien n'avait bougé. Elle
rendait aussi la main au premier palier, AVANT que le pilote ait réagi
(taskkill et Process.Kill reviennent avant le ménage CUDA) : « 0 Mo »
après un déchargement qui marchait. gpuSettle saute les lectures
ratées, n'accepte un palier qu'une fois la baisse observée, et est
testable (sampler injecté).
- /api/vram/unload et /reload acceptaient GET : sans clé de pilotage,
une balise <img> sur une page tierce suffisait à couper le moteur.
405 + Allow: POST.
- whisperShutdown prend wsrvMu, que whisperEnsure garde jusqu'à deux
minutes pendant un chargement de modèle : le geste dépassait le délai
du navigateur, moteur pourtant déjà arrêté. whisperShutdownVite tue le
processus en train de démarrer (poignée atomique hors verrou) au lieu
d'attendre derrière lui.
- Sous systemd, une unité en crash-loop répond « activating », pas
« active » : le stop était sauté et systemd relançait llama-server
toutes les trois secondes pendant que l'UI disait « déjà arrêté ».
engineNeedsStop élargit aux états transitoires.
- Un moteur planté au chargement était présenté comme « modèle
déchargé — recharge-le » : LOAD_ERROR distingue les deux, le conseil
renvoie vers l'erreur affichée dans le moniteur.
- Deux clics concurrents (moniteur + réglages) lançaient un stop au
milieu d'un start ; VRAM_BUSY fait verrou, et le bouton se repeint
depuis l'état renvoyé par le serveur, pas depuis l'ancien poll.
Quelques Mo de bruit entre deux lectures ne font plus « VRAM libérée :
0.0 Gio ».
Au passage, le 404 d'un téléchargement nomme le fichier manquant : sur
un dépôt qui publie six fragments sur sept (table PLE livrée à part),
« la révision a pu être réécrite » envoyait chercher au mauvais endroit.
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01961iDyM6pwn2dE2SW23gYX
73 lines
2.4 KiB
Go
73 lines
2.4 KiB
Go
package loki
|
|
|
|
import (
|
|
"net/http"
|
|
"net/http/httptest"
|
|
"strings"
|
|
"testing"
|
|
)
|
|
|
|
// gpuSettle : le bilan « VRAM libérée » est calculé sur ces lectures. Chaque cas
|
|
// est un faux bilan qu'on a vu — ou qu'on aurait vu — dans l'interface.
|
|
func TestGpuSettle(t *testing.T) {
|
|
seq := func(vals ...int) func() (int, bool) {
|
|
i := 0
|
|
return func() (int, bool) {
|
|
if i >= len(vals) {
|
|
return vals[len(vals)-1], true
|
|
}
|
|
v := vals[i]
|
|
i++
|
|
if v < 0 { // lecture ratée (nvidia-smi absent ou en réinitialisation)
|
|
return 0, false
|
|
}
|
|
return v, true
|
|
}
|
|
}
|
|
for _, c := range []struct {
|
|
name string
|
|
seq []int
|
|
want int
|
|
}{
|
|
// Le pilote met un temps à réagir : palier AVANT la baisse, puis la
|
|
// mémoire part. L'ancienne version rendait 20000 dès le premier palier.
|
|
{"palier avant la baisse", []int{20000, 20000, 12000, 3000, 500, 500}, 500},
|
|
// Baisse immédiate et régulière, puis stable.
|
|
{"baisse puis stable", []int{15000, 8000, 400, 400}, 400},
|
|
// Une lecture ratée au milieu n'est pas « 0 Mo » : on la saute.
|
|
{"lecture ratée ignorée", []int{14000, -1, 600, 600}, 600},
|
|
// Toutes les lectures ratées : on rend « avant », donc 0 Mo libérés,
|
|
// plutôt que d'annoncer 14 Go rendus.
|
|
{"aucune lecture", []int{-1, -1, -1, -1, -1, -1, -1, -1}, 14000},
|
|
// Rien ne baisse (moteur déjà arrêté) : dernière lecture valide.
|
|
{"rien ne bouge", []int{14000, 14000, 14000, 14000, 14000, 14000, 14000, 14000}, 14000},
|
|
} {
|
|
t.Run(c.name, func(t *testing.T) {
|
|
if got := gpuSettle(14000, seq(c.seq...), 0); got != c.want {
|
|
t.Errorf("gpuSettle = %d, attendu %d", got, c.want)
|
|
}
|
|
})
|
|
}
|
|
}
|
|
|
|
// Les deux routes arrêtent ou relancent des processus : un GET — une balise
|
|
// <img> sur une page tierce, sans clé de pilotage — ne doit rien déclencher.
|
|
func TestVramRoutesRefusentGET(t *testing.T) {
|
|
for path, h := range map[string]http.HandlerFunc{
|
|
"/api/vram/unload": handleVramUnload,
|
|
"/api/vram/reload": handleVramReload,
|
|
} {
|
|
rec := httptest.NewRecorder()
|
|
h(rec, httptest.NewRequest(http.MethodGet, path, nil))
|
|
if rec.Code != 405 {
|
|
t.Errorf("%s GET : code %d, attendu 405", path, rec.Code)
|
|
}
|
|
if rec.Header().Get("Allow") != "POST" {
|
|
t.Errorf("%s GET : en-tête Allow %q, attendu POST", path, rec.Header().Get("Allow"))
|
|
}
|
|
if !strings.Contains(rec.Body.String(), "POST attendu") {
|
|
t.Errorf("%s GET : corps %q sans explication", path, rec.Body.String())
|
|
}
|
|
}
|
|
}
|