Accès internet?Ajoute les outils web_search / web_open / web_read / web_grep via un serveur Crawl4AI. Actifs seulement si le serveur répond.
Serveurs MCP?Connecte des serveurs MCP (Model Context Protocol) pour donner de nouveaux outils à l'IA : accès fichiers, bases de données, APIs métier… stdio = programme lancé localement (npx/uvx/binaire) · http = serveur distant. ⚠️ un serveur stdio exécute du code sur cette machine, au même titre que le shell.
Paramètres
ApparenceSystem promptAccès OpenAI
Endpoint compatible OpenAI?Branchez n'importe quel client compatible OpenAI (OpenCode, Continue, Cursor…) sur ces adresses. Si une clé est définie, le client doit envoyer Authorization: Bearer <clé>.
Modèle : jean
Adresse locale (réseau)
Adresse publique — chiffrée de bout en bout, accessible partout
Clé API?Protège l'endpoint des complétions (llama-server). Indispensable avant d'exposer le serveur sur internet. Modifier la clé redémarre le service.
Accès distant
ajean.link?Accédez à ce serveur Jean depuis n'importe où, sans ouvrir de port, à travers le relais ajean.link. Le trafic est chiffré de bout en bout : le relais ne voit rien. Abonnement 4,80 €/mois.
Ouvrez l'accès distant à ce serveur en quelques clics, sans terminal.
Votre adresse d'accès distant
Première connexion?À votre première ouverture du portail distant, confirmez l'empreinte et saisissez le code d'appairage : cela verrouille la boîte noire sur CE serveur (anti-interception). Une seule fois par appareil.
MOTEUR
…
⚡ Version rapide conseillé
prête à l'emploi, installée en ~2 min
🔧 Version optimisée
compilée pour votre machine, plus longue
🧩 Backend personnalisé
forks llama.cpp pour modèles spéciaux (ternaire…)
▸ détails
Service
Actions
⏳ Compactage du contexte en cours — résumé des anciens tours…
contexte 0 / 0
Entrée pour envoyer · Maj+Entrée = nouvelle ligne
⚡ Benchmark
🧩 Backends personnalisés
Compile un fork de llama.cpp depuis un dépôt Git — pour les modèles qui exigent un moteur spécial (quant ternaire, etc.). Un backend personnalisé ne remplace pas le moteur : vous le choisissez ensuite par modèle (bouton ✎ → section Moteur → « backend détecté »).
Serveur MCP
Outils ?Décoche un outil pour le masquer à l'IA sans déconnecter le serveur. Utile pour ne garder que ce dont tu as besoin.
Preset
Nom
Modèle
Fichier
Quantizationauto si vide
Télécharger un modèle lien direct vers un .gguf
Moteur
Backend
Réglages
Contextetok
Couches sur GPU999 = tout sur le GPU
Threads CPU0 = auto
Cache KVcompression du contexte
Raisonnementréflexion étape par étape
Flash attentionplus rapide, moins de VRAM
Garder en RAMévite le swap (mlock)
Réglages avancés
BATCH
UBATCH
Threads (batch)0 = auto
Experts MoE sur CPUvide = non
Charger tout en mémoiredésactive le mmap
Configuration
Éditer le fichier .envconfiguration brute — pour les réglages avancés