La nouvelle version de llama.cpp a changé les options mémoire : --mlock / --no-mmap sont remplacés par --load-mode. D'anciens flags ont été détectés dans ta configuration.Mettre à jour les flags
Journal du moteur
Emplacements
Device
Configuration
Presets
Tasks
Le mode agent est désactivé : les tâches s'exécuteront mais l'IA n'aura aucun outil pour agir (envoyer un mail, lire des fichiers…). Active le mode agent ci-dessus.
Appearance
Affichage
API
Endpoint compatible OpenAI?Branchez n'importe quel client compatible OpenAI (OpenCode, Continue, Cursor…) sur ces adresses. Si une clé est définie, le client doit envoyer Authorization: Bearer <clé>.
Adresse locale (réseau) — modèle ajean
Adresse publique — chiffrée de bout en bout, accessible partout
Clé API?Protège l'endpoint des complétions (llama-server). Indispensable avant d'exposer le serveur sur internet. Modifier la clé redémarre le service.
AJEAN LINK
Accès distant?Accédez à ce serveur AJEAN depuis n'importe où, sans ouvrir de port, à travers le relais ajean.link. Le trafic est chiffré de bout en bout : le relais ne voit rien. Abonnement 4,80 €/mois.
Passez à AJEAN LINK
Accès distant sécurisé
Accédez à votre serveur AJEAN depuis n'importe où et depuis n'importe quelle application, chiffré de bout en bout — le relais ne voit rien.
Support dédié par chat
Une messagerie dédiée pour répondre à toutes vos questions, directement depuis l'application.
Sauvegarde intégrée
Vos réglages, presets, historique et mémoire sauvegardés automatiquement, chiffrés avant l'envoi.
Ouvrez l'accès distant à ce serveur en quelques clics, sans terminal.
4,80 €/mois · sans engagement, résiliable à tout moment
Votre adresse d'accès distant
Première connexion?À votre première ouverture du portail distant, confirmez l'empreinte et saisissez le code d'appairage : cela verrouille la boîte noire sur CE serveur (anti-interception). Une seule fois par appareil.
Sauvegarde?Sauvegarde ta mémoire, tes presets et tes réglages sur ajean.link. Tout est chiffré sur ton serveur avant l'envoi : le relais ne voit qu'un blob opaque, illisible même s'il était piraté. Restaurable sur un serveur vierge avec ton mot de passe de sauvegarde.
Inclus dans AJEAN LINK : accès distant chiffré de bout en bout · support dédié par chat · sauvegarde de vos réglages, presets, historique et mémoire.
Engine
llama.cpp précompiléconseillé
binaire officiel téléchargé tel quel, prêt en ~2 min
llama.cpp compiléconseillé
compilé ici pour votre machine — plus rapide, plus long à installer
llama.cpp personnalisé
un fork de llama.cpp pour modèles spéciaux (quant ternaire…)
▸détails
Service du moteur?Démarre, redémarre ou arrête llama-server — le processus qui charge le modèle et répond. Un redémarrage recharge le modèle du preset actif (quelques secondes à quelques minutes selon sa taille).
Paramètres
Accès internet?Ajoute les outils web_search / web_open / web_read / web_grep. Le moteur intégré ne demande aucune installation. Le moteur Crawl4AI exige un serveur que tu héberges toi-même (ex. docker run -d -p 11235:11235 --shm-size=1g unclecode/crawl4ai:latest) mais exécute le JavaScript des pages. Actifs seulement si le mode agent est actif.
enregistré automatiquement en quittant le champ
Contrôle du navigateur?Donne à l'IA le contrôle d'un navigateur sur cette machine (outils browser_open / browser_click / browser_type / browser_key / browser_scroll). L'IA lit les éléments numérotés de la page et agit par numéro — aucune vision requise, ça marche avec de petits modèles. browser_screenshot s'ajoute si la vision est active. Nécessite Chrome/Chromium/Edge installé. Actif seulement si le mode agent est actif.
MCP servers?Connecte des serveurs MCP (Model Context Protocol) pour donner de nouveaux outils à l'IA : accès fichiers, bases de données, APIs métier… stdio = programme lancé localement (npx/uvx/binaire) · http = serveur distant. ⚠ un serveur stdio exécute du code sur cette machine, au même titre que le shell.
(aucun serveur — ajoute un serveur fichiers, une base de données, une API…)
Général
HistoriqueProjets
On commence par quoi ?
Déposer pour joindre au message
·0 / 0
Entrée pour envoyer · Maj+Entrée = nouvelle ligne
Benchmark
Backends personnalisés
Compile un fork de llama.cpp depuis un dépôt Git — pour les modèles qui exigent un moteur spécial (quant ternaire, etc.). Un backend personnalisé ne remplace pas le moteur : vous le choisissez ensuite par modèle (bouton ✎ → section Moteur → « backend détecté »).
Trackers
Données datées qui s'accumulent (compteurs, relevés, trackers)
Ajouter un point
Serveur MCP
Outils?Décoche un outil pour le masquer à l'IA sans déconnecter le serveur. Utile pour ne garder que ce dont tu as besoin.
Mémoire de Jean
Profil
Ce que Jean sait de toi à coup sûr.
Leçons
Ce que Jean a appris de ses erreurs.
Fiches
Procédures et guides gardés en entier.
Journal
Tout ce qui s'est passé.
Mémoire
ModeRéglage propre à ce projet.
Pages mémoire
Tâche planifiée
Dernier résultat
Nom
Type
Consigne IA : le modèle exécute une instruction. Script seul : lance un script enregistré, sans IA ni consommation de tokens.
Consigne
Script
Script à lancer
Les scripts vivent dans le dossier protégé scripts, à l'abri d'un nettoyage du workspace.
Preset
Modèle utilisé
Fréquence
Toutes les
À
minute heure jour mois jour-semaine
Accès
Accès à la mémoire
Mémoire du projetla tâche lit/écrit dans la mémoire de ce projet
Accès au web
Tâche active
Preset
Nom
Exécution
URL de l'API(base OpenAI, ex: https://api.openai.com/v1)
Modèle(identifiant exact, ex: gpt-4o-mini)
Clé API(optionnelle pour un serveur local)
Contextetok
Visionle modèle accepte les images
tester la connexion→
Fournisseur
Préparation du GPU Cloud
Connecter un compte Modalconnexion sur modal.com, aucune clé à copier
Compte
Crédit
Connecter un autre compteun compte par preset
Connecte-toi dans l'onglet modal.com qui s'ouvre.
GPUfacturé à la seconde
Modèlelien direct vers le .gguf
Visionlien direct vers le mmproj .gguf (facultatif)
Mise en veillearrêt après inactivités
Moteur
Backend
Modèle
Fichier
Quantizationauto si vide
Visionprojecteur mmproj
Projecteur vision sur le CPUlibère de la VRAM
Télécharger un modèlelien direct vers un .gguf
Destination
Dossiers de modèlesdisque externe, autre dossier…
Ces dossiers servent aussi de destination de téléchargement.
Cartes graphiques
Réglages
Contextetok
Couches sur GPU999 = tout sur le GPU
Experts MoE sur CPUvide = non
Threads CPU0 = auto
Threads (batch)0 = auto
BATCH
UBATCH
Séquences parallèles1 recommandé
Cache KVcompresse le contexte
Chargement
Décodage spéculatifaccélère la génération
Modèle de draftmodèle brouillon
Jetons anticipésdéfaut 3
Raisonnementréflexion étape par étape
Flash attentionplus rapide, moins de VRAM
Cache KV unifiéun seul cache partagé
Échantillonnage
Réglages d'échantillonnagevide = défaut du modèle
Températurevide = défaut du modèle
top_pnoyau de probabilité
top_k0 = désactivé
min_pseuil de probabilité
Pénalité de présencefavorise les mots nouveaux
Pénalité de répétition1 = neutre
Effort de réflexionactive --jinja
System prompt
Prompt système du presetoptionnel, propre à ce preset