Contributions de l’utilisateur Admin
Autres actions
Résultats pour Admin discuter journal des blocages téléversements journaux
Un utilisateur avec 3 281 modifications. Compte créé le 26 février 2021.
18 avril 2026
- 23:0218 avril 2026 à 23:02 diff hist +84 OpenClaw →OpenAI Compatible (llama.cpp / vLLM / etc)
- 22:5218 avril 2026 à 22:52 diff hist +403 OpenClaw →Ollama
- 22:4118 avril 2026 à 22:41 diff hist 0 Llama.cpp →Service systemd
- 22:3718 avril 2026 à 22:37 diff hist +783 Llama.cpp →Service systemd
- 22:3218 avril 2026 à 22:32 diff hist +1 Llama.cpp →Optimisation (KV cache, performances, latence)
- 22:3218 avril 2026 à 22:32 diff hist +468 Llama.cpp →Remarques
- 22:2618 avril 2026 à 22:26 diff hist +281 Llama.cpp →Mode serveur (API compatible OpenAI)
- 22:2618 avril 2026 à 22:26 diff hist −2 Llama.cpp →Test rapide
- 22:2518 avril 2026 à 22:25 diff hist +282 Llama.cpp →Test rapide
- 22:2418 avril 2026 à 22:24 diff hist 0 Llama.cpp →Mode serveur (API compatible OpenAI)
- 22:2318 avril 2026 à 22:23 diff hist 0 Llama.cpp →Test rapide
- 22:1418 avril 2026 à 22:14 diff hist +427 Llama.cpp →Optimisation (KV cache, performances, latence)
- 21:4918 avril 2026 à 21:49 diff hist +3 Llama.cpp →Optimisation (KV cache, performances, latence)
- 21:4818 avril 2026 à 21:48 diff hist +174 Llama.cpp →Optimisation (KV cache, performances, latence)
- 21:4718 avril 2026 à 21:47 diff hist +148 Llama.cpp →Mode serveur (API compatible OpenAI)
- 21:4718 avril 2026 à 21:47 diff hist +278 Llama.cpp →Test rapide
- 21:3718 avril 2026 à 21:37 diff hist −4 Llama.cpp →Téléchargement d’un modèle (format GGUF)
- 21:3718 avril 2026 à 21:37 diff hist +4 Llama.cpp →Téléchargement d’un modèle (format GGUF)
- 21:3718 avril 2026 à 21:37 diff hist +275 Llama.cpp →Téléchargement d’un modèle (format GGUF)
- 21:3218 avril 2026 à 21:32 diff hist +43 Llama.cpp →Test API
- 21:3118 avril 2026 à 21:31 diff hist +264 Llama.cpp →Mode serveur (API compatible OpenAI)
- 21:2918 avril 2026 à 21:29 diff hist +17 Llama.cpp →Mode serveur (API compatible OpenAI)
- 21:2918 avril 2026 à 21:29 diff hist +80 Llama.cpp →Test rapide
- 21:2718 avril 2026 à 21:27 diff hist +539 Llama.cpp →Téléchargement d’un modèle (format GGUF)
- 20:5718 avril 2026 à 20:57 diff hist +260 Llama.cpp →Téléchargement d’un modèle (format GGUF)
- 20:2318 avril 2026 à 20:23 diff hist +3 Llama.cpp →Support GPU NVIDIA (CUDA)
- 20:0618 avril 2026 à 20:06 diff hist −78 Llama.cpp →Compilation (avec support CUDA)
- 20:0518 avril 2026 à 20:05 diff hist −212 Llama.cpp →Support GPU NVIDIA (CUDA)
- 19:5518 avril 2026 à 19:55 diff hist +56 Llama.cpp →Support GPU NVIDIA (CUDA)
- 19:5418 avril 2026 à 19:54 diff hist +18 Llama.cpp →Compilation (avec support CUDA)
- 19:0718 avril 2026 à 19:07 diff hist +26 Llama.cpp →Support GPU NVIDIA (CUDA)
- 19:0718 avril 2026 à 19:07 diff hist −52 Llama.cpp →Support GPU NVIDIA (CUDA)
- 19:0518 avril 2026 à 19:05 diff hist +234 Llama.cpp →Compilation (avec support CUDA)
- 12:2118 avril 2026 à 12:21 diff hist +199 Llama.cpp →Support GPU NVIDIA (CUDA)
- 12:0718 avril 2026 à 12:07 diff hist +5 190 Llama.cpp →Prérequis
- 11:4818 avril 2026 à 11:48 diff hist −6 GPU Passthrough Aucun résumé des modifications Balise : Révocation manuelle
- 11:4618 avril 2026 à 11:46 diff hist 0 Prometheus →(Optionnel) Securisation serveur actuelle
- 11:4618 avril 2026 à 11:46 diff hist −5 Prometheus →(Optionnel) Securisation serveur
- 11:3918 avril 2026 à 11:39 diff hist +1 905 N Llama.cpp Page créée avec « == Prérequis == * Un GPU est recommandé, idéalement NVIDIA avec le plus de VRAM possible. Contrairement à Ollama ou vLLM, llama.cpp permet cependant de répartir le modèle entre GPU et CPU si la VRAM est insuffisante, au prix d’une baisse de performances. Voir ce lien pour partager un GPU dans un LXC * Les modèles peuvent fonctionner sur CPU uniquement, mais avec des performances très faibles (souvent inutilisables en pratique pour un... »
- 11:3718 avril 2026 à 11:37 diff hist +873 Page IA Aucun résumé des modifications
- 11:2518 avril 2026 à 11:25 diff hist +1 779 N VLLM Page créée avec « == Prérequis == * Un GPU est fortement recommandé, idéalement NVIDIA avec le plus de VRAM possible. Le modèle IA choisi doit tenir entièrement en VRAM, sinon les performances chutent fortement. Voir ce lien pour partager un GPU dans un LXC * Les modèles peuvent fonctionner sur CPU, mais avec des performances extrêmement faibles (non exploitables en pratique). * VRAM recommandée : au minimum la taille du modèle chargé. Contrairement... » actuelle
- 11:1918 avril 2026 à 11:19 diff hist +366 Page IA Aucun résumé des modifications
- 11:1618 avril 2026 à 11:16 diff hist +145 Page IA Aucun résumé des modifications
- 10:2118 avril 2026 à 10:21 diff hist −6 Ollama →Spécifier interface d'écoute
- 10:2018 avril 2026 à 10:20 diff hist +36 Ollama →Spécifier interface d'écoute
- 10:1918 avril 2026 à 10:19 diff hist +299 Ollama →Commandes
- 10:1718 avril 2026 à 10:17 diff hist +128 Ollama →Spécifier interface d'écoute
- 10:1718 avril 2026 à 10:17 diff hist +534 Ollama →Spécifier interface d'écoute
- 01:2018 avril 2026 à 01:20 diff hist −8 Ollama →Spécifier interface d'écoute
- 01:1918 avril 2026 à 01:19 diff hist 0 Ollama →Limiter le contexte