Open WebUI, une interface Docker pour l'IA locale

XDA a publié un article ce mois-ci arguant que Docker a transformé une configuration d’IA locale en quelque chose qu’ils peuvent reconstruire en quatre minutes. C’est le vrai point d’une pile d’IA conteneurisée sur le bureau : les poids du modèle et l’historique du chat vivent dans un volume monté, et le reste de la pile (l’interface, le moteur d’inférence, le proxy inverse) est jetable. Supprimez-le, modifiez un fichier compose, rallumez-le.

Nous avons testé sept applications d’IA de bureau par rapport à cet objectif sur Windows, macOS et Linux. Les sept proposent soit des images Docker officielles, soit s’accompagnent d’une commande docker run d’une seule ligne, et toutes les sept séparent l’état de l’exécution pour qu’une reconstruction ne perde pas votre historique.

Ce qu'il faut rechercher dans une application d'IA compatible Docker

Comparaison rapide

Application Meilleure pour Plan gratuit Prix de départ Évaluation
Open WebUI Interface web pour LLM locaux Complet Gratuit 4.8/5
Ollama Runtime de modèle d’une ligne Complet Gratuit 4.8/5
LocalAI Remplacement compatible avec OpenAI Complet Gratuit 4.7/5
LM Studio Interface avec navigateur de modèles Complet Gratuit (niveau payant pour les équipes) 4.7/5
Jan Client de bureau natif Complet Gratuit 4.6/5
LiteLLM Proxy multi-fournisseur Complet Contrat Enterprise 4.7/5
Msty Client multimodèle poli Oui $49/an Pro 4.6/5

Les applications

1. Open WebUI – La meilleure interface web pour les LLM locaux

Open WebUI est l’interface que la plupart des gens veulent dire quand ils disent « ChatGPT local ». Il livré avec une image Docker officielle, monte tout (paramètres, utilisateurs, documents RAG) dans un seul volume et se connecte à Ollama ou à n’importe quel point de terminaison compatible avec OpenAI par défaut. Une reconstruction de quatre minutes est réaliste : docker compose down, modifiez la balise, docker compose up, et les chats sont exactement là où vous les avez laissés.

Où cela manque: Le plafond de fonctionnalités de l’interface est élevé et la surface de paramètres est dense. Les nouveaux utilisateurs ont besoin d’une heure avec la documentation.

Tarification :

Plateformes : S’exécute partout où Docker s’exécute — Windows (WSL2 ou Docker Desktop), macOS, Linux.

Télécharger : Site web · GitHub

Conclusion : Installez Open WebUI en premier. C’est la porte d’entrée sensée d’une pile Docker AI.

2. Ollama – Le meilleur runtime de modèle

Ollama est la raison pour laquelle le boom actuel des LLM locaux est possible. Un CLI, une bibliothèque de modèles GGUF et une API REST sur le port 11434 que déjà une douzaine d’interfaces (y compris Open WebUI, Jan et Msty) parlent déjà. L’image Docker supporte le passage GPU NVIDIA sur Linux ; la compilation macOS native utilise Metal directement sur l’hôte.

Où cela manque: La convention de nommage des modèles Ollama diverge de Hugging Face, ce qui est déroutant quand vous copiez un extrait.

Tarification :

Plateformes : Windows, macOS, Linux natifs ; image Docker disponible pour les trois.

Télécharger : Site web · GitHub

Conclusion : Associez Ollama à Open WebUI pour le chemin le plus court vers un modèle local fonctionnel.

3. LocalAI – Le meilleur remplacement compatible avec OpenAI

LocalAI est une API auto-hébergée qui parle le protocole OpenAI octet par octet, de sorte que tout ce que vous avez construit contre ChatGPT fonctionne contre lui. Cela inclut CrewAI, LangChain, LlamaIndex et le client Python d’OpenAI. L’image Docker officielle supporte les modèles GGUF, safetensors, whisper, stable-diffusion et text-to-speech sous le même point de terminaison.

Où cela manque: Pas d’interface de chat propriétaire ; associez-la à Open WebUI.

Tarification :

Plateformes : Docker sur Windows, macOS, Linux.

Télécharger : Site web · GitHub

Conclusion : Choisissez LocalAI si le code que vous souhaitez exécuter parle déjà l’API OpenAI.

4. LM Studio – La meilleure interface graphique avec navigateur de modèles

LM Studio est une application de bureau native avec un navigateur de modèles intégré de style Hugging Face et un chargement en un clic. Il expose un serveur compatible avec OpenAI sur localhost:1234 et peut s’exécuter dans un conteneur Docker sur Linux avec support GPU. La facilité de reconstruction provient d’un répertoire de configuration simple qui monte proprement.

Où cela manque: L’interface de bureau n’est pas aussi raffinée sur Linux que sur macOS. Le niveau payant est destiné aux équipes, pas aux individus.

Tarification :

Plateformes : Windows, macOS, Linux (Docker ou natif).

Télécharger : Site web · GitHub

Conclusion : Utilisez LM Studio si vous souhaitez parcourir et échanger les modèles visuellement.

5. Jan – Le meilleur client de bureau natif

Jan est l’application de bureau d’IA local la plus propre entièrement native. Le client Electron s’exécute sur les trois systèmes d’exploitation, est livré avec une API locale compatible avec OpenAI et s’intègre à Ollama, LocalAI et à des modèles distants. Jan peut également s’exécuter dans un conteneur Docker en tant que serveur headless sur une boîte de maison.

Où cela manque: L’écosystème d’extension est plus petit que celui d’Open WebUI.

Tarification :

Plateformes : Windows, macOS, Linux.

Télécharger : Site web · GitHub

Conclusion : Choisissez Jan si vous souhaitez une application native plutôt qu’un onglet de navigateur.

6. LiteLLM – Le meilleur proxy multi-fournisseur

LiteLLM est un proxy qui parle l’API OpenAI à votre application et envoie à n’importe quel fournisseur (OpenAI, Anthropic, Ollama, Bedrock, Vertex, Groq). Placez-le devant votre pile Docker AI et le changement de fournisseur est une modification de configuration, pas une modification de code. L’image Docker officielle gère l’authentification, les limites de débit et les budgets par utilisateur.

Où cela manque: Pas d’interface de chat propre ; c’est une infrastructure.

Tarification :

Plateformes : Docker sur Windows, macOS, Linux.

Télécharger : Site web · GitHub

Conclusion : Ajoutez LiteLLM devant Ollama et Open WebUI si vous utilisez également des fournisseurs d’API payants.

7. Msty – Le meilleur client multimodèle poli

Msty est le plus poli des clients de bureau. Il supporte les réponses de modèle côte à côte, les vues fractionnées pour comparer les résultats et une bibliothèque d’invites propre. Il exécute les modèles locaux via Ollama et les modèles distants sur API. Msty n’expédie pas officiellement une image Docker, mais l’application native fonctionne bien avec un backend Docker.

Où cela manque: Code source fermé ; fonctionnalités Pro verrouillées derrière un abonnement.

Tarification :

Plateformes : Windows, macOS, Linux.

Télécharger : Site web

Conclusion : Choisissez Msty pour le client le plus beau, surtout pour la comparaison de modèles côte à côte.

Comment choisir le bon

FAQ

Quel est le moyen le plus rapide d’exécuter un LLM local sur le bureau avec Docker ?
docker run ollama/ollama, puis docker run open-webui/open-webui avec l’indicateur réseau pointant vers Ollama. Les deux sont des images officielles. L’article XDA qui a inspiré cette liste fais à peu près ceci.

Ai-je besoin d’un GPU ?
Non, mais l’inférence CPU est lente. Une carte NVIDIA modeste, un Mac avec Apple Silicon ou un AMD Ryzen avec déchargement iGPU fonctionnent tous. Ollama et LM Studio utilisent automatiquement le meilleur backend disponible.

Ces applications peuvent-elles parler à des API distantes aussi ?
Oui. Open WebUI, LiteLLM, LM Studio, Jan et Msty supportent tous OpenAI, Anthropic et d’autres fournisseurs distants aux côtés des modèles locaux.

Quelle est la meilleure application de bureau d’IA gratuite ?
Open WebUI plus Ollama est la pile gratuite sur laquelle la plupart des gens convergent. Jan et LM Studio sont de fortes alternatives natives.

Comment maintiens-je l’historique de chat sur les reconstructions de conteneurs ?
Montez le répertoire d’état en tant que volume Docker. Open WebUI stocke tout sous /app/backend/data ; LocalAI sous /build/models ; Jan sous son répertoire de configuration. Persiste ce volume sur l’hôte et les reconstructions ne perdront pas l’historique.