Open WebUI
Interface d’interaction AI auto-hébergée et open source prenant en charge les modèles locaux et cloud
Étiquettes :Dialogue IAQu’est-ce que l’Open WebUI ?
Open WebUI est une plateforme autonome de chat IA, de base de connaissances et de collaboration en équipe, souvent utilisée pour fournir une interface navigateur aux modèles locaux d’Ollama, et qui peut également se connecter à OpenAI, Anthropic, Gemini, Azure, vLLM ainsi qu’à d’autres services compatibles avec OpenAI ou Open Responses.
Les utilisateurs peuvent gérer des dialogues multi-modèles, RAG de documents, recherche en ligne, reconnaissance vocale, génération d’images, outils et tâches automatisées depuis une interface unifiée.
Open WebUI ne contient pas un grand modèle développé en interne qui puisse remplacer directement tous les modèles. Il s’agit d’une couche d’application entre le modèle et l’utilisateur ; la qualité des réponses, leur vitesse, le contexte et le prix dépendent du service de raisonnement auquel il est connecté.
En utilisant Ollama local, les données principales restent sur votre propre appareil ou serveur ; lorsque l’on utilise des modèles cloud ou des outils externes, ces données sont envoyées au fournisseur correspondant.
Fonctionnalités principales d’Open WebUI
Chat unifié multi-modèles
L’administrateur peut accéder à plusieurs modèles locaux et cloud, tandis que les utilisateurs peuvent changer de modèle au cours d’une même session ou comparer les réponses côte à côte. La messagerie prend en charge le téléchargement de fichiers et d’images, des files d’attente de messages, des dossiers, des étiquettes, la mise en avant, la mémoire, l’entrée/sortie vocale ainsi que diverses opérations sur le contenu.
Les préférences du modèle peuvent lier des prompts système, une base de connaissances, des outils et des paramètres pour créer un assistant spécialisé pour l’écriture, l’enseignement, la programmation ou le service client.
Ollama et les modèles locaux
Open WebUI peut se connecter à Ollama sur l’hôte ou sur un serveur distant, et il existe également des images de conteneur intégrées qui incluent Ollama. La déduction locale n’inclut pas les frais API en nuage par token, mais elle consomme de la CPU, de la GPU, de la mémoire, de l’espace de stockage et de l’électricité.
Le localhost à l’intérieur du conteneur fait référence au conteneur lui-même ; pour se connecter au hôte principal Ollama, il faut utiliser l’adresse correcte du hôte principal et limiter la portée de l’écoute.
Base de connaissances et RAG
Les utilisateurs peuvent télécharger des documents, créer des collections de connaissances, et permettre au modèle de rechercher des extraits pertinents lors de conversations. Le système prend en charge la recherche vectorielle, la recherche mixte à partir de mots-clés et de vecteurs, le réarrangement, l’insertion de contenu complet, ainsi que divers moteurs d’extraction de documents.
Les sources de connaissances externes peuvent également se connecter directement à Qdrant, Milvus ou pgvector, évitant ainsi de reprendre les index existants.
Si le contexte du modèle Ollama conserve des valeurs par défaut faibles, une grande quantité de contenu récupéré pourrait être tronquée, ce qui entraînerait un mauvais rendement du RAG. Le déploiteur doit ajuster le contexte, la segmentation, le nombre de résultats récupérés et le réarrangement en fonction des capacités du modèle, et vérifier les réponses et les références à l’aide de questions standard, sans se contenter de s’assurer que les documents ont bien été téléchargés.
Recherche en ligne et contenu des pages web
Open WebUI peut se connecter à des services de recherche tels que SearXNG, Google, Tavily, etc., et utiliser le contenu des pages web comme contexte pour le modèle. La précision, la quantité et la confidentialité des résultats de recherche sont déterminées par le moteur correspondant.
Face aux nouvelles, aux prix, aux politiques et aux informations professionnelles, les utilisateurs doivent toujours ouvrir la page originale pour vérifier la date et le contexte.
MCP, OpenAPI et outils
La plateforme peut se connecter à HTTP MCP, se connecter à stdio MCP via un proxy, et découvrir des interfaces externes à partir des spécifications OpenAPI. Workspace Tools est du code Python qui s’exécute directement dans le processus Open WebUI ; il offre de nombreuses fonctionnalités, mais cela équivaut à obtenir la capacité d’exécuter du code serveur.
Seuls les administrateurs fiables peuvent créer ou importer.
Le statut « populaire » ou « sélectionné » des outils communautaires ne signifie pas qu’ils ont été soumis à une vérification de sécurité. Avant l’installation, il convient de lire le code, de vérifier les dépendances et l’utilisation des clés, ainsi que de limiter les permissions du Workspace.
Pour les tâches nécessitant une isolation plus forte ou une échelle indépendante, il est préférable de faire fonctionner l’outil en tant que service MCP externe ou service OpenAPI.
Fonctions et systèmes d’extension
La fonction Pipe permet d’ajouter des fournisseurs de modèles ou une logique de requête personnalisée ; Filter peut effectuer du masquage, du formatage, un contrôle de débit et du traitement des journaux avant et après le message ; Action permet d’ajouter des boutons sur le message. Les anciens projets Pipelines restent compatibles avec les déploiements existants, mais ils ont été officiellement désignés comme une solution obsolète ; les nouveaux projets devraient privilégier Functions, Tools ou des serveurs d’outils externes.
Code, images, voix et automatisation
Open WebUI peut se connecter à Python côté navigateur, à un Open Terminal isolé, à des services de génération d’images, ainsi qu’à la reconnaissance et à la synthèse vocale. Il prend également en charge l’exécution programmée de prompts, des listes de tâches structurées et des notifications de messages.
Lorsque l’exécution de code ou les outils en terminal ont accès à des fichiers réels et au réseau, des conteneurs isolés, des restrictions de ressources et des limites par utilisateur doivent être utilisés ; le sandbox du navigateur ne peut pas être considéré comme une barrière de sécurité complète.
Gestion d’équipe et API
L’administrateur peut gérer les utilisateurs, les groupes, les droits d’accès aux modèles, les annonces, l’analyse d’utilisation, les tests aveugles et les Webhook. La plateforme propose des clés API avec des droits d’utilisateur, ainsi que des interfaces pour la messagerie, les fichiers, la base de connaissances et l’appel d’outils.
L’héritage des clés reprend les droits du créateur ; il convient de limiter les endpoints accessibles, de définir une politique d’expiration et de procéder à un renouvellement régulier.
Comparaison des versions Open WebUI et des coûts
L’hébergement auto-géré standard ne comporte pas de frais de abonnement logiciel, mais les serveurs, les modèles et les services tiers ne sont pas nécessairement gratuits. Les versions à marque blanche pour entreprises, avec personnalisation de la marque, fonctionnalités exclusives ou partenariats d’entreprise officiels nécessitent une licence ; aucun prix fixe n’est publié officiellement, et les devis sont établis en fonction de l’organisation et du nombre de postes.
| Plan | Coût du logiciel | Scénarios d’application | Coûts et contraintes principaux |
|---|---|---|---|
| Déploiement personnel/petit local | Gratuit | Ordinateur personnel, serveur domestique, essai pour petites équipes | Gestion propre de l’équipement et de l’électricité ; frais supplémentaires pour l’utilisation de l’API du modèle cloud |
| Déploiement interne de l’organisation de normalisation | Aucun frais si la marque d’origine est conservée | Portail d’IA et base de connaissances internes à l’organisation | Il est nécessaire de prendre en charge soi-même l’exploitation, la sécurité, les modèles, la base de données et le stockage ; respecter les exigences actuelles de la licence. |
| Licence d’entreprise | Cotation sur mesure | Marque blanche, marque forte, capacités exclusives à l’entreprise et partenariats commerciaux officiels | Vendre en fonction de l’organisation et des places, les droits spécifiques sont déterminés par le contrat. |
| Services de hébergement tiers | Prix déterminé par le prestataire | Utilisateurs qui ne souhaitent pas entretenir eux-mêmes l’infrastructure | Ce n’est pas un SaaS officiel et unifié d’Open WebUI ; il est nécessaire de vérifier le prestataire, l’emplacement des données et la portée du support. |
Comparaison des méthodes d’intégration des modèles
| Méthode | Frais de raisonnement | Emplacement des données | Adéquat pour les utilisateurs |
|---|---|---|---|
| Modèle local Ollama | Pas de frais par token | Peut être conservé sur cet appareil ou sur un serveur personnalisé | Personnes et équipes qui privilégient la vie privée et disposent de puissance de calcul locale |
| Inférence personnalisée telle que vLLM | Coûts GPU et maintenance | Infrastructure propre | Les organisations ayant besoin d’une capacité de traitement multi-utilisateurs et de services de modèle unifié |
| Modèle commercial API | Par token ou forfait fournisseur | Envoyer au fournisseur de modèles | Utilisateurs cherchant des modèles puissants et une mise en ligne rapide |
| Mélange de plusieurs fournisseurs | Facturation séparée par canal | Selon les variations du modèle sélectionné | Équipes souhaitant équilibrer les coûts, les capacités et les limites de données en fonction des tâches |
Légende de la licence Open WebUI
La licence officielle actuelle est basée sur BSD 3-Clause et ajoute des exigences de protection de la marque. Elle peut être utilisée gratuitement pour une mise en œuvre interne, à condition de conserver intégralement la marque originale d’Open WebUI.
Si le déploiement ne concerne pas plus de 50 utilisateurs sur une période continue de 30 jours, il est possible d’adapter la marque selon les conditions officielles ; les contributeurs essentiels peuvent également obtenir les droits correspondants à la marque après avoir reçu une autorisation écrite ou acheté une licence d’entreprise.
Pour les solutions white-label, les marques fortes qui dépassent les limites de l’exception gratuite, celles qui affichent leur propre logo à côté du logo officiel, ou celles qui utilisent des fonctionnalités exclusives à l’entreprise, une licence d’entreprise est requise. La licence peut évoluer avec les versions du projet ; avant de distribuer des versions modifiées, de les déployer pour les clients ou de les utiliser à grande échelle à des fins commerciales, il convient de vérifier la LICENSE accompagnant la version utilisée ainsi que les instructions officielles.
Tutoriel de déploiement d’Open WebUI Docker
- Installer Docker :Installez l’environnement Docker officiel sous Windows, macOS ou Linux, et vérifiez que vous pouvez télécharger les images officielles.
- Sélectionner l’image :L’image standard convient à la plupart des utilisateurs, l’image slim a une taille plus petite, l’image CUDA prend en charge les GPU NVIDIA, et l’image Ollama inclut Ollama.
- Créer un volume persistant :Mappage du répertoire des données sur le chemin des données backend à l’intérieur du conteneur, afin d’éviter la perte de la base de données, des conversations et du savoir lors de la reconstruction du conteneur.
- Démarrer et créer un administrateur :La première fois que vous ouvrez l’appareil, le compte enregistré sur le port 3000 devient administrateur. Ne conservez pas la page de premier enregistrement non réclamée sur un réseau public.
- Modèle de connexion :Configurez l’adresse d’Ollama ou l’URL de base et la clé du modèle cloud, puis testez d’abord une conversation ordinaire et une sortie en flux.
- Configuration de RAG :Sélectionnez l’extraction de documents, les embeddings et la base de vecteurs, puis utilisez une petite quantité de documents en chinois pour vérifier la qualité de l’analyse et de la recherche.
- Services de renforcement :Désactiver les inscriptions inutiles, configurer HTTPS, des clés fortes, un proxy inversé, un pare-feu, le contrôle d’accès et les sauvegardes.
- Version de production fixe :main et latest sont des images déroulantes ; dans un environnement de production, il convient d’utiliser une étiquette de version spécifique, de faire une sauvegarde avant la mise à niveau et de lire les instructions de migration.
Guide d’utilisation d’Open WebUI
Créer des flux de travail professionnels réutilisables
- Découper les sujets complexes en quatre catégories de questions : contexte, données, comparaisons et conclusions ;
- Combinaison de modèles multiples pour une conversation unifiée, Ollama ainsi que des modèles locaux et des bases de connaissances avec RAG forment des étapes de recherche fixes ;
- Privilégier les sites officiels, les articles scientifiques, les documents réglementaires et les données brutes ;
- Mettre en place une vérification par une deuxième personne pour les conclusions à haut risque ;
- Conserver les requêtes, les preuves, les versions et les problèmes non résolus ;
- Redémarrer après modification des données et mettre à jour les conclusions ;
Précautions pour un déploiement à grande échelle
- Une instance unique peut utiliser la base de données par défaut et le stockage local ;
- Le déploiement en production avec plusieurs instances nécessite PostgreSQL, Redis, une base de données vectorielle accessible en parallèle et un stockage de fichiers partagé ;
- Chaque instance doit utiliser des secrets et des configurations de connexion cohérents, et la migration de la base de données ne peut être effectuée que par une seule instance ;
- Il convient également de mettre en place une limitation du débit du modèle, des journaux d’audit, des quotas de ressources, ainsi que des processus de restauration après sauvegarde et de réversion en cas de mise à niveau.
À qui s’adresse-t-il
- Personnes souhaitant ajouter une interface de chat web complète pour Ollama ou d’autres modèles locaux ;
- Équipes d’IA nécessitant une connexion unifiée à plusieurs clouds et modèles auto-hébergés ;
- Organisations qui prévoient de mettre en place des systèmes de questions-réponses, de recherche et de portail de modèles pour les documents internes ;
- Développeurs ayant besoin de MCP, OpenAPI, d’outils Python et d’extensions de filtrage de messages ;
- Équipes de déploiement privatisées capables de gérer l’identité, l’infrastructure et la sécurité des données.
Avantages et limites d'utilisation
- Les avantages d’OpenWebUI sont une interface mature, une large compatibilité avec les modèles, une forte capacité de privatisation, ainsi qu’une intégration de bases de connaissances, d’outils, de fonctionnalités de recherche, de reconnaissance vocale, d’analyse d’images et de gestion d’équipe.
- Il convient de passer en douceur d’une conversation locale individuelle à une plateforme interne à l’organisation ;
- La limite réside dans le grand nombre de fonctionnalités, la large gamme de configurations, ainsi que dans la complexité non négligeable de la production et de l’exploitation.
- Les plugins peuvent exécuter n’importe quel code, et des droits insuffisants peuvent mettre en danger le serveur ;
- L’autogestion ne signifie pas automatiquement sécurité ou conformité ;
- Les réponses du modèle et les citations RAG peuvent encore être erronées, le contenu essentiel doit être vérifié manuellement ;
- Avant la mise à niveau, il faut faire une sauvegarde des données et installer en priorité une version stable contenant des correctifs de sécurité ;
Questions fréquentes
Le Open WebUI est-il gratuit ?
L’hébergement auto-géré standard et l’utilisation interne sous marque propre sont gratuits. Les serveurs, les GPU, les API de modèles cloud et les services tiers sont facturés séparément ;
Pour les marques blanches, les marques fortes et les fonctionnalités exclusives aux entreprises, il est nécessaire de demander un devis pour acquérir une licence d’entreprise.
L’Open WebUI doit-il installer Ollama ?
Ce n’est pas obligatoire. Il peut se connecter à Ollama, ainsi qu’directement aux services compatibles OpenAI, Open Responses et à divers modèles cloud.
Open WebUI prend-il en charge MCP ?
Il prend en charge HTTP MCP, et il est également possible d’accéder à stdio MCP via un proxy. Le code et les permissions des services externes doivent faire l’objet d’une audit séparé.
Le Open WebUI peut-il fonctionner complètement hors ligne ?
C’est possible, mais il faut utiliser des modèles locaux, des embeddings locaux, une base de vecteurs locale, et désactiver la recherche en ligne ainsi que toutes les API externes. La phase d’installation de l’image et de téléchargement des modèles nécessite généralement encore un accès à Internet.
Open WebUI est-il adapté à une déploiement en réseau public ?
C’est possible, mais il faut configurer HTTPS, l’authentification, des secrets robustes, un proxy inversé, un pare-feu, des sauvegardes et des droits minimaux. Ne exposez pas directement les ports par défaut ou les plugins à hauts privilèges au réseau public.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164