VPS Ollama + Open WebUIVos modèles d'IA ouverts, sur votre serveur en France
- Ollama et Open WebUI déployés ensemble
- Des modèles ouverts qui tournent sur votre VPS
- Sur processeur, ou GPU NVIDIA L4 en option
- Hébergé en France, support 24/7
Choisissez votre VPS Ollama
Ollama et Open WebUI sont déployés automatiquement sur chaque offre de cette page. Sans GPU, le modèle tourne sur le processeur et se charge en mémoire : seules les offres d'au moins 4 vCPU, 8 Go de RAM et 60 Go de disque sont proposées. Sur la gamme Haute performance, l'option GPU NVIDIA L4 s'ajoute depuis la console.
Ubuntu26.04 · 24.04 · 22.04
Debian13 · 12 · 11
VPS livré en 10 secondes
- HP-8Processeur4 vCPUAMD EPYC 9554Mémoire8 GoDDR5Stockage80 Go NVMeou 160 Go SSDRéseau1 GbpsChoisir12,79 €HT/mois15,99 €Économisez 38 €/an
- HP-16Plus populaireProcesseur8 vCPUAMD EPYC 9554Mémoire16 GoDDR5Stockage160 Go NVMeou 320 Go SSDRéseau1 GbpsChoisir25,59 €HT/mois31,99 €Économisez 77 €/an
- HP-32Processeur16 vCPUAMD EPYC 9554Mémoire32 GoDDR5Stockage320 Go NVMeou 640 Go SSDRéseau1 GbpsChoisir51,19 €HT/mois63,99 €Économisez 154 €/an
- HP-64Processeur32 vCPUAMD EPYC 9554Mémoire64 GoDDR5Stockage640 Go NVMeou 1280 Go SSDRéseau1 GbpsChoisir102,39 €HT/mois127,99 €Économisez 307 €/an
Tout le nécessaire dans chaque offre, et plus encore
- Ollama + Open WebUI déployés
- HTTPS automatique
- Trafic illimité
- Protection DDoS
- Support français 24/7
Pourquoi Ollama sur un VPS OnetSolutions
Des processeurs récents, de la mémoire et du stockage NVMe sous chaque serveur Ollama.
Intel Xeon ou AMD EPYC, stockage NVMe
Jusqu'à 1 Gbps
API OnetSolutions
Sauvegardes et snapshots
Votre IA locale en trois étapes
Rien à installer : vous commandez, Ollama et Open WebUI sont déployés sur votre serveur avec une adresse HTTPS.
- 01
Choisissez votre VPS
Sélectionnez une offre d'au moins 8 Go de RAM : Ollama + Open WebUI est déjà sélectionné comme One Click App dans la commande.
- 02
Ollama et Open WebUI se déploient
Automatiquement après la création du serveur. Seul Open WebUI reçoit une adresse HTTPS ; Ollama reste interne au serveur.
- 03
Téléchargez un modèle
Créez le compte administrateur, puis tapez le nom d'un modèle dans le sélecteur d'Open WebUI : il est téléchargé depuis la bibliothèque Ollama.
Ollama et Open WebUI, une IA qui tourne chez vous
Ollama télécharge et exécute des modèles ouverts, Open WebUI vous donne l'interface. Les deux tournent sur votre VPS, sur le processeur ou sur un GPU NVIDIA L4 en option.
Votre équipe
Navigateur, ordinateur ou mobile
Open WebUI sur votre VPS
Comptes, historique et documents dans un datacenter en France
Ollama sur le même VPS
Le modèle tourne sur le processeur et la mémoire du serveur
Modèles téléchargés depuis l'interface
Tapez le nom d'un modèle dans le sélecteur d'Open WebUI, ou passez par Administration > Connexions : Ollama le télécharge pour vous.
Ollama n'est pas exposé
Dans ce déploiement, seul Open WebUI reçoit une adresse HTTPS. Ollama n'est joignable que par Open WebUI, à l'intérieur du serveur.
Aucun fournisseur d'API
Avec un modèle local, vos questions et les réponses sont calculées sur votre VPS : elles ne sont envoyées à aucun service d'IA externe.
Discutez avec vos documents
Téléversez des fichiers ou créez des bases de connaissances : Open WebUI retrouve les passages utiles et les donne au modèle.
Plusieurs utilisateurs
Rôles, groupes et permissions dans Open WebUI : chacun a son compte et son historique, l'administrateur choisit qui accède à quels modèles.
Bibliothèque de modèles ouverts
Llama, Gemma, Qwen, Mistral et bien d'autres sont publiés dans la bibliothèque Ollama, en versions de différentes tailles.
Local et API côte à côte
Pour les tâches trop lourdes pour le processeur, ajoutez une API compatible OpenAI dans Open WebUI et gardez vos modèles locaux pour le reste.
Plusieurs modèles à la fois
Open WebUI interroge plusieurs modèles en parallèle dans une même conversation, pour comparer leurs réponses avant de choisir.
Quelle mémoire pour quel modèle ?
Sans l'option GPU, Ollama charge le modèle dans la RAM du VPS. Le fichier du modèle, son contexte, Open WebUI et le 1 Go réservé au système et à la plateforme doivent tenir ensemble : c'est la RAM qui décide de la taille de modèle possible.
| Modèle (bibliothèque Ollama) | Téléchargement | Offre conseillée |
|---|---|---|
| gemma3:1b | 815 Mo | Dès 8 Go de RAM |
| llama3.2:3b | 2,0 Go | Dès 8 Go de RAM |
| qwen3:4b | 2,5 Go | Dès 8 Go de RAM |
| mistral:7b | 4,4 Go | 16 Go de RAM conseillés |
| qwen3:8b | 5,2 Go | 16 Go de RAM conseillés |
| qwen3:14b | 9,3 Go | 32 Go de RAM conseillés |
Tailles relevées sur ollama.com/library en septembre 2026. Les offres conseillées sont indicatives : un contexte plus long ou plusieurs utilisateurs simultanés demandent davantage de mémoire.
Option GPU NVIDIA L4 sur la gamme Haute performance
Les VPS Haute performance acceptent un GPU NVIDIA L4 Tensor Core avec 24 Go de VRAM, attaché et détaché depuis la console. Le L4 figure dans la liste des cartes prises en charge par Ollama : l'inférence est accélérée et des modèles plus gros deviennent utilisables.
- 0,70 € HT par heure, décompté à la minute, sans engagement
- Un redémarrage du VPS au moment de l'attache
- GPU en passthrough : pilotes NVIDIA et CUDA standards
- Le déploiement One Click App démarre Ollama sans accès au GPU : installez le pilote NVIDIA et le NVIDIA Container Toolkit avec l'accès root, puis donnez le GPU au service Ollama
- Gammes General Purpose et Performance : pas d'option GPU
Sans l'option GPU, Ollama fonctionne en mode processeur seul : les réponses arrivent nettement plus lentement que sur une carte graphique, et d'autant plus lentement que le modèle est gros. Le VPS convient alors aux petits modèles quantifiés et aux usages légers ; pour des modèles plus gros ou plus rapides, ajoutez l'option GPU sur une offre Haute performance ou reliez Open WebUI à une API.
Ollama est open source sous licence MIT. Open WebUI est publié sous l'Open WebUI License, une licence de type BSD avec une clause qui interdit de retirer la marque « Open WebUI » au-delà de 50 utilisateurs sur 30 jours glissants, sauf accord de l'éditeur. Chaque modèle a sa propre licence, indiquée sur sa fiche ollama.com. Aucun modèle n'est préinstallé.
Ce que vous pouvez faire avec Ollama sur un VPS
Des modèles ouverts sur votre propre serveur, pour les usages où un petit modèle suffit.
Assistant privé
Reformuler, résumer, traduire ou rédiger avec un petit modèle ouvert, sans envoyer vos textes à un service externe.
- Llama
- Mistral
- Qwen
Questions sur vos documents
Procédures, notes internes, documentation : le modèle répond à partir des fichiers que vous avez téléversés.
Données sensibles
Pour des textes qui ne doivent pas quitter votre infrastructure, le modèle tourne sur votre VPS dans un datacenter en France.
Tester des modèles ouverts
Téléchargez plusieurs modèles, posez-leur la même question et comparez les réponses avant d'en adopter un.
Local et API
Gardez un modèle local pour le quotidien et ajoutez une API compatible OpenAI pour les demandes plus lourdes.
- Mistral AI
- Anthropic
- OpenRouter
Une équipe, un serveur
Chaque collaborateur a son compte Open WebUI ; l'administrateur valide les inscriptions et répartit les accès par groupe.
Ollama et Open WebUI tournent sur votre VPS, notre console gère le serveur et l'application
Votre VPS et l'application se pilotent depuis la console OnetSolutions, sans SSH, et vous gardez l'accès root au serveur.
- Statut, journaux et variables d'environnement de chaque service
- Votre domaine, avec un certificat HTTPS automatique
- Mises à jour détectées et appliquées depuis la console
- Sauvegarde quotidienne des volumes de l'application, 7 jours de rétention
- Système
- Ubuntu 26.04 LTS
- Adresse IP
- 51.210.24.8
- Uptime
- 34 j
- Taille
- 4 vCPU · 8 Go
Une équipe derrière votre serveur
Des techniciens qui connaissent votre VPS, joignables à toute heure.
Support français 24/7
Ouvrez un ticket depuis la console, jour et nuit : une personne vous répond sur votre serveur.
Centre d'aide
Guides One Click Apps : déploiement, domaines, sauvegardes et mises à jour.
Satisfait ou remboursé 30 jours
Essayez Ollama sur votre VPS : s'il ne vous convient pas, vous êtes remboursé.
Pilotez votre VPS avec l'IA
Notre serveur MCP connecte Claude, Cursor ou tout client compatible Model Context Protocol à votre compte OnetSolutions : interrogez vos serveurs et leur état en langage naturel, sans quitter votre assistant.
- Lecture seule : l'assistant consulte, il ne modifie rien
- Connexion avec votre compte OnetSolutions
- Claude
- Cursor
- Tout client MCP
Questions fréquentes sur Ollama
Ce qu'il faut savoir avant de commander, et juste après.
Qu'est-ce qu'Ollama + Open WebUI ?
Ollama est un logiciel open source qui télécharge et exécute des modèles d'IA ouverts. Open WebUI est une interface web qui s'y connecte pour discuter avec ces modèles, gérer les utilisateurs et travailler sur vos documents. Cette One Click App déploie les deux ensemble sur votre VPS, déjà reliés.
Faut-il un GPU ? À quelle vitesse répond le modèle ?
Sans GPU, Ollama calcule sur le processeur du serveur, ce qui est nettement plus lent qu'une carte graphique et d'autant plus lent que le modèle est gros : comptez sur de petits modèles quantifiés, de 1 à 14 milliards de paramètres selon la RAM de l'offre. Sur une offre Haute performance, vous pouvez attacher un GPU NVIDIA L4 de 24 Go de VRAM (0,70 € HT/heure, décompté à la minute, sans engagement), pris en charge par Ollama. Le déploiement One Click App démarre Ollama sans accès au GPU : il faut installer le pilote NVIDIA et le NVIDIA Container Toolkit, puis donner le GPU au service Ollama. Vous pouvez aussi ajouter une API compatible OpenAI dans Open WebUI.
Pourquoi au moins 8 Go de RAM et 4 vCPU ?
Sans GPU, le modèle entier est chargé dans la mémoire du VPS, à côté d'Open WebUI et du 1 Go réservé au système et à la plateforme One Click Apps. Le modèle de démarrage de la documentation d'Ollama, Gemma 4 E2B, pèse 7,2 Go à télécharger et Ollama lui recommande 8 Go de mémoire. Les petits modèles tiennent dans 8 Go, les modèles de 7 à 8 milliards de paramètres sont plus à l'aise avec 16 Go, et le calcul se fait sur les vCPU de l'offre : c'est pourquoi cette page ne propose que les offres d'au moins 4 vCPU, 8 Go de RAM et 60 Go de disque.
Un modèle est-il inclus ?
Aucun modèle n'est préinstallé. Après la création du compte administrateur, tapez le nom d'un modèle dans le sélecteur d'Open WebUI (par exemple llama3.2:3b) ou ouvrez Administration > Connexions : il est téléchargé depuis la bibliothèque Ollama. Chaque modèle a sa propre licence, indiquée sur sa fiche ollama.com.
Mes conversations quittent-elles le serveur ?
Avec un modèle Ollama local, non : vos questions et les réponses sont calculées sur votre VPS, dans un datacenter en France, et l'historique est stocké par Open WebUI sur ce même serveur. Si vous ajoutez une API externe dans Open WebUI, les messages envoyés à ce modèle sont traités par son fournisseur.
Comment accéder à l'application après la commande ?
Une fois le VPS créé, Ollama et Open WebUI sont déployés automatiquement. Ouvrez l'application dans la section One Click Apps de la console et suivez son adresse HTTPS. Créez votre compte sans attendre : le premier compte créé devient l'administrateur. Ajoutez ensuite votre domaine dans l'onglet Domaines : le certificat HTTPS est émis automatiquement.
Mes données et mes modèles sont-ils sauvegardés ?
Les volumes de l'application, dont celui où Ollama range les modèles téléchargés, sont sauvegardés chaque jour à 3 h avec 7 jours de rétention, sur le disque du VPS : prévoyez l'espace disque en conséquence. Ces sauvegardes vous protègent d'une erreur dans l'application, pas de la perte du serveur : pour cela, ajoutez l'option de sauvegarde du VPS (dès 2,99 € HT/mois) ou prenez un snapshot.
Comment se passent les mises à jour ?
Chaque nuit, la console vérifie si de nouvelles versions d'Ollama et d'Open WebUI sont publiées et l'affiche sur la page de l'application. Rien n'est mis à jour sans votre action : un clic sur « Mettre à jour » suffit, les volumes de données sont conservés.
Qui maintient l'application ?
Ollama et Open WebUI sont développés par leurs éditeurs respectifs. OnetSolutions fournit le serveur, le déploiement et les outils de la console ; la configuration de l'application, le choix des modèles et leur usage relèvent de vous. Notre support porte sur le VPS : serveur, réseau, stockage et disponibilité.
Ollama et Open WebUI sont-ils payants ?
Non. Ollama est open source sous licence MIT. Open WebUI est gratuit, sous l'Open WebUI License : une licence de type BSD avec une clause qui interdit de retirer la marque « Open WebUI » au-delà de 50 utilisateurs sur 30 jours glissants, sauf accord de l'éditeur. Les prix de cette page sont ceux du VPS.
Lancez votre IA locale
Choisissez votre offre : le serveur arrive avec Ollama et Open WebUI déployés, prêts à télécharger vos premiers modèles.
- Satisfait ou remboursé 30 jours
- Hébergé en France
- Support français 24/7
15,99 €avec l'engagement annuel
- 4 vCPU AMD EPYC 9554
- 8 Go DDR5
- 80 Go NVMe
- 1 Gbps