Hébergeur français depuis 2011
4,5/5 sur Trustpilot

VPS Ollama + Open WebUIVos modèles d'IA ouverts, sur votre serveur en France

  • Ollama et Open WebUI déployés ensemble
  • Des modèles ouverts qui tournent sur votre VPS
  • Sur processeur, ou GPU NVIDIA L4 en option
  • Hébergé en France, support 24/7
Déployé pour vous
Ollama et Open WebUI prêts
Modèles locaux
Llama, Gemma, Qwen, Mistral…
HTTPS automatique
Adresse générée ou votre domaine
Support 24/7
En français, par des humains

Choisissez votre VPS Ollama

Ollama et Open WebUI sont déployés automatiquement sur chaque offre de cette page. Sans GPU, le modèle tourne sur le processeur et se charge en mémoire : seules les offres d'au moins 4 vCPU, 8 Go de RAM et 60 Go de disque sont proposées. Sur la gamme Haute performance, l'option GPU NVIDIA L4 s'ajoute depuis la console.

Système d'exploitation
  • Ubuntu26.04 · 24.04 · 22.04
  • Debian13 · 12 · 11
Au choix à la commande

VPS livré en 10 secondes

  • HP-8
    Processeur4 vCPUAMD EPYC 9554
    Mémoire8 GoDDR5
    Stockage80 Go NVMeou 160 Go SSD
    Réseau1 Gbps
    12,79 €HT/mois
    15,99 €Économisez 38 €/an
    Choisir
  • HP-16Plus populaire
    Processeur8 vCPUAMD EPYC 9554
    Mémoire16 GoDDR5
    Stockage160 Go NVMeou 320 Go SSD
    Réseau1 Gbps
    25,59 €HT/mois
    31,99 €Économisez 77 €/an
    Choisir
  • HP-32
    Processeur16 vCPUAMD EPYC 9554
    Mémoire32 GoDDR5
    Stockage320 Go NVMeou 640 Go SSD
    Réseau1 Gbps
    51,19 €HT/mois
    63,99 €Économisez 154 €/an
    Choisir
  • HP-64
    Processeur32 vCPUAMD EPYC 9554
    Mémoire64 GoDDR5
    Stockage640 Go NVMeou 1280 Go SSD
    Réseau1 Gbps
    102,39 €HT/mois
    127,99 €Économisez 307 €/an
    Choisir

Tout le nécessaire dans chaque offre, et plus encore

  • Ollama + Open WebUI déployés
  • HTTPS automatique
  • Trafic illimité
  • Protection DDoS
  • Support français 24/7

Pourquoi Ollama sur un VPS OnetSolutions

Des processeurs récents, de la mémoire et du stockage NVMe sous chaque serveur Ollama.

Intel Xeon ou AMD EPYC, stockage NVMe

Intel Xeon et DDR4 sur la gamme General Purpose, AMD EPYC 7443 sur la gamme Performance, AMD EPYC 9554 et DDR5 sur la gamme Haute performance.

Jusqu'à 1 Gbps

Jusqu'à 300 Mbps sur la gamme General Purpose, 1 Gbit/s sur les gammes Performance et Haute performance, trafic illimité partout.

API OnetSolutions

Automatisez vos déploiements, pilotez vos serveurs et connectez vos assistants IA à votre infrastructure. Voir la documentation

Sauvegardes et snapshots

Les volumes de l'application sont sauvegardés chaque jour sur le serveur. Sauvegardes quotidiennes du VPS en option dès 2,99 € HT/mois, et un premier snapshot offert.

Votre IA locale en trois étapes

Rien à installer : vous commandez, Ollama et Open WebUI sont déployés sur votre serveur avec une adresse HTTPS.

  1. 01

    Choisissez votre VPS

    Sélectionnez une offre d'au moins 8 Go de RAM : Ollama + Open WebUI est déjà sélectionné comme One Click App dans la commande.

  2. 02

    Ollama et Open WebUI se déploient

    Automatiquement après la création du serveur. Seul Open WebUI reçoit une adresse HTTPS ; Ollama reste interne au serveur.

  3. 03

    Téléchargez un modèle

    Créez le compte administrateur, puis tapez le nom d'un modèle dans le sélecteur d'Open WebUI : il est téléchargé depuis la bibliothèque Ollama.

Ollama et Open WebUI, une IA qui tourne chez vous

Ollama télécharge et exécute des modèles ouverts, Open WebUI vous donne l'interface. Les deux tournent sur votre VPS, sur le processeur ou sur un GPU NVIDIA L4 en option.

Votre équipe

Navigateur, ordinateur ou mobile

Open WebUI sur votre VPS

Comptes, historique et documents dans un datacenter en France

Ollama sur le même VPS

Le modèle tourne sur le processeur et la mémoire du serveur

  • Modèles téléchargés depuis l'interface

    Tapez le nom d'un modèle dans le sélecteur d'Open WebUI, ou passez par Administration > Connexions : Ollama le télécharge pour vous.

  • Ollama n'est pas exposé

    Dans ce déploiement, seul Open WebUI reçoit une adresse HTTPS. Ollama n'est joignable que par Open WebUI, à l'intérieur du serveur.

  • Aucun fournisseur d'API

    Avec un modèle local, vos questions et les réponses sont calculées sur votre VPS : elles ne sont envoyées à aucun service d'IA externe.

  • Discutez avec vos documents

    Téléversez des fichiers ou créez des bases de connaissances : Open WebUI retrouve les passages utiles et les donne au modèle.

  • Plusieurs utilisateurs

    Rôles, groupes et permissions dans Open WebUI : chacun a son compte et son historique, l'administrateur choisit qui accède à quels modèles.

  • Bibliothèque de modèles ouverts

    Llama, Gemma, Qwen, Mistral et bien d'autres sont publiés dans la bibliothèque Ollama, en versions de différentes tailles.

  • Local et API côte à côte

    Pour les tâches trop lourdes pour le processeur, ajoutez une API compatible OpenAI dans Open WebUI et gardez vos modèles locaux pour le reste.

  • Plusieurs modèles à la fois

    Open WebUI interroge plusieurs modèles en parallèle dans une même conversation, pour comparer leurs réponses avant de choisir.

Quelle mémoire pour quel modèle ?

Sans l'option GPU, Ollama charge le modèle dans la RAM du VPS. Le fichier du modèle, son contexte, Open WebUI et le 1 Go réservé au système et à la plateforme doivent tenir ensemble : c'est la RAM qui décide de la taille de modèle possible.

Modèle (bibliothèque Ollama)TéléchargementOffre conseillée
gemma3:1b815 MoDès 8 Go de RAM
llama3.2:3b2,0 GoDès 8 Go de RAM
qwen3:4b2,5 GoDès 8 Go de RAM
mistral:7b4,4 Go16 Go de RAM conseillés
qwen3:8b5,2 Go16 Go de RAM conseillés
qwen3:14b9,3 Go32 Go de RAM conseillés

Tailles relevées sur ollama.com/library en septembre 2026. Les offres conseillées sont indicatives : un contexte plus long ou plusieurs utilisateurs simultanés demandent davantage de mémoire.

Option GPU NVIDIA L4 sur la gamme Haute performance

Les VPS Haute performance acceptent un GPU NVIDIA L4 Tensor Core avec 24 Go de VRAM, attaché et détaché depuis la console. Le L4 figure dans la liste des cartes prises en charge par Ollama : l'inférence est accélérée et des modèles plus gros deviennent utilisables.

  • 0,70 € HT par heure, décompté à la minute, sans engagement
  • Un redémarrage du VPS au moment de l'attache
  • GPU en passthrough : pilotes NVIDIA et CUDA standards
  • Le déploiement One Click App démarre Ollama sans accès au GPU : installez le pilote NVIDIA et le NVIDIA Container Toolkit avec l'accès root, puis donnez le GPU au service Ollama
  • Gammes General Purpose et Performance : pas d'option GPU

Sans l'option GPU, Ollama fonctionne en mode processeur seul : les réponses arrivent nettement plus lentement que sur une carte graphique, et d'autant plus lentement que le modèle est gros. Le VPS convient alors aux petits modèles quantifiés et aux usages légers ; pour des modèles plus gros ou plus rapides, ajoutez l'option GPU sur une offre Haute performance ou reliez Open WebUI à une API.

Ollama est open source sous licence MIT. Open WebUI est publié sous l'Open WebUI License, une licence de type BSD avec une clause qui interdit de retirer la marque « Open WebUI » au-delà de 50 utilisateurs sur 30 jours glissants, sauf accord de l'éditeur. Chaque modèle a sa propre licence, indiquée sur sa fiche ollama.com. Aucun modèle n'est préinstallé.

Ce que vous pouvez faire avec Ollama sur un VPS

Des modèles ouverts sur votre propre serveur, pour les usages où un petit modèle suffit.

  • Assistant privé

    Reformuler, résumer, traduire ou rédiger avec un petit modèle ouvert, sans envoyer vos textes à un service externe.

    • Llama
    • Mistral
    • Qwen
  • Questions sur vos documents

    Procédures, notes internes, documentation : le modèle répond à partir des fichiers que vous avez téléversés.

  • Données sensibles

    Pour des textes qui ne doivent pas quitter votre infrastructure, le modèle tourne sur votre VPS dans un datacenter en France.

  • Tester des modèles ouverts

    Téléchargez plusieurs modèles, posez-leur la même question et comparez les réponses avant d'en adopter un.

  • Local et API

    Gardez un modèle local pour le quotidien et ajoutez une API compatible OpenAI pour les demandes plus lourdes.

    • Mistral AI
    • Anthropic
    • OpenRouter
  • Une équipe, un serveur

    Chaque collaborateur a son compte Open WebUI ; l'administrateur valide les inscriptions et répartit les accès par groupe.

Ollama et Open WebUI tournent sur votre VPS, notre console gère le serveur et l'application

Votre VPS et l'application se pilotent depuis la console OnetSolutions, sans SSH, et vous gardez l'accès root au serveur.

  • Statut, journaux et variables d'environnement de chaque service
  • Votre domaine, avec un certificat HTTPS automatique
  • Mises à jour détectées et appliquées depuis la console
  • Sauvegarde quotidienne des volumes de l'application, 7 jours de rétention
console.onetsolutions.net/compute/instances/ollama-with-open-webui-prod
OnetSolutions
Agence Horizon
Compute/Instances/web-prod-01
web-prod-01En cours
GP-8 · Intel Xeon 2,60 GHz
RedémarrerConsole
CPU34%
RAM5,2 / 8 Go
Réseau128 Mb/s
Système
Ubuntu 26.04 LTS
Adresse IP
51.210.24.8
Uptime
34 j
Taille
4 vCPU · 8 Go
Activité CPU (24 h)34%
-24 h-12 hmaintenant

Une équipe derrière votre serveur

Des techniciens qui connaissent votre VPS, joignables à toute heure.

4,5/5 sur Trustpilot
Contacter le support

Support français 24/7

Ouvrez un ticket depuis la console, jour et nuit : une personne vous répond sur votre serveur.

Centre d'aide

Guides One Click Apps : déploiement, domaines, sauvegardes et mises à jour.

Satisfait ou remboursé 30 jours

Essayez Ollama sur votre VPS : s'il ne vous convient pas, vous êtes remboursé.

MCP · Bêta

Pilotez votre VPS avec l'IA

Notre serveur MCP connecte Claude, Cursor ou tout client compatible Model Context Protocol à votre compte OnetSolutions : interrogez vos serveurs et leur état en langage naturel, sans quitter votre assistant.

  • Lecture seule : l'assistant consulte, il ne modifie rien
  • Connexion avec votre compte OnetSolutions
Configurer le serveur MCP
  • Claude
  • Cursor
  • Tout client MCP

Questions fréquentes sur Ollama

Ce qu'il faut savoir avant de commander, et juste après.

Qu'est-ce qu'Ollama + Open WebUI ?

Ollama est un logiciel open source qui télécharge et exécute des modèles d'IA ouverts. Open WebUI est une interface web qui s'y connecte pour discuter avec ces modèles, gérer les utilisateurs et travailler sur vos documents. Cette One Click App déploie les deux ensemble sur votre VPS, déjà reliés.

Faut-il un GPU ? À quelle vitesse répond le modèle ?

Sans GPU, Ollama calcule sur le processeur du serveur, ce qui est nettement plus lent qu'une carte graphique et d'autant plus lent que le modèle est gros : comptez sur de petits modèles quantifiés, de 1 à 14 milliards de paramètres selon la RAM de l'offre. Sur une offre Haute performance, vous pouvez attacher un GPU NVIDIA L4 de 24 Go de VRAM (0,70 € HT/heure, décompté à la minute, sans engagement), pris en charge par Ollama. Le déploiement One Click App démarre Ollama sans accès au GPU : il faut installer le pilote NVIDIA et le NVIDIA Container Toolkit, puis donner le GPU au service Ollama. Vous pouvez aussi ajouter une API compatible OpenAI dans Open WebUI.

Pourquoi au moins 8 Go de RAM et 4 vCPU ?

Sans GPU, le modèle entier est chargé dans la mémoire du VPS, à côté d'Open WebUI et du 1 Go réservé au système et à la plateforme One Click Apps. Le modèle de démarrage de la documentation d'Ollama, Gemma 4 E2B, pèse 7,2 Go à télécharger et Ollama lui recommande 8 Go de mémoire. Les petits modèles tiennent dans 8 Go, les modèles de 7 à 8 milliards de paramètres sont plus à l'aise avec 16 Go, et le calcul se fait sur les vCPU de l'offre : c'est pourquoi cette page ne propose que les offres d'au moins 4 vCPU, 8 Go de RAM et 60 Go de disque.

Un modèle est-il inclus ?

Aucun modèle n'est préinstallé. Après la création du compte administrateur, tapez le nom d'un modèle dans le sélecteur d'Open WebUI (par exemple llama3.2:3b) ou ouvrez Administration > Connexions : il est téléchargé depuis la bibliothèque Ollama. Chaque modèle a sa propre licence, indiquée sur sa fiche ollama.com.

Mes conversations quittent-elles le serveur ?

Avec un modèle Ollama local, non : vos questions et les réponses sont calculées sur votre VPS, dans un datacenter en France, et l'historique est stocké par Open WebUI sur ce même serveur. Si vous ajoutez une API externe dans Open WebUI, les messages envoyés à ce modèle sont traités par son fournisseur.

Comment accéder à l'application après la commande ?

Une fois le VPS créé, Ollama et Open WebUI sont déployés automatiquement. Ouvrez l'application dans la section One Click Apps de la console et suivez son adresse HTTPS. Créez votre compte sans attendre : le premier compte créé devient l'administrateur. Ajoutez ensuite votre domaine dans l'onglet Domaines : le certificat HTTPS est émis automatiquement.

Mes données et mes modèles sont-ils sauvegardés ?

Les volumes de l'application, dont celui où Ollama range les modèles téléchargés, sont sauvegardés chaque jour à 3 h avec 7 jours de rétention, sur le disque du VPS : prévoyez l'espace disque en conséquence. Ces sauvegardes vous protègent d'une erreur dans l'application, pas de la perte du serveur : pour cela, ajoutez l'option de sauvegarde du VPS (dès 2,99 € HT/mois) ou prenez un snapshot.

Comment se passent les mises à jour ?

Chaque nuit, la console vérifie si de nouvelles versions d'Ollama et d'Open WebUI sont publiées et l'affiche sur la page de l'application. Rien n'est mis à jour sans votre action : un clic sur « Mettre à jour » suffit, les volumes de données sont conservés.

Qui maintient l'application ?

Ollama et Open WebUI sont développés par leurs éditeurs respectifs. OnetSolutions fournit le serveur, le déploiement et les outils de la console ; la configuration de l'application, le choix des modèles et leur usage relèvent de vous. Notre support porte sur le VPS : serveur, réseau, stockage et disponibilité.

Ollama et Open WebUI sont-ils payants ?

Non. Ollama est open source sous licence MIT. Open WebUI est gratuit, sous l'Open WebUI License : une licence de type BSD avec une clause qui interdit de retirer la marque « Open WebUI » au-delà de 50 utilisateurs sur 30 jours glissants, sauf accord de l'éditeur. Les prix de cette page sont ceux du VPS.

Lancez votre IA locale

Choisissez votre offre : le serveur arrive avec Ollama et Open WebUI déployés, prêts à télécharger vos premiers modèles.

HP-8Ollama + Open WebUI inclus
dès12,79 €HT/mois

15,99 €avec l'engagement annuel

  • 4 vCPU AMD EPYC 9554
  • 8 Go DDR5
  • 80 Go NVMe
  • 1 Gbps
Commander HP-8
VPS Ollama + Open WebUI dès 12,79 € HT/mois, hébergé en France - OnetSolutions