FrameworksAgents.com Logo

Installer Ollama sur Hostinger : guide VPS 2026

Comparatifcalendar_todayPublié le 19 septembre 2026schedule11 min de lectureinstaller ollama hostingerollama vps hostinger

Installer Ollama sur un VPS Hostinger : template en un clic, méthode manuelle Ubuntu, choix CPU/GPU, Open WebUI et sécurité du port 11434.

Introduction

Oui, Ollama Hostinger fonctionne, et c'est une option honnête pour self-host un petit LLM en continu, à condition de choisir un plan dont la RAM suit le modèle et de ne jamais exposer le port 11434 sur Internet. Ce guide compare deux parcours : le template « Ubuntu avec Ollama » et l'installation manuelle sur Ubuntu 24.04 via le script officiel Ollama. Il est utile pour déplacer un prototype Ollama local vers un serveur disponible 24/7 ou évaluer un VPS avant un GPU dédié. Il est à éviter si vous n'avez pas encore installé Ollama en local ou si votre charge justifie directement un endpoint cloud payant.

Résumé rapide

QuestionRéponse courte
Ollama fonctionne-t-il chez Hostinger ?Oui, via le template Ollama VPS ou une installation manuelle Ubuntu
Quel plan choisir pour débuter ?KVM 4 (16 Go RAM, 4 vCPU, 200 Go NVMe) — minimum viable pour Llama 3 8B
CPU ou GPU pour un usage sérieux ?CPU suffit pour 3B–8B ponctuels ; GPU dédié dès 13B ou usage continu
Template ou installation manuelle ?Template pour aller vite ; manuel pour garder le contrôle (système propre, modèle au choix)
Comment exposer l'API ?Jamais directement : reverse proxy + TLS, Tailscale ou tunnel SSH ; port 11434 en local

Vous voulez un serveur Ollama disponible 24/7 ? Consultez l'offre LLM VPS Hostinger puis suivez le parcours template de ce guide. Lien partenaire : FrameworksAgents touche une commission si vous souscrivez via ce lien, sans surcoût pour vous ; le choix du VPS (CPU vs GPU, template vs manuel) reste neutre dans le guide.

Comprendre le contexte : Ollama Hostinger, ce que ça change

Héberger Ollama sur un VPS Hostinger n'est pas un copier-coller de l'installation locale.

RAM système vs VRAM n'est pas la même chose. Ollama charge les poids en RAM système (mode CPU) ou en mémoire GPU (si la carte est compatible : NVIDIA CUDA, AMD ROCm, Apple Silicon, Vulkan). Sur un VPS CPU-only, vous restez en RAM système, suffisant pour 3B–8B. Un 8B quantifié Q4_K_M pèse ~4,9 Go ; avec 16 Go de RAM Ollama le charge sans swap. Règle Hostinger du 15 septembre 2026 : « au moins 16 Go de RAM, 12 Go de stockage, 4 cœurs CPU » pour Ollama stable ; au-delà de 8B ou contexte long, montez à 32 Go.

Le port 11434 n'a rien à faire sur Internet. Ollama expose par défaut une API REST non authentifiée sur localhost:11434. Si vous l'ouvrez sans reverse proxy authentifié, n'importe qui peut interroger votre modèle, consommer votre RAM, et exfiltrer vos prompts. Bonne pratique : OLLAMA_HOST=127.0.0.1, exposition via Nginx + TLS + token, ou Tailscale/WireGuard.

Le template Hostinger n'est pas une boîte noire. Il installe Ollama, Llama 3 et Open WebUI sur le port 8080 du VPS. Surface d'attaque plus large que l'installation manuelle : changez le mot de passe Open WebUI et bindez-le sur 127.0.0.1:8080 via systemctl edit open-webui.

Choisir le bon plan et le bon parcours

Quel plan Hostinger pour quel usage ?

Les plans LLM VPS vont du KVM 1 au KVM 8, plus GPU dédiée pour les charges exigeantes. Tarifs à vérifier à la date d'achat.

Besoin réelModèle typePlan Hostinger minimalLimite à connaître
Tester Ollama, requêtes ponctuellesllama3.2:3b, qwen2.5:3bKVM 2 (8 Go RAM, 2 vCPU)contexte court, pas de multi-utilisateurs
Agent de production, modèles 7B–8Bllama3.1:8b, mistral:7bKVM 4 (16 Go RAM, 4 vCPU)un seul utilisateur ou agent à la fois
Modèles 13B+ ou multi-utilisateursllama3.1:13b, mixtral:8x7bKVM 8 (32 Go RAM, 8 vCPU)latence CPU-only sensible, prévoir GPU
Contexte long, 30B+ ou intensifllama3.1:70b (Q4_K_M)KVM 8 + GPU dédiée50 Go de VRAM minimum, facturation à l'heure

Le plan KVM 4 est le point d'entrée réaliste pour un builder : assez de RAM pour Llama 3 8B avec contexte 8K, assez de CPU pour ne pas attendre 30 secondes par réponse. Pour les 30B+ ou le multi-utilisateurs, le VPS CPU-only n'est plus le bon outil — l'arbitrage complet est dans le comparatif LLM open source vs API fermée.

Préparer l'instance dans hPanel

Créez votre VPS, puis choisissez le template « Ubuntu 24.04 avec Ollama » dans « OS avec applications ». Trois réflexes :

  • Sauvegarde immédiate. Snapshot du VPS vierge depuis hPanel.
  • IP et SSH. Clé SSH configurée avant le premier ssh root@<ip>. Désactivez l'auth par mot de passe (PasswordAuthentication no).
  • Mises à jour. apt update && apt upgrade -y, puis redémarrage si le kernel change.

Hostinger recommande (15 septembre 2026) au minimum 16 Go de RAM, 12 Go de stockage et 4 vCPU pour Ollama 7B–8B. Pour 13B ou contexte long, doublez la RAM.

Parcours A — template Hostinger en un clic

Le template installe Ollama en service systemd, télécharge Llama 3 et déploie Open WebUI sur le port 8080 du VPS. Trois contrôles pour valider :

systemctl status ollama
ollama --version
ollama list
ollama ps

Si ollama list renvoie llama3:latest et que ollama ps affiche le modèle en mémoire, l'installation est fonctionnelle. Test rapide de l'API locale :

curl http://127.0.0.1:11434/api/generate -d '{
  "model": "llama3",
  "prompt": "Réponds simplement OK.",
  "stream": false
}'

Vous devez recevoir une réponse JSON avec un response non vide. Pour l'interface WebUI, ouvrez https://<ip-du-vps>:8080, créez le compte administrateur au premier accès, et changez immédiatement le mot de passe par défaut.

Parcours B — installation manuelle sur Ubuntu

Si vous voulez un système propre, sans Open WebUI préinstallé, ou si vous ciblez un modèle précis, l'installation manuelle tient en quatre étapes d'après la documentation officielle Ollama :

sudo apt update && sudo apt upgrade -y
sudo apt install -y curl
curl -fsSL https://ollama.com/install.sh | sh
sudo systemctl daemon-reload
sudo systemctl enable ollama
sudo systemctl start ollama
ollama --version
systemctl status ollama

Puis téléchargez un modèle dimensionné pour votre VPS :

ollama pull llama3.2:3b
ollama pull llama3.1:8b
ollama run llama3.1:8b "Donne-moi la capitale de la France en un mot."

Pour exposer le port sans casser la sécurité, gardez 127.0.0.1 comme bind par défaut — ajoutez dans la section [Service] via sudo systemctl edit ollama la ligne Environment="OLLAMA_HOST=127.0.0.1:11434", puis systemctl daemon-reload && systemctl restart ollama.

Les modèles sont stockés dans /usr/share/ollama/.ollama/models/ sur Linux. Pour déplacer le cache, définissez OLLAMA_MODELS=/mnt/data/ollama dans le même override systemd.

Connecter un client compatible OpenAI

Open WebUI reste l'interface la plus simple pour chatter avec Ollama depuis un navigateur. Pour brancher un client compatible OpenAI ou un agent Python, la base URL est http://127.0.0.1:11434/v1 :

from openai import OpenAI

client = OpenAI(
    base_url="http://<ip-vps>:11434/v1",
    api_key="ollama",
)
resp = client.chat.completions.create(
    model="llama3.1:8b",
    messages=[{"role": "user", "content": "Dis bonjour en français."}],
)
print(resp.choices[0].message.content)

Pour un agent complet (mémoire, outils, multi-rôles), ne réécrivez pas l'orchestration : repartez du guide Ollama + CrewAI/LangChain listé dans les articles liés.

Exemple concret

Contexte. Vous avez prototypé un agent de qualification de leads avec Ollama + Mistral 7B sur votre Mac, et vous voulez l'exposer à un client pour 4 à 6 heures d'usage quotidien, sans API payante au million de tokens.

Parcours choisi : template Hostinger KVM 4 (16 Go RAM, 4 vCPU, 200 Go NVMe, snapshot activé) + Open WebUI + Nginx. Pourquoi KVM 4 plutôt que KVM 2 : Mistral 7B tourne près de la limite sur 8 Go, et un agent conversationnel dépasse vite 4 Ko de contexte — 16 Go donnent la marge sans swap.

Réalisation. (1) VPS KVM 4 + template Ollama, snapshot, apt update && apt upgrade. (2) SSH avec clé, désactivation de l'auth par mot de passe. (3) ollama list retourne llama3:latest, ollama pull mistral:7b. (4) ollama run mistral:7b "..." valide une réponse. (5) Bind Ollama sur 127.0.0.1, Nginx + Certbot, auth par token. (6) Connexion client via https://<domaine>/v1. (7) Monitoring : journalctl -u ollama -f, ollama ps, alerte disque à 80 %.

Résultat. Latence : 3 à 6 s par réponse Mistral 7B sur contexte 4 Ko en CPU-only (mesure indicative à valider sur votre instance). Coût : ~12,99 $/mois sur KVM 4 la première période avec engagement 24 mois, puis ~28,99 $/mois au renouvellement — vérifier le tarif en vigueur sur la page LLM VPS Hostinger avant achat (prix consultés le 19 septembre 2026). 11434 non exposé, accès HTTPS + token, logs centralisés.

Bonnes pratiques

  • Commencez petit, mesurez. KVM 2 pour valider, KVM 4 en production, GPU dédié uniquement si la latence CPU bloque.
  • Ne jamais exposer 11434. Bind sur 127.0.0.1, exposition via Nginx + TLS + auth, ou Tailscale/WireGuard. Un Ollama non authentifié sera trouvé en quelques heures.
  • Snapshot avant chaque changement majeur. Avant upgrade du modèle, changement d'OS, ou modif du service systemd. Le rollback doit toujours exister.
  • Mises à jour et journaux. apt update hebdomadaire, journalctl -u ollama -e, espace disque surveillé. Un 8B ~5 Go, un 70B ~40 Go — nettoyez les modèles inutilisés.
  • Testez le chemin d'échec. Coupez la clé API, redémarrez Ollama sans réseau, saturez le contexte : vous devez voir une erreur claire, pas un timeout silencieux.
  • CPU ≠ GPU. Sur une instance GPU Hostinger (RTX 4090), Llama 3.1 8B Q4_K_M est ~2,7× plus rapide que sur une instance CPU-only (mesure Hostinger du 15 septembre 2026 ; plan CPU non précisé). Si vos utilisateurs attendent moins d'une seconde, le VPS CPU n'est pas la bonne réponse.

Questions fréquentes

Ollama fonctionne-t-il sur un VPS Hostinger ?

Oui. Hostinger propose un template « Ubuntu avec Ollama » qui installe le moteur, Llama 3 et Open WebUI en quelques minutes. Installation manuelle possible via le script officiel. Point d'attention : au moins 16 Go de RAM pour un modèle 7B–8B stable.

Quel plan Hostinger choisir pour Ollama ?

Usage ponctuel : KVM 2 (8 Go). Production avec 7B–8B : KVM 4 (16 Go, 4 vCPU, 200 Go NVMe) — ~12,99 $/mois la première période, ~28,99 $/mois au renouvellement sur engagement 24 mois (tarif au 19 septembre 2026). 13B+ ou multi-utilisateurs : KVM 8 ou GPU dédiée.

Le template Hostinger est-il plus simple que l'installation manuelle ?

Oui pour la vitesse : Ollama, Llama 3 et Open WebUI sont préinstallés sur https://<ip>:8080. Revers : surface d'attaque plus large (port 8080 exposé) et modèle imposé. L'installation manuelle prend dix minutes de plus et laisse un système propre.

Faut-il un GPU pour faire tourner Ollama ?

Non, Ollama fonctionne en CPU-only sur la RAM système — suffisant pour 3B–8B ponctuel. Un GPU devient nécessaire dès 13B, plusieurs utilisateurs simultanés, ou quand la latence CPU (3 à 10 s par réponse sur 7B) bloque l'UX. Hostinger propose des instances GPU à l'heure ou au mois.

Comment sécuriser Ollama sur un VPS ?

Trois règles : (1) ne jamais exposer 11434 directement, bind sur 127.0.0.1 ; (2) exposer l'API via Nginx + TLS + auth (token ou basic) ou via tunnel privé (Tailscale, WireGuard) ; (3) désactiver l'auth par mot de passe SSH, clé SSH obligatoire, mises à jour de sécurité activées. Côté template, changez le mot de passe Open WebUI et bindez-le sur 127.0.0.1:8080 via systemctl edit open-webui.

Articles liés

Cet article fait partie du cluster Ollama local. Le bon enchaînement après l'installation : finaliser votre agent avec le guide Ollama canonique (modèles, API, intégrations CrewAI/LangChain), arbitrer vos choix d'architecture avec agent IA local, et passer en production durable via déployer un agent IA. Pour maîtriser le budget VPS vs API cloud, voyez coûts des agents IA ; pour sécuriser clés et configurations, gestion des secrets pour les agents IA ; et pour orchestrer plusieurs appels, workflows agentiques.

Restez informé sur les agents IA

Nouveaux tutoriels, comparatifs et guides pratiques directement dans votre boîte mail.

homeAccueilcodeFrameworkssmart_toyAgentsmenu_bookTutorielsTwitter