Ollama sur NAS Synology : un LLM sur le serveur familial
Oui, sur les NAS x86 (Intel Celeron ou AMD Ryzen) uniquement : les NAS ARM Realtek ne peuvent pas exécuter Ollama. Comptez environ 10 Go de RAM libre pour un modèle 7B, en plus de DSM. Il n'existe pas de paquet Ollama officiel : passez par Container Manager (DSM 7.2+) et l'image ollama/ollama.
Un NAS Synology peut héberger un vrai LLM local, accessible depuis tout le réseau familial ou l'entreprise, sans dépendre d'un cloud. Mais toutes les configurations ne s'y prêtent pas : le processeur, la RAM disponible et la façon d'exposer le service sur le réseau font la différence entre un outil utilisable et une déception. Voici ce qu'il faut vérifier avant d'installer, et ce à quoi s'attendre en CPU seul.
#Quels NAS Synology sont compatibles avec Ollama
Ollama nécessite un processeur x86-64. C'est la première chose à vérifier avant tout achat ou toute tentative d'installation : les NAS Synology construits autour d'un processeur ARM (Realtek, par exemple les gammes d'entrée de gamme comme le DS124, DS223 ou DS223J) ne peuvent pas exécuter Ollama, faute des jeux d'instructions que le logiciel suppose disponibles sur le CPU.
En pratique, ce sont les séries « Plus » et supérieures, équipées d'un Intel Celeron ou d'un AMD Ryzen, qui conviennent. Avant d'installer quoi que ce soit, vérifiez la fiche technique exacte de votre modèle : le nom de la gamme (Plus) est un indice, pas une garantie à lui seul.
#Combien de RAM prévoir pour un usage réaliste
Des agents qui agissent sur ta machine : Cline agentique, MCP, n8n + Ollama, automatisations locales.
- Espace en ligne à vie
- PDF + fichiers
- Remboursé 30 j
Le besoin en RAM varie selon le modèle chargé, la quantification, la longueur du contexte et le nombre d'utilisateurs simultanés ; il faut aussi garder de la marge pour DSM et les autres paquets qui tournent en parallèle. Un modèle 7B nécessite environ 10 Go de RAM libre, ce qui, sur un NAS avec 8 ou 16 Go au total, laisse peu de marge une fois DSM et Container Manager pris en compte.
| Modèle | CPU | RAM d'origine | RAM max |
|---|---|---|---|
| DS225+ / DS425+ | Intel Celeron J4125 | 2 Go DDR4 | 6 Go |
| DS725+ | AMD Ryzen R1600 (2 cœurs) | 4 Go DDR4 ECC | 32 Go |
| DS925+ | AMD Ryzen V1500B (4 cœurs) | 4 Go DDR4 ECC | 32 Go |
| DS1525+ / DS1825+ | AMD Ryzen V1500B (4 cœurs) | 8 Go DDR4 ECC | 32 Go |
Les DS225+ et DS425+ sont livrés avec seulement 2 Go de RAM d'origine : c'est largement insuffisant pour un LLM utilisable, même un petit modèle. Une mise à niveau mémoire est indispensable sur ces références avant toute installation d'Ollama.
#Quels modèles Synology considérer en priorité
Les références équipées d'un Ryzen (DS725+, DS925+, DS1525+, DS1825+) offrent une RAM extensible jusqu'à 32 Go et un CPU plus adapté au calcul que les Celeron des gammes DS225+/DS425+. Pour un usage LLM sérieux, ce sont ces gammes qu'il faut viser, avec une mise à niveau mémoire vers le maximum supporté plutôt que la configuration d'origine.
#Installer Ollama via Container Manager
Synology ne propose pas Ollama comme paquet officiel dans le Centre de paquets : il faut passer par Container Manager, qui remplace l'ancien paquet Docker depuis DSM 7.2 (sur DSM 7.0 et 7.1, c'est encore l'ancien paquet Docker qui est disponible).
- 01Vérifier la version de DSMContainer Manager nécessite DSM 7.2 ou supérieur. Sur une version antérieure, c'est l'ancien paquet Docker qu'il faut utiliser, avec une interface différente.
- 02Ouvrir Container Manager et chercher l'image officielleDepuis le menu principal de DSM, ouvrir Container Manager, aller dans Registre, chercher ollama/ollama, sélectionner l'image officielle et cliquer sur Télécharger.
- 03Configurer le port et lancer le conteneurMapper le port du conteneur (11434 par défaut pour Ollama) sur une plage haute côté hôte, dans l'esprit de la plage 8000-9000 recommandée pour ce type de service, plutôt que de toucher aux ports par défaut de DSM.
- 04Télécharger un premier modèle adapté à la RAM disponibleUne fois le conteneur lancé, se connecter en ligne de commande ou via l'interface et récupérer un modèle dimensionné à la RAM libre réellement disponible sur le NAS, pas à la RAM totale installée.
#Attentes réalistes en CPU seul
Un NAS Synology fait tourner Ollama uniquement sur CPU : il n'y a pas de GPU dédié à exploiter sur ces machines. Le débit réel doit être mesuré sur le modèle et la charge visés, car il varie avec la longueur de contexte, la version d'Ollama et l'activité concurrente du NAS (sauvegardes, indexation, autres paquets). Un ordre de grandeur qualitatif observé pour de la génération longue tourne autour de 5 tokens par seconde — largement suffisant pour un usage asynchrone (résumé, traitement en tâche de fond), plus limite pour une conversation en direct exigeante.
#Sécurité réseau : ne pas exposer Ollama sur Internet
Un NAS contient généralement l'ensemble des fichiers personnels ou professionnels d'un foyer ou d'une petite structure : c'est une machine à protéger en priorité, pas à exposer par confort. Rediriger un port DSM ou un port de conteneur directement vers Internet place un appareil qui contient tous vos fichiers directement dans la trajectoire de scans automatisés, et des NAS Synology ont déjà été ciblés par des campagnes de rançongiciel pour cette raison précise.
#Face à un déploiement Docker de production
Ce guide vise une installation simple, mono-conteneur, sur un NAS familial ou de petite structure. Pour une stack de production avec reverse proxy HTTPS, interface web dédiée, RAG vectoriel et monitoring, la démarche est différente et plus lourde à opérer : elle est couverte par le guide Docker Compose de production de ce site, pensé pour un serveur Linux dédié plutôt que pour un NAS.
- Déploiement LLM Docker Compose en production
- Alternative : Ollama sur Proxmox (LXC/VM)
- Source : compatibilité CPU et RAM par modèle
- Source : Container Manager et sécurité réseau
#Pour qui ce montage a du sens
Un Ollama sur NAS Synology convient à qui a déjà un NAS x86 en service pour le stockage et veut y ajouter un usage IA léger, asynchrone, accessible depuis tout le réseau local : résumer des documents déposés dans un dossier partagé, extraire des informations d'e-mails archivés, ou servir de brique à une automatisation domestique. Ce n'est pas la bonne cible si l'objectif est une conversation fluide et rapide au quotidien, ou si le NAS sert déjà de sauvegarde principale et n'a pas de marge mémoire à consacrer à un LLM sans risquer de ralentir ses tâches habituelles.
- Vous avez déjà un NAS x86 Plus avec de la RAM libre
- C'est le scénario le plus rentable : pas de matériel supplémentaire à acheter, juste une mise à niveau mémoire éventuelle et un conteneur à configurer.
- Vous cherchez une conversation instantanée type ChatGPT
- Le CPU seul d'un NAS reste lent face à un GPU dédié ou une puce à mémoire unifiée récente ; privilégiez plutôt un mini-PC ou une machine avec GPU pour cet usage.
- Le NAS héberge déjà des sauvegardes critiques
- Vérifiez la RAM et la charge CPU disponibles avant d'ajouter Ollama : un service mal dimensionné peut ralentir les tâches de sauvegarde existantes.
Tous les NAS Synology peuvent-ils faire tourner Ollama ?+
Combien de RAM faut-il sur un NAS Synology pour Ollama ?+
Existe-t-il un paquet Ollama officiel dans le Centre de paquets Synology ?+
Quelle vitesse attendre d'Ollama sur un NAS Synology ?+
Est-il prudent de rendre Ollama accessible depuis Internet ?+
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.