Tu veux faire tourner ton propre NotebookLM sans envoyer tes données à Google ?
Ce guide t’accompagne pas-à-pas pour installer Open Notebook + Ollama sur Linux ou WSL2. En 30 minutes, tu auras une IA locale, privée, et gratuite.
Au programme :
- Installer Ollama et télécharger les modèles
- Déployer Open Notebook avec Docker
- Configurer et tester
- Bonus : CLI et API pour tes automatisations
Prérequis
Vérifie le GPU sous WSL2 :
nvidia-smi ne fonctionne pas ? Plusieurs cas possibles :
- Pas de GPU NVIDIA → Ollama fonctionnera en mode CPU (beaucoup plus lent, mais ça marche). Passe directement à l’étape 1.
- GPU NVIDIA mais commande introuvable → Les drivers ne sont pas installés ou pas à jour.
- Sous WSL2 : installe les derniers drivers NVIDIA côté Windows (pas dans WSL). Redémarre ensuite WSL avec
wsl --shutdown puis relance.
- Sous Linux natif :
sudo apt install nvidia-driver-535 (ou version plus récente)
- GPU AMD ou Intel →
nvidia-smi est spécifique à NVIDIA. Pour AMD, Ollama supporte ROCm mais la config est plus complexe. Pour Intel, c’est CPU only pour l’instant.
Étape 1 — Installer Ollama
Vérifie l’installation :
Le script crée automatiquement un service systemd. Ollama démarrera donc automatiquement au boot.
Étape 2 — Télécharger les modèles
Étape 3 — Exposer Ollama pour Docker
Par défaut, Ollama n’écoute que sur localhost. On crée un fichier “override” pour le rendre accessible à Docker, sans modifier le service original.
Contenu du fichier :
Applique les changements :
Vérifie :
Étape 4 — Installer Docker Compose v2
Si tu as déjà Docker Compose v2 (docker compose version), passe directement à l’étape 5.
Vérifie :
Étape 5 — Déployer Open Notebook
Crée le fichier docker-compose.yml :
Crée le fichier docker.env :
Lance :
- Ouvre http://localhost:8502
- Va dans Models
- Configure les trois entrées suivantes :
C’est prêt ! Tu peux créer ton premier notebook et ajouter des sources (PDF, URL, texte…).
Utilisation
Commandes utiles
Utiliser Ollama en ligne de commande
Pratique pour tester rapidement un prompt sans ouvrir l’interface web.
Chat interactif
Tu entres dans un mode conversationnel. Tape /bye pour quitter.
Question unique (one-shot)
Autres commandes Ollama
API Ollama — intégrations et automatisations
L’API Ollama permet d’intégrer l’IA locale dans tes automatisations (Make, n8n, scripts…).
Générer une réponse (completion)
Le paramètre stream: false retourne la réponse complète d’un coup. Avec stream: true, la réponse arrive token par token (SSE) — non compatible avec Make.
Chat avec historique
Générer des embeddings
Endpoints de diagnostic
Intégration Make
Dans Make, utilise un module HTTP > Make a request :
La réponse JSON contient le champ response avec le texte généré. Tu peux chaîner ce module avec Notion, Google Sheets, Slack, ou n’importe quel autre connecteur Make.
Aller plus loin
Voir les logs Ollama
Installer une version spécifique
Utile si une nouvelle version pose problème. Liste des versions : https://github.com/ollama/ollama/releases
Désinstaller Ollama proprement
Support GPU AMD (ROCm)
Ollama supporte les GPU AMD via ROCm, mais la configuration est plus complexe. Voir la doc officielle.
Dépannage
Problème de permissions sur les volumes
Ollama non accessible depuis Docker
Container Open Notebook qui ne démarre pas
Ressources
Autrement dit
Ollama fait tourner des modèles de langage directement sur ta machine. Open Notebook est l’interface qui les rend utilisables comme NotebookLM — sans cloud, sans abonnement, sans que tes données quittent ton ordinateur.