Déploiement local du grand modèle Ollama

Déployez vous-même un grand modèle en local avec Ollama pour un usage illimité des fonctionnalités AI.

Déployer Ollama avec Docker

  1. Installez l'application de bureau Docker Desktop (si vous ne la connaissez pas, recherchez un tutoriel d'installation).
  2. Recherchez ollama sur Docker Hub, puis téléchargez et lancez l'image.
  3. Une fois l'image lancée, exécutez la commande suivante dans le terminal pour télécharger un modèle (vous pouvez choisir le modèle open source de votre choix) :
    # qwen2.5:1.5b est le nom du modèle ; vous pouvez en rechercher un autre et le remplacer
    docker exec -it ollama ollama run qwen2.5:1.5b
    

  4. Attendez la fin du téléchargement du modèle. Pour autoriser l'accès cross-origine de l'extension, relancez le conteneur avec la commande suivante :
    docker run -d -v ollama:/root/.ollama -p 11434:11434 -e OLLAMA_ORIGINS="*" --name ollama ollama/ollama
    
    Si un message indique que le conteneur existe déjà, supprimez d'abord le conteneur existant, puis relancez la commande ci-dessus.
  5. De retour dans les paramètres de l'extension, testez la connexion à Ollama.