123SUDODocs
Guides

Modèles locaux avec Ollama

Connectez les instances Ollama pour exécuter des modèles open source sans frais de jeton.

9xchat se connecte aux environnements d'exécution Ollama exécutés sur votre ordinateur ou sur un serveur distant de votre réseau. Lorsque vous interrogez un modèle Ollama exécuté sur votre machine, les invites ne sont pas transmises aux API cloud externes et vous ne consommez jamais de crédits 9xchat ni ne payez de frais par jeton.

Les connexions du modèle Ollama sont disponibles sur le bureau (Windows, macOS et Linux). L'utilisation de vos propres modèles Ollama ne nécessite pas d'abonnement ni de crédits 9xchat.

Guide de configuration

1. Installez Ollama

Téléchargez et installez Ollama à partir de ollama.com pour votre système d'exploitation de bureau.

2. Tirez un modèle

Ouvrez votre terminal ou votre invite de commande et extrayez le modèle souhaité :

# General chat models
ollama run llama3.2

# Coding & reasoning models
ollama run deepseek-r1:8b
ollama run qwen2.5-coder:7b

Par défaut, Ollama sert son API localement sur http://localhost:11434.

3. Connectez Ollama dans 9xchat

  1. Dans 9xchat, ouvrez Bibliothèque → Modèles.
  2. Sélectionnez Ollama dans la barre latérale du fournisseur.
  3. 9xchat vérifie automatiquement http://localhost:11434 et répertorie vos modèles.
  4. Si votre instance Ollama s'exécute sur une machine distante ou un port personnalisé, saisissez l'URL dans le champ URL de l'hôte.
  5. Activez les modèles que vous souhaitez disponibles dans le compositeur de chat.

Capacités et limites actuelles

  • Conversations par chat : Vous pouvez basculer entre les modèles cloud et les modèles Ollama par message dans les fils de discussion standard.

  • Outils et MCP : Les modèles Ollama ne prennent actuellement pas en charge les outils agentiques 9xchat. ou appel de fonction du serveur MCP.

  • Espace de travail de code : Le workflow de code multi-fichiers agentique complet nécessite le cloud des modèles capables d'exécuter des outils structurés ; Le chat et les explications du code de base peuvent toujours fonctionner sur les modèles Ollama.

  • Indexation des connaissances locales :DansParamètres → Modèles par défaut, vous pouvez sélectionner Ollama en tant que fournisseur d'intégrations pour indexer les collections de documents localement.

Considérations relatives à la confidentialité

  • En pointant vers localhost ou 127.0.0.1, les requêtes de génération restent entièrement sur votre ordinateur.
  • Si vous configurez une URL d'hôte distant (par exemple http://192.168.1.50:11434), les requêtes voyager sur votre réseau vers cet hôte de destination.
  • Fonctionnalités cloud (telles que la recherche sur le Web, les transcriptions YouTube et l'audio cloud) contactez des services externes même si le modèle de chat que vous avez sélectionné est local.

Dépannage

  • Instance non détectée : Confirmez qu'Ollama est en cours d'exécution et accessible sur http://localhost:11434.
  • Connexions à distance ou Docker : Démarrez Ollama avec OLLAMA_ORIGIN="*" pour autoriser les demandes d'origine croisée provenant de 9xchat.
  • Performances : Si la génération est lente, choisissez un modèle à paramètres plus petits (tels que llama3.2:3b ou 8b) qui s'intègre confortablement dans la RAM/VRAM de votre système.

Sur cette page