Installer Ollama
Ouvrez un terminal et lancez la commande pour votre système. Vous pouvez aussi télécharger l’installateur sur ollama.com.
irm https://ollama.com/install.ps1 | iex
curl -fsSL https://ollama.com/install.sh | sh
Télécharger un modèle et le tester
Cette commande télécharge Gemma 4 de Google et ouvre une discussion dans votre terminal. Écrivez un message pour vérifier, puis /bye pour sortir. Les petits modèles tournent sur un portable normal ; les plus gros demandent plus de mémoire.
ollama run gemma4
Installer Claude Code
Passez cette étape si vous l’avez déjà. Vérifiez ensuite avec claude --version.
irm https://claude.ai/install.ps1 | iex
curl -fsSL https://claude.ai/install.sh | bash
Connecter Claude Code à Ollama
Une seule commande. Ollama démarre Claude Code et le branche sur votre modèle grâce à son API compatible Anthropic.
ollama launch claude
Vous préférez le faire à la main ? Définissez ces variables, puis lancez Claude Code avec votre modèle (exemple de la doc Ollama) :
Réglage manuel (optionnel)
Shell macOS / Linux. Sous Windows PowerShell, utilisez $env:ANTHROPIC_AUTH_TOKEN="ollama", etc.
export ANTHROPIC_AUTH_TOKEN=ollama export ANTHROPIC_API_KEY="" export ANTHROPIC_BASE_URL=http://localhost:11434 claude --model qwen3.5
Donner assez de contexte au modèle
Pour les outils de code, Ollama recommande une fenêtre de contexte d’au moins 64 000 tokens pour que le modèle garde votre projet en tête. Dans l’application Ollama, utilisez le curseur de longueur de contexte dans les réglages, ou démarrez le serveur ainsi. Plus de contexte = plus de mémoire ; vérifiez avec ollama ps.
OLLAMA_CONTEXT_LENGTH=64000 ollama serve
📄 Recevoir le guide PDF
Entrez votre email et téléchargez la version imprimable. Vous recevrez aussi les nouveaux guides. Désinscription à tout moment.