Ce qui se passe
Ollama v0.34.0 ajoute une intégration à ChatGPT Desktop : les modèles servis par Ollama s'utilisent directement dans ce client, la configuration se faisant depuis l'application Ollama sur macOS. La note de version le formule comme un choix de continuité — garder son environnement de travail habituel tout en faisant tourner des modèles ouverts.
Trois autres points dans la même version :
- Sorties structurées plus rapides sur Apple Silicon. C'est le chemin qu'on emprunte dès qu'un modèle alimente du code plutôt qu'un humain : un schéma JSON imposé, une réponse contrainte, et une latence qui se paie à chaque appel.
- Recherche d'outils (tool search) pour les clients compatibles OpenAI. Utile quand on expose une longue liste d'outils MCP et qu'on ne veut pas tous les envoyer à chaque tour.
- Images correctement gérées à travers les réponses compactées.
Ce que ça change
L'architecture ne bouge pas : Ollama reste un serveur local exposant une API compatible OpenAI. Ce qui se déplace, c'est le point de branchement — la conversation se déroule dans un client propriétaire, pendant que le modèle et les poids restent sur la machine. Cela vaut le détour par les réglages pour savoir ce qui transite réellement vers l'éditeur du client.
À retenir
Après la mise à jour, vérifiez que le serveur répond bien :
curl http://localhost:11434/api/tagsPuis rejouez une génération à sortie structurée que vous trouviez lente. C'est le seul gain de cette version qui se mesure avant et après, sur votre matériel.
Source : Ollama v0.34.0