Un iMac avec l'application ChatGPT ouverte et un badge modèle local, un llama lumineux flottant au-dessus du clavier

ChatGPT Desktop accepte enfin tes modèles IA locaux

Ollama 0.34 branche tes modèles IA locaux dans l'application ChatGPT sur Mac : l'interface que tu connais, tes données qui restent chez toi. Mode d'emploi.

Tu as une machine correcte, tu as installé des modèles IA en local, et pourtant tu continues à ouvrir ChatGPT parce que son interface est agréable ? C'était le dilemme classique : le client d'OpenAI d'un côté, la confidentialité de tes données de l'autre. Ollama 0.34, sorti le 5 septembre 2026, fait tomber ce mur. La petite application qui fait tourner des modèles d'intelligence artificielle sur ton propre ordinateur se branche maintenant directement dans l'application ChatGPT pour ordinateur.

Concrètement : tu gardes l'interface de ChatGPT que tu connais par cœur, mais les réponses viennent d'un modèle installé sur ta machine. Tes questions, tes documents, ta vie privée : rien ne sort de chez toi.

De quoi on parle exactement

Ollama est un logiciel libre très populaire (plus de 180 000 étoiles sur GitHub, licence MIT) qui simplifie une chose normalement pénible : faire tourner un modèle d'IA sur son ordinateur. Un modèle IA de ce type, appelé LLM pour « grand modèle de langage », est le moteur qui génère les réponses de ChatGPT ou Claude. Ollama le télécharge et le fait tourner chez toi, derrière une interface simple.

Depuis juillet 2026, l'application Ollama a aussi une vraie interface graphique sur Mac et Windows, avec une liste d'applications compatibles : Claude Desktop, Codex, OpenCode, Cline, Goose. Tu choisis un modèle, tu cliques, l'application tierce est configurée automatiquement. La version 0.34 ajoute l'application ChatGPT à cette liste, et c'est une première : ChatGPT est le client le plus utilisé au monde, et il n'avait jamais officiellement accepté de parler à un modèle local.

L'application Codex configurée par Ollama : le sélecteur de modèle affiche un modèle exécuté localement.

Documentation officielle d'Ollama : la documentation officielle qui illustre cette capture.

Le problème que ça résout

Aujourd'hui, utiliser ChatGPT veut dire envoyer tes messages aux serveurs d'OpenAI. Pour la plupart des usages, pas de souci. Mais il y a des cas où tu ne veux rien envoyer : un dossier médical, des documents de travail confidentiels, des notes personnelles, ou simplement l'envie de garder tes conversations pour toi.

La réponse habituelle était d'utiliser une autre interface, pensée pour l'IA locale. Ça marche, mais tu perds les automatismes de ChatGPT : l'historique, les raccourcis clavier, les petites habitudes prises depuis des années. Avec cette nouveauté, tu gardes l'interface que tu connais et tu changes juste le moteur. C'est un peu comme garder le tableau de bord de ta voiture et remplacer le moteur : le conducteur, lui, ne change pas ses gestes.

Deuxième bénéfice : la facturation. Un modèle local ne coûte rien à l'usage après le téléchargement initial. Tu peux discuter, faire résumer des centaines de pages, générer du texte à longueur de journée sans regarder un compteur d'abonnement.

Comment ça marche

Pas de magie : Ollama installe sur ton Mac un petit serveur local, une porte d'entrée sur ton propre ordinateur qui parle exactement le même langage que l'API d'OpenAI. Quand tu lances le raccordement, Ollama configure l'application ChatGPT pour envoyer ses questions à cette adresse locale au lieu des serveurs d'OpenAI.

L'application ChatGPT croit parler à OpenAI, mais la conversation ne quitte jamais ta machine. Le modèle tourne sur ta puce graphique, tes données restent dans tes fichiers. Le seul prérequis côté matériel : un Mac assez récent pour faire tourner un modèle correctement, typiquement une puce Apple M avec au moins 16 Go de mémoire.

Petite limite assumée par la documentation d'Ollama : cette passerelle est pour l'instant réservée à l'application ChatGPT sur macOS. Sur Windows, le raccordement n'est pas encore proposé. Linux n'est pas concerné non plus pour la partie application.

Demander des changements en annotant directement une page ouverte dans l'application.

Documentation officielle d'Ollama : la documentation officielle qui illustre cette capture.

Comment l'installer chez toi

La procédure officielle tient en trois étapes. Tout se fait depuis l'application Ollama, sans fichier de configuration ni ligne de commande.

  • Télécharge et installe Ollama depuis le site officiel ollama.com, puis ouvre l'application.
  • Télécharge un modèle : dans la barre de recherche de l'application, choisis un modèle adapté à ta machine (un modèle « 8B » passe sur 16 Go de mémoire, un « 27B » demande davantage).
  • Dans l'application Ollama, ouvre la section Apps, active ChatGPT, et laisse l'application faire le raccordement. Si ChatGPT n'est pas installée, Ollama propose de le faire.

Pour changer de modèle plus tard, c'est dans les réglages d'Ollama, section Apps : tu choisis le modèle, tu redémarres ChatGPT, et l'interface utilise le nouveau moteur.

La même mécanique existe pour les autres applications de la liste : l'application Codex d'OpenAI se lance avec une seule commande, ollama launch codex-app, avec le modèle de ton choix, local ou hébergé dans le cloud d'Ollama. Un système de restauration rend à chaque application sa configuration d'origine quand tu débranches le modèle local.

Cline, un assistant de programmation, connecté à un modèle servi par Ollama en local.

Documentation officielle d'Ollama : la documentation officielle qui illustre cette capture.

Les modèles qui t'attendent

Le catalogue d'Ollama compte aujourd'hui les familles open source connues : Gemma de Google, Qwen d'Alibaba, DeepSeek, GLM, Kimi, MiniMax, Mistral, et les modèles gpt-oss qu'OpenAI a elle-même publiés en open source. La version 0.34 ajoute au passage le support de Gemma 4 avec images et audio sur Mac.

Si ta machine est juste pour l'IA locale, un modèle « 8B » (8 milliards de paramètres, la taille de son « cerveau ») tourne bien sur 16 Go de mémoire. Un modèle plus gros donne de meilleures réponses mais demande une machine costaud. Et si tu veux tester un gros modèle sans le télécharger, Ollama propose des modèles hébergés sur son cloud, marqués du suffixe cloud dans le catalogue.

✉️ Un moment, avant de continuer la lecture…

Le rendez-vous du dimanche : un extrait de la chronique « Un pavé dans la tech », les 4-5 infos qui comptent et un aperçu de la semaine à venir. Inscription gratuite, désinscription en un clic.

Le choix du modèle reste le nerf de la guerre : en français, la qualité varie sensiblement d'une famille à l'autre, et un modèle trop petit hallucine (il invente des réponses avec aplomb). Commence petit, monte en taille si le résultat te frustre.

Les limites, soyons honnêtes

D'abord, la force brute. Un modèle local sur un Mac de 16 Go n'a pas la puissance des plus gros modèles du cloud : sur des raisonnements complexes ou des documents très longs, l'écart se sent. C'est excellent pour le quotidien, pas pour remplacer un abonnement haut de gamme sur des tâches lourdes.

Ensuite, certaines fonctions de l'application ChatGPT restent liées aux serveurs d'OpenAI : la recherche web intégrée, la génération d'images, la mémoire de ton compte. Le raccordement change le moteur de conversation, pas les services en ligne annexes. Le retour d'expérience des premiers utilisateurs le confirme : les fonctions propres à OpenAI ne fonctionnent qu'avec les modèles d'OpenAI.

Enfin, il y a un piège d'usage signalé par plusieurs utilisateurs sur le forum d'OpenAI : une fois branché sur un modèle local, l'application ChatGPT peut sembler bloquée sur ce modèle, sans bouton évident pour revenir au mode normal. La parade est documentée : la commande ollama launch codex-app avec l'option restore remet les réglages d'origine, et quitter Ollama pendant que ChatGPT est connectée restaure aussi sa configuration.

Garde donc un réflexe simple : note comment revenir en arrière avant de bidouiller.

Pour qui, vraiment

Si tu as un Mac récent et que tu te demandais si l'IA locale était faite pour toi : c'est la porte d'entrée la plus simple qu'on ait vue jusqu'ici. Tu testes en dix minutes, avec l'interface que tu connais déjà, sans carte bancaire et sans compte supplémentaire.

Si tu es déjà équipé d'un serveur d'IA locale, l'intérêt est plus fin : c'est un client de plus qui parle à ton serveur, mais l'application ChatGPT apporte une ergonomie que les interfaces alternatives n'ont jamais vraiment égalée.

Et si ta machine date un peu, ne force pas : un modèle local lent est pire qu'un modèle cloud. Chez nous, un LLM sous 7 tokens par seconde (7 mots environ par seconde) n'est pas jouable au quotidien. Mieux vaut un petit modèle rapide qu'un gros modèle qui rame.

Ollama 0.34 ne réinvente pas l'IA locale : il supprime la dernière friction qui retenait le grand public. Le client le plus populaire du monde accepte désormais de parler à ton propre ordinateur, et ça, ça change la donne pour la vie privée de tous les jours. Il ne te reste qu'à vérifier la mémoire de ta machine et à te lancer.

Sources

Release v0.34.0 d'Ollama (GitHub) : la note de version officielle d'Ollama 0.34.0 sur GitHub, qui annonce le raccordement de ChatGPT Desktop et l'amélioration des sorties structurées sur Apple Silicon.

Documentation officielle d'Ollama (docs.ollama.com) : la documentation officielle d'Ollama sur les intégrations, dont l'application Codex et les commandes de lancement et de restauration.

AppSelfHost, l'analyse de la version 0.34.0 : l'analyse détaillée de la version 0.34.0 (contenu des nouveautés, contexte macOS et compatibilité Windows) publiée par AppSelfHost le 10 septembre 2026.

Forum OpenAI, retour d'expérience sur le blocage du modèle local : le fil d'expérience d'un utilisateur dont l'application ChatGPT est restée bloquée sur le modèle local, avec la méthode de retour en arrière.

Open WebUI, la façade qui transforme Ollama en service IA (article interne) : notre pas-à-pas pour installer Ollama et Open WebUI chez toi, l'alternative quand tu veux une interface dédiée à l'IA locale.

DeepSeek, GLM ou Mistral : quel modèle écrit le mieux le français ? (article interne) : notre test en conditions réelles des modèles open source pour écrire du français.



Recherche, relecture et illustration assistées par IA. Le contenu reflète le travail éditorial de la rédaction.

No comments yet