Retour au blogIntelligence artificielle

GPT-Live : OpenAI ouvre Codex et ChatGPT au pilotage vocal full duplex

CZSyn
23 juillet 2026
6 min

OpenAI étend GPT-Live, son mode vocal en full duplex, à Codex et à ChatGPT sur desktop. Vraie avancée pour coder ou gadget de démo ? Notre décryptage.

Un développeur parle à voix haute devant un microphone de bureau pendant qu'un agent de codage IA écrit du code en temps réel sur son écran
Ce qu'il faut retenir.
  1. OpenAI étend GPT-Live, son mode de conversation vocale en full duplex, à Codex, son agent de codage, et à ChatGPT sur desktop, ce qui permet de piloter du code à la voix sans couper le fil de la conversation, selon VentureBeat.
  2. Le full duplex change la donne face aux modes vocaux classiques : l'agent écoute en continu et peut être interrompu en pleine réponse, au lieu du fonctionnement en aller-retour strict des modes vocaux half duplex.
  3. OpenAI n'a pas communiqué de détails précis sur les paliers d'abonnement ou la disponibilité géographique de cette extension au moment de l'annonce rapportée par VentureBeat.

Résumé généré par IA

En juillet 2026, OpenAI a étendu GPT-Live, son mode de conversation vocale en full duplex, à Codex, son agent de codage, ainsi qu'à ChatGPT sur les applications de bureau, rapporte VentureBeat. Concrètement, vous pouvez désormais parler à voix haute à votre agent de développement, l'interrompre en pleine réponse et enchaîner des instructions sans repasser par le clavier à chaque tour de la conversation.

Si vous découvrez le nom, un rappel s'impose. Codex est l'agent de codage d'OpenAI, disponible en CLI, en extension IDE et dans une interface web, capable d'écrire du code, de lancer des tests, de corriger des erreurs et de proposer des diffs à partir d'une consigne en langage naturel. ChatGPT propose de son côté depuis plusieurs années un mode vocal, connu sous le nom d'Advanced Voice Mode, qui permet de converser à l'oral avec l'assistant. GPT-Live pousse ce principe plus loin en full duplex : l'IA écoute en continu pendant qu'elle parle, au lieu de fonctionner en aller-retour strict où vous parlez, elle répond, puis vous reprenez la parole. C'est la différence entre un talkie-walkie et un appel téléphonique ordinaire.

Ce que le full duplex change vraiment

La bascule technique mérite d'être expliquée, parce qu'elle n'est pas cosmétique. Dans un échange vocal classique en half duplex, un seul flux audio circule à la fois : tant que le modèle parle, votre micro est ignoré, ou vous devez appuyer sur un bouton pour reprendre la main. En full duplex, les deux flux, votre voix et celle de l'agent, coexistent. Vous pouvez donc couper l'IA au milieu d'une explication pour lui dire non, pas cette fonction, l'autre, sans attendre qu'elle termine sa phrase.

Pour un usage de développement, c'est la différence entre dicter un cahier des charges à un stagiaire poli qui vous laisse toujours finir, et discuter avec un collègue qui réagit en temps réel. Appliqué à Codex, cela signifie que vous pouvez suivre l'exécution d'une tâche à voix haute : demander l'état d'avancement, réorienter l'agent en cours de génération, ou lui faire relire un extrait de code sans couper la session. Appliqué à ChatGPT sur desktop, GPT-Live devient une sorte de canal de contrôle vocal permanent, ouvert en fond pendant que vous travaillez sur autre chose.

Comment ça se traduit dans votre usage quotidien

OpenAI n'a pas détaillé, dans les éléments rapportés par VentureBeat, les modalités précises de déploiement : paliers d'abonnement concernés, disponibilité par langue ou par pays, limites de durée de session. Nous vous recommandons donc de vérifier la disponibilité de GPT-Live directement dans vos applications ChatGPT et Codex avant de bâtir un workflow dessus. Ce que l'on peut en revanche anticiper sans grand risque, c'est le type de scénarios que ce mode cible :

  • Revue de code à voix haute pendant que vous gardez les mains sur un second écran ou un carnet de notes.
  • Pilotage d'une session Codex longue, migration ou refacto, où vous voulez interrompre l'agent dès qu'il part dans la mauvaise direction, plutôt que de le laisser terminer une réponse inutile.
  • Débogage en pair programming à distance, où l'un des deux interlocuteurs pilote l'agent à la voix pendant que l'autre lit l'écran partagé.
  • Intervention mains occupées, par exemple pendant une manipulation matérielle, où taper au clavier n'est pas pratique.

Notre lecture chez CZSyn

L'angle qui nous intéresse ici n'est pas la prouesse technique du full duplex, elle est réelle et suit la même trajectoire que les API vocales temps réel qu'OpenAI développe depuis l'Advanced Voice Mode. La vraie question, c'est de savoir si parler à un agent de codage rend le travail plus fluide, ou si cela reste une démonstration impressionnante en conférence qui ne survit pas à un open space bondé.

Notre avis, en l'état des informations disponibles : le full duplex a un intérêt réel pour piloter et orienter un agent, moins pour écrire du code précis. Dicter à voix haute « renomme cette variable en camelCase et ajoute un test unitaire » fonctionne bien, parce que c'est une instruction de haut niveau que l'agent peut interpréter. Épeler un nom de variable exact, un chemin de fichier ou une expression régulière à la voix reste plus lent et plus sujet à erreur que de le taper. Le clavier ne va pas disparaître de sitôt, mais un canal vocal supplémentaire, qui n'interrompt pas votre flux quand vous voulez recadrer l'agent, est un vrai gain d'ergonomie sur les tâches de supervision plutôt que sur l'exécution fine.

Deux réserves nous semblent importantes pour une PME française qui voudrait adopter ce mode. D'abord la confidentialité : parler du contenu d'un code propriétaire à voix haute dans un espace de travail partagé n'est pas neutre, surtout sur des projets sous clause de confidentialité. Ensuite la langue et l'accent : les modes vocaux d'OpenAI progressent vite, mais un test en conditions réelles, avec votre équipe et son français du quotidien, reste le seul moyen de savoir si l'expérience tient la route au-delà de la démo. Notre recommandation : testez GPT-Live sur une tâche encadrée, une revue de pull request ou un debug ciblé, avant de l'intégrer à un workflow de production.

Vous voulez intégrer des agents IA vocaux à votre workflow de développement ?

Nous accompagnons les équipes techniques dans l'adoption d'agents de codage IA, du choix de l'outil à l'intégration dans vos process métier. Audit gratuit sous 24h.

06 64 81 45 03

ou programmez votre appel · devis gratuit en ligne

29 avis 5/5 · +200 projets livrés · réponse express

Sources primaires

Un projet en tête ?

Diagnostic gratuit, devis ferme, et un seul interlocuteur du premier appel à la mise en ligne.