GPT-Live : OpenAI dévoile son nouveau modèle vocal qui parle et écoute en même temps

GPT-Live ChatGPT Voice OpenAI 2026

OpenAI franchit une nouvelle étape dans la conversation vocale avec l’IA. GPT-Live est une nouvelle génération de modèles vocaux qui rend les échanges avec l’intelligence artificielle beaucoup plus proches d’une vraie conversation humaine.

GPT-Live : la fin des pauses et des coupures

Jusqu’à présent, les systèmes vocaux d’IA fonctionnaient en cascade : un modèle transcrivait la voix, un autre générait la réponse, un troisième la convertissait à nouveau en parole. Résultat : des réponses lentes, des pauses longues et une conversation souvent hachée. GPT-Live rompt avec cette approche en adoptant une architecture full-duplex. Le modèle écoute et parle en même temps, sans interrompre le fil de la conversation. Il peut manifester son attention avec des expressions naturelles comme « mmh » ou « oui », participer à des échanges rapides, ou rester silencieux lorsque l’utilisateur a besoin d’un instant pour réfléchir.

Le modèle vocal le plus intelligent d’OpenAI à ce jour

GPT-Live n’est pas seulement plus fluide, il est aussi bien plus intelligent. Lorsqu’une question nécessite une recherche sur le Web, un raisonnement approfondi ou un traitement complexe, le modèle délègue discrètement la tâche en arrière-plan à GPT-5.5, le dernier modèle de pointe d’OpenAI, et réintègre la réponse dans la conversation lorsqu’elle est prête. Pendant ce traitement, GPT-Live continue de dialoguer, sans rupture ni silence gênant. À terme, OpenAI prévoit de mettre continuellement à jour le modèle utilisé en arrière-plan au fur et à mesure des nouvelles versions.

Deux versions lancées simultanément dans le monde entier

OpenAI déploie dès aujourd’hui deux versions de GPT-Live : GPT-Live-1 et GPT-Live-1 mini. Ces deux modèles sont progressivement accessibles à l’ensemble des utilisateurs de ChatGPT dans le monde. Une intégration via l’API est également prévue prochainement pour les développeurs et les entreprises. OpenAI a ouvert un formulaire d’inscription pour être informé en priorité lors de la disponibilité API.

Toutes les informations ainsi que la présentation officielle sont à retrouver sur le site d’OpenAI : Présentation de GPT‑Live

Une architecture pensée pour la conversation naturelle

Contrairement aux modèles vocaux au tour par tour introduits avec le mode vocal avancé de GPT-4o, GPT-Live traite et génère l’audio en temps réel dans un modèle unique. Cette conception élimine les pertes d’information entre les différentes couches de traitement et réduit drastiquement la latence. Le résultat est une expérience vocale avec laquelle il est « étonnamment facile de converser », selon les termes mêmes d’OpenAI. La fluidité atteinte se rapproche désormais d’un échange entre deux personnes.

Vers une IA aussi réactive qu’un collègue humain

La vision affichée par OpenAI est claire : rendre la collaboration humain-IA aussi fluide et réactive que le travail avec une autre personne, pendant que le raisonnement et l’exécution de tâches complexes se déroulent en arrière-plan sans interruption. GPT-Live n’est qu’une première étape. OpenAI anticipe que ces recherches permettront à terme d’utiliser la voix pour des tâches de plus en plus longues, complexes et agentiques. La course à l’IA vocale conversationnelle vient de franchir un nouveau palier.

La rédaction ICONIQ. IA

Commentaires

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *