Podcast
Écoutez cet article en audio
OpenAI continue de pousser les frontières de l’interaction homme-machine. Le 8 juillet 2026, la société californienne a dévoilé deux nouveaux modèles conversationnels : GPT-Live-1 et GPT-Live-1 mini. Leur particularité ? Ils fonctionnent en mode « full-duplex », c’est-à-dire qu’ils peuvent parler et écouter simultanément, comme le ferait un interlocuteur humain.

Jusqu’ici, le mode vocal avancé de ChatGPT reposait sur une architecture en trois étapes : transcription de la voix en texte, génération d’une réponse par un grand modèle de langage, puis synthèse vocale. GPT-Live intègre ces fonctions de manière plus directe et connecte la voix aux derniers modèles textuels, comme GPT-5.5, pour la recherche, le raisonnement et les tâches agentiques. Le système peut même restituer certaines informations sous forme visuelle.
OpenAI annonce que le mode vocal avancé actuel de ChatGPT sera remplacé par GPT-Live-1 mini par défaut. Les abonnements payants auront accès au modèle plus grand, GPT-Live-1. Atty Eleti, chef de produit de la voix chez ChatGPT, a indiqué avoir tenu des conversations de 30 à 40 minutes avec le système lors de ses promenades. Pour lui, la voix pourrait devenir « l’interface principale de l’informatique » et le futur canal de travaux complexes longue durée.
Avec plus de 150 millions d’utilisateurs qui s’adressent déjà à ChatGPT par la voix, OpenAI vise clairement à transformer l’assistant en compagnon conversationnel quotidien. La concurrence ne dort pas : Apple et d’autres acteurs peaufinent également leurs assistants. Mais en rendant le dialogue aussi naturel qu’une conversation entre deux personnes, OpenAI marque un tournant dans la course à l’IA vocale.
Source : TechCrunch
Commentaires (0)
Aucun commentaire pour le moment.
Soyez le premier à commenter !