ChatGPT Voice Astra

ChatGPT Voice avec GPT-6 Astra : toutes les nouveautés 2026

Le lancement de GPT-6 Astra le 3 septembre 2026 a également affecté l’une des fonctionnalités les plus reconnaissables de ChatGPT : la voix. OpenAI a abordé l’architecture et les limites du mode vocal le 9 septembre et a ajouté le 23 septembre l’utilisation de plugins et l’accès à ChatGPT Work. Le résultat change le rôle de la voix au sein de ChatGPT : une conversation peut s’appuyer sur des modèles de recherche et de raisonnement plus puissants, et peut être utilisée pour lancer des activités impliquant des documents, des applications associées et des navigateurs.

La distinction technique est importante. GPT-6 Astra n’a pas simplement remplacé le modèle qui gère le dialogue vocal en temps réel. OpenAI continue d’utiliser la famille GPT-Live pour la conversation, tandis que ChatGPT Voice peut s’appuyer sur GPT-5.6 ou GPT-6 Astra pour rechercher des informations ou répondre à des demandes qui nécessitent plus de raisonnement.

GPT-6 Astra rejoint Voice, mais ne remplace pas GPT-Live

OpenAI a présenté GPT-6 Astra, le décrivant comme son modèle le plus avancé et indiquant les progrès dans l’utilisation de l’ordinateur, la navigation sur le Web, le génie logiciel, la cybersécurité, la science et les activités professionnelles. La version a commencé avec un groupe limité d’organisations, avec une extension ultérieure aux utilisateurs des forfaits pris en charge.

Six jours plus tard, la mise à jour Voice est arrivée. Dans les notes de version du 9 septembre, OpenAI écrit : « ChatGPT Voice peut désormais utiliser GPT-5.6 ou GPT-6 Astra lorsqu’il a besoin de rechercher ou de raisonner sur des questions plus difficiles. » L’utilisateur peut choisir le modèle et le niveau de raisonnement via les mêmes commandes que celles utilisées dans le chat textuel.

Cette étape clarifie également ce qu’Astra n’est pas dans Voice. La conversation orale continue de s’appuyer sur les modèles GPT-Live. Astra peut être appelé lorsque la tâche nécessite des capacités autres que celles nécessaires pour maintenir un dialogue fluide et à faible latence.

Cela crée une séparation entre l’interaction et le raisonnement. GPT-Live gère le rapport vocal en temps réel ; GPT-5.6 ou GPT-6 Astra peut répondre aux demandes les plus exigeantes. Pour l’utilisateur, l’expérience reste une conversation, mais différents modèles peuvent fonctionner derrière cette conversation.

Le choix du modèle est proche du chat textuel

La mise à jour du 9 septembre élimine également une différence entre l’interface vocale et l’interface texte. OpenAI a abandonné les couches de raisonnement distinctes Instantané, moyen et élevé qui étaient spécifiques à la modalité vocale. Dans les notes dédiées à ChatGPT Business, l’entreprise précise que le modèle et le niveau de raisonnement sont désormais choisis via les mêmes contrôles que le chat textuel.

C’est un changement moins tape-à-l’œil que l’arrivée d’Astra, mais cela affecte le fonctionnement du produit. La voix n’est plus traitée comme un environnement doté de sa propre hiérarchie de capacités cognitives. Au lieu de cela, il devient une interface à travers laquelle ChatGPT peut accéder, lorsque le plan de l’utilisateur le requiert, aux modèles également disponibles pour d’autres modes d’interaction.

La différence entre parler et écrire se déplace donc vers l’interface. La sélection des capacités de raisonnement suit une logique commune, tandis que la partie conversationnelle conserve un modèle spécialisé pour la voix.

Plugin dans ChatGPT Voice

La deuxième mise à jour est arrivée le 23 septembre. OpenAI a annoncé que GPT-Live prend en charge les plugins sur le Web, iOS et Android. Lors d’une conversation vocale, vous pouvez utiliser les plugins et les applications connectées disponibles pour votre compte, en continuant à voir les réponses écrites dans le chat.

La phrase utilisée par OpenAI dans les notes de version résume l’orientation du produit : « Utilisez des plugins dans Voice et travaillez en parlant. »

La conséquence pratique est qu’une conversation vocale peut impliquer des informations et des fonctions qui ne résident pas exclusivement dans le modèle. Si un compte dispose d’un plugin ou d’une application connectée compatible, Voice peut les utiliser dans les limites des autorisations déjà accordées et des limites fixées par le forfait.

En fait, OpenAI précise que les connexions, autorisations et limites d’utilisation existantes continuent de s’appliquer. L’introduction de la voix n’accorde donc pas automatiquement de nouveaux accès aux données : elle modifie la manière dont l’utilisateur peut interagir avec des outils déjà disponibles sur son compte.

Pour les utilisateurs Libre et partezVoice peut fonctionner dans Chat avec les plugins autorisés par le plan respectif. Les fonctions réellement disponibles dépendent donc de l’abonnement, des plugins installés et des autorisations associées aux services externes.

ChatGPT Work peut être contrôlé en parlant

L’intégration avec ChatGPT Work étend encore l’utilisation de la voix. À partir du 23 septembre, Voice est disponible dans Work sur le Web et sur mobile pour les utilisateurs ayant accès à la fois à Voice et Work.

OpenAI indique explicitement certaines des activités qui peuvent être demandées en parlant : créer des documents, des présentations et des feuilles de calcul, utiliser des applications connectées ou travailler via un navigateur. La voix devient ainsi une porte d’entrée pour des activités pouvant produire un résultat persistant en dehors de la simple conversation.

La continuité entre la voix et le texte est l’un des éléments les plus intéressants de la mise à jour. OpenAI explique : «Lorsque vous terminez un appel vocal dans Work, une tâche inachevée peut continuer sous forme de texte

L’appel vocal ne doit donc pas nécessairement coïncider avec la durée de l’activité. Un utilisateur peut donner des instructions en parlant, interrompre la session vocale et laisser le travail inachevé se poursuivre sous forme de texte.

C’est une différence substantielle par rapport à l’idée originale d’un assistant vocal, construit principalement autour de la séquence questions-réponses. L’entrée peut désormais être utilisée pour décrire un objectif et démarrer une activité en plusieurs étapes.

Ce qui change dans l’usage quotidien

Les nouveautés de septembre présentent trois niveaux distincts. Le premier est la conversation : GPT-Live doit permettre un échange naturel et rapide.

Le second est le raisonnement : GPT-5.6 ou GPT-6 Astra peuvent être utilisés lorsque la demande nécessite une recherche ou un traitement plus exigeant.

Le troisième concerne l’action : les plugins et Work permettent à la conversation d’interagir avec des outils, des données et des environnements externes.

Un exemple aide à comprendre la différence. Demander une brève explication verbalement peut être géré dans le cadre de la conversation en direct. Une demande qui implique une recherche détaillée peut utiliser un modèle comme Astra. Une tâche qui vous oblige à consulter une application connectée ou à produire une présentation dans Work ajoute à la place des outils exploitables à la conversation.

La voix devient ainsi l’un des moyens de contrôler un système composé de différents modèles et instruments. L’utilisateur n’a pas forcément besoin de connaître toutes les étapes techniques qui se déroulent derrière l’interface, mais la distinction reste utile pour comprendre pourquoi les performances, les délais et les limites peuvent évoluer en fonction de la demande.

Les limites quotidiennes changent également

La mise à jour du 9 septembre a modifié les limites d’utilisation de GPT-Live pour les comptes personnels.

Selon les notes de version d’OpenAI, le forfait Go offre jusqu’à trois heures par jour avec GPT-Live-1 mini. De plus, cela va jusqu’à trois heures avec GPT-Live-1. Le forfait Pro à 100 $ offre jusqu’à 15 heures par jour avec GPT-Live-1, tandis que le forfait Pro à 200 $ offre une utilisation illimitée de GPT-Live-1.

OpenAI a également supprimé le passage automatique à GPT-Live mini après avoir atteint la limite vocale pour Plus et Pro. Les modèles disponibles et leurs limites restent liés au forfait de l’utilisateur.

Pour ChatGPT Business, la structure est différente. Les notes de version du 9 septembre indiquent jusqu’à trois heures de GPT-Live-1 pour les licences Business Standard et jusqu’à 15 heures pour les licences Business Premium. L’utilisation supplémentaire du mode vocal est comptée séparément, tandis que la recherche et le raisonnement suivent les limites et les prix du modèle sélectionné.

Ce détail rend encore plus visible la séparation entre le coût de calcul de la conversation vocale et celui des opérations de raisonnement confiées à d’autres modèles.

Astra apporte à Voice des fonctionnalités créées pour des tâches complexes

L’intégration prend plus de poids compte tenu du profil du GPT-6 Astra. OpenAI a conçu le modèle pour des tâches complexes impliquant des logiciels, des navigateurs et des flux de travail professionnels. Lors du lancement le 3 septembre, la société a indiqué qu’Astra pouvait créer des documents, des feuilles de calcul et des présentations en suivant des modèles et des instructions et s’adapter à mesure que l’utilisateur change ses exigences au fur et à mesure de son travail.

La disponibilité de Voice Within Work place ces fonctionnalités derrière une interface vocale. Cela ne signifie pas que chaque phrase prononcée est entièrement traitée par Astra. Cela signifie qu’une session vocale peut accéder à un modèle conçu pour des tâches complexes lorsque le travail l’exige.

C’est cette architecture, plutôt que la seule qualité de voix synthétique, qui distingue les mises à jour de septembre. Le modèle chargé de tenir la conversation ne doit pas nécessairement être le même que celui chargé de résoudre le problème.

De l’assistant vocal à l’interface de travail

Les mises à jour des 9 et 23 septembre déplacent ChatGPT Voice au-delà de la fonctionnalité de conversation. Recherche, raisonnement, plugins et Travail sont reliés à une interface dans laquelle l’utilisateur peut continuer à s’exprimer en parlant.

La transition n’efface pas les différences entre les différentes composantes.

GPT-Live reste le moteur spécialisé dans la conversation vocale ; GPT-5.6 et GPT-6 Astra ajoutent des capacités de recherche et de raisonnement ; les plugins et applications connectées apportent des données et des services externes ; Le travail permet de transformer une instruction en une tâche plus longue et un résultat exploitable.

Astra ne transforme donc pas simplement Voice en un chatbot plus intelligent qui parle. Les mises à jour de septembre construisent une chaîne dans laquelle la voix peut être le début d’un travail qui se poursuit au-delà de la conversation elle-même. La vérification décisive viendra de l’utilisation quotidienne : de la capacité du système à choisir et coordonner sans compliquer modèles, outils et autorisations ce qui, pour l’utilisateur, commence par un geste très simple, celui de parler.