openai.com détecté sur le web

OpenAI ouvre GPT-Live aux fichiers et Projects en voix

openai ai-business

TL;DR

  • GPT-Live dans ChatGPT Voice accepte désormais l'upload de fichiers et l'analyse de leur contenu pendant une conversation vocale.
  • Le mode voix peut puiser dans les Projects en référençant les chats récents, sources et instructions du projet.
  • Sur Enterprise, Edu et Healthcare, Live devient la voix par défaut dès qu'un owner active Voice, sans passer par l'Early Model Access.

Le mode voix de ChatGPT commence à ressembler à une vraie interface de travail plutôt qu'à un simple assistant conversationnel. Selon les release notes d'OpenAI, reprises par Releasebot, GPT-Live dans ChatGPT Voice accepte désormais l'upload de fichiers et l'accès aux Projects. Concrètement, on peut charger un document en pleine conversation vocale pour en analyser le contenu ou poser des questions dessus, et la voix peut puiser dans les chats récents, sources et instructions d'un Project existant.

Le second volet, plus discret mais probablement plus structurant, concerne les workspaces Enterprise, Edu et Healthcare. Sur ces plans, Live devient l'expérience voix par défaut dès qu'un workspace owner active Voice: l'ancienne étape par l'Early Model Access setting n'est plus requise. Autrement dit, la voix full-duplex de GPT-Live sort du statut expérimental pour devenir le mode standard dans les environnements les plus régulés que vend OpenAI.

Ce qui rend l'ajout intéressant, c'est le point de contact entre voix et données propres. Jusqu'ici, dicter à ChatGPT relevait surtout d'une interaction éphémère; ancrer la voix dans les fichiers chargés et les Projects rapproche l'outil des cas d'usage terrain où l'on préfère parler à un assistant en gardant les mains libres. Pour les équipes qui ont déjà organisé leurs prompts et documents en Projects, c'est une nouvelle interface d'accès, sans travail préparatoire.

La réserve honnête, c'est que la note reste courte. Elle ne précise ni les formats de fichiers acceptés, ni les tailles limites, ni les garanties de conformité pour les documents ainsi chargés par la voix, ce qui n'est pas anodin quand on cible explicitement Healthcare et Edu. Rien non plus sur ce qui change, ou pas, côté grand public.

Reste que la trajectoire est lisible: OpenAI banalise la voix en entreprise pendant que Microsoft pousse Copilot Voice et que Google avance Gemini Live. Le terrain de jeu se déplace du 'quel modèle parle le mieux' vers 'quel assistant vocal sait vraiment lire vos documents et vos projets'.