La modalità vocale GPT-Live di OpenAI aggiunge allegati di file, progetti e integrazione tra funzionalità
Punti chiave
- •GPT-Live impiega un'architettura vocale full-duplex che consente l'ascolto e la parlata simultanei, supportando comportamenti conversazionali naturali come interruzioni a metà frase e dialoghi sovrapposti.
- •Il modello di punta GPT-Live-1 è disponibile per gli abbonati a pagamento con capacità complete, mentre gli utenti del livello gratuito ricevono GPT-Live-1 mini con capacità di elaborazione ridotte.
- •GPT-Live può instradare attività computazionalmente impegnative verso modelli più potenti come GPT-5.5 mantenendo uno strato vocale reattivo in tempo reale.
- •Le sessioni vocali ora supportano allegati di file, elaborazione delle immagini, funzionalità di memoria, ricerca web e integrazione con la funzione Progetti negli ambienti Work, Codex e desktop.
- •La Libreria ChatGPT attualmente non supporta la ricerca diretta di file o l'aggiunta di file durante le sessioni vocali, rappresentando una limitazione residua nel sistema aggiornato.

OpenAI ha lanciato GPT-Live l'8 luglio 2026, stabilendolo come nuova famiglia di modelli vocali predefiniti per ChatGPT. L'aggiornamento porta allegati di file, integrazione dei progetti, memoria e capacità di ricerca in una parte del prodotto che precedentemente funzionava in larga misura in modo isolato.
Gli utenti possono ora condurre una conversazione vocale con ChatGPT condividendo simultaneamente documenti, eliminando la necessità di passare alla modalità testo per le attività basate sui contenuti. Il cambiamento affronta un punto di attrito di lunga data negli assistenti IA, dove le interazioni vocali sono tipicamente state trattate come un'area funzionale separata piuttosto che come uno strato integrato in grado di accedere agli stessi strumenti e contesto disponibili nei flussi di lavoro basati su testo.
Architettura vocale full-duplex
GPT-Live è una famiglia di modelli vocali full-duplex, ovvero il sistema può ascoltare e parlare contemporaneamente anziché alternare i turni. Ciò permette comportamenti conversazionali naturali come interruzioni a metà frase e dialoghi sovrapposti, che gli assistenti vocali tradizionali basati su turni non potevano gestire senza interrompere o riavviare le risposte. Il modello di punta è GPT-Live-1, disponibile per gli abbonati a pagamento con il set completo di funzionalità. Una variante più leggera, GPT-Live-1 mini, è offerta agli utenti del livello gratuito e condivide la stessa architettura conversazionale ma con capacità di elaborazione ridotte.
GPT-Live può delegare attività computazionalmente intensive a modelli più potenti, tra cui GPT-5.5, mantenendo uno strato vocale reattivo. Questa architettura di instradamento riflette un pattern industriale più ampio in cui interfacce leggere e a bassa latenza orchestrano il lavoro eseguito da modelli di backend più pesanti, una scelta di progettazione che bilancia la reattività in tempo reale con la capacità di ragionamento approfondito.
Allegati di file e integrazione con i Progetti
L'aggiunta più significativa a livello operativo è il supporto agli allegati di file durante le sessioni vocali live. Gli utenti possono allegare file a metà conversazione e far sì che ChatGPT elabori quel contenuto in tempo reale. L'aggiornamento introduce anche l'elaborazione delle immagini, funzionalità di memoria e ricerca web all'interno delle sessioni vocali.
GPT-Live ora si collega alla funzione Progetti di ChatGPT, che permette agli utenti di mantenere un contesto persistente tra le sessioni tramite file archiviati, preferenze e istruzioni personalizzate. Questa integrazione si estende agli ambienti Work, Codex e desktop. Per gli utenti che si affidano a ChatGPT su più superfici — conversazionale, coding e centrata sui documenti — l'integrazione con i Progetti trasforma efficacemente la voce da modalità di interazione autonoma a punto di accesso condiviso in grado di attingere dalla stessa base di conoscenza delle altre interfacce.
Rimane una limitazione: la Libreria ChatGPT, che archivia i documenti separatamente dai Progetti, attualmente non supporta la ricerca diretta di file o l'aggiunta di file durante una sessione vocale.
Evoluzione da Advanced Voice Mode
GPT-Live rappresenta una maturazione incrementale di ciò che OpenAI precedentemente chiamava Advanced Voice Mode, piuttosto che una reinvenzione radicale. Advanced Voice Mode aveva introdotto una prosodia più naturale e una gamma emotiva più ampia nella parlata di ChatGPT, ma operava ancora su un sistema basato su turni. GPT-Live aggiunge connettività strutturale, collegando la voce al più ampio ecosistema del prodotto, inclusi ricerca, memoria, caricamento di file e integrazione con i Progetti. La traiettoria riflette una spesa più ampia tra i provider di IA conversazionale per unificare input vocali, testuali e multimodali sotto un singolo modello di sessione, anziché mantenere capacità parallele con set di funzionalità scollegati.