AI Observatory
Una mappa quotidiana di ciò che viene pubblicato sull’intelligenza artificiale.
← Torna alle ultime pubblicazioni
comunicato aziendale · OpenAI

Advancing voice intelligence with new models in the API

Di cosa parla

OpenAI ha reso disponibili nell'API nuovi modelli vocali che funzionano in tempo reale: ascoltano il parlato, lo trascrivono, lo traducono e possono svolgere ragionamenti per rispondere e interagire. L'idea è offrire esperienze vocali più naturali e capaci di comprendere e trasformare la lingua parlata. Si tratta di strumenti pensati per far parlare e capire meglio le macchine senza dover digitare.

Cosa permette di osservare

Fa riflettere su come la voce possa diventare l'interfaccia principale per servizi e app: quali nuove esperienze si possono creare, quali limiti restano nella comprensione e nella traduzione del parlato, e come cambierà l'uso quotidiano.

voce

Dalla fonte

Explore new realtime voice models in the OpenAI API that can reason, translate, and transcribe speech, enabling more natural and intelligent voice experiences.