AI Observatory
Una mappa quotidiana di ciò che viene pubblicato sull’intelligenza artificiale.
← Torna alle ultime pubblicazioni
release software · OpenAI

Introducing next-generation audio models in the API

Di cosa parla

OpenAI ha reso disponibili nella sua interfaccia per sviluppatori nuovi modelli audio che trasformano il testo in voce. Per la prima volta gli sviluppatori possono dire al modello non solo cosa dire, ma anche come dirlo — per esempio “parla come un agente di assistenza empatico” — permettendo di creare agenti vocali con tono e personalità più controllati e adatti a diversi ruoli.

Cosa permette di osservare

Il cambiamento apre domande pratiche: come progettare la voce e il tono degli assistenti per migliorare l'esperienza degli utenti e quali scelte di personalità offrire agli sviluppatori per diversi contesti d'uso.

agentivoce

Dalla fonte

For the first time, developers can also instruct the text-to-speech model to speak in a specific way—for example, “talk like a sympathetic customer service agent”—unlocking a new level of customization for voice agents.