Skip to main content
Il text-to-speech trasforma il testo scritto in audio parlato. Scegli un modello TTS, seleziona una voce supportata da quel modello, invia il testo a /audio/speech e salva la risposta audio binaria. Usa questa guida per la generazione vocale standard. Se vuoi creare audio a partire da una voce di riferimento personalizzata, consulta il Voice Cloning.

Utilizzo di Base

Scelta di Modello e Voce

Le voci sono specifiche per modello. Il valore di voice deve essere valido per il model che scegli. Usa la pagina Modelli Text-to-Speech per esplorare i modelli e le voci disponibili. Il selettore delle voci elenca gli ID esatti da passare nella richiesta.
Gli ID delle voci fanno distinzione tra maiuscole e minuscole. Se cambi modello TTS, aggiorna contemporaneamente il valore di voice.

Struttura della Richiesta

Consigli per la Produzione

  • Metti in cache l’audio generato quando il testo sorgente e la voce vengono riutilizzati.
  • Normalizza e revisiona il testo prima della sintesi. La punteggiatura influenza ritmo e intonazione.
  • Salva l’output con l’estensione di file corretta in base al formato di risposta del modello.

Risorse Correlate