Voz
Texto a voz por el contrato de OpenAI, tarifado por caracteres del texto de entrada.
La llamada
POST /v1/audio/speech recibe { model, input, voice } y devuelve los bytes del MP3 directamente — sin paso intermedio de descarga, a diferencia de imagen y video.
audio = client.audio.speech.create(
model="voice-standard",
input="Bienvenido a Truo AI.",
voice="es-MX",
)
audio.write_to_file("saludo.mp3")Los dos modelos
El consumo se mide por caracteres del texto que mandás, no por duración del audio, así que el costo es predecible antes de generar.
| Modelo | Para qué | Desde el plan |
|---|---|---|
| voice-standard | Narración clara y multi-idioma | start |
| voice-expressive | Emoción y ritmo, para doblaje y personajes | pro |