Texto a voz

Cuándo usarlo

Usa TTS para convertir texto en audio: narraciones, feedback hablado, prototipos de asistentes, mensajes de accesibilidad o generación de audios cortos dentro de una app.

Modelo y endpoint

Endpoint POST /audio/speech
Modelo tts
Uso orientativo 1% / minuto

Ejemplo con curl

curl https://inference.devexpert.io/v1/audio/speech \
  -H "Authorization: Bearer $DEVEXPERT_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts",
    "voice": "alloy",
    "input": "Bienvenido a DevExpert Inference. Este audio se ha generado desde la API."
  }' \
  --output respuesta.mp3

Ejemplo en TypeScript

import fs from "node:fs/promises";
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.DEVEXPERT_API_KEY,
  baseURL: "https://inference.devexpert.io/v1",
});

const audio = await client.audio.speech.create({
  model: "tts",
  voice: "alloy",
  input: "Tu resumen diario ya está listo.",
  response_format: "mp3",
});

const buffer = Buffer.from(await audio.arrayBuffer());
await fs.writeFile("respuesta.mp3", buffer);

Ejemplo en Python

import os
from pathlib import Path
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["DEVEXPERT_API_KEY"],
    base_url="https://inference.devexpert.io/v1",
)

response = client.audio.speech.create(
    model="tts",
    voice="alloy",
    input="Tu resumen diario ya está listo.",
    response_format="mp3",
)

Path("respuesta.mp3").write_bytes(response.read())

Errores habituales

  • Generar textos muy largos cuando solo necesitas una frase corta.
  • No guardar la respuesta como binario.
  • Usar una voz no soportada por el proveedor.