API de Audio · STT + TTS · USDT

Voz entrada,
Voz salida.

Convierte la voz de tus clientes en texto y las respuestas de la IA en voz natural. 5+ idiomas: español, portugués, chino, inglés y árabe.

🎤
● Disponible

Voz a texto (STT)

Transcribe audio con OpenAI Whisper. 90+ idiomas, incluye acentos de LATAM.

curl -X POST https://zetta-api.com/api/v1/audio/transcriptions \ -H "Authorization: Bearer $KEY" \ -F file=@audio.mp3 \ -F model="whisper-1"
$0.006 / minuto · detección automática de idioma
🔊
⚠ Beta

Texto a voz (TTS)

Convierte texto en 4 voces naturales. OpenAI estándar + ElevenLabs premium (optimizado para español y portugués).

curl -X POST https://zetta-api.com/api/v1/audio/speech \ -H "Authorization: Bearer $KEY" \ -d '{"model":"tts-1","input":"Hola","voice":"alloy"}'
$15 / 1M caracteres (OpenAI) · ElevenLabs aparte

// Idiomas soportados

🇪🇸 ES (Castellano + LATAM) 🇧🇷 PT-BR 🇨🇳 ZH-CN 🇺🇸 EN 🇸🇦 AR + 85 más (Whisper)

// Casos de uso

📞
Notas de voz de WhatsApp a texto → respuesta con IA
🎓
Transcribe reuniones y la IA hace el resumen
🎙️
Subtítulos de podcast (traducción a 5 idiomas)
🛒
Respuestas de voz para atención al cliente, ahorra 50% de personal

Empieza ahora

Regístrate gratis — bono de bienvenida en tu primera recarga

Registro gratis → Ver documentación API