Volcengine Speech Synthesis MCP Server
La API de voz masiva de 'TikTok' — genere habla natural con los modelos de voz icónicos de ByteDance.
Pregúntale a la IA sobre este MCP Server
Vinkius AI Gateway soporta streamable HTTP y SSE.

Funciona con todos los agentes de IA que ya usas
…y cualquier cliente compatible con MCP


















¿Qué es el Volcengine Speech Synthesis MCP Server?
El Volcengine Speech MCP Server da a agentes de IA como Claude, ChatGPT y Cursor acceso directo a Volcengine Speech. La API de voz masiva de 'TikTok' — genere habla natural con los modelos de voz icónicos de ByteDance. Potenciado por el Vinkius AI Gateway — sin claves API, sin infraestructura, conecta en menos de 2 minutos.
Volcengine Speech MCP Server: mira tu AI Agent en acción
Capacidades integradas (7)
create_custom_voice
Requires 10-50 high-quality audio recordings of a single speaker. Training takes 1-3 days. Once complete, use the custom voice_type in synthesize_speech. Create a custom voice model from training audio samples
get_audio_formats
Use MP3 for web delivery, WAV for editing, OGG Opus for efficient streaming, or PCM for raw processing. List supported audio output formats
get_task_status
Returns whether processing, completed, or failed. Check status of an async TTS task
list_voices
Essential for choosing the right voice before synthesis. Includes the famous TikTok voice styles. List all available TTS voice models
synthesize_long_text
Ideal for articles, audiobooks, and lengthy documentation. Use this when your text exceeds the standard 1024 character limit. Synthesize speech from long text (over 1024 characters)
synthesize_speech
Supports multiple languages (Chinese, English, Japanese), various voice styles (female, male, child, trendy, news), and adjustable speed/volume. Returns audio data or URL. Ideal for narration, accessibility, multi-language content, and the iconic TikTok voice effects. Convert text to speech using Volcengine TTS
synthesize_ssml
Use SSML tags like <break>, <emphasis>, <prosody> for natural-sounding output with precise timing and intonation control. Convert SSML (Speech Synthesis Markup Language) to speech
Lo que este conector desbloquea
Conecte la Síntesis de Voz Volcengine (plataforma TTS de ByteDance) a cualquier agente de IA y genere habla natural impresionante — incluyendo las voces icónicas de TikTok.
Qué puede hacer
- Texto a Voz — Convierta texto en habla natural
- Voces de TikTok — Use los mismos modelos de voz de los efectos virales de TikTok
- Multi-idioma — Sintetice en chino, inglés, japonés
- SSML — Control fino con pausas, énfasis y prosodia
¿Para quién es?
- Creadores de Contenido — Generen voiceovers para videos y TikToks
- Equipos de Accesibilidad — Añadan habla a apps y sitios web
- Desarrolladores — Integren TTS de calidad TikTok
Preguntas frecuentes
Dale a tus agentes de IA el poder de Volcengine Speech
Accede a Volcengine Speech y a 2.500+ servidores MCP — listos para que tus agentes los usen, ahora mismo. Sin código pegamento. Sin integraciones personalizadas. Solo conecta el Vinkius AI Gateway y deja que tus agentes trabajen.
