> ## Documentation Index
> Fetch the complete documentation index at: https://api-docs.voicecheap.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Texto a voz

> Utilice la herramienta de texto a voz cuando necesite generar audio de voz a partir de texto sin crear un proyecto de doblaje completo.

# Texto a voz

Utilice texto a voz cuando desee audio hablado a partir de texto sin pasar por el flujo de trabajo completo de doblaje de video. VoiceCheap genera el audio con Fish Audio S2.1 Pro a través de Vercel AI Gateway. Esta herramienta tiene un modelo de producción fijo y no utiliza un modelo de respaldo.

## Vista previa pública y herramienta de espacio de trabajo

La página de inicio pública permite a los visitantes buscar y escuchar la biblioteca de voces multilingüe. Generar audio, descargar archivos MP3, ver el historial y guardar una voz clonada requiere una cuenta de VoiceCheap.

La herramienta autenticada admite:

* 41 voces multilingües seleccionadas con acentos variados
* nombres de voz, acentos y estilos de habla buscables
* siete preajustes de entrega: predeterminado, alegre, tranquilo, narrador, dramático, susurro y enérgico
* clones de voz reutilizables en planes de pago
* un selector de voz buscable con reproducción de vista previa integrada
* un reproductor de audio centrado en la transcripción basado en el patrón de interacción de la interfaz de ElevenLabs
* resaltado sincronizado con la reproducción basado en marcas de tiempo medidas a partir del audio generado
* historial de generación y descargas de MP3

Los preajustes de entrega se traducen en etiquetas de acción de lenguaje natural de S2.1 Pro. Por ejemplo, Susurro envía una dirección explícita entre corchetes antes de cada fragmento de texto generado para que el modelo aplique la entrega solicitada.

El resultado reproducible aparece tan pronto como termina la generación. VoiceCheap luego analiza el MP3 guardado en segundo plano para obtener marcas de tiempo reales de inicio y fin para sus palabras habladas. Esas marcas de tiempo se almacenan en caché con el elemento del historial, por lo que las solicitudes simultáneas comparten un análisis y la reproducción de un resultado existente no procesa repetidamente el mismo audio. Si la sincronización no está disponible temporalmente o el idioma hablado no se puede alinear de manera confiable, la reproducción y la descarga continúan funcionando y la transcripción permanece estática en lugar de mostrar el resaltado estimado.

## Clonación de voz guardada

La clonación de voz utiliza la API del modelo específico del proveedor de Fish Audio porque la generación de voz de AI Gateway no expone la creación de modelos. Las muestras de voz deben contener de 10 a 120 segundos de voz clara de un solo hablante. Los usuarios deben confirmar que tienen permiso para clonar la voz.

Cuando las muestras seleccionadas superan los 120 segundos combinados, los usuarios pueden optar por el recorte automático. VoiceCheap acorta cada archivo seleccionado según sea necesario para que todas las muestras contribuyan mientras el total enviado se mantiene dentro del límite de 120 segundos.

El panel de clonación permanece bloqueado y abierto mientras se crea una voz. El botón de creación mantiene un indicador de carga visible y los controles del formulario permanecen deshabilitados hasta que la solicitud tenga éxito o falle.

La voz de AI Gateway está configurada actualmente a `$0` por millón de bytes UTF-8 mientras la promoción de Fish Audio está activa. Establezca `FISH_AUDIO_TTS_PRICE_PER_MILLION_UTF8_BYTES` a la tarifa en vivo posterior a la promoción cuando se reanude la facturación de Gateway; la tarifa estándar pública es actualmente de \$15 por millón de bytes UTF-8.

Los límites de voz guardada son independientes de los límites de voces personalizadas de doblaje:

* Gratis: 0 voces guardadas
* Tester, Beginner y Starter: 3 voces guardadas
* Creator y Worldwide: 5 voces guardadas
* Scale, Pro, Entrepreneur y Enterprise: 10 voces guardadas

## Buenos casos de uso

* locuciones
* fragmentos hablados
* verificaciones de pronunciación
* pruebas de narración preliminares

## Cuándo usar un proyecto completo en su lugar

Utilice un proyecto de doblaje completo cuando el audio deba permanecer vinculado a:

* una transcripción existente
* un video traducido
* subtítulos
* sincronización labial
* Smart Publish

## Páginas relacionadas

* [Descripción general de herramientas](/docs/es/tools/tools-overview)
* [Consejos de doblaje](/docs/es/voice/dubbing-tips)
