IA Aplicada09/10/20267 min lectura

Clonación de voz con IA local: qué ofrece VoiceStudio

Review de OmniVoice Studio: análisis, límites y veredicto

OmniVoice Studio, ahora llamado VoiceStudio, es un estudio de voz con IA para clonar voces, doblar vídeos, transcribir y producir audiolibros desde tu propio ordenador. Su gran baza es trabajar en local y sin claves API. La contrapartida: el rendimiento depende de tu equipo y del modelo elegido.

Mascota Marketing Ultra

TL;DR: El resumen sin rodeos

  • Todo en local: la clonación, el doblaje y la síntesis pueden ejecutarse en tu hardware sin cuenta ni clave API.
  • Herramienta ambiciosa: reúne diseño de voces, transcripción, dictado, vídeos y audiolibros en una aplicación de escritorio.
  • Coste sin trampa semántica: el programa es de código abierto con licencia AGPL-3.0, pero el equipo, la electricidad y algunos modelos corren de tu cuenta.
  • Evidencia limitada: la documentación describe 646 idiomas, pero no hemos recibido una prueba independiente que mida calidad, velocidad o fidelidad en todos ellos.
Veredicto: merece una prueba si priorizas privacidad y control, siempre que aceptes montar y mantener tu propia infraestructura de voz.
En este artículo
  1. El problema que resuelve
  2. Cómo se pone en marcha
  3. Usándola en marketing real
  4. Lo que no te cuentan
  5. Alternativas
  6. Veredicto
Qué esApp de escritorio que clona voces, dobla vídeos y crea audiolibros en 646 idiomas ejecutándose al 100 % en local, sin límites de uso ni claves API.
Web oficialhttps://voicestudio.sh/
Repositoriorepo
LicenciaAGPL-3.0
Preciocódigo abierto
Alternativa aElevenLabs
Estrellas en GitHub11.000 (web oficial, 21-08-2026)
Año de lanzamiento2026
Quién lo mantienedebpalash (persona)
PlataformasmacOS, Windows, Linux, Docker (app de escritorio Electron)
RequisitosSin cuenta ni clave API; equipo propio; modelos descargados en local; bun para instalar desde el código fuente
IntegracionesAPI local compatible con OpenAI, MCP para agentes de IA
Idioma646 idiomas para síntesis y transcripción de voz; interfaz en inglés, docs también en chino simplificado

Revisado el 2026-09-30

Esta herramienta forma parte de estos recopilatorios: Aplicaciones open source que sustituyen software de pago

El problema que resuelve

VoiceStudio concentra tareas que normalmente acabarían repartidas entre servicios de síntesis, transcripción, traducción y edición. Según su repositorio oficial, permite clonar o diseñar voces, doblar vídeos, dictar, transcribir y crear audiolibros en 646 idiomas.

En cristiano

Le das una grabación autorizada o describes una voz, escribes el texto y generas el audio en tu ordenador. Para un creador o un equipo pequeño, la gracia está en evitar que cada minuto producido pase por una cuenta externa con contador de uso.

También reduce otro marrón: mover material sensible entre varias plataformas. El proyecto afirma que los flujos locales se ejecutan en el equipo del usuario y que los servicios remotos son opcionales. Eso mejora el control sobre los archivos, aunque no convierte automáticamente cualquier instalación en segura.

Ojo con el nombre. OmniVoice Studio fue rebautizado como VoiceStudio, así que las referencias antiguas y el producto actual apuntan al mismo proyecto. La aplicación mantenida hoy es la versión Electron; la antigua edición Tauri quedó archivada tras la versión 0.5.3.

Cómo se pone en marcha

La ruta más corta es descargar la versión estable desde GitHub Releases y seguir la guía correspondiente a macOS, Windows, Linux o Docker. No exige cuenta ni clave API, pero sí descargar los modelos necesarios.

Mascota instala modelos en una máquina abierta que conecta VoiceStudio, almacenamiento y hardware local.
La web oficial de OmniVoice Studio
La web oficial de OmniVoice Studio, capturada el 2026-09-30.

Una vez abierta la aplicación, entras en "Voice cloning", eliges una voz o añades una grabación limpia, escribes el texto e instalas el modelo solicitado. Los requisitos de memoria, almacenamiento y aceleración cambian según el motor. La documentación no ofrece un requisito universal que sirva para cualquier configuración, así que prometer que irá fino en cualquier portátil sería vender humo.

Desde código fuente, el proceso documentado usa bun install, bun run setup:api y bun run dev. Electron debe supervisar el servicio interno. Si vienes de Tauri, el mantenedor pide instalar Electron por separado y consultar la guía de migración; no presenta la actualización como un cambio directo.

▶¿Quieres probarlo tú mismo?

Copia esto y pégalo en Claude Code, Cursor o tu asistente de código favorito:

Instala VoiceStudio desde https://github.com/debpalash/VoiceStudio siguiendo la guía oficial de mi sistema y comprueba mi hardware antes de descargar modelos.
Mantén desactivados los servicios remotos y la analítica, abre la aplicación y verifica el servicio local en http://localhost:3900/health.
Genera un audio corto con una voz incluida o autorizada y dime versión, motor, dispositivo real y ruta del archivo.

No necesitas saber programar. El asistente se encarga de la instalación, la configuración y las pruebas.

Usándola en marketing real

Un caso razonable: un equipo necesita adaptar una pieza audiovisual a varios mercados sin subir las voces de clientes o locutores a distintos proveedores. Puede transcribir el vídeo, traducir el guion, asignar voces y ajustar tiempos desde el espacio de doblaje.

OmniVoice Studio en acción
OmniVoice Studio en acción - fotograma del vídeo de AiThatSpeaks.
OmniVoice Studio en funcionamiento
OmniVoice Studio en funcionamiento (captura del 2026-09-30).

Que conste: aquí planteamos un uso posible. No lo hemos probado. El dossier tampoco incluye resultados comparables sobre naturalidad, sincronización o precisión entre idiomas. Completar el flujo desde la interfaz no garantiza un resultado listo para campaña sin revisión humana.

La API local compatible con OpenAI y la integración MCP permiten conectar agentes de IA a los flujos de audio. Ambas aparecen en la documentación oficial. Falta una ejecución verificada para medir su estabilidad y comprobar cómo se llevan con un asistente concreto.

Fabricar voces porque sí aporta poco al marketing. La gracia está en controlar el proceso y abaratar iteraciones cuando ya tienes consentimiento y un guion con criterio editorial. Sin eso, solo produces ruido a velocidad industrial. Fantástico invento.

Lo que no te cuentan

"Local" no significa "sin coste". VoiceStudio es código abierto bajo AGPL-3.0 y no impone un contador de uso, pero necesita hardware, almacenamiento para modelos y tiempo de configuración. La información recibida tampoco aporta una tarifa oficial en euros que pueda publicarse con rigor.

Los modelos tienen licencias propias. La licencia de la aplicación no concede automáticamente derechos comerciales sobre cada motor, cada voz ni cada grabación utilizada. El propio repositorio pide revisar esas condiciones y clonar voces solo con permiso.

La promesa de 646 idiomas describe el alcance anunciado para síntesis y transcripción. No prueba la misma calidad en todos ellos, ni acredita que cada motor cubra cada idioma. Soporte y calidad son cosas distintas. Mezclarlas queda muy bonito en una landing page, pero bastante menos cuando entregas el vídeo al cliente.

Tampoco hay opiniones públicas verificadas en el dossier con autor, fecha y enlace directo. Por eso no voy a convertir testimonios comerciales de la web en supuesto consenso de usuarios. Ni vídeos sin versión y minuto útil. Cero fuegos artificiales.

Alternativas

La alternativa indicada en la ficha es ElevenLabs. Tiene sentido como referencia por compartir tareas de generación y clonación de voz, pero el dossier no aporta su tarifa vigente, condiciones ni una comparación bajo el mismo guion y equipo.

¿Qué prefieres comprar? Con VoiceStudio eliges control local y te ocupas del mantenimiento. ElevenLabs es la vía del servicio externo. Sin una prueba equivalente de calidad, velocidad y coste total, declarar un ganador sería jugar a la ouija con una tabla de precios.

Veredicto

OmniVoice Studio, hoy VoiceStudio, se gana un sitio en un recopilatorio de código abierto. Reúne muchas funciones de audio en una aplicación local y ofrece API y MCP para conectarlas con otros flujos. La propuesta tiene chicha para creadores técnicos, equipos preocupados por la privacidad o proyectos con bastante volumen potencial.

No lo recomendaría a quien necesite soporte homogéneo, tiempos garantizados o calidad validada en cientos de idiomas desde el minuto uno. Tampoco a quien confunda "código abierto" con "me olvido de mantenerlo".

Mi veredicto sobre OmniVoice Studio es sencillo: pruébalo con una voz autorizada y una tarea real antes de mover producción. Si tu equipo lo ejecuta bien, ganas control. Si no, has descubierto el límite sin mandar una campaña entera al barranco. Así se prueban las herramientas. Lo demás es hacer una demo bonita y rezar.

Deja un comentario

Tu correo no se publicará. Revisamos los comentarios antes de mostrarlos.