
OmniVoice Studio, ahora llamado VoiceStudio, es un estudio de voz con IA para clonar voces, doblar vídeos, transcribir y producir audiolibros desde tu propio ordenador. Su gran baza es trabajar en local y sin claves API. La contrapartida: el rendimiento depende de tu equipo y del modelo elegido.

TL;DR: El resumen sin rodeos
- Todo en local: la clonación, el doblaje y la síntesis pueden ejecutarse en tu hardware sin cuenta ni clave API.
- Herramienta ambiciosa: reúne diseño de voces, transcripción, dictado, vídeos y audiolibros en una aplicación de escritorio.
- Coste sin trampa semántica: el programa es de código abierto con licencia AGPL-3.0, pero el equipo, la electricidad y algunos modelos corren de tu cuenta.
- Evidencia limitada: la documentación describe 646 idiomas, pero no hemos recibido una prueba independiente que mida calidad, velocidad o fidelidad en todos ellos.
En este artículo
| Qué es | App de escritorio que clona voces, dobla vídeos y crea audiolibros en 646 idiomas ejecutándose al 100 % en local, sin límites de uso ni claves API. |
|---|---|
| Web oficial | https://voicestudio.sh/ |
| Repositorio | repo |
| Licencia | AGPL-3.0 |
| Precio | código abierto |
| Alternativa a | ElevenLabs |
| Estrellas en GitHub | 11.000 (web oficial, 21-08-2026) |
| Año de lanzamiento | 2026 |
| Quién lo mantiene | debpalash (persona) |
| Plataformas | macOS, Windows, Linux, Docker (app de escritorio Electron) |
| Requisitos | Sin cuenta ni clave API; equipo propio; modelos descargados en local; bun para instalar desde el código fuente |
| Integraciones | API local compatible con OpenAI, MCP para agentes de IA |
| Idioma | 646 idiomas para síntesis y transcripción de voz; interfaz en inglés, docs también en chino simplificado |
Revisado el 2026-09-30
Esta herramienta forma parte de estos recopilatorios: Aplicaciones open source que sustituyen software de pago
El problema que resuelve
VoiceStudio concentra tareas que normalmente acabarían repartidas entre servicios de síntesis, transcripción, traducción y edición. Según su repositorio oficial, permite clonar o diseñar voces, doblar vídeos, dictar, transcribir y crear audiolibros en 646 idiomas.
En cristiano
Le das una grabación autorizada o describes una voz, escribes el texto y generas el audio en tu ordenador. Para un creador o un equipo pequeño, la gracia está en evitar que cada minuto producido pase por una cuenta externa con contador de uso.
También reduce otro marrón: mover material sensible entre varias plataformas. El proyecto afirma que los flujos locales se ejecutan en el equipo del usuario y que los servicios remotos son opcionales. Eso mejora el control sobre los archivos, aunque no convierte automáticamente cualquier instalación en segura.
Ojo con el nombre. OmniVoice Studio fue rebautizado como VoiceStudio, así que las referencias antiguas y el producto actual apuntan al mismo proyecto. La aplicación mantenida hoy es la versión Electron; la antigua edición Tauri quedó archivada tras la versión 0.5.3.
Cómo se pone en marcha
La ruta más corta es descargar la versión estable desde GitHub Releases y seguir la guía correspondiente a macOS, Windows, Linux o Docker. No exige cuenta ni clave API, pero sí descargar los modelos necesarios.


Una vez abierta la aplicación, entras en "Voice cloning", eliges una voz o añades una grabación limpia, escribes el texto e instalas el modelo solicitado. Los requisitos de memoria, almacenamiento y aceleración cambian según el motor. La documentación no ofrece un requisito universal que sirva para cualquier configuración, así que prometer que irá fino en cualquier portátil sería vender humo.
Desde código fuente, el proceso documentado usa bun install, bun run setup:api y bun run dev. Electron debe supervisar el servicio interno. Si vienes de Tauri, el mantenedor pide instalar Electron por separado y consultar la guía de migración; no presenta la actualización como un cambio directo.
Copia esto y pégalo en Claude Code, Cursor o tu asistente de código favorito:
Instala VoiceStudio desde https://github.com/debpalash/VoiceStudio siguiendo la guía oficial de mi sistema y comprueba mi hardware antes de descargar modelos. Mantén desactivados los servicios remotos y la analítica, abre la aplicación y verifica el servicio local en http://localhost:3900/health. Genera un audio corto con una voz incluida o autorizada y dime versión, motor, dispositivo real y ruta del archivo.
No necesitas saber programar. El asistente se encarga de la instalación, la configuración y las pruebas.
Usándola en marketing real
Un caso razonable: un equipo necesita adaptar una pieza audiovisual a varios mercados sin subir las voces de clientes o locutores a distintos proveedores. Puede transcribir el vídeo, traducir el guion, asignar voces y ajustar tiempos desde el espacio de doblaje.


Que conste: aquí planteamos un uso posible. No lo hemos probado. El dossier tampoco incluye resultados comparables sobre naturalidad, sincronización o precisión entre idiomas. Completar el flujo desde la interfaz no garantiza un resultado listo para campaña sin revisión humana.
La API local compatible con OpenAI y la integración MCP permiten conectar agentes de IA a los flujos de audio. Ambas aparecen en la documentación oficial. Falta una ejecución verificada para medir su estabilidad y comprobar cómo se llevan con un asistente concreto.
Fabricar voces porque sí aporta poco al marketing. La gracia está en controlar el proceso y abaratar iteraciones cuando ya tienes consentimiento y un guion con criterio editorial. Sin eso, solo produces ruido a velocidad industrial. Fantástico invento.
Lo que no te cuentan
"Local" no significa "sin coste". VoiceStudio es código abierto bajo AGPL-3.0 y no impone un contador de uso, pero necesita hardware, almacenamiento para modelos y tiempo de configuración. La información recibida tampoco aporta una tarifa oficial en euros que pueda publicarse con rigor.
Los modelos tienen licencias propias. La licencia de la aplicación no concede automáticamente derechos comerciales sobre cada motor, cada voz ni cada grabación utilizada. El propio repositorio pide revisar esas condiciones y clonar voces solo con permiso.
La promesa de 646 idiomas describe el alcance anunciado para síntesis y transcripción. No prueba la misma calidad en todos ellos, ni acredita que cada motor cubra cada idioma. Soporte y calidad son cosas distintas. Mezclarlas queda muy bonito en una landing page, pero bastante menos cuando entregas el vídeo al cliente.
Tampoco hay opiniones públicas verificadas en el dossier con autor, fecha y enlace directo. Por eso no voy a convertir testimonios comerciales de la web en supuesto consenso de usuarios. Ni vídeos sin versión y minuto útil. Cero fuegos artificiales.
Alternativas
La alternativa indicada en la ficha es ElevenLabs. Tiene sentido como referencia por compartir tareas de generación y clonación de voz, pero el dossier no aporta su tarifa vigente, condiciones ni una comparación bajo el mismo guion y equipo.
¿Qué prefieres comprar? Con VoiceStudio eliges control local y te ocupas del mantenimiento. ElevenLabs es la vía del servicio externo. Sin una prueba equivalente de calidad, velocidad y coste total, declarar un ganador sería jugar a la ouija con una tabla de precios.
Veredicto
OmniVoice Studio, hoy VoiceStudio, se gana un sitio en un recopilatorio de código abierto. Reúne muchas funciones de audio en una aplicación local y ofrece API y MCP para conectarlas con otros flujos. La propuesta tiene chicha para creadores técnicos, equipos preocupados por la privacidad o proyectos con bastante volumen potencial.
No lo recomendaría a quien necesite soporte homogéneo, tiempos garantizados o calidad validada en cientos de idiomas desde el minuto uno. Tampoco a quien confunda "código abierto" con "me olvido de mantenerlo".
Mi veredicto sobre OmniVoice Studio es sencillo: pruébalo con una voz autorizada y una tarea real antes de mover producción. Si tu equipo lo ejecuta bien, ganas control. Si no, has descubierto el límite sin mandar una campaña entera al barranco. Así se prueban las herramientas. Lo demás es hacer una demo bonita y rezar.

