<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Clonacion De Voz on SoloSoft</title><link>https://www.solosoft.dev/es/tags/clonacion-de-voz/</link><description>Recent content in Clonacion De Voz on SoloSoft</description><generator>Hugo</generator><language>es-es</language><lastBuildDate>Fri, 01 May 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://www.solosoft.dev/es/tags/clonacion-de-voz/index.xml" rel="self" type="application/rss+xml"/><item><title>GPT-SoVITS: Clonacion de Voz con Pocos Ejemplos con Solo 1 Minuto de Datos de Voz</title><link>https://www.solosoft.dev/es/post/gpt-sovits-voice-cloning-2026/</link><pubDate>Fri, 01 May 2026 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/gpt-sovits-voice-cloning-2026/</guid><description>&lt;p&gt;GPT-SoVITS es un sistema de clonacion de voz y texto a voz de codigo abierto desarrollado por &lt;a href="https://github.com/RVC-Boss/GPT-SoVITS"&gt;RVC-Boss&lt;/a&gt; que ha causado sensacion en la comunidad de audio IA. La capacidad destacada del proyecto es la clonacion de voz con pocos ejemplos que requiere solo 1 minuto de datos de voz para entrenar un modelo de voz convincente, con capacidades zero-shot usando tan solo 5-10 segundos de audio de referencia. Soportando chino, ingles, japones y coreano, GPT-SoVITS combina el poder del modelado autoregresivo basado en GPT con la fidelidad espectral de SoVITS (Sintesis de Voz Cantada con Refinamiento Iterativo usando un Sinkhorn basado en Transformer).&lt;/p&gt;</description></item><item><title>VoxCPM2: Sintesis de Voz Multilingue Sin Tokenizador de OpenBMB</title><link>https://www.solosoft.dev/es/post/voxcpm-tts-2026/</link><pubDate>Fri, 01 May 2026 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/voxcpm-tts-2026/</guid><description>&lt;p&gt;VoxCPM2 es un modelo de texto a voz (TTS) sin tokenizador desarrollado por &lt;a href="https://www.openbmb.cn/"&gt;OpenBMB&lt;/a&gt;, una comunidad de investigacion de IA de codigo abierto afiliada a la Universidad Tsinghua y la Academia de Inteligencia Artificial de Beijing (BAAI). Con 2 mil millones de parametros, VoxCPM2 representa un cambio de paradigma en la sintesis de voz al operar directamente sobre representaciones continuas de voz, eliminando la necesidad de tokenizadores de audio discretos que normalmente degradan la calidad de la voz.&lt;/p&gt;
&lt;p&gt;El modelo soporta mas de 30 idiomas con capacidades que abarcan clonacion de voz zero-shot, diseno de voz (creacion de voces completamente nuevas a partir de descripciones textuales) e inferencia de transmision en tiempo real. VoxCPM2 se ha convertido rapidamente en uno de los modelos TTS de codigo abierto mas comentados de 2026, compitiendo directamente con ofertas comerciales como ElevenLabs y OpenAI TTS, mientras permanece disponible gratuitamente bajo la licencia Apache 2.0.&lt;/p&gt;</description></item></channel></rss>