NEO
Tendencias
·Cargando tendencias...·Cargando tendencias...
TV

Fish Audio recauda $50 millones en financiamiento inicial para desarrollar modelos de voz de IA para creadores y empresas

Startup con 8 millones de usuarios y $21 millones en ingresos recurrentes anuales busca escalar modelos de generación de audio

Fish Audio ha conseguido $50 millones en financiamiento inicial con el objetivo de desarrollar modelos de voz de inteligencia artificial (IA) enfocados en creadores y empresas. Este sector presenta un potencial significativo, ya que las aplicaciones creativas demandan voces más expresivas, mientras que las empresas buscan soluciones que permitan automatizar

Redaccion NEO·28/7/2026
Compartir:LinkedInXWhatsAppFacebook
Fish Audio recauda $50 millones en financiamiento inicial para desarrollar modelos de voz de IA para creadores y empresas

Fish Audio ha conseguido $50 millones en financiamiento inicial con el objetivo de desarrollar modelos de voz de inteligencia artificial (IA) enfocados en creadores y empresas. Este sector presenta un potencial significativo, ya que las aplicaciones creativas demandan voces más expresivas, mientras que las empresas buscan soluciones que permitan automatizar el soporte al cliente y optimizar las operaciones de ventas.

Con sede en Palo Alto, Fish Audio se propone satisfacer estas necesidades mediante su extensa biblioteca que incluye más de 15,000 controles de lenguaje natural. Desde su lanzamiento el año pasado, la startup ha atraído a más de 8 millones de usuarios que emplean sus modelos, ya sea a través de versiones de código abierto o alojadas, y ha logrado generar ingresos recurrentes anuales de $21 millones.

Con el fin de seguir avanzando en este crecimiento, Fish Audio anunció recientemente la recaudación de $50 millones en una ronda de financiamiento inicial, liderada por Coreline Ventures y Capital Today, con el respaldo adicional de varios inversores destacados.

La historia de Fish Audio comenzó con Shijia Liao, un ex investigador de NVIDIA, quien, motivado por la falta de voces sintéticas expresivas en el mercado, desarrolló un modelo de generación de voz utilizando una única GPU, el cual se hizo disponible como código abierto. Su repositorio, Fish Speech en GitHub, ha acumulado más de 31,000 estrellas y es utilizado por desarrolladores independientes, diseñadores de videojuegos y creadores de contenido.

En el último año, la compañía ha lanzado cinco modelos, entre ellos cuatro de generación de voz y uno de conversión de voz a texto. Aunque tres de sus modelos de voz han sido liberados como código abierto, su modelo más reciente, S2.1 Pro, está disponible únicamente a través de su API de pago.

Fish Audio ofrece planes mensuales adaptados a creadores y equipos, que permiten acceder a un número determinado de minutos de generación de voz, así como funciones de clonación. También proporciona una versión empresarial de sus APIs y plataforma, siendo utilizada por organizaciones como HeyGen, Sanas y Plaud.

Rissa Cao, CEO y cofundadora de Fish Audio, explicó que cada empresa tiene diferentes necesidades y preferencias. Por ejemplo, HeyGen busca realismo en las voces para sus avatares de IA, mientras que los estudios de videojuegos requieren voces más expresivas para sus personajes.

Una de las estrategias que ha implementado la startup para enriquecer su biblioteca de voces es solicitar a los usuarios que envíen grabaciones de sus propias voces para entrenar los modelos, ofreciendo compensaciones cuando estas son utilizadas. Sin embargo, este enfoque ha generado controversias, ya que algunos creadores han denunciado que sus voces fueron subidas sin su consentimiento. Para abordar estas preocupaciones, Fish Audio está...

Sigue leyendo