๐—™๐—ถ๐˜€๐—ต ๐—”๐˜‚๐—ฑ๐—ถ๐—ผ ๐—ฎ๐—ฐ๐—ฎ๐—ฏ๐—ฎ ๐—ฑ๐—ฒ ๐—น๐—ฎ๐—ป๐˜‡๐—ฎ๐—ฟ ๐—ฆ๐Ÿฎ.๐Ÿญ ๐—ฃ๐—ฟ๐—ผ ๐—ฎ๐—น ๐—ฝ๐˜‚ฬ๐—ฏ๐—น๐—ถ๐—ฐ๐—ผ

julio 31, 2026

Y viene con datos que llaman la atenciรณn:
๐Ÿ”น Clona una voz con solo 5 segundos de audio
๐Ÿ”น Cubre 83 idiomas con una sola identidad de voz
๐Ÿ”น Latencia de ~90ms โ€” suficiente para conversaciones en tiempo real
๐Ÿ”น Mรกs de 15.000 controles en lenguaje natural para matizar emociรณn, tono y ritmo (nada de emociones “preset”)

El lanzamiento llega junto a una ronda semilla de $52M, y la empresa asegura que es 2 veces mรกs rรกpido que Cartesia y hasta 6 veces mรกs barato que ElevenLabs. En un aรฑo pasaron de ser un proyecto open-source a 8 millones de usuarios.

Ya lo estรกn usando en producciรณn compaรฑรญas como HeyGen, LiveKit, Retell y Sanas.

La carrera por la voz en IA estรก que arde.

UP