Fish Audio complète un financement seed de 50 millions de dollars américains, accélérant la R&D de modèles vocaux d'IA et les services aux entreprises.
7x24h Brève
Fish Audio complète un financement seed de 50 millions de dollars américains, accélérant la R&D de modèles vocaux d'IA et les services aux entreprises.
Selon TechCrunch, la société de modèles vocaux IA Fish Audio a annoncé avoir achevé un tour de financement de série seed de 50 millions de dollars, mené par Coreline Ventures et Capital Today, avec la participation d'investisseurs tels que 359 Capital, Parable et Play Time. La société a indiqué qu'à ce jour, ses modèles open source et hébergés comptent plus de 8 millions d'utilisateurs cumulés et que son revenu annuel récurrent a atteint 21 millions de dollars.
Selon TechFlow, le 28 juillet, TechCrunch a rapporté que la société de modèles vocaux IA Fish Audio a annoncé avoir achevé un financement de série Seed de 50 millions de dollars, mené par Coreline Ventures et Capital Today, avec la participation d'investisseurs tels que 359 Capital, Parable et Play Time. La société a indiqué que le nombre cumulatif d'utilisateurs de ses modèles open source et hébergés a dépassé 8 millions, et que son revenu annuel récurrent atteint 21 millions de dollars.
Fish Audio a lancé 5 modèles au cours de l'année dernière, dont 4 modèles de génération vocale et 1 modèle de transcription vocale, parmi lesquels 3 sont open source, tandis que le dernier modèle S2.1 Pro est disponible via une API payante. Les produits de l'entreprise s'adressent aux créateurs, aux développeurs et aux clients entreprises, avec des cas d'utilisation couvrant les avatars IA, le doublage de personnages de jeux et les agents vocaux, etc.
Face au problème de téléchargement de voix non autorisé survenu précédemment sur la plateforme, Fish Audio a déclaré avoir automatisé le processus de retrait ; une fois que les ayants droit ont soumis des échantillons vocaux ou des contrats pertinents, le traitement peut être achevé en 3 minutes. La société prévoit de lancer à l'avenir des modèles de compréhension audio et des modèles de voix vers voix.




