Yapay Zeka Ses Girişimi Fish Audio 50 Milyon Dolar Yatırım Aldı

Palo Alto merkezli yapay zeka girişimi Fish Audio, yaratıcı süreçler ve kurumsal otomasyon ihtiyaçları için geliştirdiği ses modellerini ölçeklendirmek amacıyla 50 milyon dolarlık tohum yatırımı aldığını duyurdu. Coreline Ventures ve Capital Today liderliğinde gerçekleşen tura 359 Capital, Parable, Play Time ve HF0 gibi yatırımcılar da katıldı.
Eski bir NVIDIA araştırmacısı olan Shijia Liao tarafından kurulan girişim, piyasadaki yapay seslerin yetersizliğine çözüm üretme hedefiyle yola çıktı. Şirket, GitHub üzerinde 31 binden fazla yıldıza sahip olan açık kaynaklı projesiyle bağımsız geliştiriciler ve oyun tasarımcıları arasında hızla popülerleşti. Bugün 8 milyondan fazla kullanıcıya ulaşan platform, yıllık 21 milyon dolar seviyesinde düzenli gelir elde ediyor.
Platform, kullanıcılarına 15 binden fazla doğal dil kontrolü sunarak sesin tonunu ve ifadesini detaylı şekilde özelleştirme imkanı tanıyor. Şirket, geçtiğimiz yıl içerisinde dört farklı konuşma üretme ve bir adet konuşmadan metne dönüştürme modeli yayınladı. En güncel modeli olan S2.1 Pro ise yalnızca ücretli API üzerinden erişilebilir durumda.
Fish Audio, HeyGen, Sanas ve Plaud gibi büyük ölçekli kuruluşların da aralarında bulunduğu kurumsal müşterilerine, düşük gecikmeli ve yüksek gerçekçilik sunan ses çözümleri sağlıyor. CEO Rissa Cao, girişimin bu yıl içerisinde ses anlama ve konuşmadan konuşmaya dönüştürme modellerini de piyasaya sürmeyi planladığını belirtti.
Platform, modellerini eğitmek için kullanıcıların ses örneklerinden yararlanıyor ancak bu durum geçmişte bazı telif sorunlarını beraberinde getirdi. Bazı içerik üreticileri, seslerinin rızaları dışında sisteme yüklendiğini iddia etmişti. Bu endişeleri gidermek için şirket, otomatik bir DMCA içerik kaldırma süreci geliştirdi. Artık hak sahipleri, ses örneklerinin kendilerine ait olduğunu kanıtladıkları takdirde, verilerinin platformdan 3 dakikadan kısa sürede kaldırılmasını sağlayabiliyor.



