Yapay Zeka Ses Modellerinde Yenilikçi Adım: Fish Audio
Yapay zeka ses modelleri pazarı hızla büyürken, Palo Alto merkezli Fish Audio, hem kreatif hem de kurumsal ihtiyaçları karşılamak için özgün ses kütüphaneleri sunmaya odaklanıyor. Şirket, 15,000’den fazla doğal dil kontrolüne sahip olan modelleriyle, kullanıcılarına daha ifade dolu ve ayarlanabilir ses deneyimleri sağlıyor.
Finansman ve Büyüme Stratejileri
Geçtiğimiz yıl kurulan Fish Audio, bugüne dek 8 milyondan fazla kullanıcıya ulaştı ve yıllık 21 milyon dolar gelir elde etti. Şirket, büyüme stratejileri doğrultusunda 50 milyon dolar yatırım aldığını duyurdu. Bu fonlama, Coreline Ventures ve Capital Today tarafından yönetildi ve birçok önemli yatırımcıdan destek aldı.
Fish Audio, kurucusu Shijia Liao’nın öncülüğünde, daha önce NVIDIA’da araştırmacı olarak çalışmış bir ekip tarafından oluşturuldu. Liao, piyasadaki sıradan seslerin yetersizliğinden dolayı, tek bir GPU üzerinde ses üretim modeli geliştirdi ve bunu açık kaynak olarak sundu. Şimdi, GitHub’daki Fish Speech deposu 31,000’in üzerinde yıldız almış durumda ve bağımsız geliştiriciler ile oyun tasarımcıları tarafından yoğun bir şekilde kullanılıyor.
Şirket, son bir yıl içinde dört ses üretim modeli ve bir sesten metne modelini tanıttı. Açık kaynaklı üç ses üretim modelini kullanıma sundu ancak en son modeli S2.1 Pro yalnızca ücretli API üzerinden erişilebilir durumda. Sonuç olarak, içerik üreticileri ve ekipler için farklı planlar sunulmakta, böylece ses kopyalama özellikleri erişilebilir hale gelmektedir.
Fish Audio, kullanıcıların seslerini eğitim için sunmalarına olanak tanıyan bir model izliyor ve bu seslerin kullanılması durumunda onlara tazminat ödüyor. Ancak, bu süreçte kullanıcıların seslerinin izinsiz bir şekilde yüklenmesi gibi sorunlar da ortaya çıkabiliyor. Şirket, bu sorunları çözmek amacıyla hızlı bir DMCA takvim süreci geliştirdi.
Şirketin CEO’su Rissa Cao, ses sahiplerinin platformdan kolayca ilgili seslerini kaldırabilmesi için süreci otomatikleştirdiklerini belirtti. Yine de, bazı kullanıcıların seslerinin habersiz bir şekilde platformda kalması riski devam ediyor. Bu yüzden sanatçıların seslerinin yetkisiz kullanımına karşı daha güçlü bir izleme ve takibin gerekliliği vurgulanmakta.
Gelecek planları arasında, ses anlama modeli ve sesten sese çevrim modeli geliştirmek bulunuyor. Kıyaslandığında, ses üretim pazarı yoğun bir rekabet içerisine girmiş durumda ve Fish Audio, bu alanda kullanıcı dostu araçlar ile maliyet verimliliği sağlayarak büyük AI laboratuvarlarıyla rekabet etmeyi hedefliyor.
Kaynak: https://techcrunch.com/2026/07/28/fish-audio-raises-50m-seed-to-build-ai-voice-models-for-creators-and-enterprises/


