← Tüm AI haberleri

AI

Fish Audio, yaratıcılar ve işletmeler için AI ses modelleri oluşturmak üzere 52 milyon dolarlık tohum yatırımı aldı

techcrunch.com · 28.07.2026 · Base of AGI özeti

Fish Audio, yaratıcılar ve işletmeler için AI ses modelleri oluşturmak üzere 52 milyon dolarlık tohum yatırımı aldı
© techcrunch.com — görsel kaynağa aittir

Özgün başlık: Fish Audio raises $52M seed to build AI voice models for creators and enterprises

Yapay zeka tarafından oluşturulan ses modellerinin pazarı çok büyük. Yaratıcı kullanım örnekleri, yapay zeka ses modellerinin daha etkileyici olmasını gerektirirken, müşteri desteğini ve satış operasyonlarını otomatikleştirmek isteyen kuruluşlar, bunların daha yönlendirilebilir olmasını gerektirir. Palo Alto merkezli Fish Audio, 15.000'den fazla doğal dil kontrolünden oluşan kütüphanesiyle tüm bu kullanım durumlarına hitap etmek istiyor. Geçen yıl piyasaya sürülmesinden bu yana, girişim şu anda modellerinin açık kaynaklı veya barındırılan sürümlerini kullanan 8 milyondan fazla kişiye sahip ve yıllık 21 milyon dolarlık yinelenen gelir elde ediyor. Bu çekişi geliştirmeye devam etmek için girişim Salı günü, Coreline Ventures ve Capital Today liderliğindeki tohum turunda 52 milyon dolar topladığını söyledi. Finansmana ayrıca 359 Capital, Parable, Play Time, Alphalist Partners, Bayhouse Ventures, Carya Venture Partners ve HF0'dan da katılım görüldü. Fish Audio, piyasada bulunan etkileyici olmayan sentetik seslerden bıkmış olan eski NVIDIA araştırmacısı Shijia Liao tarafından küçük bir proje olarak başladı ve daha sonra açık kaynaklı olarak tek bir GPU üzerinde bir ses oluşturma modeli eğitti. GitHub'deki Balık Konuşması deposu artık 31.000'den fazla yıldıza sahip ve bağımsız geliştiriciler, video oyunu tasarımcıları ve yaratıcılar tarafından kullanılıyor. Şirket geçen yıl beş model piyasaya sürdü: dört konuşma üretme modeli ve bir konuşmayı metne dönüştürme modeli.

Konuşma oluşturma modellerinden üçü açık kaynaklıdır ancak en son S2.1 Pro modeli yalnızca ücretli API aracılığıyla kullanılabilir. Fish Audio, yaratıcılara ve ekiplere uygun, belirli sayıda dakikalık üretimin yanı sıra ses klonlama özelliklerinin kilidini açan ücretli aylık planlar sunar. Şirket ayrıca API'lerinin ve platformunun kurumsal bir versiyonunu da sunuyor ve HeyGen ve Sanas gibi kuruluşların bunu zaten kullandığını söylüyor. Her işletmenin farklı kullanım durumları ve farklı tercihleri ​​vardır. Örneğin, yapay zeka avatarlarını güçlendirmek için seslerimizi kullanan HeyGen gibi şirketler seslerde gerçekçilik istiyor; bir oyun stüdyosu karakterleri için etkileyici sesler ister; Cao, LiveKit gibi ses aracısı şirketlerinin, aramalar için yeterince anlamlı, daha doğal ses veren ve düşük gecikmeli sesler istediklerini söyledi. Startup'ın ses kütüphanesini oluşturmasının bir yolu, kullanıcılardan modellerini eğitmek için kendi seslerini göndermelerini istemek ve sesleri kullanılırsa telafi etmektir.

Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗ Akış içinde yorumlarla aç

İlgili AI haberleri