Suno, bir metinden veya yazılı açıklamadan konuşma sesi üreten Speech özelliğini herkese açık beta sürümünde kullanıma sundu. Özellik, Suno’nun web ve mobil platformlarında kullanılabiliyor; tek bir parçada seslendirme ile arka plan müziğini birlikte üretebiliyor.
Müzik isteğe bağlı ve kapatılabiliyor. Suno, şiirlere sakin müzik ya da dramatik seslendirmelere ve teşvik edici konuşmalara daha hareketli bir eşlik gibi, konuşmaya uygun müzikler eklenebileceğini belirtiyor.
Kullanıcılar Speech’i Create sekmesinde bulabiliyor. Simple modu bir açıklamadan ses üretirken Advanced modu özel bir metin girilmesine olanak tanıyor. Advanced ayarlarında ayrıca yapay zekâ sesinin cinsiyeti ve konuşma tarzı ile her üretimdeki çeşitlilik düzeyi ayarlanabiliyor. Speech’in süresi yaklaşık sekiz dakikaya kadar çıkabiliyor.
Suno’nun ürünlerden sorumlu üst düzey yöneticisi Jack Brody, Speech’i ses ile müziği birlikte üreten şirketin ilk ses modeli olarak tanımladı. Yapay zekâyla konuşma üretimi başka şirketlerde de bulunuyor: DeepMind on yıldır konuşma sentezi üzerinde çalışıyor, Adobe’nin bir metinden konuşma aracısı var ve ElevenLabs 2023’te kullanıma sunuldu.
Suno, kullanıcı geri bildirimlerine göre Speech’i geliştirmeyi sürdüreceğini söylüyor. Brody, beta çıktılarında aksanların tutarsızlaşabildiğini ve duraklamaların gereğinden fazla dramatik olabildiğini kabul etti. The Verge, Suno’nun müzik üreticisinin davalara konu olduğunu bildiriyor; duyuruda Speech’in bu davalara yanıt olarak geliştirildiği belirtilmiyor.
Yorumlar
0Henüz yorum yok. İlk yorumu siz yazın.