Audio

Suno wprowadza funkcję Speech. Generuje mowę i dopasowaną muzykę w jednej ścieżce

Suno udostępniło w wersji beta funkcję Speech. Nowe narzędzie nie służy do podkładania muzyki pod gotowy głos, lecz generuje wypowiedź i dopasowane do niej tło muzyczne jednocześnie, w ramach jednej ścieżki audio. Użytkownik może wprowadzić gotowy tekst lub zarys pomysłu oraz określić pożądany charakter głosu i styl muzyki.

Firma wskazuje jako główne zastosowania m.in. medytacje prowadzone, wiersze oraz bajki na dobranoc. Przed premierą funkcja była testowana przez miesiąc w zamkniętej grupie, ale wciąż ma zauważalne ograniczenia – model nie zawsze precyzyjnie wykonuje polecenia dotyczące sposobu mówienia i brytyjski akcent może w wygenerowanym nagraniu zabrzmieć jak australijski.

Suno nie podało informacji o zbiorach danych użytych do wytrenowania Speech. Źródła materiałów treningowych firmy budzą wątpliwości prawne od dłuższego czasu: wytwórnie płytowe skierowały przeciwko niej pozwy o naruszenie praw autorskich, a sąd w Monachium odrzucił niedawno argumentację Suno powołującą się na dozwolony użytek.