Hume AI prezentuje Octave 2: Nowa generacja syntezy mowy AI
Hume AI wprowadza na rynek Octave 2, ulepszony model AI do syntezy mowy, obiecujący szybkość, wielojęzyczność i nowe możliwości edycji głosu. Czy to przełom w branży voice AI?
Read MoreHume AI wprowadza na rynek Octave 2, ulepszony model AI do syntezy mowy, obiecujący szybkość, wielojęzyczność i nowe możliwości edycji głosu. Czy to przełom w branży voice AI?
Read MoreNowe narzędzie open-source łączy transkrypcję, precyzyjne znaczniki czasowe i analizę dźwięku w jednym, wydajnym systemie.
Read MoreHume AI przygotowuje się do wprowadzenia na rynek Octave 2 Multilingual, model syntezy mowy, który oferuje niskie opóźnienia i obsługę ponad 10 języków. Czy to przełom w dziedzinie tłumaczeń w czasie rzeczywistym i interakcji głosowych?
Read MoreStartup Liquid AI wprowadza na rynek LFM2-Audio-1.5B, kompaktowy model fundamentowy audio-językowy, który rozumie i generuje mowę oraz tekst za pomocą pojedynczego, kompleksowego stosu. Obiecuje on niskie opóźnienia i działanie w czasie rzeczywistym, nawet na urządzeniach o ograniczonych zasobach.
Read MoreNorweski startup Hance opracował niezwykle małe i wydajne oprogramowanie do przetwarzania dźwięku oparte na sztucznej inteligencji. Ich rozwiązanie, ważące zaledwie 242 kB, znalazło już zastosowanie w Formule 1 i współpracuje z Intelem.
Read MoreBadania wskazują, że sztuczna inteligencja osiągnęła punkt, w którym generowane przez nią głosy są niemal nieodróżnialne od ludzkich, co rodzi pytania o etykę i bezpieczeństwo.
Read MoreSpotify ogłosiło zmiany w polityce dotyczące sztucznej inteligencji, obejmujące oznaczanie muzyki generowanej przez AI, filtrowanie spamu i zakaz nieautoryzowanych klonów głosowych. Platforma zamierza wprowadzić standard DDEX i nowe filtry antyspamowe.
Read MoreZespół stojący za sukcesem NotebookLM prezentuje Huxe, aplikację, która przekształca informacje w angażujące podcasty, otwierając nowy rozdział w konsumpcji treści.
Read MoreXiaomi wprowadza na rynek MiMo-Audio, model językowy mowy o parametrach 7B, przeszkolony na ponad 100 milionach godzin nagrań audio. Model ten, wykorzystujący unikalne tokeny dyskretne o wysokiej wierności, stanowi znaczący krok naprzód w dziedzinie sztucznej inteligencji mowy.
Read MoreNowy model od Stability, Stable Audio 2.5, w kilka sekund generuje utwory, edytuje dźwięk i umożliwia tworzenie muzyki na potrzeby biznesu.
Read More