Gen AI

AudioNarzędziaVideo

Adobe prezentuje narzędzia AI do manipulacji głosem i edycji audio

Adobe na swojej konferencji MAX zaprezentowało innowacyjne narzędzia oparte na sztucznej inteligencji, które w znaczący sposób mogą zmienić obróbkę materiałów audio w produkcji wideo. Od zmiany emocji w głosie lektora po inteligentne rozdzielanie ścieżek audio – nowe funkcjonalności mają za zadanie usprawnić pracę twórców i edytorów, jednocześnie budząc dyskusje na temat wpływu AI na branżę aktorską.

Read More
AudioCyberbezpieczeństwo

VoiceSecure: sztuczna inteligencja chroni prywatność danych głosowych przed cyfrową inwigilacją

Profesor Nirupam Roy z University of Maryland opracował VoiceSecure – innowacyjny system, który maskuje mowę przed algorytmami sztucznej inteligencji, jednocześnie zachowując jej pełną zrozumiałość dla ludzkiego ucha. To odpowiedź na rosnące zagrożenie związane z wykorzystaniem danych głosowych do celów szpiegowskich, generowania deepfake’ów i kradzieży tożsamości biometrycznej.

Read More
AudioBiznes

Przyszłość generatywnego audio AI w wizji ElevenLabs

Mati Staniszewski, dyrektor generalny ElevenLabs, przewiduje, że modele AI do generowania audio ulegną w przyszłości komodytyzacji. Firma, znana z innowacji w syntezie mowy, planuje przekierować swoje strategiczne wysiłki, aby sprostać nowym wyzwaniom rynkowym. Ta wizja, przedstawiona na konferencji TechCrunch Disrupt 2025, rzuca światło na ewolucję sektora AI i strategię utrzymania przewagi konkurencyjnej w horyzoncie średnio- i długoterminowym.

Read More
LLMObrazR & D

Glyph: Przełom w przetwarzaniu długich kontekstów dzięki kompresji wizualno-tekstowej

Zhipu AI prezentuje Glyph, innowacyjny framework wykorzystujący kompresję wizualno-tekstową, by znacząco zwiększyć długość przetwarzanych kontekstów w modelach językowych. Ta metoda może zrewolucjonizować sposób, w jaki sztuczna inteligencja radzi sobie z obszernymi dokumentami, zmieniając tekst w obrazy i przetwarzając je za pomocą modeli wizualno-językowych.

Read More
Data ScienceKulturaLLM

Afrykańskie głosy w AI: Przełomowy zbiór danych zmieniający oblicze technologii

Projekt „African Next Voices” dostarcza największy dotychczasowy zbiór danych językowych dla sztucznej inteligencji, otwierając drogę do bardziej inkluzywnych i kulturowo świadomych technologii na kontynencie afrykańskim. Inicjatywa ta ma szansę znacząco zmniejszyć przepaść cyfrową, umożliwiając rozwój AI, która naprawdę służy lokalnym społecznościom.

Read More