Gen AI

LLMProgramowanie

Pyversity: Innowacyjna biblioteka Python poprawiająca różnorodność wyników wyszukiwania

Tradycyjne systemy wyszukiwania często generują powtarzalne wyniki, ograniczając ich użyteczność. Biblioteka Pyversity, oparta na Pythonie, oferuje skuteczne algorytmy rerankingu, które balansują między trafnością a różnorodnością, dostarczając bardziej wszechstronne i informatywne zestawy danych. To nowe narzędzie ma potencjał, aby znacząco poprawić doświadczenia użytkowników w wielu dziedzinach, od e-commerce po systemy RAG/LLM.

Read More
Video

VISTA — pętla test‑time, która poprawia generowanie wideo z tekstu

Google przedstawił VISTA, system wieloagentowy który podczas inferencji iteracyjnie poprawia prompt i regeneruje wideo. Metoda łączy planowanie scen, turnieje parowe, wielowymiarowe krytyki i moduł „głębokiego myślenia” dla przepisywania promptów. Badania zespołu pokazują powtarzalne zyski jakościowe i preferencje ludzkich ocen, przy koszcie tokenowym rzędu 0,7 mln na iterację.

Read More
Gen AI

Meta szykuje duży skok w Meta AI. Wyciek z webowej wersji zdradza Reasoning, Research, Storybook i dyktowanie głosowe

W ukrytym menu webowej aplikacji Meta AI pojawiły się odniesienia do nieopublikowanych jeszcze trybów: Reasoning, Research, Storybook, a także Canvas, Connections, Think Hard i Search. Sygnalizuje to pakietową aktualizację, która mogłaby domknąć lukę funkcjonalną wobec czołowych modeli LLM. Tempo wdrożenia pozostaje niepewne, ale ślady w interfejsie sugerują, że prace są zaawansowane.

Read More
LLMR & D

kvcached: Elastyczne zarządzanie pamięcią GPU kluczem do efektywniejszego serwowania dużych modeli językowych

Model kvcached, opracowany przez badaczy z University of California w Berkeley we współpracy z Rice University i UCLA oraz z wkładem ekspertów z NVIDIA i Intela, to nowa biblioteka, która rewolucjonizuje zarządzanie pamięcią GPU w kontekście serwowania dużych modeli językowych (LLM). Wprowadza ona wirtualizację pamięci KV cache, umożliwiając elastyczne przydzielanie zasobów i optymalizując ich wykorzystanie w dynamicznych środowiskach.

Read More