Gen AI

LLM

ReasonFlux-PRM zmienia ocenę rozumowania LLM poprzez analizę przebiegu tego procesu

Tradycyjne metody oceny dużych modeli językowych (LLM) skupiają się głównie na poprawności odpowiedzi końcowych, ignorując proces rozumowania, który do nich prowadzi. Nowe podejście, ReasonFlux-PRM, ma na celu zrewolucjonizowanie tej praktyki, koncentrując się na jakości poszczególnych kroków myślowych, co jest kluczowe dla zaawansowanych modeli generujących złożone ścieżki rozumowania.

Read More
LLMR & D

Baidu udostępnia ERNIE 4.5: ewolucja modeli LLM od 0.3B do 424B parametrów

Baidu, chiński gigant technologiczny, ogłosił udostępnienie swojej najnowszej serii modeli językowych ERNIE 4.5. Pakiet zawiera dziesięć wariantów, od kompaktowych modeli o 0.3 miliarda parametrów do rozbudowanych architektur Mixture-of-Experts (MoE) sięgających 424 miliardów parametrów, oferując globalnej społeczności badawczej i deweloperskiej dostęp do zaawansowanych zdolności analizy i generowania języka.

Read More
LLMR & D

Crome: Google DeepMind przedstawia metodę na uniknięcie 'hakowania nagród’ w modelach językowych

W dążeniu do stworzenia bardziej niezawodnych i bezpiecznych modeli językowych (LLM), Google DeepMind, wspólnie z badaczami z McGill University i MILA, przedstawiło Crome – nowatorski framework oparty na przyczynowym rozumieniu generowania odpowiedzi. Crome ma za zadanie raz na zawsze rozwiązać problem tzw. hakowania nagród, który trawi obecne systemy sztucznej inteligencji.

Read More
NarzędziaProgramowanie

OpenAI Codex jako kopilot w inżynierii oprogramowania: Połączenie z GitHub zmienia perspektywę rozwoju

OpenAI Codex, integrując się z repozytoriami GitHub, oferuje deweloperom zaawansowane narzędzie, które rewolucjonizuje proces tworzenia oprogramowania. Od automatycznego tworzenia zapytań PR po głęboką analizę kodu – Codex staje się aktywnym partnerem w codziennej pracy programisty, przesuwając granice efektywności i współpracy z AI.

Read More
BiznesLLM

Ukryte koszty AI: jak błędne podpowiedzi i 'context bloat’ windują wydatki i rodzą nową dyscyplinę – Prompt Ops

Rosnąca złożoność modeli językowych LLM i wydłużające się okna kontekstowe, choć zwiększają ich możliwości, prowadzą do niekontrolowanego wzrostu kosztów obliczeniowych. Nowa dyscyplina, Prompt Ops, ma pomóc firmom w zarządzaniu tym wyzwaniem i optymalizacji interakcji z AI, by zminimalizować zbędne wydatki i zwiększyć \”wykorzystanie systemu\”.

Read More