LLM

AWS udostępnia Strands Decider 2B. Model podejmuje decyzje zamiast generować tekst

AWS Strands Labs udostępniło Strands Decider 2B — model, który nie tworzy tekstu, lecz wybiera jedną z podanych w zapytaniu opcji, ocenia prawdopodobieństwo odpowiedzi „tak” lub „nie” albo przypisuje wynik na uporządkowanej skali. Każdemu rozstrzygnięciu towarzyszy wyliczony poziom pewności.

Architektura różni się od tradycyjnych modeli językowych. Zamiast standardowej głowicy generującej kolejne tokeny, w Strands Decider zastosowano niewielką głowicę wskaźnikową. Porównuje ona stan ukryty modelu z reprezentacją opcji podanych w zapytaniu, dzięki czemu wynik powstaje w jednym przebiegu obliczeniowym.

Model liczy 1,9 mld parametrów i może działać lokalnie na procesorze, konsumenckiej karcie graficznej lub komputerze z układem Apple Silicon. Wagi udostępniono w serwisie Hugging Face na licencji Apache-2.0. Do uruchomienia służy pakiet strands-decider, który zapewnia interfejs wiersza poleceń oraz serwer HTTP.

Autorzy projektu zwracają uwagę na kwestie bezpieczeństwa: serwer domyślnie nasłuchuje wyłącznie pod adresem lokalnym (127.0.0.1) i nie ma wbudowanego mechanizmu uwierzytelniania. Wykorzystanie go w środowisku produkcyjnym wymaga wdrożenia własnej warstwy zabezpieczeń.

Strands Decider 2B jest wyspecjalizowanym komponentem i nie zastępuje ogólnych modeli językowych. Twórcy zaznaczają, że nie nadaje się do prowadzenia rozmów, pisania kodu ani streszczania tekstów, a w złożonych zadaniach wypada słabiej niż modele ukierunkowane na wnioskowanie. Z deklaracji zespołu wynika, że w przypadku krótkich, niewidzianych wcześniej zadań trafność sięgała około 95 proc., lecz odnosi się to wyłącznie do odpowiedzi z poziomem pewności wynoszącym co najmniej 0,9.