Anthropic obniża stawki za Claude Haiku 5.5, ale rachunki zależą od tokenizatora
Anthropic udostępnił model Claude Haiku 5.5, zaprojektowany do szybkich zadań wykonywanych na dużą skalę i przy dużej wrażliwości na koszty, takich jak klasyfikacja danych, generowanie podsumowań, obsługa zapytań do baz czy prosta komunikacja z klientami. Model jest dostępny w usługach chmurowych AWS, Google Cloud oraz Microsoft Azure.
Główną zmianą w nowym wariancie jest cennik. Dla promptów mieszczących się w limicie 100 tys. tokenów stawki wynoszą 0,10 dolara za milion tokenów wejściowych oraz 0,50 dolara za milion tokenów wyjściowych. W porównaniu z Haiku 4.5 (odpowiednio 1 i 5 dolarów) oznacza to spadek cen jednostkowych nawet o 90 proc. Według szacunków Anthropic w tym limicie mieści się około 90 proc. zapytań kierowanych dotąd do modeli z tej rodziny. Firma podaje, że średni koszt korzystania z modelu spadł o około 75 proc.
Przekroczenie progu 100 tys. tokenów wiąże się jednak ze znaczącym wzrostem opłat: stawki rosną wtedy pięciokrotnie, do 0,50 dolara za tokeny wejściowe i 2,50 dolara za tokeny wyjściowe.
Sama redukcja stawek za token nie przekłada się automatycznie na proporcjonalnie niższy rachunek. Haiku 5.5 wykorzystuje zaktualizowany tokenizator, który przetwarza ten sam tekst na większą liczbę tokenów niż poprzednik. Opublikowane materiały nie podają dokładnego pomiaru kosztów wykonania konkretnych zadań w nowej wersji, przez co faktyczne oszczędności w środowisku produkcyjnym zależą od specyfiki przetwarzanych danych.
Większa skuteczność w obsłudze interfejsów
Wśród wyników testów przedstawionych przez Anthropic największą różnicę odnotowano w środowiskach pracy z komputerem. W benchmarku OSWorld-2.1, mierzącym zdolność modelu do wykonywania operacji w systemie operacyjnym, Haiku 5.5 uzyskał 72,4 proc., podczas gdy Haiku 4.5 osiągał w nim 15,7 proc. Zdolność ta ma znaczenie w powtarzalnych, zautomatyzowanych procesach, które wymagają dużej liczby zapytań.
Haiku 5.5 jest również pierwszym modelem w swojej linii, w którym użytkownik może regulować poziom rozumowania, dopasowując czas odpowiedzi i koszt do stopnia skomplikowania polecenia. Anthropic przedstawia go jako narzędzie do wąsko zdefiniowanych zadań lub pomocniczego agenta, wskazując, że do złożonych zadań programistycznych i wieloetapowej pracy agentowej nadal przeznaczone są większe modele: Sonnet 5.5 oraz Opus 5.5.
