Cohere rzuca wyzwanie gigantom: Command A+ debiutuje jako model open source
Zamiast budować kolejne szczelnie zamknięte mury, kanadyjski Cohere stawia na otwartość. Firma właśnie udostępniła Command A+, swój najpotężniejszy model, na licencji Apache 2.0. To ruch pod prąd rynkowych liderów, który ma jeden cel: przekonać firmy, że zaawansowana AI nie musi kosztować fortuny ani wymagać serwerowni wielkości stadionu. Model z 218 miliardami parametrów wylądował na platformie Hugging Face, gotowy do pobrania i własnej konfiguracji.
Dlaczego to ważne teraz
Premiera Command A+ to sygnał, że rynek enterprise AI wchodzi w fazę bezwzględnej optymalizacji. Udostępnienie tak dużej jednostki w architekturze Mixture-of-Experts (MoE) pozwala na wdrożenia typu open source przy drastycznie niższych kosztach obliczeniowych. Dzięki licencjonowaniu Apache 2.0 i oknie kontekstowym 128 tys. tokenów, bariera wejścia dla firm chcących budować własne systemy RAG na prywatnej infrastrukturze gwałtownie spada.
Architektura Mixture-of-Experts w służbie wydajności
Startup z Toronto wykonał odważny krok, pozycjonując się w kontrze do zamkniętych ekosystemów OpenAI czy Google. Nowa jednostka posiada 218 miliardów parametrów, ale dzięki architekturze MoE tylko 25 miliardów z nich pracuje podczas generowania odpowiedzi. Taka konstrukcja pozwala na znaczną oszczędność sprzętową. Według oficjalnego bloga Cohere, model można uruchomić na zaledwie dwóch akceleratorach Nvidia H100 lub pojedynczym układzie Blackwell. Zastosowanie kwantyzacji W4A4 daje dodatkowe 47% wzrostu szybkości, co przy zachowaniu jakości odpowiedzi czyni ten model niezwykle ekonomicznym w eksploatacji.
Skokowa poprawa w zadaniach agentowych i kodowaniu
To, co wyróżnia Command A+ na tle poprzednika, to drastyczny przyrost zdolności rozumowania. W benchmarku agentowym τ²-Bench Telecom model osiągnął wynik 85%, co stanowi potężny skok z poziomu 37%, jaki notowała wersja Command A Reasoning. Podobną progresję widać w testach programistycznych Terminal-Bench Hard, gdzie skuteczność wzrosła z marginalnych 3% do 25%. System został zoptymalizowany pod kątem tzw. Agentic Workflows, czyli autonomicznego wykonywania złożonych zadań wieloetapowych. Jak podkreśla zespół Cohere: „Używamy również techniki speculative decoding, aby przyspieszyć generowanie tekstu bez wpływu na jakość wyników”.
Ekosystem biznesowy i wsparcie dla 48 języków
Model obsługuje aż 48 języków (ponad dwukrotny wzrost względem poprzedniej generacji), wykazując przy tym o 20% lepszą efektywność tokenizacji dla języka arabskiego czy o 16% dla koreańskiego. Choć z wynikiem 37 punktów w Artificial Analysis Intelligence Index Command A+ plasuje się w tej samej lidze co Claude 3.5 Haiku, jego głównym atutem jest gotowość do pracy w środowiskach RAG. Premiera zbiega się w czasie z istotnym wzmocnieniem struktur firmy po przejęciu niemieckiego Aleph Alpha, co sygnalizuje ambicje Cohere do dominacji na europejskim rynku rozwiązań AI dla sektora przedsiębiorstw. Wagi modelu są już dostępne na platformie Hugging Face w różnych stopniach kwantyzacji, od BF16 po oszczędne W4A4.
