Agenci AI

Alibaba rzuca wyzwanie OpenAI. Qwen3.7-Plus wprowadza multimodalność w służbie agentów AI

Alibaba Cloud rzuca rękawicę liderom z Doliny Krzemowej. Udostępnienie modelu Qwen3.7-Plus na platformie Bailian (znanej globalnie jako Model Studio) to moment, w którym chiński gigant przestaje tylko gonić GPT-4, a zaczyna wyznaczać własne zasady gry w segmencie autonomicznym.

Dlaczego to ważne właśnie teraz? Branża AI przesuwa środek ciężkości z prostych chatbotów w stronę agentów wykonawczych. W wyścigu, w którym udział biorą OpenAI, Anthropic i Google, seria Qwen3.x wyrasta na pierwszą realną, nieamerykańską alternatywę. Dzięki oknu kontekstowemu sięgającemu 1 miliona tokenów oraz biegłości w zadaniach typu agentic coding, Alibaba oferuje suwerenność technologiczną firmom, które chcą budować złożone workflow bez polegania wyłącznie na modelach z USA. Według analityków z DevstockAcademy, model ten w testach naprawy błędów w repozytoriach GitHub osiąga wyniki zbliżone do najmocniejszych wersji Claude Opus.

Od czytania obrazu do pełnego sprawstwa

Qwen3.7-Plus to „native multimodal agent” – system od podstaw trenowany na danych wizualnych i tekstowych. W przeciwieństwie do wcześniejszych rozwiązań, które doklejały moduły wzroku do silników językowych, nowa jednostka spaja percepcję z wnioskowaniem. System ten służy do rozumienia treści wizualnych, a nie ich generowania. Potrafi analizować skomplikowane schematy i wyciągać dane z wideo, ale nie stworzy grafiki od zera.

„Qwen3.6-Plus postrzega świat z większą dokładnością i ostrzejszym rozumowaniem multimodalnym” – deklaruje Alibaba Cloud, promując fundament pod tzw. pętlę możliwości (capability loop). Model nie tylko planuje zadania, ale samodzielnie pisze kod, uruchamia testy i koryguje błędy w pętli zwrotnej. Skalę tego zjawiska pokazuje test modelu Qwen3.7-Max, który przeprowadził autonomiczny proces optymalizacji jądra systemu operacyjnego. Operacja ta trwała 35 godzin i wymagała ponad 1000 wywołań zewnętrznych narzędzi bez utraty spójności logicznej.

Chińska ofensywa w rankingach

Debiut nowej wersji Qwen widać w benchmarkach. W zestawieniu Vision Arena model zajął 16. miejsce w klasyfikacji ogólnej, czyniąc Alibabę piątym najsilniejszym ośrodkiem badawczym w dziedzinie widzenia komputerowego. Bariera technologiczna między Wschodem a Zachodem staje się coraz cieńsza. Tekstowy wariant Max w indeksie Artificial Analysis uzyskał 56,6 punktu – to najwyższy rezultat zanotowany przez model z Chin, potwierdzający solidne fundamenty logiczne serii.

Ekosystem nastawiony na bezpieczeństwo

Dla inżynierów kluczowe jest wsparcie dla 201 języków i dialektów oraz integracja z mechanizmem Agentic RL (uczenie ze wzmocnieniem). Pozwala to modelowi uczyć się na podstawie realnych wyników wykonanych operacji. Alibaba wprowadziła też sztywne bariery bezpieczeństwa (guardrails). Są niezbędne, gdy agent dostaje uprawnienia do edycji plików lub dostępu do systemów informatycznych firmy – bez nich ryzyko niekontrolowanych zmian w infrastrukturze byłoby zbyt wysokie.

Qwen3.7-Plus to jasny sygnał: dla Alibaby przyszłość AI to nie tylko rozmowa, ale działanie. Choć amerykańscy liderzy wciąż prowadzą w rankingach czystej mocy obliczeniowej, kompleksowość narzędzi do obsługi długofalowych procesów biznesowych sprawia, że propozycja z Hangzhou staje się trudna do zignorowania.