Agenci AI

Alibaba rzuca wyzwanie zachodnim gigantom: Qwen3.7-Plus zmienia AI w autonomicznego agenta

Dwa czerwca 2026 roku Alibaba oficjalnie wypuściła Qwen3.7-Plus, kończąc czas prostych chatbotów. To narzędzie nie pyta o zgodę przy każdym kliknięciu. To „multimodalny hybrydowy agent interaktywny”, który na platformie Bailian łączy wzrok i język w jedną maszynę do wykonywania zadań. Zamiast tylko podpowiadać kod, system sam obsługuje aplikacje i zarządza infrastrukturą chmurową.

Premiera ta wpisuje się w zaostrzający się wyścig agentów, w którym chińscy giganci przestali gonić Zachód i zaczęli wytyczać własne ścieżki. Według analizy MarkTechPost, model ten ma zająć pozycję lidera w automatyzacji workflowów, oferując sprawność porównywalną z Claude Opus, ale przy ułamku kosztów operacyjnych.

Wizualna inteligencja i interfejsy przyszłości

Qwen3.7-Plus redefiniuje granice multimodalności. System operuje w zamkniętej pętli decyzyjnej, co pozwala mu na płynne przechodzenie między wierszem poleceń a kliknięciami w menu aplikacji mobilnych. Zespół Qwen z Alibaby podkreśla, że model integruje cykl „zobacz – pomyśl – napisz – wykonaj – zweryfikuj” w jeden proces. Rezultat? AI potrafi samodzielnie kupić i skonfigurować serwery ECS w konsoli Alibaba Cloud poprzez rozszerzenie do przeglądarki Chrome, bez żadnej pomocy eksperta.

Od dokumentacji po 10 tysięcy linii kodu

Możliwości modelu najlepiej ilustruje testowy projekt budowy aplikacji do nauki angielskiego. Agent pracował nieprzerwanie przez ponad 11 godzin, wywołał narzędzia ponad 1000 razy i wygenerował przeszło 10 tysięcy linii kodu. Proces nie był jedynie bezmyślnym pisaniem skryptów. Model przygotował dokumentację, stworzył scenariusze testowe i przeprowadził deployment. Kolejny dowód to rekonstrukcja natywnej aplikacji giełdowej Stocks z systemu macOS. Qwen3.7-Plus przeanalizował interfejs, napisał kod w SwiftUI i podłączył zewnętrzne API. Efekt to 10 na 10 punktów w testach funkcjonalnych, wliczając w to poprawne odwzorowanie trybu ciemnego.

Precyzja w GUI kontra wyzwania logiczne

W benchmarkach takich jak ScreenSpot Pro czy AndroidWorld, Qwen3.7-Plus dominuje nad zachodnią konkurencją w zakresie nawigacji po interfejsach graficznych. Na poziomie czystego kodowania model zdobył 87,9 pkt w MultiPL-E, co stawia go w ścisłej światowej czołówce systemów klasy enterprise. Jednak w rygorystycznych testach naukowych, jak MedXpertQA-MM, wciąż ustępuje pola jednostkom takim jak Gemini 3.1 Pro. „Qwen3.7-Plus jednoczy widzenie i język, stając się fundamentem dla inteligentnych agentów” — przekonuje zespół Alibaba Cloud w serwisie AIBase News.

Agresywna strategia cenowa i integracja

Alibaba uderza bezpośrednio w ekosystem Anthropic. Qwen3.7-Plus jest w pełni kompatybilny z protokołami OpenAI i Anthropic, co umożliwia szybką migrację projektów korzystających dotąd z Claude Code. Strategicznym uderzeniem jest jednak cena. 0,40 USD za milion tokenów wejściowych i 2,40 USD za wyjściowe to stawki kilkukrotnie niższe niż u amerykańskiej konkurencji. Dzięki funkcji preserve_thinking, model zachowuje ciągłość logiczną nawet przy wielogodzinnych zadaniach, co może uczynić go bazowym silnikiem dla autonomicznych botów chmurowych i systemów wsparcia kierowców.