Tencent rzuca wyzwanie gigantom: Premiera modelu Hy4 z milionowym oknem kontekstowym
Tencent wykonał właśnie ruch, który może zmienić układ sił w świecie modeli open-source. Chiński koncern opublikował Hy4 preview – kolosa o łącznej liczbie 770 miliardów parametrów, z których 49 miliardów pozostaje aktywnych w trakcie przetwarzania dzięki architekturze Mixture-of-Experts (MoE). Największe wrażenie robi jednak okno kontekstowe o pojemności miliona tokenów. To wyraźny sygnał, że gigant z Shenzhen nie zamierza zostawiać pola rywalom z USA w kategorii przetwarzania gigantycznych zbiorów danych.
Dlaczego to ważne teraz
Premiera Hy4 to moment, w którym technologie o skali do niedawna zarezerwowanej dla zamkniętych systemów trafiają do szerszego obiegu pod licencją Apache 2.0. Model ten, udostępniony na platformach takich jak OpenRouter, rzuca wyzwanie globalnej czołówce AI, oferując gigantyczną pamięć operacyjną przy relatywnie niskich kosztach wdrożenia. To szansa na budowę agentów AI, którzy nie „zapominają” początku dokumentacji technicznej po kilku minutach rozmowy.
Precyzyjna optymalizacja i wydajność w chmurze
Inżynierowie z zespołu Tencent Hy zaprojektowali system z myślą o ekstremalnie wymagających środowiskach: od inżynierii oprogramowania po fizykę materii skondensowanej. Co istotne dla społeczności, udało się skompresować Hy4 z pierwotnych 1,5 TB do około 200 GiB w formacie GGUF. Zastosowano technikę MIX-STQ1_0, w której kalibracja danych decyduje o szerokości bitowej poszczególnych warstw (od 1,31 do 2,06 bita), co pozwala na płynną pracę nawet przy ograniczonych zasobach sprzętowych.
Autonomia w kodowaniu i badaniach
Hy4 nie jest jedynie kolejnym chatbotem. Tencent pozycjonuje go jako narzędzie do planowania i debugowania złożonych projektów. W testach wewnętrznych system potrafił tworzyć grywalne prototypy na podstawie pojedynczego promptu i samodzielnie poprawiać kod w silnikach gier. Zespół Hy Team deklaruje na GitHubie projektu, że jednostka jest przeznaczona do zadań wymagających „ciągłości kontekstu i wieloetapowego wykonania”. W benchmarkach dotyczących trenowania małych modeli system pokonał nawet wyspecjalizowany model Codex, co sugeruje, że chińskie AI zaczyna realnie wspierać procesy R&D.
Konfrontacja z rynkową czołówką
W ślepych testach z udziałem 163 ekspertów Hy4 uzyskał średnią ocenę 2,99 w skali inżynieryjnej. To wynik wyższy niż w przypadku konkurencyjnych modeli GLM 5.3 (2,92) oraz Kimi K3 (2,94). Twórcy zachowują jednak szczyptę samokrytycyzmu. Przyznają, że wersja preview miewa tendencję do zbyt długiego analizowania zadań oraz nadmiernej weryfikacji własnych wyników, co niepotrzebnie wydłuża czas pracy.
Dostępność i agresywny cennik
Model jest dostępny przez Tencent Cloud oraz publiczne repozytoria. Strategia cenowa API wygląda na próbę agresywnego przejęcia rynku: stawka wynosi zaledwie 0,042 USD za milion tokenów w przypadku danych zbuforowanych, co czyni go atrakcyjną alternatywą dla drogich modeli z USA. Jak informuje firma w oficjalnym komunikacie: „Hy4 preview jest teraz dostępny jako model open-source i można z niego korzystać globalnie poprzez WorkBuddy, CodeBuddy, a także produkty Yuanbao i ima”. Dane treningowe pochodziły bezpośrednio z pracy programistów i analityków finansowych Tencentu, co ma być gwarancją użyteczności w realnym biznesie.
