LLM

Nvidia rzuca wyzwanie OpenAI. Model Nemotron 3 Super zmienia zasady gry

Przez lata rynkowa pozycja Nvidii była klarowna: firma dostarczała łopaty i kilofy dla cyfrowej gorączki złota, pozostawiając tworzenie samych algorytmów graczom takim jak OpenAI czy Anthropic. Premiera modelu Nemotron 3 Super 120B kończy tę epokę. Udostępniając potężny model w formacie open-weight, Jensen Huang wkracza agresywnie w sferę oprogramowania i drastycznie zmienia ekonomię wdrożeń sztucznej inteligencji.

Dlaczego to ważne właśnie teraz

Premiera modelu, która miała miejsce 11 marca 2026 roku, to element szerszej strategii Nvidii polegającej na domykaniu ekosystemu. Firma nie chce być już tylko dostawcą krzemu. Wypuszczając rodzinę Nemotron 3 (Nano, Super, Ultra), Nvidia uderza bezpośrednio w model biznesowy dostawców zamkniętych systemów. To strategiczne posunięcie ma zacementować popyt na układy Blackwell i usługi DGX Cloud, czyniąc z darmowego oprogramowania wabik na klientów potrzebujących ogromnej mocy obliczeniowej.

Architektura hybrydowa: Szybkość ponad wszystko

Techniczna strona Nemotrona 3 Super to popis inżynieryjnej sprawności. Zamiast powielać schematy konkurencji, Nvidia postawiła na hybrydową architekturę łączącą mechanizmy Mamba-2 z modelem LatentMoE (Latent Mixture of Experts). Rezultaty są konkretne: mimo posiadania 120 miliardów parametrów, model podczas pracy aktywuje jedynie 12 miliardów z nich. Ta inteligentna selektywność pozwala na osiąganie rekordowej przepustowości.

W porównaniu z rynkowymi rywalami, takimi jak chiński Qwen3.5-122B, propozycja z Santa Clara oferuje nawet 7,5-krotnie wyższą przepustowość w scenariuszach długiego kontekstu. Dodając do tego okno kontekstowe o pojemności miliona tokenów, otrzymujemy narzędzie, które według NVIDIA Research wygrywa w benchmarkach RULER, sprawniej radząc sobie z analizą potężnych zbiorów danych niż konkurencyjne rozwiązania.

Ekonomia uzależnienia, czyli darmowe wagi i drogi krzem

Ruch Nvidii to pokaz siły. Oferując model o wydajności zbliżonej do zamkniętego Claude 4.8 Opus w ułamku jego ceny (zaledwie 0,09 USD za milion tokenów na platformach takich jak OpenRouter), firma wywiera potężną presję na firmy żyjące ze sprzedaży dostępu do API. Nie jest to jednak gest altruizmu. Choć wagi i „receptury” treningowe są dostępne bezpłatnie, model zoptymalizowano pod format NVFP4, co czyni go najbardziej wydajnym na najnowszych kartach H200 i Blackwell.

Jak zauważa zespół Greptile, który testował model w realnych warunkach: „Nemotron 3 Super uderza znacznie powyżej swojej kategorii wagowej. Mimo że jest o rząd wielkości mniejszy od modeli frontier, był w stanie zidentyfikować zaskakujące błędy w kodzie”. Nvidia sprytnie domyka obieg: optymalizuje model pod własną architekturę, czyniąc z oprogramowania darmowe narzędzie, które zmusza klientów do zakupów w dziale sprzedaży GPU. To budowa totalnego systemu, w którym jeden gracz kontroluje zarówno warstwę fizyczną, jak i logiczną cyfrowego świata.