LLM

DeepSeek uderza w OpenAI: Model Flash 0731 oferuje niemal topową wydajność za ułamek ceny

Chiński DeepSeek właśnie udowodnił, że potrafi wycisnąć z algorytmów więcej niż giganci z Doliny Krzemowej. Premiera modelu V4 Flash o oznaczeniu – – 0731 to nie jest kolejna nudna aktualizacja. To brutalny atak na portfele klientów OpenAI. Nowy model osiąga wyniki, które niemal stawiają go na równi z GPT-5.6 Luna, ale robi to za cenę, która sprawia, że amerykańska konkurencja wygląda na absurdalnie drogą.

Dla branży to moment krytyczny. Zbliżenie się DeepSeek do czołówki przy drastycznym cięciu kosztów zwiększa presję na rynki API i zmusza OpenAI do defensywy. Według raportu Artificial Analysis, model ten – – uzyskał 50 punktów w Artificial Analysis Intelligence Index, co oznacza skok o 10 punktów w zaledwie kilka miesięcy. To sygnał, że dominacja USA w dziedzinie efektywnego AI właśnie pękła.

Wydajność na poziomie gigantów

Wynik 50 punktów w rankingu plasuje chiński model zaledwie jeden punkt za flagowym, budżetowym produktem Sama Altmana. Poprawa parametrów to nie tylko liczby w tabelkach. W teście GDPval, symulującym realne zadania biurowe, model zanotował potężny wzrost z 1189 do 1559 punktów Elo. Największe postępy widać tam, gdzie mniejsze modele zazwyczaj polegały — w zadaniach agentycznych i w walce z halucynacjami.

Inżynierowie DeepSeek nie zmienili architektury – – to nadal 284 miliardy parametrów, z czego tylko 13 miliardów pracuje w danej chwili. Zoptymalizowali jednak proces tak skutecznie, że system zużywa o 12 procent mniej tokenów niż poprzednia wersja. Przy oknie kontekstowym sięgającym miliona tokenów, model staje się potężnym narzędziem do analizy ogromnych zbiorów danych.

Ekonomia skali: Ceny, które bolą konkurencję

To, co faktycznie zmienia zasady gry, to cennik. DeepSeek ustalił stawki na poziomie 0,14 dolara za milion tokenów wejściowych oraz 0,28 dolara za wyjściowe. Nawet po ostatnich obniżkach w OpenAI, rozwiązanie z Chin pozostaje o około 60 procent tańsze w przeliczeniu na pojedyncze zadanie.

Kluczem do finansowej dominacji jest jednak obsługa pamięci podręcznej. Podczas gdy rynkowym standardem jest 90-procentowa zniżka, Chińczycy oferują aż 98-procentowy rabat na trafienie w pamięć podręczną, wyceniając je na symboliczne 0,0028 dolara za milion tokenów. Model jest już dostępny na platformie Hugging Face na licencji MIT, co pozwala deweloperom budować własne systemy bez uwiązania w zamkniętych, amerykańskich chmurach.