LLM

DeepSeek V4 rzuca wyzwanie liderom. Chińskie modele niemal dogoniły GPT i Gemini

DeepSeek, chiński startup, który w ubiegłym roku wywołał poruszenie modelem R1, powraca z nową generacją systemów AI. Modele DeepSeek V4 Flash oraz V4 Pro to konstrukcje oparte na architekturze Mixture-of-Experts (MoE), które celują bezpośrednio w segment tzw. frontier models. Flagowy wariant Pro posiada łącznie 1,6 biliona parametrów, z czego 49 miliardów pozostaje aktywnych podczas wykonywania pojedynczego zadania. Takie podejście pozwala nie tylko na zachowanie wysokiej wydajności, ale przede wszystkim na drastyczną redukcję kosztów obliczeniowych, co staje się znakiem rozpoznawczym azjatyckiego laboratorium.

Potęga skali i precyzja rozumowania

Nowe modele oferują okno kontekstowe o rozmiarze 1 miliona tokenów, co w praktyce umożliwia analizę obszernych repozytoriów kodu lub wielusetstronicowych dokumentów w jednym zapytaniu. Pod względem rozmiaru DeepSeek V4 Pro wyprzedza konkurentów takich jak Moonshot AI czy MiniMax, stając się obecnie największym dostępnym modelem o otwartych wagach. Twórcy deklarują, że w testach sprawdzających umiejętności programistyczne oba warianty V4 osiągają wyniki porównywalne z najbardziej zaawansowanymi wersjami GPT, co sytuuje je w absolutnej czołówce branżowej.

Gdzie kończą się możliwości technologii z Hangzhou?

Mimo sukcesów w benchmarkach logicznych i technicznych, DeepSeek otwarcie przyznaje, że ich systemy wciąż ustępują zachodnim rywalom w testach sprawdzających wiedzę ogólną. Dystans do modeli takich jak GPT-5.4 czy Gemini 3.1 Pro oceniany jest na około 3 do 6 miesięcy opóźnienia technologicznego. Warto również zauważyć, że modele z serii V4 pozostają systemami czysto tekstowymi. Podczas gdy giganci z USA stawiają na multimodalność, integrując natywną obsługę audio, wideo i obrazu, DeepSeek koncentruje się na maksymalizacji efektywności przetwarzania tekstu i kodu.

Ekonomia skali i kontrowersje w tle

Największym atutem chińskiego rozwiązania pozostaje bezkonkurencyjna cena. DeepSeek V4 Pro jest wielokrotnie tańszy w eksploatacji niż Claude Opus czy Gemini Pro, co stawia platformy takie jak OpenAI w trudnej sytuacji rynkowej. Jednak ten agresywny model biznesowy i technologiczny budzi opór. Premiera zbiegła się w czasie z oskarżeniami rządu USA o masową kradzież własności intelektualnej przez chińskie podmioty. Sam DeepSeek był już wcześniej posądzany przez Anthropic i OpenAI o techniki „destylacji”, czyli de facto kopiowania sposobu myślenia ich modeli, co rzuca cień na oryginalność spektakularnych postępów laboratorium.