Gen AI

LLM

DeepSeek-V3.2: Przełom w rozumowaniu długiego kontekstu dzięki rzadkiej uwadze i obciążeniom agentowym

DeepSeek prezentuje modele DeepSeek-V3.2 i DeepSeek-V3.2-Speciale, które dzięki innowacyjnemu podejściu do rzadkiej uwagi i zaawansowanym metodom RL osiągają wydajność porównywalną z GPT-5 i Gemini 3.0 Pro, znacząco obniżając koszty obliczeniowe dla złożonych zadań agentowych i rozumowania w długim kontekście. Modele te, dostępne z otwartymi wagami, redefiniują możliwości wielkich modeli językowych.

Read More