DeepSeek zaprezentował eksperymentalny model sztucznej inteligencji V3.2-Exp. Dzięki technologii Sparse Attention ma on znacząco obniżać koszty wnioskowania w długim kontekście i poprawiać efektywność przetwarzania tekstu.
Nowy model dla długiego kontekstu
Model V3.2-Exp został oficjalnie ogłoszony w poniedziałek na platformie Hugging Face, a także szczegółowo opisany w artykule naukowym opublikowanym na GitHubie. Jego kluczowym elementem jest DeepSeek Sparse Attention (DSA) – mechanizm, który pozwala modelowi efektywniej radzić sobie z długimi sekwencjami tekstu.
System składa się z dwóch głównych modułów: indeksatora Lightning, który priorytetyzuje istotne fragmenty kontekstu, oraz systemu precyzyjnego wyboru tokenów, który selekcjonuje konkretne jednostki językowe i przekazuje je do ograniczonego okna uwagi modelu.
Dzięki temu, V3.2-Exp może operować na dużych blokach tekstu, zużywając znacznie mniej mocy obliczeniowej.
DeepSeek stawia na tańsze modele AI
Według wstępnych testów przeprowadzonych przez DeepSeek, zastosowanie Sparse Attention pozwala zmniejszyć koszt wywołań API w długim kontekście nawet o 50%. Choć firma zaznacza, że potrzebne są dalsze badania, otwarta dostępność modelu umożliwi szybkie weryfikacje przez niezależne podmioty.
Co ciekawe, DeepSeek już wcześniej próbował obniżać koszty trenowania i utrzymania modeli. Na początku roku firma zwróciła na siebie uwagę branży modelem R1, trenowanym głównie z wykorzystaniem uczenia wzmacniającego i znacznie tańszym od innych rozwiązań dostępnych na rynku amerykańskich. Model ostatecznie nie spełnił pokładanych w nim nadziei, ale potwierdził ambicje DeepSeek w tworzeniu bardziej ekonomicznych alternatyw, czego przykładem jest chociażby nowo zaprezentowany model V3.2-Exp.
Aby zapewnić jak najlepsze wrażenia, korzystamy z technologii, takich jak pliki cookie, do przechowywania i/lub uzyskiwania dostępu do informacji o urządzeniu. Zgoda na te technologie pozwoli nam przetwarzać dane, takie jak zachowanie podczas przeglądania lub unikalne identyfikatory na tej stronie. Brak wyrażenia zgody lub wycofanie zgody może niekorzystnie wpłynąć na niektóre cechy i funkcje.
Funkcjonalne
Zawsze aktywne
Przechowywanie lub dostęp do danych technicznych jest ściśle konieczny do uzasadnionego celu umożliwienia korzystania z konkretnej usługi wyraźnie żądanej przez subskrybenta lub użytkownika, lub wyłącznie w celu przeprowadzenia transmisji komunikatu przez sieć łączności elektronicznej.
Preferencje
Przechowywanie lub dostęp techniczny jest niezbędny do uzasadnionego celu przechowywania preferencji, o które nie prosi subskrybent lub użytkownik.
Statystyka
Przechowywanie techniczne lub dostęp, który jest używany wyłącznie do celów statystycznych.Przechowywanie techniczne lub dostęp, który jest używany wyłącznie do anonimowych celów statystycznych. Bez wezwania do sądu, dobrowolnego podporządkowania się dostawcy usług internetowych lub dodatkowych zapisów od strony trzeciej, informacje przechowywane lub pobierane wyłącznie w tym celu zwykle nie mogą być wykorzystywane do identyfikacji użytkownika.
Marketing
Przechowywanie lub dostęp techniczny jest wymagany do tworzenia profili użytkowników w celu wysyłania reklam lub śledzenia użytkownika na stronie internetowej lub na kilku stronach internetowych w podobnych celach marketingowych.