Radykalny skok skali modeli językowych
Planowany model rozwijany przez zespół Qwen ma charakteryzować się skalą od 5 do 10 bilionów parametrów. Dla porównania, obecny flagowy system koncernu, Qwen 3.8 Max, posiada 2,4 biliona parametrów. Nowa konstrukcja ma być od dwóch do czterech razy większa i pozwoli na realizację bardziej złożonych, długoterminowych zadań. Jak zaznaczył Eddie Wu podczas konferencji Apsara w Hangzhou, celem prac jest przybliżenie się do stworzenia sztucznej superinteligencji (ASI).
Zespół badawczy Alibaba osiągnął również postępy w zakresie rekursywnej samodoskonalenia (RSI), czyli procesu, w którym modele samodzielnie identyfikują własne ograniczenia, projektują eksperymenty i syntetyzują dane do dalszego rozwoju.
Nowy chip i potężne klastry obliczeniowe
Wraz z zapowiedzią nowego modelu, należąca do koncernu spółka projektująca układy scalone, T-Head, zaprezentowała procesor Zhenwu V900. Według deklaracji dyrektora wykonawczego jest to najpotężniejszy chip AI stworzony w Chinach. Oferuje on trzykrotnie wyższą wydajność w porównaniu do swojego poprzednika, układu M890.
Pojedynczy klaster oparty na Zhenwu V900 może obsłużyć do 500 tysięcy kart przyspieszających jednocześnie, co umożliwia wspólne trenowanie oraz prowadzenie wnioskowania dla najbardziej zaawansowanych modeli. Wdrożenie na skalę komercyjną planowane jest na pierwszy kwartał 2027 roku.
Globalna rozbudowa chmury do 2032 roku
Równolegle z rozwojem warstwy sprzętowej i programowej Alibaba planuje znaczną rozbudowę zaplecza infrastrukturalnego. Koncern wyznaczył sobie cel zwiększenia globalnej wydajności centrów danych Alibaba Cloud do poziomu ponad 20 gigawatów (GW) do 2032 roku.
Przedstawiciele firmy podkreślają, że średnio- i długoterminowe zapotrzebowanie rynku znacznie przewyższa obecne moce produkcyjne i dostawcze w łańcuchu dostaw centrów danych AI, co przyspiesza wzrost przychodów Alibaba Cloud.