Właśnie zaszły wydarzenia o ogromnym znaczeniu dla świata informatyki.
Niewiarygodna zmiana w architekturze modeli
Firma Nvidia przejęła najnowszy model Qwen 3.6 od Alibaby i dokonała nad nim rewolucyjnych zmian technicznych.
Specjaliści zdołali zredukować rozmiar modelu do takiego stopnia, że teraz pasuje on na sprzęt posiadany przez przeciętnego użytkownika domowego lub biurowy.
Zachowanie wysokiej inteligencji przy mniejszym zużyciu zasobów
Niezwykle ważne jest to, że pomimo drastycznego zmniejszenia rozmiaru, model nie stracił na swojej zdolności do rozwiązywania złożonych problemów.
Ta nowość całkowicie zmienia postać rzeczy w dziedzinie dostępu do zaawansowanych systemów sztucznej inteligencji dla każdego człowieka.
Unikalny mechanizm aktywacji podmózg
Nazwa modelu Qwen 3.635B-A3B może wydawać się skomplikowana, ale w rzeczywistości opisuje on genialną koncepcję działania.
Liczba 35B oznacza całkowitą pojemność wiedzy wynoszącą trzydzieści pięć miliardów parametrów, co tworzy ogromny intelektualny potencjał.
Jednakże liczba 3B wskazuje na fakt, że w danej chwili aktywowane są tylko trzy miliardy tych elementów podczas przetwarzania danych.
Porównanie do pracy zespołu specjalistów
Można to porównać do funkcjonowania szpitala, gdzie nie każdy lekarz musi badać każdego pacjenta jednocześnie.
Sysdem przywołuje tylko tych ekspertów, których potrzebuje w danym momencie, ignorując pozostałe setki podmózg znajdujących się w stanie spoczynku.
Dostępność na pojedynczym sprzęcie
Wcześniej uruchomienie tak inteligentnego modelu wymagało gigantycznej farmy komputerowej dostępnej wyłącznie dla wielkich korporacji.
Teraz osoby prywatne mogą uruchamiać ten system na zwykłej karcie graficznej o wysokiej wydajności, uzyskując prędkość przetwarzania ponad sto słów na sekundę.
Optymalizacja formatu danych przez firmę Nvidia
Nvidia opracowała specjalną wersję NVFP4, która pozwala zapisywać liczby w znacznie mniejszym formacie bez utraty precyzji obliczeń.
Każda wartość została zmniejszona do jednej czwartej jej dawnego rozmiaru, co przekłada się na trzykrotne oszczędzenie pamięci i sprzętu potrzebnego do działania.
Wyniki testów potwierdzające skuteczność
Kiedy zmniejsza się model w ten sposób, zazwyczaj oczekuje się spadku jakości, ale tutaj wyniki nie uległy zmianie.
Trochę tu na dole, trochę tam na górze – generalnie remis między wersją pełnowymiarową a zoptymalizowaną przez firmę Nvidia.