W tym samym tygodniu ukazały się dwa monumentalne modele w świecie sztucznej inteligencji, a ich połączenie tworzy coś o wiele bardziej przydatnego niż każda z nich osobno. Alibaba właśnie zaprezentowała Qwen 3.8, który ma imponujące 2,4 biliona parametrów i jest największym modelem stworzonym przez tę firmę.
Dwa potężne modele zmieniają landscape
Qwen 3.8 to nie tylko narzędzie do pisania tekstów, ale profesjonalny współpracownik zdolny do oglądania obrazów i filmów oraz samodzielnego wykonywania zadań planowania. W tym samym czasie NVIDIA ujawniła urządzenie o nazwie Nemotron 3 Embed 8B, które zajęło pierwsze miejsce w rankingu RTEB.
Rola pamięci w systemach AI
Nemotron 3 Embed to część systemu odpowiedzialna za pamięć, podczas gdy Qwen działa jak mózg myślowy. Duży model bez odpowiedniej warstwy osadzania zapomina wszystko po zamknięciu czatu, co czyni go niewydajnym w długoterminowych projektach.
Przełomowa technologia wyszukiwania
Nemotron 3 Embed umożliwia błyskawiczne przeszukiwanie ogromnych ilości tekstu i precyzyjne wydobycie informacji. Model ten tworzy logiczne foldery w systemie liczbowym, grupując fragmenty o podobnym znaczeniu nawet przy użyciu różnych słów.
Szybkość jako klucz do sukcesu
Presja konkurencji zmusza firmy do szybszego działania. Dwa dni przed premierą Qwen 3.8 firma Moonshot AI wypuściła model Kimiko 3, co wymusiło na Alibaba przyspieszenie procesu.
Dostępność dla programistów
NVIDIA udostępniła Nemotron publicznie, dzięki czemu każdy developer może go wykorzystać w projektach komercyjnych. Model ten integruje się z narzędziami do wyszukiwania i pobierania danych na platformie Base 10.
Techniczne szczegóły modelu
Nemotron powstał na bazie architektury Mistral, przeprojektowany przez NVIDIA do odczytywania danych w obu kierunkach. Rozumie on aż trzydzieści cztery języki i obsługuje kontekst składający się z około 32 tysięcy słów.
Wyniki testów wydajności
Członek zespołu Qwen, Shuai Bai, podkreślił, że to pierwszy raz, gdy model przekroczył bilion parametrów i obsługiwał multimedia. Alibaba twierdzi, że ich rozwiązanie ustępuje jedynie Claude Fable 5 pod względem ogólnej wydajności.