Jesteśmy świadkami rewolucji w świecie technologii, gdzie chiński model Quen 3.8 Max zaskakuje nas swoją nieprzeciętną wydajnością.
Wielkie roszczenia bez dowodów
Zespół Alibaby podczas konferencji World AI w Szanghaju przedstawił model o 2,4 bilionach parametrów. Twierdzą oni, że ustępuje on jedynie najnowszym rozwiązaniom od Fable 5.
Brak transparentności danych
Niestety informacje te opierają się na wewnętrznej ocenie producenta i nie są poparte publicznymi tabelami testów ani kartami modelu. Nie wiemy, ile parametrów faktycznie jest uruchamianych w czasie rzeczywistym.
Testy gier wyścigowych
Pierwszym wyzwaniem była budowa gry wyścigowej 3D. W tym konkretnym scenariuszu chiński Quen 3.8 zdecydowanie zwyciężył nad konkurencją, tworząc ostry obraz i płynną rozgrywkę.
Porównanie z GPT 5.6
Kolejnym etapem była walka przeciwko modelowi GPT 5.6 Soul. Tym razem lepsze wyniki odnotował zachodni gigant, który wykazał się przejrzystszym i bardziej estetycznym interfejsem użytkownika.
Wnioski z wielokrotnych prób
Jeden test nie wystarczy do podsumowania jakości oprogramowania. Dlatego przeprowadziliśmy szereg eksperymentów, w tym symulację lotu oraz analizę fizyki materiałów, aby uzyskać pełny obraz.
System operacyjny Agent OS
Korzystamy z własnego systemu operacyjnego agenta, który pozwala na jednoczesne uruchamianie Quen 3.8, Fable 5 oraz GPT 5.6 na tym samym pulpicie do porównawczych analiz.
Szybka decyzja dla zarządu
Nasz system umożliwia podjęcie trafnej decyzji o wyborze odpowiedniego narzędzia w ciągu zaledwie dwóch minut, zamiast marnować dwa dni na rozważania i testowanie pojedynczych rozwiązań.