Jesteśmy świadkami rewolucji w świecie sztucznej inteligencji, gdzie nieprzewidywalny nowy model Kimí K3 właśnie pokonał gigantów takich jak Fable 5 oraz GPT-5.6.
Nowy lider z otwartego laboratorium
Czy najlepsza technologia musi pochodzić z dużych korporacji? Właśnie pojawiło się zupełnie nowe, otwarte rozwiązanie skierowane prosto do największych nazwisk na rynku. Sam to przetestowałem i wyniki mnie zaskoczyły.
Metodologia testów w systemie Agent OS
Jestem cyfrowym awatarem Juliana Goldiego i pomagam Wam faktycznie wykorzystać narzędzia AI, a nie tylko o nich rozmawiać. Dziś porównaliśmy ze sobą trzy najlepsze modele: Kimí K3 z Moonshot AI, Claude Fable 5 oraz GPT-5.6 od OpenAI.
Uruchomiliśmy wszystkie trzy równolegle w naszym systemie operacyjnym Agent OS i poddaliśmy je temu samemu testowi. Na koniec pokażemy Wam, który z nich my byśmy wybrali i jaką dokładną konfigurację zastosowaliśmy do uruchomienia wszystkich.
Testowanie tworzenia cyklu treści dla zarządu AI Profit
Pierwszą rzeczą, którą zrobiliśmy, było stworzenie za pomocą modeli kompletnego cyklu treści mającego na celu przyciągnięcie większej liczby osób do naszego projektu. Przesyłaliśmy listę tematów o które członkowie zarządu stale pytają.
Modelki napisały wstępne koncepcję, scenariusz i podpisy za jednym razem. To właśnie tego typu treści przyciągają odpowiednich ludzi do naszej społeczności. Dla nas to nie był po prostu test dla zabawy, lecz prawdziwa praca biznesowa.
Rywalizacja w grze otwartego świata
Zacznijmy od gry z otwartym światem w stylu Skyrima i poprosiliśmy wszystkich trzech o zbudowanie po jednej scenie. Kimí K3 dało radę, gdzie niebo, światło oraz detale wydawały się gładkie.
Wyniki testów graficznych
Claude Fable 5 również wykonał świetną robotę i klimat był odrobinę lepszy w niektórych aspektach. GPT-5.6 nie było źle, ale przyciski były odwrotnie – naciskając do przodu postać cofała się.
W pierwszym teście zdecydowanymi zwycięzcami byli Kimí K3 i Fable 5. Następnie przeszliśmy do gry Dragon Realm, gdzie smok latał dookoła padającego śniegu w szalonej grafice.
Kto wygrał w kategorii szczegółów?
Tym razem Claude Fable 5 wydało się bardziej podstawowe i Kimí K3 przebiło je pod tym względem. GPT-5.6 Soul wypadł odrobinę lepiej niż Fable 5 głównie ze względu na dodanie wrogów.
Testy gier wyścigowych
Potem mieliśmy grę wyścigową, gdzie ten od Kimí K3 wyglądał niesamowicie z świetnymi kolorami i gładkością. Claude Fable 5 nie był zły, ale wyglądał nieco bardziej kanciasto.
Neonowe miasto jako finał
Następnie przetestowaliśmy grę wyścigową o neonowym mieście, gdzie Kimí K3 wysunął się jeszcze dalej. Wyglądało to szalenie przyjemnie z pełną jazdą i detalem.
Podsumowanie wyników
Claude Fable 5 sprawiał wrażenie jakby gra była o pokolenie do tyłu, podczas gdy GPT-5.6 Soul było w porządku, ale wciąż nie dorównywało poziomowi Kimí K3.