Witamy nasza społeczność entuzjastów technologii i sztucznej inteligencji. Dziś chcemy przedstawić coś wyjątkowego z japońskiego laboratorium Sakana, które stworzyło system o nazwie Fugu. Jest to kompletny ekosystem orkiestracji wieloagentowej dostępny poprzez pojedyncze interfejs API.
Nowa architektura współpracy agentów
Zamiast polegać na jednym modelu, jak miało miejsce w poprzednich wersjach Fable 5, nowy system integruje wiele podsystemów ze sobą współpracujących. Gdy zadajesz pytanie, uruchamia się panel wieloagentowy, gdzie poszczególne jednostki rywalizują i uzupełniają swoje działania.
Następnie proces syntetyzuje te różne wątki dyskusji w jedną spójną odpowiedź. Jest to podejście bardzo zbliżone do koncepcji Fusion, ale z dodatkową warstwą konkurencji wewnętrznej między agentami.
Wydajność na poziomie Frontier
W środku tego systemu znajduje się model o nazwie Fugu Ultra. Jego wydajność dorównuje najnowszym rozwiązaniom takim jak Fable Mythos i oferuje możliwości klasy Frontier.
Jest to potężna rzecz, która zmienia zasady gry w świecie generowania treści kodem oraz analizy danych. Testowaliśmy już trzy różne scenariusze i zawsze powtarzamy: sprawdźcie sami te wyniki na własnych urządzeniach.
Praktyczne zastosowanie w tworzeniu stron
Jako pierwszy przykład pokazujemy stronę internetową, którą system stworzył samodzielnie. Wygląda ona naprawdę bardzo ładnie i posiada profesjonalny układ graficzny.
Zobaczmy teraz wyniki na Goldie Bench w porównaniu z innymi modelami AI. Fugu Ultra osiąga tutaj znacznie lepsze rezultaty niż konkurenci, co potwierdza jego przewagę technologiczną.
Gra labiryntowa jako test logiczny
Mamy też na przykład grę typu labiryntowy, która okazała się super fajna w praktyce. System nie tylko napisał kod gry, ale zadbał o płynność działania i logikę przejść.
Znowu pokażemy wyniki porównawcze z innymi modelami, ponieważ zawsze używamy tych samych testów dla każdego rozwiązania. To naprawdę potężna rzecz w kontekście rozwoju gier komputerowych.
Symulacja galaktyki i jakość danych
A potem mamy jeszcze to, co jest naprawdę niesamowite – symulację galaktyki z generowaniem realistycznych obiektów astronomicznych. Jakość wyników tutaj jest super wysoka.
Bardzo fajna rzecz dla badaczy i programistów szukających zaawansowanych narzędzi do modelowania wszechświata w środowisku cyfrowym.
Porównanie z Terminal Bench
Jak już wcześniej wspomniałem, sprawdziliśmy to na sobie. W testach porównawczych Fugu uzyskuje wynik 82,1 punktów, co jest lepsze niż 80,4 punkty dla modelu Fable.
W większości innych testów wyniki są wyrównane lub model został tylko nieznacznie prześcignięty przez konkurencję. Można więc zobaczyć na przykład Live Code Bench tutaj, gdzie Fugu Ultra osiąga wynik 93,2 punktów.
Konfrontacja z GLM 5.2
Przyjrzyjmy się teraz temu bliżej w kontekście modelu GLM 5.2. Widzieliśmy już wersję demonstracyjną tego rywala, ale ta nowa edycja zawiera wciąż trochę błędów.
Fugu wygląda super z ładnymi animacjami i kolorem, podczas gdy konkurent nie ma już takiego efektu wizualnego ani funkcjonalności. Po prostu nie wygląda to zbyt dobrze w porównaniu do japońskiego rozwiązania.
Podsumowanie wyników testów
Powtórzę jeszcze raz: przetestujcie sami te wyniki na własnych serwerach i zobacz, co myślicie o tym podejściu. Jeśli szukacie modelu na poziomie Fable 5 lub lepszych rezultatów, to może być właśnie ta opcja.