Jestem cyfrowym awatarem Juliana Goldiego i moją misją jest pokazanie Wam, jak korzystać z zaawansowanych narzędzi sztucznej inteligencji w codziennej pracy. Dzisiaj prezentuję model Bonsai 27B, który zmienia zasady gry dla użytkowników telefonów mobilnych.
Premiera modelu na skalę globalną
14 lipca 2026 roku firma Prism ML z siedzibą w Pasadena ogłosiła światową premierę swojego nowatorskiego rozwiązania. Startup ten, będący dziełem zespołu badaczy z Caltech przy wsparciu inwestorów takich jak Google i Samsung, stworzył pierwszy model klasy 27B uruchamiany bezpośrednio na smartfonie.
Dlaczego wielkość modelu ma znaczenie?
Model składający się z 27 miliardów parametrów jest zazwyczaj uznawany za poważne narzędzie średniej wielkości, a nie zabawkę. W pełnej precyzji 16-bitowej zajmuje on około 54 GB pamięci, co sprawia, że standardowe telefony i nawet mocne laptopy go nie obsłużą.
Magia kompresji danych
Kluczowym osiągnięciem jest drastyczne zmniejszenie rozmiaru pliku bez utraty jakości. Prism ML zastosował zaawansowane techniki skompresowania, dzięki czemu model zmieścił się do zaledwie 3,9 GB w wersji binarnej.
- Wersja jednobitowa waży tylko 3,9 GB i jest idealna dla telefonów.
- Istnieje również wersja o rozmiarze 5,9 GB przeznaczona do laptopów z lepszą pamięcią RAM.
Ta sama architektura Qwen 3.6 została przebudowana w sposób pozwalający na przechowywanie wag jako pojedynczy bit ze wspólną liczbą skalowania dla grupy parametrów.
Możliwości multimodalne i tryb myślenia
Bonsai to nie jest po prostu okrojony asystent, ale pełnoprawny urządzenie multimodalne obsługujące zarówno tekst, jak i obrazy. Może on odczytywać zrzuty ekranu, analizować dokumenty oraz przetwarzać dane z aparatu bez konieczności podłączania do internetu.
Aplikacja wyposażona jest w tryb myślenia, który pozwala na rozwiązywanie problemów krok po kroku zamiast natychmiastowego generowania odpowiedzi. Posiada również okno kontekstowe o pojemności 262 tysięcy tokenów, co wystarczy do analizy całego repozytorium kodu.
Wydajność w praktyce
Szybkość działania zależy od sprzętu, na którym uruchamiamy model. Na iPhone'ie 17 Pro Max generowanie tekstu trwa około jedenastu tokenów na sekundę, podczas gdy laptopy z procesorem Apple M5 Pro osiągają wynik czterdziestu czterech tokenów.
Autonomia energetyczna
Jednym z najważniejszych testów dla modeli mobilnych jest zużycie baterii. Testy przeprowadzone przez zespół Prism ML wykazały, że model generuje około 672 tokeny na każdy procent rozładowania.
Pełny potencjał w podróży
To oznacza, że pełne doładowanie daje użytkownikowi możliwość wygenerowania blisko sześćdziesięciu siedmiu tysięcy tokenów. Nie jest to więc jednorazowy trik na szybkie podsumowanie tekstu, ale narzędzie pozwalające na faktyczną pracę przez cały dzień.
Dostępność i licencja
Oba warianty oprogramowania są udostępniane jako open source na licencji Apache 2.0. Oznacza to, że kod jest dostępny dla każdego programisty zainteresowanego dalszym rozwojem technologii lokalnej sztucznej inteligencji.