W dzisiejszym artykule przyjrzymy się nowemu sposobowi na ograniczenie liczby zużywanych tokenów o imponujące sześćdziesiąt procent. Jeśli grasz w grę Fable 5, jest to prosty sposób na zmniejszenie kosztów operacyjnych związanych z korzystaniem z agentów sztucznej inteligencji.
Jak działa technika jaskiniowca
Wyobraź sobie sytuację, w której możesz napisać o sześćdziesiąt pięć procent więcej kodu przy tym samym budżecie. Dlatego właśnie używamy tego systemu do ograniczenia liczby tokenów wykorzystywanych podczas pracy z agentami AI.
Dostępność dla różnych platform
Warto wiedzieć, że nie jest to rozwiązanie przeznaczone wyłącznie dla firmy Claude Co. Możesz uruchomić ten mechanizm za pomocą Codeex, Gemini, Cursor czy innych popularnych edytorów kodu.
- Jest ono całkowicie bezpłatne i gotowe do natychmiastowego użycia.
- Może być zainstalowane dla jednego agenta lub nawet dla trzydziestu różnych systemów jednocześnie.
Zasady komunikacji jaskiniowca
Gdy sztuczna inteligencja odpowiada, zużywasz żetony za każde wypowiedziane przez nią słowo. Te najinteligentniejsze modele są dość drogie i zużywają mnóstwo zasobów.
Filtrowanie zbędnych słów
Zasada działania opiera się na zestawie instrukcji, które Twój agent odczytuje na początku każdej rozmowy. Instrukcje mówią, aby usunąć słowa-wypełniacze i uniknąć rozgrywki składającej się z kilku akapitów.
Trzy filary efektywności
Krótko, konkretnie i bez zbędnych ozdobników. W grze jaskiniowiec obowiązują trzy podstawowe zasady dzięki którym można ograniczyć zużycie żetonów do minimum.
Sakralność kodu
Pierwsza zasada mówi, że kod jest święty. Bloki kodu, polecenia i ścieżki plików nigdy nie są zmieniane przez agenta w trybie oszczędnościowym.
Przystosowanie do języków obcych
Potrafi również mówić w wielu językach. Jeśli na przykład napiszesz po portugalsku, aplikacja odpowie jak jaskiniowiec używając odpowiedniego słownictwa dla tego języka.
Utrzymanie precyzji
Kompresuje styl wypowiedzi, ale nie zmienia faktycznego znaczenia przekazywanego informacji. Myśli dokładnie tak samo jak wcześniej, różnica tkwi jedynie w późniejszym filtrze usuwającym zbędne słowa.
Wyniki badań naukowych
W artykule badawczym z marca 2026 roku przetestowano trzydzieści jeden modeli i odkryto, że wymuszanie krótkich odpowiedzi poprawiło dokładność nawet o dwadzieścia sześć punktów w niektórych testach porównawczych.
Własne doświadczenia
A w moim własnym teście z pięcioma podpowiedziami, każda odpowiedź jaskiniowca zawierała tę samą poprawkę co wersja długa. Prawidłowość działania została potwierdzona na wielu scenariuszach.