Baza wiedzy
Agent AI na modelu lokalnym — bez opłat za tokeny
Agent nie musi płacić za każdy token. Model uruchomiony na Twoim komputerze kosztuje zero, dane nie wychodzą z maszyny, a agent działa identycznie — pod jednym warunkiem: model musi obsługiwać wywoływanie narzędzi.
Opublikowano · Jakub Butryn, Founder · Lead engineer
Jak podłączyć model lokalny
Ollama, LM Studio i llama.cpp wystawiają końcówkę zgodną z OpenAI, więc agent potrzebuje tylko adresu i nazwy modelu — żadnego klucza. W ZAZA-CODE to `zaza provider use ollama`, a `zaza provider test` od razu mówi, czy model odpowiada i czy przyjmuje narzędzia.
Szczegół, który psuje pierwsze podejście: modele lokalne chodzą po `http://`, a klienci HTTP często wymuszają `https://`. Wtedy każde zapytanie kończy się błędem połączenia albo cichym przejściem na wolniejszą ścieżkę.
Czego model lokalny może nie potrafić
Najważniejsza różnica to tool-calling. Bez niego agent nie wykona zadania — będzie rozmawiał. Wiele mniejszych modeli i część konfiguracji LM Studio nie obsługuje narzędzi w formacie OpenAI, więc sprawdź to zanim ocenisz „agent nie działa”.
Druga różnica to okno kontekstu i jakość planowania przy wielu krokach. Do zadań jednokrokowych model lokalny wystarcza; do długich pętli narzędziowych zwykle przegrywa z dużym modelem.
Kiedy model lokalny jest właściwym wyborem
Nauka i eksperymenty (zero kosztu za pomyłki), praca na danych, które nie mogą wyjść z firmy, oraz zadania powtarzalne o wąskim zakresie — na przykład porządkowanie plików czy generowanie szablonów.
Model chmurowy zostaw na zadania wymagające planowania i długiego kontekstu. Rozsądny układ to jedno i drugie: przełączanie dostawcy jedną komendą, bez zmiany reszty konfiguracji agenta.
Co zostaje po stronie konta
Wybór własnego dostawcy nie musi oznaczać rezygnacji z wygody. W ZAZA-CODE generowanie tekstu idzie do wybranego modelu, a konto zaza.net.pl nadal trzyma charakter agenta, wyuczone zasady, pamięć i sesje w chmurze.
Dzięki temu praca jest przenośna: ten sam agent, te same nawyki, inny komputer i inny model pod spodem. To rozwiązuje typowy problem harnessów AI, w których sesje i preferencje są przywiązane do jednej maszyny.
Najczęstsze pytania
- Czy agent AI może działać bez internetu?
Tak, z modelem uruchomionym lokalnie — wtedy zapytania nie opuszczają maszyny. Warunkiem wykonywania zadań jest obsługa wywoływania narzędzi przez model; bez niej agent będzie tylko rozmawiał.
- Który model lokalny nadaje się do agenta AI?
Taki, który obsługuje tool calling w formacie OpenAI i ma wystarczające okno kontekstu — w praktyce modele kodujące średniej wielkości. Sprawdź to zapytaniem testowym przed oceną, że agent nie działa.
Omów swój przypadek — konsultacja bezpłatna Telegram @sotius