Rate limit (limit użycia)
Rate limit, po polsku limit użycia, to górna granica tego, ile możesz „zużyć“ usługi AI w danym czasie. Gdy w środku pracy agent nagle zatrzymuje się z komunikatem o wyczerpanym limicie albo prosi o przerwę do konkretnej godziny, to właśnie rate limit w akcji. Nie jest to awaria ani kara, tylko mechanizm, którym dostawcy dzielą ograniczoną moc obliczeniową między użytkowników.

Dwa rodzaje limitów, które warto rozróżniać
Pierwszy rodzaj to limity abonamentowe: w planach typu Claude Pro czy Cursor Pro dostajesz pulę użycia, która odnawia się cyklicznie, na przykład w kilkugodzinnych oknach albo tygodniowo. Pula jest liczona w tokenach lub w wartości zużycia, a po jej wyczerpaniu czekasz na odnowienie albo przechodzisz na wyższy plan.
Drugi rodzaj to limity API: przy płaceniu za faktyczne zużycie dostawca ogranicza liczbę zapytań na minutę i tokenów na minutę. Tu limit nie chroni Twojego portfela, tylko infrastrukturę dostawcy, a rachunek rośnie razem ze zużyciem.
W praktyce częściej zderzysz się z pierwszym rodzajem, bo większość osób budujących aplikacje z AI pracuje na abonamentach.
Dlaczego agent zużywa limit tak szybko
Pojedyncze pytanie w czacie to grosze, ale agentowe kodowanie działa inaczej. Agent pracujący nad zadaniem czyta dziesiątki plików, planuje, generuje kod, uruchamia go i poprawia, a każdy z tych kroków przepuszcza przez model tysiące tokenów. Jedno ambitne zadanie potrafi kosztować tyle, co godzina zwykłej rozmowy. Do tego dochodzi historia sesji: im dłużej trwa rozmowa, tym więcej kontekstu model przetwarza przy każdej odpowiedzi, więc końcówka długiej sesji zużywa pulę szybciej niż jej początek.
Jak pracować, żeby limity mniej bolały
Kilka nawyków robi zaskakująco dużą różnicę. Czyść rozmowę między niezwiązanymi zadaniami, świeży kontekst to mniejsze zużycie i celniejsze odpowiedzi. Rozbijaj duże zadania na mniejsze etapy zamiast kazać agentowi „zbudować wszystko“ w jednej sesji. Trzymaj w projekcie plik zasad, dzięki któremu nie tłumaczysz tego samego w kółko. A prostsze zadania zlecaj tańszym czy szybszym modelom, jeżeli narzędzie pozwala wybierać.
Jeśli mimo to regularnie dobijasz do ściany, policz swój scenariusz: nasz kalkulator kosztów API pokaże, ile kosztowałaby Twoja praca przy rozliczeniu za zużycie, a narzędzie API kontra subskrypcja wskaże próg, od którego opłaca się zmiana modelu rozliczeń albo wyższy plan.
Skąd wiedzieć, ile mi zostało
Coraz więcej narzędzi pokazuje stan puli wprost: w Claude Code sprawdzisz go komendą /usage, inne narzędzia mają paski zużycia w ustawieniach konta. Warto zerkać tam przed większym zadaniem, zamiast dowiadywać się o wyczerpanej puli w połowie pracy. Aktualne limity poszczególnych planów zbieramy w cenniku narzędzi AI.
W skrócie
Rate limit to granica zużycia wpisana w każdy plan: odnawialna pula w abonamentach i przepustowość w API. Agenty zużywają ją szybciej, niż podpowiada intuicja, bo pracują na tysiącach tokenów na krok. Higiena kontekstu i dzielenie zadań na etapy pozwalają zrobić w tej samej puli wyraźnie więcej.