Kimi K3: chiński model łapie czołówkę, ale kończy z niskimi cenami
Kimi K3 od Moonshot AI: 2,8 bln parametrów, kontekst 1 mln tokenów, coding index 76,2. Ceny rosną trzykrotnie względem K2.7, wagi dopiero 27 lipca.

Moonshot AI wypuściło 16 lipca Kimi K3, swój największy model w historii i pierwszy chiński, który w niezależnych benchmarkach siedzi tuż za Claude Fable 5 i GPT-5.6 Sol. Jest jednak druga strona tej premiery: cennik. Za milion tokenów wyjściowych Moonshot liczy sobie 15 USD, prawie cztery razy więcej niż za poprzednika. Era chińskich modeli za grosze, którą otwierało Kimi K2.7 Code, właśnie się kończy.
Liczby na start
Według Artificial Analysis (dane pobrane 17 lipca 2026) Kimi K3 osiąga Coding Index 76,2. Dla porównania: Claude Fable 5 ma 76,5, GPT-5.6 Sol w najwyższym trybie 77,4, a Claude Opus 4.8 74,3. Różnica do ścisłej czołówki spadła do wartości dziesiętnych, a Opus 4.8 i GPT-5.5 zostały za plecami. W ogólnym Intelligence Index model dostał 57,1 i to czwarty wynik całego rankingu.
Sam Moonshot jest w komunikacji ostrożniejszy niż nagłówki mediów. W ogłoszeniu pisze wprost, że K3 wciąż ustępuje najmocniejszym modelom zamkniętym, wymieniając z nazwy Claude Fable 5 i GPT-5.6 Sol. Z liczbami producenta warto obchodzić się jak zwykle: Terminal Bench 2.1 na poziomie 88,3, BrowseComp 91,2 czy MMMU-Pro 81,6 pochodzą z własnej ewaluacji Moonshota, nie z niezależnego testu. My tego modelu jeszcze nie testowaliśmy w naszych narzędziach, więc trzymamy się publicznych benchmarków.
Co nowego pod maską
Kimi K3 to Mixture-of-Experts z 2,8 bln parametrów, w architekturze nazwanej Stable LatentMoE: na każdy token aktywuje się 16 z 896 ekspertów. Okno kontekstu urosło do miliona tokenów, model jest natywnie multimodalny (tekst, obraz, wideo), a rozumowanie ma włączone na stałe, z regulowanym poziomem wysiłku.
Przy okazji premiera sprostowała przedpremierowe przecieki. Plotki mówiły o 2,5 bln parametrów, wyszło 2,8 bln. Tajemniczy „Agent Swarm“, opisywany w sieci jako funkcja K3, okazał się osobną publikacją badawczą Moonshota o skalowaniu agentów, nie trybem modelu. Część agregatorów zdążyła nawet wymyślić warianty „K3 Swarm Max“, których w oficjalnym ogłoszeniu po prostu nie ma.
Koniec supertaniego chińskiego AI?
Cennik API wygląda tak: 0,30 USD za milion tokenów wejściowych przy trafieniu w cache, 3,00 USD bez trafienia i 15,00 USD za milion tokenów wyjściowych. Zestawmy to z Kimi K2.7 Code, które według cennika producenta kosztuje 0,95 USD za wejście i 4,00 USD za wyjście. Skok wynosi około trzykrotności na wejściu i prawie czterokrotności na wyjściu. To już nie jest model „za grosze“, tylko środek stawki: taniej niż Claude Fable 5 (50 USD za wyjście) i GPT-5.6 Sol (30 USD), ale wyraźnie drożej niż dotychczasowe chińskie premiery.
Serwis The Decoder ujął to jako sygnał końca supertaniego chińskiego AI i coś w tym jest, choć to interpretacja mediów, nie deklaracja Moonshota. Logika za podwyżką jest prosta: skoro model gra o czołówkę, przestaje konkurować wyłącznie ceną. Dla czytelnika liczy się bilans: za jakość o włos od Fable 5 płacisz jedną trzecią jego stawki, ale trzykrotnie więcej, niż przyzwyczaiły nas modele z Chin.
Otwarte wagi na razie na piśmie
Media okrzyknęły K3 największym otwartym modelem w historii, ale w dniu premiery to obietnica, nie fakt. Moonshot pisze dosłownie, że pełne wagi zostaną opublikowane do 27 lipca 2026. Na Hugging Face nie ma jeszcze karty modelu, nie znamy też licencji. Poprzednik wyszedł na zmodyfikowanej licencji MIT i taki wariant jest prawdopodobny, ale do dnia publikacji wag pozostaje zgadywanką. Jeśli planujesz hostować model u siebie, na razie nie masz czego pobrać; wrócimy do tematu, gdy wagi i licencja będą na stole. Czym w ogóle są otwarte wagi, tłumaczymy w słowniku.
Co z tego wynika dla Ciebie
Model działa od dnia premiery w aplikacji Kimi, przez API Moonshota i na OpenRouter, więc każde narzędzie, w którym podpinasz własny klucz, może z niego korzystać już dziś. Oficjalnych integracji z konkretnymi edytorami na razie nie ogłoszono. Jeśli budujesz z agentami i rachunek za tokeny jest dla Ciebie realnym kosztem, K3 wchodzi do rozmowy jako tańsza alternatywa dla zachodniej czołówki, a koszt przy własnym wolumenie przeliczysz w kalkulatorze kosztów API. Jeśli natomiast szukasz modelu za grosze do prostych zadań, K2.7 Code nadal jest w cenniku i nadal kosztuje ułamek stawki następcy.
Opanuj AI‑coding w 5 minut. W każdy poniedziałek.
Konkretne premiery, analizy cen i jeden trik, który przyspieszy Twoją pracę. Po polsku, bez żargonu, prosto na maila.