Stworzył działający procesor w 48 godzin. Ten darmowy model AI przeraża swoimi możliwościami

Chiński rynek sztucznej inteligencji właśnie udowodnił, że amerykańskie sankcje sprzętowe nie są w stanie powstrzymać rewolucji na Wschodzie. Startup Moonshot AI oficjalnie zaprezentował Kimi K3 – potężny model AI posiadający aż 2,8 tryliona (2800 miliardów) parametrów, stając się tym samym największym otwartym w historii. W oficjalnych testach programistycznych dla deweloperów, chiński gigant zszokował branżę, pokonując w kodowaniu najnowszy amerykański model Claude Fable 5 od Anthropic.

Nowy król open-source. Czym jest Kimi K3 od Moonshot AI?

Moonshot AI, z siedzibą w Pekinie, opublikowało dokumentację techniczną modelu Kimi K3, ogłaszając go pierwszym na świecie otwartym systemem klasy 3T. Choć w ogólnym rozrachunku model wciąż nieznacznie ustępuje amerykańskim liderom, takim jak GPT 5.6 Sol czy Claude Fable 5, to w testach programistycznych i zadaniach automatycznych agentów AI zostawił w tyle potężne systemy Claude Opus 4.8 oraz GPT 5.5. Ten cyfrowy kolos ma zostać bezpłatnie udostępniony społeczności już 27 lipca 2026 roku.

Pod kątem czystej specyfikacji Kimi K3 imponuje oknem kontekstowym obsługującym aż 1 milion tokenów oraz natywną obsługą analizy obrazu. Konstrukcja bazuje na zaawansowanej architekturze Mixture of Experts (MoE) składającej się z 896 wyspecjalizowanych sub-modeli. W celu drastycznej optymalizacji zużycia energii i zasobów, system aktywuje zaledwie 16 ekspertów na każdy token, co oznacza, że w danym momencie pracuje zaledwie 1,8% całego potencjału sieci.

Pogromca Claude Fable 5 w kodowaniu i drastyczny wzrost cen API

Prawdziwą sensacją okazał się wynik w ślepym teście programistycznym Frontend Code Arena. Kimi K3 zdobył tam 1679 punktów, plasując się na pierwszym miejscu na świecie i wyprzedzając dotychczasowego lidera – Claude Fable 5. Deweloperzy biorący udział w testach wyżej ocenili kod generowany przez chińską sztuczną inteligencję, doceniając jego strukturę i bezbłędność.

Nowy cennik dla programistów

Wraz ze wzrostem możliwości drastycznie podskoczyły jednak koszty utrzymania infrastruktury. Oficjalny cennik API dla Kimi K3 prezentuje się następująco:

  • 0,30 USD za milion tokenów wejściowych (w przypadku trafienia w pamięć podręczną – cache-hit).
  • 3,00 USD za milion tokenów wejściowych (z chybieniem w pamięć podręczną – cache-miss).
  • 15,00 USD za milion tokenów wyjściowych (wygenerowanych przez AI).

Oficjalne API Kimi, oparte na architekturze dezagregacji wnioskowania Mooncake, osiąga wskaźnik trafienia w pamięć podręczną powyżej 90% w obciążeniach programistycznych.. Porównując to z debiutującym rok temu modelem Kimi K2, koszt zapytania bez cache wzrósł aż pięciokrotnie, co pokazuje, jak kosztowne staje się utrzymanie modeli o tak gigantycznej skali.

Jak Chińczycy oszukali sankcje USA? Architektura ponad czystą moc

Amerykańskie ograniczenia eksportowe mocno utrudniają chińskim firmom dostęp do najnowszych akceleratorów graficznych. Z tego powodu inżynierowie z Moonshot AI musieli postawić na genialne triki architektoniczne, osiągając aż 2,5-krotny wzrost wydajności skalowania w stosunku do poprzednika. Sukces opiera się na dwóch autorskich rozwiązaniach: Kimi Delta Attention (hybrydowy system uwagi liniowej) oraz Attention Residuals, które całkowicie zredefiniowały sposób przesyłania informacji między warstwami sieci.

Co więcej, proces kompresji i kwantyzacji (użycie MXFP4 oraz MXFP8) zaimplementowano już na etapie wstępnego dotrenowania, co zapewnia modelowi doskonałą kompatybilność z szeroką gamą starszego i mniej wydajnego sprzętu. Analitycy Bank of America wprost wskazują, że ten pokaz inżynierii udowadnia, iż zaawansowana architektura potrafi zrekompensować braki w najnowszym sprzęcie obliczeniowym.

Tajemnicze chipy i autorski kompilator MiniTriton

Podczas testów wydajnościowych rdzenia, Moonshot AI korzystało z kart Nvidia H200 oraz tajemniczego procesora określonego jedynie jako „GPGPU od alternatywnego dostawcy”, co wywołało w branży falę spekulacji o użyciu tajnych chińskich chipów (np. od Huawei). Ponieważ USA w styczniu 2026 roku zamknęły lukę prawną pozwalającą chińskim firmom na zdalne wynajmowanie serwerów z chipami H200 w chmurach offshore, Moonshot zmuszone było do stworzenia od zera własnego kompilatora MiniTriton. Przetestowano go na układach Nvidia L20 – okrojonych kartach graficznych stworzonych specjalnie na rynek chiński zgodnie z restrykcjami USA. Producent rekomenduje uruchamianie K3 na superwęzłach składających się z minimum 64 akceleratorów.

Projektowanie mikroprocesorów przez… samo AI

W ramach testów praktycznych Kimi K3 przeprowadził autonomiczny, trwający 48 godzin proces projektowania symulowanego układu scalonego dla mniejszego modelu AI. Wykorzystując wyłącznie otwartoźródłowe narzędzia inżynierskie, model z powodzeniem stworzył projekt chipu o powierzchni 4 mm², zawierający 1,46 miliona standardowych komórek logicznych. Symulowany procesor osiągnął taktowanie 100 MHz i był w stanie przetwarzać ponad 8700 tokenów na sekundę.

Moonshot AI modelem Kimi K3 udowodniło, że zepchnięcie Chin do technologicznego narożnika przyniosło odwrotny skutek od zamierzonego – zamiast spowolnienia, wymusiło niesamowitą innowację w kodzie i architekturze. Choć na ostateczną weryfikację tych rewelacji musimy poczekać do 27 lipca, kiedy to model trafi do sieci, pokonanie Claude Fable 5 w programowaniu to historyczny moment. Nad sukcesem wisi jednak cień oskarżeń ze strony Anthropic o to, że Kimi powstało na bazie nielegalnej destylacji danych z ich własnych modeli.

You may also like...