Chińskie laboratorium AI Moonshot AI zaprezentowało Kimi K3 16 lipca 2026 r., wypuszczając tak zwany „pierwszy na świecie otwarty model klasy 3T” — system o 2,8 bilionach parametrów, który zmniejsza lukę w stosunku do najpotężniejszych, zastrzeżonych modeli firm Anthropic i OpenAI. Premiera natychmiast stała się jedną z najczęściej dyskutowanych premier roku w zakresie sztucznej inteligencji, docierając na szczyty rankingów Hacker News i ciesząc się zainteresowaniem agencji Reuters, Bloomberg i The New York Times.

Dla szerszego [zasięgu branży sztucznej inteligencji] (https://aibuzzwire.news) Kimi K3 ma znaczenie, ponieważ znacznie przesuwa granicę modeli o otwartej wadze, jednocześnie wymuszając nową debatę na temat tego, czy systemy, które można bezpłatnie pobrać, mogą dorównać systemom zamkniętym. Moonshot twierdzi, że pełne wagi modeli zostaną opublikowane do 27 lipca 2026 r.

Otwarty model o 2,8 bilionach parametrów

Zgodnie z zapowiedzią techniczną Moonshot, Kimi K3 to model o 2,8 bilionach parametrów zbudowany w oparciu o dwie aktualizacje architektoniczne, które firma nazywa Kimi Delta Attention (KDA) i Attention Residuals (AttnRes). Wykorzystuje projekt Mixture-of-Experts (MoE), który aktywuje tylko 16 z 896 ekspertów dla danego tokena, w połączeniu z tym, co Moonshot opisuje jako stabilny framework LatentMoE. Firma twierdzi, że zmiany te zapewniają około 2,5-krotną poprawę ogólnej wydajności skalowania w porównaniu z poprzednim modelem Kimi K2.

Model jest również wyposażony w natywne funkcje wizyjne i okno kontekstowe zawierające milion tokenów. Analityk Simon Willison na swoim blogu zauważył, że Kimi K3 przejmuje koronę otwartego rozmiaru od DeepSeek v4 Pro o parametrach 1,6 biliona parametrów – „ponad dwukrotnie większy” od poprzedzającego go Kimi K2.6 o 1 bilionie parametrów.

Moonshot określa tę premierę jako najnowszy krok w ciągłym dążeniu do skalowania, twierdząc, że przez dziewięć z ostatnich dwunastu miesięcy jej modele wyznaczały górną granicę rozmiarów modeli otwartych.

Porównanie w testach porównawczych

Własny zestaw ocen Moonshot stawia ogólną wydajność Kimi K3 w tyle za jedynie dwoma zastrzeżonymi systemami — Claude Fable 5 firmy Anthropic i GPT-5.6 Sol firmy OpenAI — podczas gdy stale przewyższa inne testowane modele, w tym Claude Opus 4.8 i GPT-5.5. Analiza stron trzecich zasadniczo śledzi te twierdzenia.

Niezależna usługa ewaluacyjna Artificial Analysis podała, że ​​w swoim prywatnym, długoterminowym benchmarku pracy opartej na wiedzy Kimi K3 osiągnął ogólny poziom Elo na poziomie 1547, co stanowi skok o 732 punkty w stosunku do Kimi K2.6 i ustępuje jedynie Claude Fable 5. Na arenie Frontend Code Arena.ai Kimi K3 wspiął się na pierwsze miejsce, wyprzedzając nawet Claude Fable 5, zgodnie z postem w tabeli liderów, który szeroko rozpowszechnił się po premierze.

Ceny są istotną częścią historii. Sztuczna analiza ustaliła średni koszt zadania na 0,94 dolara, co jest porównywalne z 1,04 dolara w przypadku GPT-5.6 Sol i mniej więcej połową 1,80 dolara w Claude Opus 4.8, zauważając jednocześnie, że Kimi K3 zużywał o 21% mniej tokenów wyjściowych niż jego poprzednik. W przeliczeniu na token model jest wyceniony na 3 dolary za milion tokenów wejściowych i 15 dolarów za milion tokenów wyjściowych – na tym samym poziomie co seria Claude Sonnet firmy Anthropic i, jak zauważył Willison, najdroższy model wydany dotychczas przez chińskie laboratorium AI, w porównaniu z Kimi K2.6 wynoszącym 0,95 dolara/4 dolara.

Kodowanie agentowe i kompilator, który sam zbudował

Duża część zapowiedzi Moonshota nie skupiała się na testach porównawczych chatbotów, ale na długoterminowych zadaniach agentów. Firma twierdzi, że Kimi K3 może wytrzymać długie sesje inżynieryjne, nawigować po dużych repozytoriach kodu i koordynować narzędzia terminalowe przy minimalnym nadzorze człowieka.

Podczas jednej z demonstracji Moonshot powiedział, że wczesna wersja Kimi K3 wykonała większość prac związanych z optymalizacją jądra procesora graficznego prowadzonych przez zespół na późnym etapie rozwoju. W innym modelu zbudowano „MiniTriton”, kompaktowy kompilator GPU podobny do Tritona z własną reprezentacją pośrednią na poziomie kafelków, przebiegami optymalizacji i potokiem generowania kodu PTX. Moonshot twierdzi, że MiniTriton dorównał lub pobił uznane stosy Triton i torch.compile w testach porównawczych obsługiwanych linii dachu i trwałym, kompleksowym szkoleniu nanoGPT ze stabilną konwergencją.

Firma zaprezentowała także uderzający dowód słuszności koncepcji w zakresie projektowania chipów. Według doniesień, w ciągu jednego 48-godzinnego autonomicznego działania Kimi K3 zaprojektował, zoptymalizował i zweryfikował chip zbudowany do obsługi modelu nano w oparciu o własną architekturę, przy użyciu narzędzi EDA typu open source w bibliotece Nangate 45 nm. Moonshot powiedział, że projekt zamyka taktowanie przy 100 MHz w promieniu 4 mm² i wytrzymuje w symulacji ponad 8700 tokenów na sekundę przepustowości dekodowania.

Jeśli chodzi o badania, Moonshot powiedział, że Kimi K3 odtworzył uniwersalne relacje I-Love-Q z astrofizyki obliczeniowej w około dwie godziny – praca, która według szacunków firmy zajmowała badaczowi zazwyczaj od jednego do dwóch tygodni – poprzez weryfikację krzyżową ponad 20 artykułów, wdrożenie pełnego potoku numerycznego w ponad 300 równaniach stanu i napisanie ponad 3000 wierszy języka Python.

Debata na temat wagi otwartej powraca

Pojawienie się Kimi K3 na nowo rozpala debatę, która toczy się przez cały 2026 r., kiedy chińskie laboratoria wielokrotnie zmniejszały – lub wydawały się zmniejszać – dystans do amerykańskich modeli granicznych. Schemat jest teraz znany: w chińskiej publikacji same raporty umieszczają się na czołowych miejscach rankingów, zachodnie laboratoria podkreślają swoją wciąż rosnącą przewagę zastrzeżoną, a firmy porównują koszty i otwartość z surowymi możliwościami.

To napięcie widać w cenach. Model, który podcina Claude Opus 4.8 pod względem kosztu zadania, choć zbliża się do jego możliwości, a jednocześnie pobiera więcej opłat niż jakakolwiek poprzednia chińska wersja, odzwierciedla pewność Moonshot, że może uzyskać wyższą cenę nawet w otwartym ekosystemie. Willison przestrzegł, aby nie wczytywać się zbyt wiele w pojedynczy benchmark – napisał, że jego długotrwały test „pelikana na rowerze” nie koreluje już niezawodnie z rzeczywistą jakością – ale stwierdził, że wydanie nadal nagradza praktyczne testy.

Kimi K3 jest już dostępny za pośrednictwem Kimi.com, agenta komputerowego Kimi Work, narzędzia programistycznego Kimi Code i interfejsu API Kimi. Moonshot powiedział, że współpracuje z partnerami zajmującymi się wnioskowaniem i opiekunami oprogramowania open source, aby zapewnić niezawodne wdrożenie przed wydaniem pełnej wagi.

Wyprzedź sztuczną inteligencję

Aby na bieżąco śledzić premiery modeli, bitwy porównawcze i granicę wagi otwartej, śledź AI Buzz Wire, aby zapoznać się z wydarzeniami kształtującymi globalny wyścig sztucznej inteligencji.

Przeczytaj więcej aktualności na temat modeli AI →