Kimi K3 ukázal čísla: 2,8bilionový model se dotáhl na frontier za cenu Sonnetu, open-weight váhy míří na 27. července
Den po uvedení má Kimi K3 oficiální čísla, a jsou působivá. Obří MoE s 2,8 bilionu parametrů (aktivních zhruba 104 miliard) se v Artificial Analysis Intelligence Indexu drží kolem Opus 4.8, jen kousek za Fable 5 a GPT-5.6 Sol, a přitom stojí jako Sonnet (3 a 15 dolarů za milion tokenů). Open-weight váhy vyjdou 27. července.
Včera jsme psali, že Moonshot vypustil Kimi K3, ale bez oficiálních čísel. O den později je doplnil, a to čekání stálo za to. Obří čínský model se výkonem zařadil mezi frontier, cenou mezi střední třídu, a co je možná nejdůležitější, dostal i konkrétní datum, kdy vyjdou váhy.
Co je Kimi K3 zač
Kimi K3 je obří Mixture of Experts s architekturou, kterou Moonshot nazývá Stable LatentMoE. Má 2,8 bilionu parametrů celkem, ale z 896 expertů se na každý token aktivuje jen 16, tedy necelá 2 procenta, takže reálně pracuje se zhruba 104 miliardami aktivních parametrů. Kontext je 1 milion tokenů. Obrovská kapacita, ale relativně levný provoz, přesně proto, aby model utáhl dlouhé coding a agentní úlohy.
Navazuje na svou vlastní linii. Předchozí Kimi K2 byl v roce 2025 jedním z nejsilnějších open-weight modelů vůbec, vydaný pod licencí Modified MIT. K3 v téhle tradici pokračuje a po zveřejnění vah se stane vůbec největším otevřeným modelem, jaký kdy vyšel.
Benchmarky: těsně pod špičkou, místy na ní
Tady jsou ta slíbená čísla. Na Artificial Analysis Intelligence Indexu, což je složený žebříček přes reasoning, znalosti, matiku a kód, dosáhl K3 skóre kolem 57. To ho staví zhruba na úroveň Opus 4.8 (kolem 56) a jen kousek za Fable 5 (kolem 60) a GPT-5.6 Sol (kolem 59). Jinak řečeno, třetí až čtvrté místo v celkovém pořadí, uprostřed západní špičky.
V agentním a programátorském měření to vypadá podobně:
- Terminal-Bench 2.1: 88,3 (harness KimiCode, max reasoning), prakticky nastejno s GPT-5.6 Sol (88,76)
- DeepSWE: 67,5
- FrontierSWE: 81,2
- Program Bench: 77,8
Malá poznámka pod čarou: jsou to čísla od výrobce, měřená z velké části vlastním harnessem, a nezávislé skóre na SWE-bench Verified se teprve doplní. I tak je ale vidět posun. Čínský model se poprvé baví se západní špičkou plošně, napříč benchmarky, ne jen na jednom vybraném evalu.
Cena a váhy: tady je pointa
Nejsilnější na celém příběhu není benchmark, ale cenovka. Kimi K3 stojí 3 dolary za milion vstupních a 15 za milion výstupních tokenů, a při zásahu cache padá vstup až na 0,30 dolaru, tedy o 90 procent níž. To je zhruba cenová hladina Sonnetu a přibližně třetina ceny Fable 5.
Výkon na dosah špičky za cenu střední třídy je přesně ten tlak, o kterém tu píšeme pořád, naposledy u MiniMax M3 a Sonnetu 5. A přidává se k tomu druhá věc: open-weight váhy vyjdou 27. července. Dnes model běží jen na hostované infrastruktuře Moonshotu, za pár dní ale půjde checkpoint ven a bude si ho moct provozovat kdokoli. Otázka, kterou jsme si kladli včera, tím dostává jasnou odpověď: ano, váhy budou.
Co si z toho vzít
- Frontier už není jen západní klub. K3 ukazuje, že čínská laboratoř umí dorovnat špičku napříč benchmarky, ne jen na jednom čísle. Navazuje na to, co jsme viděli u MiniMax M3 i GLM-5.1, ale posouvá to o level výš.
- Ekonomika mluví jasně. Výkon kolem Opus 4.8 za cenu Sonnetu je pro produkční agenty a coding hodně lákavé. S open-weight váhami navíc přibývá možnost provozovat model doma tam, kde záleží na citlivosti dat nebo na nezávislosti na dodavateli.
- Ale počkejte si na 27. 7. a nezávislé testy. Oficiální čísla jsou od výrobce a měřená vlastním harnessem. Skutečný verdikt dají až váhy venku a nezávislé benchmarky. Do té doby stavte produkci na tom, co je ověřené dnes, ať už je to Sonnet 5, nebo Opus 4.8, a K3 si připravte jako silného kandidáta na otestování.
Včerejší otazníky se den nato proměnily ve slušně konkrétní odpovědi. A jestli váhy 27. července potvrdí, co slibují benchmarky, bude Kimi K3 jeden z nejdůležitějších modelů léta. A hlavně důkaz, že náskok západních labů se ztenčil na dny, ne měsíce. 🌙
Kurátorsky, na základě veřejných zdrojů a kontextu našeho stacku. Pokud najdeš nepřesnost nebo chceš k tématu reagovat, napiš nám — rádi to opravíme.
Související
Máte nápad?
Vytvořme ho spolu.
Napište nám pár vět o tom, co chcete postavit či vytvořit. Do dvou pracovních dnů se ozveme s první bezplatnou konzultací.
