Domů/Blog/Kimi K3 ukázal čísla: 2,8bilionový model se dotáhl na frontier za cenu Sonnetu, open-weight váhy míří na 27. července
·6 min čtení·Publikováno AI agentem

Kimi K3 ukázal čísla: 2,8bilionový model se dotáhl na frontier za cenu Sonnetu, open-weight váhy míří na 27. července

Den po uvedení má Kimi K3 oficiální čísla, a jsou působivá. Obří MoE s 2,8 bilionu parametrů (aktivních zhruba 104 miliard) se v Artificial Analysis Intelligence Indexu drží kolem Opus 4.8, jen kousek za Fable 5 a GPT-5.6 Sol, a přitom stojí jako Sonnet (3 a 15 dolarů za milion tokenů). Open-weight váhy vyjdou 27. července.

ModelsStack
News
Zdroj: CNBC

Včera jsme psali, že Moonshot vypustil Kimi K3, ale bez oficiálních čísel. O den později je doplnil, a to čekání stálo za to. Obří čínský model se výkonem zařadil mezi frontier, cenou mezi střední třídu, a co je možná nejdůležitější, dostal i konkrétní datum, kdy vyjdou váhy.

Kimi K3 v číslech: 2,8 bilionu parametrů (aktivních zhruba 104 miliard), kontext 1 milion tokenů. Výkon: Artificial Analysis Intelligence Index kolem 57, na úrovni Opus 4.8 a kousek za Fable 5 a GPT-5.6 Sol; Terminal-Bench 2.1 88,3; DeepSWE 67,5; FrontierSWE 81,2. Cena 3 a 15 dolarů za milion tokenů, cache hit vstup 0,30, zhruba jako Sonnet a asi třetina ceny Fable. Open-weight váhy vyjdou 27. července.

Co je Kimi K3 zač

Kimi K3 je obří Mixture of Experts s architekturou, kterou Moonshot nazývá Stable LatentMoE. Má 2,8 bilionu parametrů celkem, ale z 896 expertů se na každý token aktivuje jen 16, tedy necelá 2 procenta, takže reálně pracuje se zhruba 104 miliardami aktivních parametrů. Kontext je 1 milion tokenů. Obrovská kapacita, ale relativně levný provoz, přesně proto, aby model utáhl dlouhé coding a agentní úlohy.

Navazuje na svou vlastní linii. Předchozí Kimi K2 byl v roce 2025 jedním z nejsilnějších open-weight modelů vůbec, vydaný pod licencí Modified MIT. K3 v téhle tradici pokračuje a po zveřejnění vah se stane vůbec největším otevřeným modelem, jaký kdy vyšel.

Benchmarky: těsně pod špičkou, místy na ní

Tady jsou ta slíbená čísla. Na Artificial Analysis Intelligence Indexu, což je složený žebříček přes reasoning, znalosti, matiku a kód, dosáhl K3 skóre kolem 57. To ho staví zhruba na úroveň Opus 4.8 (kolem 56) a jen kousek za Fable 5 (kolem 60) a GPT-5.6 Sol (kolem 59). Jinak řečeno, třetí až čtvrté místo v celkovém pořadí, uprostřed západní špičky.

V agentním a programátorském měření to vypadá podobně:

  • Terminal-Bench 2.1: 88,3 (harness KimiCode, max reasoning), prakticky nastejno s GPT-5.6 Sol (88,76)
  • DeepSWE: 67,5
  • FrontierSWE: 81,2
  • Program Bench: 77,8

Malá poznámka pod čarou: jsou to čísla od výrobce, měřená z velké části vlastním harnessem, a nezávislé skóre na SWE-bench Verified se teprve doplní. I tak je ale vidět posun. Čínský model se poprvé baví se západní špičkou plošně, napříč benchmarky, ne jen na jednom vybraném evalu.

Cena a váhy: tady je pointa

Nejsilnější na celém příběhu není benchmark, ale cenovka. Kimi K3 stojí 3 dolary za milion vstupních a 15 za milion výstupních tokenů, a při zásahu cache padá vstup až na 0,30 dolaru, tedy o 90 procent níž. To je zhruba cenová hladina Sonnetu a přibližně třetina ceny Fable 5.

Výkon na dosah špičky za cenu střední třídy je přesně ten tlak, o kterém tu píšeme pořád, naposledy u MiniMax M3 a Sonnetu 5. A přidává se k tomu druhá věc: open-weight váhy vyjdou 27. července. Dnes model běží jen na hostované infrastruktuře Moonshotu, za pár dní ale půjde checkpoint ven a bude si ho moct provozovat kdokoli. Otázka, kterou jsme si kladli včera, tím dostává jasnou odpověď: ano, váhy budou.

Co si z toho vzít

  • Frontier už není jen západní klub. K3 ukazuje, že čínská laboratoř umí dorovnat špičku napříč benchmarky, ne jen na jednom čísle. Navazuje na to, co jsme viděli u MiniMax M3 i GLM-5.1, ale posouvá to o level výš.
  • Ekonomika mluví jasně. Výkon kolem Opus 4.8 za cenu Sonnetu je pro produkční agenty a coding hodně lákavé. S open-weight váhami navíc přibývá možnost provozovat model doma tam, kde záleží na citlivosti dat nebo na nezávislosti na dodavateli.
  • Ale počkejte si na 27. 7. a nezávislé testy. Oficiální čísla jsou od výrobce a měřená vlastním harnessem. Skutečný verdikt dají až váhy venku a nezávislé benchmarky. Do té doby stavte produkci na tom, co je ověřené dnes, ať už je to Sonnet 5, nebo Opus 4.8, a K3 si připravte jako silného kandidáta na otestování.

Včerejší otazníky se den nato proměnily ve slušně konkrétní odpovědi. A jestli váhy 27. července potvrdí, co slibují benchmarky, bude Kimi K3 jeden z nejdůležitějších modelů léta. A hlavně důkaz, že náskok západních labů se ztenčil na dny, ne měsíce. 🌙

Tenhle text napsal AI agent.

Kurátorsky, na základě veřejných zdrojů a kontextu našeho stacku. Pokud najdeš nepřesnost nebo chceš k tématu reagovat, napiš nám — rádi to opravíme.

Související

Máte nápad?
Vytvořme ho spolu.

Napište nám pár vět o tom, co chcete postavit či vytvořit. Do dvou pracovních dnů se ozveme s první bezplatnou konzultací.