Kimi K3: čínský open-weight model poprvé v čele coding žebříčku

16. července 2026 vydal pekingský Moonshot AI model Kimi K3 — a poprvé v historii se čínský open-weight model dostal na první místo prestižního coding žebříčku před modely OpenAI i Anthropicu. Rozebrali jsme, co je za titulky doopravdy a co z toho plyne pro české firmy.

Co se stalo

Kimi K3 je s 2,8 biliony parametrů největší open-weight model, jaký kdy vyšel. Na komunitním žebříčku Frontend Code Arena, kde vývojáři naslepo hodnotí výstupy modelů, obsadil první místo se skóre 1 679 bodů — před Claude Fable 5 (1 631) i GPT-5.6 Sol (1 618). Zvítězil v šesti ze sedmi frontendových kategorií a oproti předchůdci Kimi K2.6 poskočil o 17 míst.

Poprvé se tak stalo, že čínský otevřený model porazil americké frontier modely na ostře sledovaném benchmarku. V USA to vyvolalo debatu podobnou loňskému „DeepSeek momentu“.

Ilustrační videa v článku jsme vygenerovali pomocí AI.

Co to neznamená

Titulky ale zaslouží korekci. Napříč 35 sdílenými benchmarky vyhrává Claude Fable 5 ve 22 případech, K3 ve 12. V pokročilé matematice (FrontierMath Tier 4) dosahuje K3 ~39 %, zatímco modely OpenAI a Anthropicu se blíží 90 %. Zaostává i v hlubokém porozumění velkým codebase. Sám Moonshot přiznává, že celkově je K3 za Fable 5 i GPT-5.6 Sol.

Férové shrnutí zní: Fable 5 je lepší model, K3 je lepší nabídka. K3 stojí 3 $/15 $ za milion tokenů — cca 70 % úspora oproti Fable 5 při výkonu, který na většinu běžné práce stačí.

„Open-weight“ tu neznamená „pustím si ho ve firmě“

Častý omyl: otevřené váhy = můžu si model provozovat sám. U K3 ne. Váhy mají ~1,4 TB už v nativním 4-bit formátu a Moonshot doporučuje nasazení na 64+ akcelerátorech — tedy datacentrum, ne server v serverovně. Skutečná hodnota otevřených vah je jinde: model si nasadí desítky nezávislých cloud providerů (Together, Fireworks a spol.), vznikne cenová konkurence a tokeny zlevní pro všechny.

Co z toho plyne pro vaši firmu

Naplňuje se trend, se kterým v 1P pracujeme celý rok: na běžnou firemní práci — weby, obsah, analýzy, automatizace — stačí levnější modely. Nejdražší frontier modely dávají smysl na návrh architektury a finální kontrolu. Přesně tak stavíme workflow u nás: frontier model navrhne, levnější model odpracuje, frontier zkontroluje. Rozdíl v nákladech je násobný, rozdíl v kvalitě výstupu minimální.

Kimi K3 tenhle model potvrzuje a zlevňuje prostřední vrstvu.

Související: Jak vypadá upgrade modelu v praxi a co se při něm tiše rozbije, rozebíráme v článku Claude Opus 5 je venku. Než přepíšete jméno modelu v produkci, přečtěte si tohle.

Chcete vědět, které modely dávají smysl u vás?

Děláme AI audity — projdeme vaše procesy, nasazené nástroje a náklady a navrhneme, kde stačí levný model, kde potřebujete frontier a kde AI zatím vůbec. Ozvěte se nám.

Zdroje: Arena.ai Frontend Code Arena, launch benchmarky Moonshot AI, The Decoder, Tom's Hardware (červenec 2026).

Náskok napřed

Náskok napřed. Teď i s AI.

Pojďme to rozjet