Přejít k navigační liště

Zdroják » Zprávičky » Kimi K3: první otevřený model třídy 3T míří na špičku

Kimi K3: první otevřený model třídy 3T míří na špičku

Zprávičky AI

Nálepky:

Moonshot AI představil Kimi K3, svůj zatím nejvýkonnější model a podle firmy vůbec první otevřený model třídy 3T. Jde o model s 2,8 bilionu parametrů postavený na architektuře Kimi Delta Attention a Attention Residuals, s nativním viděním a kontextovým oknem 1 milionu tokenů. Model cílí na špičkovou inteligenci v dlouhodobém kódování, znalostní práci a uvažování.

Firma otevřeně přiznává, že celkovým výkonem model stále zaostává za nejsilnějšími proprietárními modely (Claude Fable 5 a GPT 5.6 Sol), ale v jejich testovací sadě dosahoval špičkových výsledků a konzistentně překonával ostatní testované modely.

Klíčové body:

  • Architektura a efektivita: Díky škálování řídkosti Mixture of Experts (aktivních 16 z 896 expertů) a novým strukturálním změnám dosáhli přibližně 2,5x lepší efektivity škálování oproti Kimi K2.
  • Kódování: Model zvládá dlouhé inženýrské relace, orientaci v obřích repozitářích a práci s terminálovými nástroji. V ukázkách postavil od nuly kompilátor podobný Tritonu (MiniTriton) a v jediném 48hodinovém autonomním běhu navrhl čip pro svou vlastní architekturu.
  • Znalostní práce: Umí generovat interaktivní výzkumné reporty, dashboardy, prezentace a dokáže i editovat video (sestříhal si vlastní teaser z 56 klipů). V Kimi Work přibývají nové funkce Widgets a Dashboard.
  • Dostupnost: K dispozici je od dnešního dne na Kimi.com, v Kimi Work, Kimi Code i přes API (model kimi-k3). Plné váhy modelu budou uvolněny do 27. července 2026. Cena API je 3 USD/MTok za vstup (cache-miss) a 15 USD/MTok za výstup.
  • Omezení: Firma upozorňuje na citlivost na historii uvažování, sklon k přílišné proaktivitě (může dělat neočekávaná rozhodnutí za uživatele) a znatelný rozdíl v uživatelské zkušenosti oproti Fable 5 a GPT 5.6 Sol.

Pro více informací: https://www.kimi.com/blog/kimi-k3

Komentáře

Odebírat
Upozornit na
guest
0 Komentářů
Nejstarší
Nejnovější Nejvíce hlasů

Fronta před rychlým backendem. Co ukázal veřejný test eDokladů

Veřejný zátěžový test eDokladů přinesl zdánlivě protichůdný výsledek: aplikační servery odpovídaly v milisekundách, zatímco část lidí čekala desítky sekund. Za hlavní omezení závěrečná analýza DIA označila vstupní bránu, jejíž automatické škálování nestačilo na náhlý náběh provozu. Test zároveň ukázal, proč samotný generátor HTTP požadavků nenahradí identity skutečných uživatelů a jejich zařízení.