Ha eddig azt hitted, hogy a „frontier” (csúcskategóriás) modellek ligájában legfeljebb két-három szereplőnek osztanak lapot, a Kimi K3 kellemetlenül jó ellenpélda. Ráadásul úgy közelít a csúcshoz, hogy közben a modell „súlyai” (a betanított paraméterek, amiket futtathatsz a saját infrastruktúrádon) nyilvánosak lehetnek.

Mi történt

A kínai Moonshot AI kiadta a Kimi K3-at, egy „open-weights” modellt, amely több benchmarkon néhány ponton belülre kerül a legjobb zárt modellekhez képest, és bizonyos feladatokban még jobbnak is mérik. A bejelentés egyik erős állítása, hogy mindezt a csúcskategóriás árak töredékéért kínálják.

A K3 technikai oldalról is figyelemfelkeltő: 1 millió tokenes kontextusablakkal érkezik. Gondolj erre úgy, mint egy óriási „munkamemóriára”: nem csak pár oldalnyi szöveget tud egyszerre szem előtt tartani, hanem komplett dokumentumcsomagokat, hosszú beszélgetéseket vagy nagy kódbázis-részleteket is. A közölt eredmények szerint a modell kifejezetten erős webes kutatásban, táblázatos feladatokban, frontend tervezésben és hosszú kódolási munkákban.

A teljesítményt egy összesítő mérőszámmal is pozicionálják: az AA’s Intelligence Indexen 57 pontot kapott, közvetlenül a két említett csúcsmodell mögé sorolva, és nagy ugrást mutatva a korábbi K2.6-hoz képest. Egy demóban a K3 állítólag 48 órán át dolgozott önállóan egy apró chip megtervezésén és verifikálásán, amely szimulációban egy mini „saját verzióját” futtatta, 8 700 token/másodperces sebességgel.

Miért fontos

A történet itt nem az, hogy „még egy modell kijött”, hanem hogy a csúcsteljesítmény és az elérhetőség kezd közelebb kerülni egymáshoz. Az „open-weights” jelleg gyakorlati következménye, hogy a fejlesztők és vállalatok (ha valóban publikálják a súlyokat) könnyebben építhetnek saját futtatásra, szabályozott környezetre (pl. adatrezidencia), vagy akár költségkontrollra optimalizált megoldásokat. Közben a közölt árképzés a Claude 5 Sonnet szintjére van belőve (3/15 dollár per millió token), ami azt jelzi: a verseny már nem csak a pontszámokról, hanem a „mennyiért kapom meg ugyanezt a munkát?” kérdésről is szól. A The Rundown AI értelmezése szerint ez a dinamika látványosan rövidítheti azt a korábban gyakran emlegetett lemaradást, amely Kína és az open source ökoszisztéma mögöttét feltételezte a legjobb zárt modellekhez képest.

Mire figyelj

  1. Valóban megjelennek-e a súlyok július 27-ig, és milyen licenccel? Az „open-weights” sok mindent jelenthet; a felhasználási korlátok döntik el, mennyire lesz építhető üzletileg.
  2. Reprodukálhatók-e a benchmarkok és a gyakorlati előnyök? A webkutatás, táblázatkezelés és hosszú kódolás tipikusan olyan terület, ahol a „demó” és a mindennapi munka között nagy lehet a szórás.
  3. Mit jelent a 1M kontextus a valós költségben és sebességben? A hosszú kontextus hasznos, de drága is tud lenni; nem mindegy, mennyire hatékonyan „gondolkodik” ilyen hosszú bemeneten.
  4. Ár/érték verseny a csúcskategóriában: ha a K3 tényleg közel van a legjobbakhoz, a következő hónapok inkább szólhatnak árazásról és csomagolásról (tooling, integrációk, megbízhatóság), mint puszta pontvadászatról.

A Kimi K3 üzenete egyszerű: a „frontier” klub ajtaja nem zárható be örökre, főleg ha a teljesítmény, az ár és a hozzáférés egyszerre mozdul el a felhasználók felé.