Ugyanaz az árcédula nem mindig ugyanazt a végösszeget jelenti. A Google új Gemini 3.8 Flash modelljénél épp ez a lényeg: papíron nem drágább, használat közben mégis könnyen többe kerülhet.

Mi történt

A Google elindította a Gemini 3.8 Flash modellt, alig néhány héttel a 3.7 Flash után. A vállalat azt állítja, hogy az új verzió „keményebben dolgozik”: összetettebb feladatoknál több következtetési lépést hajt végre, és iteratívan hív meg eszközöket. Ez utóbbi leegyszerűsítve azt jelenti, hogy a modell nem egyetlen próbálkozással old meg mindent, hanem többször visszanyúlhat külső segédeszközökhöz vagy részfeladatokhoz, hogy pontosabb eredményt adjon.

Az induló ár ugyanaz maradt, mint a 3.7 Flashnél: 0,75 dollár egymillió bemeneti tokenért és 3,75 dollár egymillió kimeneti tokenért. A token itt nagyjából a szöveg apró elszámolási egysége: gondolj rá úgy, mint amikor nem egy teljes dokumentumért, hanem karaktercsomagokért fizetsz. A csavar az, hogy a modell magasabb „erőfeszítési” szinten több tokent használhat a jobb teljesítmény érdekében, ezért a végső költség nőhet akkor is, ha az egységár nem változik. Aki a tokenfogyasztást akarja minimalizálni, továbbra is használhatja a Gemini 3.7 Flash modellt.

A 3.8 Flash főleg szoftverfejlesztési és autonóm ügynökös feladatokban kapott erősítést. Az autonóm AI-ügynök olyan rendszer, amely több lépésen át, részben önállóan hajt végre feladatokat — például kódot elemez, hibát keres, majd javítási javaslatot is ad. A modell a közölt eredmények szerint jobban szerepelt elődjénél és több riválisnál szoftvermérnöki, pénzügyi ügynökös és jogi benchmarkokon is. Megjelent mellette a Gemini 3.8 Flash Cyber is, amely a Fairwind Program részeként kormányzati és megbízható partneri kör számára érhető el, biztonsági és sebezhetőség-javítási feladatokra.

Miért fontos

Ez a frissítés jól mutatja, merre mozdul a piac: nem elég olcsónak lenni tokenenként, az is számít, mennyi munkát végez el a modell egy feladaton belül. Ha egy rendszer több lépésben gondolkodik, több kimenetet generál és többször használ eszközöket, akkor jobb eredményt adhat, de a számla is gyorsabban nőhet. Fejlesztőknek és cégeknek ez gyakorlati döntés lesz: olcsóbb, takarékosabb modellt választanak, vagy többet fizetnek a jobb minőségért és az önállóbb működésért. A The Verge által idézett korai értékelések alapján a 3.8 Flash ár-teljesítmény arányban így is erős lehet, csak már nem elég a listaárat nézni.

Mire figyelj

  1. Érdemes követni, valós projektekben mennyivel nő a tokenhasználat a 3.7 Flashhez képest, mert ez dönti el a tényleges költséget.
  2. Fontos lesz, hogy a jobb benchmarkeredmények mennyire fordulnak át stabil, hétköznapi teljesítményre kódolásnál, jogi és pénzügyi feladatoknál.
  3. A Cyber változat és a Fairwind Program azt jelzi, hogy a Google a védelmi és kritikus infrastruktúrás felhasználást is komolyan építi — itt a biztonsági korlátok és a hozzáférési szabályok különösen lényegesek lesznek.
  4. Felhasználói oldalon az is kérdés, hogy a Google AI Pro és Ultra előfizetők mennyit érzékelnek majd ebből a „keményebben dolgozó” működésből a sebesség, a pontosság és a használati korlátok szintjén.