A Google bemutatta a Gemini 3.6 Flash és a 3.5 Flash-Lite modelleket

A Google DeepMind bemutatta a Gemini 3.6 Flash, a Gemini 3.5 Flash-Lite és a Gemini 3.5 Flash Cyber modelleket. Az új modellek közös célja, hogy alacsonyabb késleltetés és jobb tokenhatékonyság mellett támogassák a nagy léptékű AI-ügynököket.
- A Gemini 3.6 Flash 17 százalékkal kevesebb kimeneti tokent használ a 3.5 Flashnél az Artificial Analysis Index szerint.
- A Gemini 3.5 Flash-Lite másodpercenként 350 kimeneti tokent generál az Artificial Analysis mérése alapján.
- A Gemini 3.5 Flash Cyber kiberbiztonsági sérülékenységek felderítésére és javítására készült.
- A 3.6 Flash és a 3.5 Flash-Lite fejlesztők, vállalatok és a Gemini alkalmazás felhasználói számára is elérhető.
A Gemini 3.6 Flash kevesebb tokennel dolgozik
A Google DeepMind július 21-i bejelentése szerint a Gemini 3.6 Flash a 3.5 Flash továbbfejlesztett változata, amelyet kódolási, tudásalapú és multimodális feladatokra szánnak. Az Artificial Analysis Index mérése alapján a modell 17 százalékkal kevesebb kimeneti tokent használ, mint a Gemini 3.5 Flash. A Datacurve DeepSWE tesztjében a vállalat legfeljebb 65 százalékos csökkenést figyelt meg.
A Google szerint a 3.6 Flash kevesebb következtetési lépéssel és eszközhívással is képes végrehajtani a többlépcsős munkafolyamatokat. A modell ára 1,50 dollár egymillió bemeneti tokenenként és 7,50 dollár egymillió kimeneti tokenenként. A vállalat állítása szerint ez csökkenti az egyes AI-ügynöki feladatok teljes költségét.
A közzétett teszteredmények szerint a 3.6 Flash a DeepSWE mérésében 49 százalékos eredményt ért el a 3.5 Flash 37 százalékával szemben. Az MLE Benchben 63,9 százalékot produkált a korábbi modell 49,7 százalékával szemben, az OSWorld-Verified tesztben pedig 83,0 százalékot a 78,4 százalékhoz képest. A GDPval-AA v2 tudásmunkát mérő tesztjén az eredmények 1421 és 1349 voltak.
A Flash-Lite a sebességre és a nagy terhelésre épít
A Gemini 3.5 Flash-Lite a 3.5-ös sorozat leggyorsabb modellje a Google szerint. Az Artificial Analysis mérése alapján másodpercenként 350 kimeneti tokent generál. Ára egymillió bemeneti tokenenként 0,30 dollár, egymillió kimeneti tokenenként pedig 2,50 dollár.
A modellt alacsony késleltetésű és nagy áteresztőképességet igénylő feladatokra tervezték, például ügynöki kereséshez és dokumentumfeldolgozáshoz. A fejlesztők különböző gondolkodási szinteket állíthatnak be. Az alacsonyabb szintek a gyors és olcsó végrehajtást célozzák, a magasabbak pedig többlépcsős alügynöki feladatok feldolgozására használhatók.
A Google által közölt tesztekben a 3.5 Flash-Lite a Terminal-Bench 2.1 mérésében 54 százalékot ért el a 3.1 Flash-Lite 31 százalékával szemben. A GDM-MRCR v2 hosszú kontextusú tesztjében 72,2 százalékos eredményt produkált a korábbi modell 60,1 százalékával szemben, a GDPval-AA v2-ben pedig 1140 pontot szerzett a 642-vel szemben. A modell beépített számítógép-használati eszközt is kapott.
Korlátozott hozzáférésű kiberbiztonsági modell érkezik
A Gemini 3.5 Flash Cyber a Gemini 3.5 Flashra épül, és a Google kiberbiztonsági sérülékenységek felismerésére, ellenőrzésére és javítására hangolta. A modell a CodeMender kód-biztonsági ügynökkel együtt működik. A rendszerben több 3.5 Flash Cyber ügynök dolgozik egy közös jelentés elkészítésén.
A Google szerint a megoldás versenyképes teljesítményt nyújt a CyberGym nevű tesztben. A technológia kettős felhasználású jellege miatt a 3.5 Flash Cyber kezdetben kizárólag kormányok és megbízható partnerek számára lesz elérhető, a CodeMenderen keresztül, korlátozott hozzáférésű pilotprogramban. A vállalat ezt azzal indokolja, hogy a védekezők előbb találhassák meg és javíthassák a kritikus hibákat, miközben mérséklik a szélesebb körű visszaélés kockázatát.
A modellek több Google-szolgáltatásban elérhetők
A Gemini 3.6 Flash és a Gemini 3.5 Flash-Lite a bejelentés napjától használható a Gemini API-ban, a Google AI Studio és az Android Studio fejlesztői környezetben. A 3.6 Flash a Google Antigravity szolgáltatásban is megjelent.
A vállalati ügyfelek a Gemini Enterprise Agent Platformon érhetik el a modelleket, a 3.6 Flash pedig a Gemini Enterprise alkalmazásban is rendelkezésre áll. A felhasználók számára a Gemini alkalmazásban váltak elérhetővé, a 3.5 Flash-Lite pedig fokozatosan a Google Keresőbe is bekerül.
A 3.6 Flash fokozott biztonsági védelmet kapott a kémiai, biológiai, radiológiai és nukleáris területeken, valamint a kiberbűnözési visszaélésekkel szemben. A Google közlése szerint a modellt úgy képezték, hogy a hasznos felhasználások esetén kevesebb elutasítást adjon. A vállalat közben azt is közölte, hogy a Gemini 3.5 Pro partnertesztelés alatt áll, és a Gemini 4 legnagyobb eddigi előtanítási futtatását is megkezdte.
Google DeepMind: Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
