Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

A Fireworks AI szerint az új modell Opus 5 szintű diákat készít

2026. szeptember 10.Forrás: Fireworks AI
A Fireworks AI szerint az új modell Opus 5 szintű diákat készít
Kép: Fireworks AI

A Fireworks AI és a Genspark olyan modellt fejlesztett, amely megtervezi, elkészíti és ellenőrzi a teljes prezentációkat. A Gen-1 Slides a Fireworks AI értékelése szerint Opus 5 szintjét hozza, miközben egy kész deck költsége körülbelül 90 százalékkal alacsonyabb.

A lényeg röviden
  • A Gen-1 Slides a MiniMax M3 utótanított változata.
  • A modell teljes prezentációkat tervez, készít és ellenőriz.
  • A Fireworks AI szerint az értékelésben Opus 5 szintjét érte el.
  • Egy kész deck költsége körülbelül 90 százalékkal alacsonyabb.
  • A rendszer már a Genspark AI Slides Standard módjának alapértelmezettje.

Hosszú munkafolyamatokra tanították a modellt

A Fireworks AI szeptember 10-i közlése szerint a Genspark a Fireworks Lab csapatával együtt a nyílt súlyú, multimodális MiniMax M3 modellt alakította át Gen-1 Slides néven prezentációkészítő rendszerré. A modell a teljes folyamatot kezeli: megtervezi a bemutató ívét, megírja a diákat HTML-ben, megjeleníti azokat, ellenőrzi a renderelt eredményt, majd szükség esetén javítja a hibákat.

A fejlesztők szerint erre azért volt szükség, mert egy jó prezentáció elkészítése több tucat lépésből állhat, és egyetlen munkamenet több százezer tokent is felölelhet. A hibák sokszor csak később válnak láthatóvá. Ilyen lehet a szöveg túlfutása a dobozon, az üres renderelés vagy a kitalált tartalom.

A Genspark kutatócsapata határozta meg, mit tekintenek jó prezentációnak, és ezt értékelési szabvánnyá alakította. A Fireworks Lab a jutalmazási rendszer kidolgozásában, több mint 100 kísérletben és a teljes tanítási folyamat irányításában vett részt.

A tanítás több szakaszban zajlott

A fejlesztés megerősítéses tanulásra épült. A Fireworks AI szerint az egyszerű utánzás nem elég, mivel egy kész deck csak a végeredményt mutatja meg, azt nem, hogy a modell milyen döntések sorozatán keresztül jutott el oda.

Első lépésként a csapat válogatott prezentációkon végzett felügyelt finomhangolást, hogy a modell elsajátítsa a jó diák vizuális alapelveit. Ezután rövid epizódokon indították el a megerősítéses tanulást, majd fokozatosan növelték a kontextus hosszát. A közlés szerint a túl hosszú munkamenetek kezdetben hibákkal teli kimeneteket és zajos tanítási jelet eredményeztek.

A hosszú, több mint 100 000 tokenes pályák stabil futtatása külön rendszertervezési problémát is jelentett. A Fireworks Lab olyan eltérést talált, amelyben a mintavételezést végző rendszer és a tanító rendszer nem pontosan ugyanazokat a tokeneket értékelte. A tokenizálási eltérés torzította a tanítási jelet. A két tokenfolyam összehangolása, valamint token- és kötegszintű szűrés segített megszüntetni a problémát.

A Gensparkban már alapértelmezettként működik

A Gen-1 Slides a közlés szerint már elérhető a Genspark AI Slides Standard módjának alapértelmezett modelljeként. A Genspark értékelésében a rendszer az Opus 5-tel azonos szintet ért el. A Fireworks AI szerint a Gen-1 Slides a vizuális tervezésben és az összesített pontszámban is vezetett, a kilenc értékelési oszlopból nyolcban első lett, és mind a kilencben az első két hely valamelyikén végzett.

A vállalat összehasonlítása alapján a Gen-1 Slides bemeneti tokenenkénti listaára körülbelül az Opus 5 árának egy tizenhetede. Egy elkészült deckre vetítve a költség nagyjából a tizede. A Fireworks AI példája szerint havi 1000 prezentáció esetén a kiadás hozzávetőleg 4200 dollárról 400 dollárra csökkenhet, ami körülbelül 90 százalékos megtakarítás.

Éles használatban a modell a közlés szerint minden mérőszámban az Opus 5 szintjén teljesít, miközben az alapmodellhez képest 18 százalékról 3,6 százalékra csökkent az alacsony értékelésű deckek aránya. A Fireworks AI ezt annak tulajdonítja, hogy a modellt teljes ügynöki munkameneteken tanították, így a tervezés, az önellenőrzés és a hibajavítás is része lett a működésének.

Kapcsolódó hírek

A tapasztalatokból tanuló LLM-ügynökök módszerét mutatta be a NAVER
Kutatás2026. október 4.

A tapasztalatokból tanuló LLM-ügynökök módszerét mutatta be a NAVER

A NAVER LABS Europe kutatói olyan nagy nyelvi modellekre épülő ügynökök betanítási módszerét mutatták be, amely a korábbi tapasztalatok visszakeresését és a felügyelt…

Az Anthropic csökkentette Claude jellegzetes fordulatait, de nem tűntek el
Kutatás2026. szeptember 29.

Az Anthropic csökkentette Claude jellegzetes fordulatait, de nem tűntek el

Az Opus 5.5 valóban szinte teljesen elhagyta a hosszú gondolatjeleket, és a Claude-ra jellemző stiláris fordulatok száma is csökkent. Az Arize AI vizsgálata szerint…

Az Anthropic tényleg javított Claude stílusán, de nem tüntette el teljesen
Kutatás2026. szeptember 29.

Az Anthropic tényleg javított Claude stílusán, de nem tüntette el teljesen

Az Opus 5.5 valóban sokkal kevesebb em dash jelet és Claude-ra jellemző fordulatot használ, mint az Opus 5, de az Arize AI vizsgálata szerint a probléma nem tűnt el…