Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

A Fireworks AI Opusra optimalizált útválasztót indított

2026. szeptember 28.Forrás: Fireworks AI
A Fireworks AI Opusra optimalizált útválasztót indított
Kép: Fireworks AI

A Fireworks AI elindította a FireRouter with Opus szolgáltatást, amely a feladatok alapján Claude Opus 5.5, GLM 5.3 és GLM 5.3 Flash között választ. A vállalat belső tesztje szerint a rendszer 57 százalékkal csökkentette a munkamenetenkénti költséget az Opus önálló használatához képest.

A lényeg röviden
  • A FireRouter with Opus három modell között választ: Claude Opus 5.5, GLM 5.3 és GLM 5.3 Flash.
  • A Fireworks belső tesztje szerint a munkamenetenkénti költség 15,36 dollárról 6,63 dollárra csökkent.
  • A rendszer az Opus önálló használatához képest 98,1 százalékos összesített pontosságot ért el.
  • A cache-találati arány 94,2 százalék volt, szemben az Opus önálló használatánál mért 97,8 százalékkal.
  • A szolgáltatás több fejlesztői környezetben, köztük a Claude Code, a Codex és a Cursor IDE rendszerében érhető el.

Cache-tudatos útválasztás több modell között

A FireRouter with Opus a Fireworks AI közlése szerint a FireRouterre épül, amely a piacon első cache-tudatos útválasztó. A szolgáltatás a Claude Opus 5.5, a GLM 5.3 és a GLM 5.3 Flash között irányítja a felhasználói kéréseket. A modellkészlet a vállalat szerint változhat, amikor új modellek és verziók jelennek meg.

Minden, a FireRouterhez érkező felhasználói kérést kiértékel a rendszer. Megvizsgálja, hogy az adott feladathoz melyik modell illik a legjobban, majd megbecsüli a feldolgozás költségét. Ebbe a prompt gyorsítótárának költsége is beletartozik, valamint az, hogy egy másik modellre váltás miatt mennyibe kerülhet a meglévő gyorsítótár-találatok elvesztése. Ez alapján a minőség és a költség közötti egyensúlyt legjobban megközelítő modellt választja.

A Fireworks belső tesztjének eredményei

A Fireworks AI 2026. szeptember 28-án közzétett bejelentése szerint több mint egy hónapon át végzett belső A/B tesztet. A programozási feladatokat azonos munkaterhelések és felhasználók mellett véletlenszerűen osztották be a FireRouter with Opus, illetve a kizárólag Opust használó kontrollcsoport között.

A munkamenetenkénti költség 57 százalékkal csökkent, 15,36 dollárról 6,63 dollárra. A Fireworks által megadott mérés bizonytalansága plusz-mínusz 19 százalékpont volt. A pontosság értékelésekor azt vizsgálták, hogy az ügynök befejezte-e a munkát, eljutott-e a helyes válaszig, illetve szükség volt-e felhasználói javításra a következő körben.

A FireRouter with Opus a kiértékelt fordulók 78,7 százalékában ért el megfelelő eredményt, míg az Opus önállóan 80,2 százalékot. A Fireworks ezt az Opushoz viszonyított 98,1 százalékos összesített pontosságként adta meg.

A gyorsítótár-találatok ára és a használat lehetőségei

A belső forgalom jelentős része programozási feladatokból állt, amelyeknél a vállalat szerint a nyílt modellek sok rutinszerű kérést is képesek voltak kezelni. A cache-tudatos útválasztás a modellváltással elérhető megtakarítást összevetette a gyorsítótár-találat elvesztésének költségével.

Ennek eredményeként a FireRouter with Opus használatakor 94,2 százalékos cache-találati arányt mértek, szemben az Opus önálló használatánál elért 97,8 százalékkal. A Fireworks ezt kisebb, tudatos kompromisszumként írja le, amely jelentősen csökkentette a teljes költséget.

A szolgáltatás elérhető a Fireworks parancssori felületén, valamint önálló routermodellként is. A vállalat szerint bármely Fireworks-fiók szerver nélküli végpontként használhatja, ugyanúgy, mint bármely más modellt. A FireRouter with Opus több fejlesztői környezetben is működik, köztük a Claude Code, a Codex és a Cursor IDE rendszerében. A használathoz a Fireworks a fireconnect login, majd a fireconnect claude --model firerouter/opus parancsot adta meg. A fiókba belépve a felhasználók megnézhetik a csapatuk Claude Opus-költésére becsült megtakarítást.

Kapcsolódó hírek

Modellek
Modellek2026. október 2.

Az OpenAI útmutatót adott ki a GPT-6 modellek használatához

Az OpenAI gyakorlati útmutatóban mutatja be, hogyan érdemes kiválasztani és használni a GPT-6 család modelljeit. A dokumentum a fejlesztési feladatoktól a több napon át…

A Fireworks AI új routere 57 százalékkal csökkentette a költséget
Cégek és üzlet2026. szeptember 28.

A Fireworks AI új routere 57 százalékkal csökkentette a költséget

A Fireworks AI bemutatta a FireRouter with Opus szolgáltatást, amely a feladatokat több modell között osztja el. A vállalat belső tesztjeiben a megoldás 57 százalékkal…

A Fireworks szerint a modellek együtt többre képesek, mint külön-külön
Kutatás2026. szeptember 21.

A Fireworks szerint a modellek együtt többre képesek, mint külön-külön

A megfelelő modell feladatonkénti kiválasztásával jelentősen javítható egy kódoló ügynök teljesítménye, miközben a költség is csökkenthető. A Fireworks AI elemzése…