Három nyílt súlyú modellel bővíti a GitLab Duo Agent Platformot

A GitLab három hosztolt, nyílt súlyú modellel bővíti a Duo Agent Platform modellválasztékát. A Kimi K3, a GLM 5.3 és a MiniMax M3 különböző fejlesztési feladatokhoz kínálhat kedvezőbb költség és teljesítmény arányt.
- A GitLab három hosztolt nyílt súlyú modellt adott a Duo Agent Platformhoz.
- A Kimi K3, a GLM 5.3 és a MiniMax M3 eltérő fejlesztési feladatokra készült.
- A modellek egy kreditből 1,82, 5, illetve 8 hívást tesznek lehetővé.
- A Fireworks AI szolgálja ki mindhárom modellt, nulla adatmegőrzéssel.
- A rendszergazdák funkciónként állíthatnak be alapértelmezett modellt és engedélyezett modelleket.
Feladatonként választható modell
A GitLab szerint nincs egyetlen modell, amely minden szoftverfejlesztési feladatra a legjobb választás lenne. Egy új funkció elkészítése, egy sikertelen folyamat diagnosztizálása és egy biztonsági rés kezelése eltérő képességeket igényelhet.
A hosszú refaktorálási feladatoknál fontos lehet a nagy kontextusablak és a mélyebb következtetés, míg a rutinszerű, nagy mennyiségű munkákhoz gyorsabb és költséghatékonyabb modell lehet megfelelő. A GitLab most a Kimi K3, a GLM 5.3 és a MiniMax M3 modelleket teszi elérhetővé a GitLab Duo Agent Platformban, a korábban kínált csúcskategóriás modellek mellett.
A vállalat belső tesztjei szerint a Kimi K3 és a GLM 5.3 bizonyos összehasonlítható csúcskategóriás modelleknél jobb eredményt ért el, miközben hívásonként kevesebbe kerül. A rutinszerű, nagy volumenű feladatokra a GitLab a MiniMax M3-at ajánlja.
Akár nyolc hívás egy kreditből
A GitLab Duo Agent Platformban egy hívás egyetlen olyan kérés, amelyet a rendszer a modellnek küld. Egy ügynöki művelet vagy egy csevegési üzenet több hívást is kiválthat, ezért a hosszabb, többlépéses munkafolyamatoknál a modell költsége gyorsan összeadódhat.
A GitLab adatai szerint a Kimi K3 egy kreditből 1,82 hívást tesz lehetővé. A platform legtöbb funkciója mögött használt alapértelmezett modellnél ez az érték 2 hívás kreditenként. A GLM 5.3 esetében 5, a MiniMax M3-nál pedig 8 hívás jut egy kreditre.
A vállalat megfogalmazása szerint az új modellekkel egyes összehasonlítható csúcskategóriás modellekhez képest akár négyszer több hívás is indítható egy GitLab Credit felhasználásával. A GitLab a részletes szorzókat és modellenkénti kreditfelhasználást külön dokumentációs oldalon ismerteti.
A modellek eltérő szerepre készültek. A Moonshot AI Kimi K3 modelljét nagy kódbázisokhoz és hosszú ideig futó ügynöki munkamenetekhez szánják. A Z.ai GLM 5.3-at hosszú távú kódolási feladatokra hangolták, a MiniMax M3 pedig a számítási költségek alacsonyan tartására és nagy volumenű, többlépéses munkára készült.
Központi adminisztráció és többféle üzemeltetés
A rendszergazdák központilag szabályozhatják, hogy a csapatok mely modelleket használhatják. A felső szintű csoport tulajdonosa funkciónként más alapértelmezett modellt állíthat be, és meghatározhatja a választható modellek körét. Ezek a beállítások az alárendelt csoportokra és projektekre is érvényesek.
A GitLab szerint a modellválasztás összehangolható a biztonsági, megfelelőségi és infrastruktúra-követelményekkel. A GitLab által kezelt modellek a vállalat környezetében futnak, így az ügyfélnek nem kell saját infrastruktúrát kiépítenie és fenntartania. Saját üzemeltetés esetén a modellforgalom az adott csapat hálózatán belül marad, a hibrid telepítés pedig a két megközelítés kombinációját teszi lehetővé.
Mindhárom új, hosztolt nyílt súlyú modellt a Fireworks AI szolgálja ki. A GitLab közlése szerint a szolgáltató megfelelt a vállalat kockázatkezelési követelményeinek. A GitLab Duo Agent Platform kéréseinél a Fireworks esetében nulla adatmegőrzési szabály érvényesül, vagyis a bemenetet és a kimenetet a válasz után azonnal törlik, és nem tárolják visszaélések monitorozására.
A Kimi K3, a GLM 5.3 és a MiniMax M3 opcionális modellként már kiválasztható a Duo Agent Platformban, illetve egy funkció alapértelmezett modelljeként is beállítható. A GitLab a Transcend eseményét október 6-án rendezi meg, ahol a vállalat a fejlesztési sebesség, a kódellenőrzések, a biztonsági szabályok és a kiadási ciklusok összehangolásáról is beszél.


