Koa néven saját vállalati érvelő modellt épített a Salesforce

Koa néven mutatta be első, vállalati munkára optimalizált érvelő modelljét a Salesforce. A modell az NVIDIA Nemotron 3 Super alapjára épül, és a Salesforce szerint a vállalat biztonsági határain belül működik.
- A Koa a Salesforce első, vállalati munkára optimalizált érvelő modellje.
- Az alapot az NVIDIA 120 milliárd paraméteres Nemotron 3 Super modellje adta.
- A modellt több mint 14 iparág szimulált munkafolyamataival tanították.
- A Koa a Salesforce biztonsági határain belül fut, és a vállalat szerint az ügyféladatok nem tanítják tovább.
- A modell szolgáltatási, értékesítési és kereskedelmi pilotokban is megjelenik.
A Salesforce külön modellre bízta a vállalati érvelést
A Salesforce szeptember 16-i közleménye szerint az Agentforce történetének nagy részében egy általános modell végezte a legtöbb feladat mögötti érvelést. Ide tartozott többek között a szándékfelismerés, a promptinjekciók kiszűrése, a mérgező tartalmak vizsgálata, az értékelés és a keresési találatok újrarangsorolása.
Az elmúlt 18 hónapban a vállalat több kisebb, célfeladatra kialakított modellt épített, a többlépcsős érvelést azonban továbbra is az általános modellre bízta. Ezen változtat a Koa, amelyet a Salesforce első, vállalati munkára optimalizált AI-érvelő modellként mutatott be. A Koa az Agentforce ügynökeinek folyamatait futtathatja.
A Salesforce értelmezésében az érvelés azt jelenti, hogy egy ügynök összetett problémákon dolgozik, ellenőrzi saját logikáját, kiválasztja a szükséges eszközöket, majd az eredmény közlése vagy egy művelet végrehajtása előtt ellenőrzi a megtett utat.
NVIDIA-alapmodellből, szimulált munkafolyamatokkal tanították
A Koa-t a Salesforce és az NVIDIA közösen fejlesztette. Az alapot az NVIDIA 120 milliárd paraméteres, nyílt modellje, a Nemotron 3 Super adta. A Salesforce szerint a közvetlen hozzáférés a modell súlyaihoz lehetővé tette az utólagos tanítást és a vállalati feladatokra szabást. Az NVIDIA emellett közzétette a Nemotron betanításához használt adatkészletek eredetét is, így a Salesforce betekintést kapott az alapmodell hátterébe.
A vállalat először sikeresen végrehajtott munkák átirataival próbálta tanítani a modellt, ez azonban korlátozott eredményt hozott. A vállalati ügynökök többlépcsős, eszközöket használó folyamatokban dolgoznak, ezért a Koa-t szimulált munkafolyamatokban is gyakoroltatták.
A csapat több mint 14 iparágban, köztük a gyártásban, a pénzügyi szolgáltatásokban, az egészségügyben és az utazásban hozott létre szimulációkat. A mesterségesen létrehozott ügyfelek eltérő személyiséggel és hangulattal rendelkeztek, az eszközök pedig reagáltak az ügynök hívásaira. Egy értékelő azt vizsgálta, hogy sikerült-e megoldani az ügyfél problémáját. A modell ezután újra megpróbálta a feladatot, a Salesforce leírása szerint minden forgatókönyvet több ezer alkalommal futtatva.
A megerősítéses tanulás célja a többfordulós eszközhasználat javítása volt. A Salesforce ehhez 27 évnyi tapasztalatára támaszkodott azokban a munkafolyamatokban, amelyeket a modellnek meg kellett tanulnia.
A Koa a Salesforce biztonsági határain belül működik
A Salesforce külön figyelmet fordított arra, hogyan reagáljon a modell olyan helyzetekben, amikor a szükséges eszköz nem áll rendelkezésre. A vállalat szerint a Koa ilyenkor közli, hogy mit nem tud végrehajtani, bekéri a hiányzó információt, később folytatja a feladatot, vagy emberi munkatárshoz továbbítja az ügyet, ha az önálló modellalapú döntés nem lenne megfelelő.
A Koa a Salesforce más, célfeladatra készített modelljeivel együtt működik. A HyperClassifier, a TextEval és a Moirai mellett a vállalat általános nyelvi modelleket is használ. A célzott feladatokat, például a szándék osztályozását, a mérgező tartalmak szűrését és a keresési eredmények újrarangsorolását az ezekre kialakított modellek kapják, míg a Koa a többlépcsős vállalati érvelést végzi.
A modell jelenleg a Salesforce saját munkafolyamataiban fut, és egy kisebb ügyfélcsoporttal már megkezdődtek a pilotok a szolgáltatás, az értékesítés és a kereskedelem területén. A vállalat szerint a CRM-specifikus feladatokon, például egy értékesítési lehetőség frissítésén, egy ügy továbbításán vagy egy utánkövetés ütemezésén végzett korai tesztek biztatóak voltak, és a Koa felülmúlta a legerősebb általános célú modelleket.
A Koa teljes egészében a Salesforce által üzemeltetett infrastruktúrán, a Salesforce biztonsági határain belül fut. A vállalat szerint a betanítás során nem használtak valódi ügyféladatokat, és az ügyféladatok, valamint az ügynökök működésének nyomai nem tanítják tovább a modellt. A Salesforce közlése alapján ez különösen a szabályozott iparágakban, például a pénzügyi szolgáltatások, az egészségügy, az utazás és a könyvelés területén működő pilotügyfelek számára lehet fontos.
Salesforce: Why We Post-Trained Our Own Reasoning Model


