Az AWS új modellekkel és olcsóbb ügynökfuttatással bővítette Bedrockot

Az AWS szeptemberben több ponton bővítette az Amazon Bedrock, az AgentCore és a Strands képességeit. Az újdonságok között új OpenAI, Claude, Kimi és Grok modellek, hatékonyabb ügynökfuttatás, valamint új vállalati adatforrások szerepelnek.
- Nyilvános előzetesként elérhető az OpenAI által hajtott Amazon Bedrock Managed Agents.
- Az AgentCore frissített futtatókörnyezete alacsonyabb hidegindítási késleltetést és használatalapú működést kínál.
- Az Amazon Bedrock új OpenAI, Claude, Kimi és Grok modellekkel bővült.
- A Strands Decider 2B helyben, körülbelül 115 ezredmásodperc alatt hoz döntést.
- Új natív csatlakozók érkeztek többek között a ServiceNow, Salesforce és Zendesk rendszerekhez.
OpenAI-modellek és gyorsabb ügynökök az AWS-en
Az AWS október 9-én közzétett összefoglalója szerint az Amazon Bedrock Managed Agents, amelyet az OpenAI technológiája hajt, nyilvános előzetesként vált elérhetővé. A szolgáltatás lehetővé teszi OpenAI-modellek használatát úgy, hogy az adatok az AWS-en belül maradnak. A fejlesztők újrahasznosíthatják a meglévő AWS Identity and Access Management, vagyis IAM-jogosultságokat, az ellenőrizhetőséget pedig az AWS CloudTrail támogatja.
A tartós munkamenetek és a beépített emberi jóváhagyási folyamatok csökkenthetik a fejlesztési ráfordítást és a kockázatot. Az AgentCore futtatókörnyezetének frissítése emellett hatékonyabb memóriakezelést és alacsonyabb hidegindítási késleltetést kínál a szerver nélküli ügynökök számára. A munkamenetek tétlenség esetén nullára skálázódnak, hardveresen elkülönített környezetben futnak, a számlázás pedig a tényleges használathoz igazodik, előre lefoglalt kapacitás nélkül.
A Strands új, nyílt forráskódú agent harness eszköze az AWS szerint a népszerű megoldásokhoz hasonló pontosságot ér el 28 százalékkal kevesebb token használatával. Pythonban vagy TypeScriptben egyetlen sorral elindítható, és beépített kontextuskezelést, promptgyorsítótárat és memóriát kínál.
Új modellek a különböző munkaterhelésekhez
Az Amazon Bedrockon általánosan elérhetővé vált az OpenAI Astra, Sol és Luna modellcsaládja. A GPT-6 Astra legfeljebb 1 millió bemeneti tokennel támogatja az összetett döntéseket, dokumentumelemzést és szoftverfejlesztést. A GPT-6 Astra Ultrafast a sebességre optimalizált változat, amely az API-ban akár 6-szor gyorsabb következtetést és másodpercenként legfeljebb 300 tokent kínál.
A GPT-6.1 Sol és a GPT-6 Sol kódolási, számítógépes használati és rendszeresen futó szakmai feladatokra készült. A GPT 6.1 Luna nagy mennyiségű kinyerési, összefoglalási, osztályozási és útválasztási munkát céloz.
A Claude választéka a Claude Fable 5.1, a Claude Opus 5.5 és a Claude Sonnet 5.5 modellekkel bővült. Az Opus 5.5 ügynökalapú kódolásra, tudásmunkára és hosszú ideig futó feladatokra készült, adaptív gondolkodással és beállítható erőfeszítési paraméterrel. Az AWS szerint a Sonnet 5.5 feladatonként 30 százalékkal olcsóbb és 30 százalékkal gyorsabb a Claude Sonnet 5-nél.
Az Amazon Bedrockra megérkezett a Moonshot AI Kimi K3 modellje, valamint az xAI Grok 4.6 és Grok 4.7 modelljei is. A Kimi K3 egymillió tokenes kontextusablakot, natív látásfeldolgozást és beépített promptgyorsítótárat kínál. A Grok modellek 500 ezer tokenes kontextusablakot, állítható gondolkodási erőfeszítést és önellenőrzést támogatnak.
Kisebb, helyben futó döntési modell
A Strands Decider 2B egy nyílt forráskódú, 2 milliárd paraméteres döntési modell. Szöveg létrehozása helyett előre meghatározott lehetőségek közül választ, ezért az AWS szerint ügynökös feladatokra, eszközválasztásra, útválasztásra és védelmi korlátokra is használható.
A modell helyben körülbelül 115 ezredmásodperc alatt ad választ. A kód, az adatok és a súlyok a GitHubon és a Hugging Face-en is elérhetők. Az AWS ezt olyan megoldásként mutatja be, amely nagyobb döntéseket is helyben kezelhet.
Frissebb vállalati tudás és több natív adatkapcsolat
Az Amazon Bedrock Managed Knowledge Base új automatikus szinkronizálási ütemezése napi, heti és havi frissítést tesz lehetővé az összes natív adatforrás-csatlakozónál. Ez segíthet abban, hogy a vállalati ügynökök frissebb információkat kérjenek le.
A szolgáltatás natív csatlakozóként támogatja a ServiceNow, a Confluence Data Center, a Salesforce és a Zendesk rendszereit. A csatlakozók automatikusan kezelik az adatok feltérképezését, a metaadatok kinyerését és a részleges szinkronizálást, így kevesebb egyedi betöltési kódra lehet szükség a támogatási tartalmak, belső dokumentációk és működési ismeretek kezeléséhez.
A SharePoint, OneDrive és Confluence esetében felhasználó által kezelt beállítás is elérhető, ami csökkentheti az adminisztrátor által kezelt szolgáltatásfiókoktól való függést, ha a szükséges hozzáférések már rendelkezésre állnak. A frissítések az AWS szerint azt a célt szolgálják, hogy a vállalati fejlesztők rugalmasabban választhassanak modellt, futtatási környezetet és eszközt, miközben az ügynökök működése, költsége és adatkezelése jobban ellenőrizhető marad.


