GPT-5-támogatást és új dokumentumkezelő funkciókat kapott az Azure

A Microsoft frissítette az Azure Content Understanding szolgáltatását, amely dokumentumokból, űrlapokból, táblázatokból, képekből, hang- és videofájlokból alakít strukturált adatot. A CU 1.0 általánosan elérhető frissítése mellett megjelent a CU 2.0 nyilvános előzetese is, többek között GPT-5-támogatással, szinkron API-kkal és szemantikus darabolással.
- A frissített CU 1.0 API általánosan elérhető termelési munkaterhelésekhez.
- Az Azure Content Understanding több GPT-5 modellt és standard, mini, illetve nano változatot támogat.
- A Microsoft belső mérése szerint a tokenhasználat legfeljebb 28 százalékkal csökkent bizonyos modelleknél.
- A CU 2.0 előzetese új adózási elemzőket, szemantikus darabolást és oldalon belüli felosztást kínál.
- A CU 2.0 fejlett kontextualizálást és megbízhatósági értékeket is bevezet.
A CU 1.0 a termelési használatra kapott fejlesztéseket
A Microsoft Foundry 2026. augusztus 12-i bejelentése szerint a frissített CU 1.0 API, amely a 2025-11-01 verzióra épül, általánosan elérhetővé vált termelési munkaterhelésekhez. A kiadás célja, hogy a fejlesztők hatékonyabban dolgozhassák fel a vállalati tartalmakat, miközben nagyobb választási lehetőséget kapnak a használt modellek között.
Az Azure Content Understanding elemzői mostantól a GPT-5 modellcsalád több változatát is használhatják, köztük a GPT-5.5, GPT-5.4, GPT-5.3, GPT-5.2 és GPT-5.1 modelleket, valamint a standard, mini és nano változatokat. A Microsoft szerint a fejlesztők így saját adataikon mérlegelhetik a pontosság, a késleltetés és a költség közötti kompromisszumokat. A meglévő PTU-kötelezettségek továbbra is használhatók.
A frissítés a forrásokhoz való kötést, vagyis a groundingot is hatékonyabbá teszi. A Microsoft belső értékelései szerint a GPT-4.1 és GPT-5.2 esetében az átlagos következtetési tokenhasználat legfeljebb 28 százalékkal csökkent, miközben az átlagos pontosság legfeljebb 3 százalékkal javult. A megújított megbízhatósági modellnél az AUROC alapján mért pontosság legfeljebb 14 százalékkal nőtt.
A CU 2.0 új építőelemeket ad a fejlesztőknek
A CU 2.0 nyilvános előzetese a 2026-06-01-preview verzióval érhető el. A kiadás ugyanarra a GPT-5 modellcsaládra épít, mint a frissített CU 1.0, így a fejlesztők összevethetik a pontosságot, a késleltetést és a költségeket saját, reprezentatív adataikon.
Az egyik központi funkció a fejlett kontextualizálás. Ez lehetővé teszi, hogy az egyedi elemzők hatékonyabban használják a címkézett példákat és a dokumentumismeretet. A Microsoft belső tesztjei szerint az átlagos pontosság legfeljebb 3,5 százalékkal javult, az átlagos nyelvimodell-tokenhasználat pedig legfeljebb 22 százalékkal csökkent. A betanítási adatok az ügyfél Azure Storage-fiókjában maradnak, és tudásforrásként szolgálnak.
Az előzetes öt új, előre elkészített elemzőt is bemutat adózási munkafolyamatokhoz. Ezek a 1065, 1120-S, 8865, 1041 Schedule K-1 és Minnesota State M1 típusú dokumentumokat támogatják. A Microsoft szerint az új elemzők összetett, többoldalas elrendezéseket kezelnek, és bizonyos kinyerési esetekben egyáltalán nem igényelnek nyelvimodell-tokeneket. Az elemzők a Content Understanding Studio és a Microsoft Foundry felületén is elérhetők, ahol az értékek, a dokumentumon belüli kijelölések és a megbízhatósági pontszámok ellenőrizhetők.
Szemantikus darabolás és részletesebb osztályozás
A CU 2.0 előzetese szemantikus darabolást ad a prebuilt-documentSearch funkcióhoz. A módszer nem kizárólag karakterszám vagy oldahatár alapján választja szét a tartalmat, hanem a dokumentum szerkezetét is figyelembe veszi. Így kisebb eséllyel kerül külön egységbe egy táblázat és a hozzá tartozó fejléc, illetve az egymáshoz kapcsolódó bekezdések.
A Microsoft szerint ez különösen a visszakeresést bővítetten használó, RAG-alapú és ügynöki munkafolyamatoknál lehet hasznos, mivel a rendszer által megtalált tartalom minősége közvetlenül befolyásolja a következtetés eredményét.
Az osztályozás szintén részletesebbé válik. Az új, oldalon belüli felosztás lehetővé teszi, hogy a rendszer egyetlen fizikai oldalon belül is külön dokumentumszakaszokat azonosítson. A nyilvános előzetes az ilyen felosztáshoz és az osztályozáshoz megbízhatósági értéket is biztosít. A fejlesztők így automatizált folyamatokban dönthetnek arról, mikor folytatódjon közvetlenül a feldolgozás, és mikor legyen szükség további ellenőrzésre.
Mit jelent ez a felhasználóknak?
A CU 1.0 frissítése a már működő termelési folyamatokhoz kínál GPT-5-modellválasztékot, alacsonyabb tokenhasználatot és a Microsoft belső mérései szerint pontosabb megbízhatósági értékeket. A CU 2.0 előzetese eközben azoknak a fejlesztőknek szól, akik új dokumentumautomatizálási, visszakeresési és ügynöki forgatókönyveket próbálnának ki. A közös alap lehetőséget ad a jelenlegi és a következő API-változat összehasonlítására, mielőtt a fejlesztők kiválasztják a termelési használathoz megfelelő modellt és verziót.
Microsoft Foundry: From Sync APIs to support for the GPT-5 model series and agentic workflows: What’s new in Azure Content Understanding – August 2026


