Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Az OpenAI javította a GPT-6 promptgyorsítótárát

2026. szeptember 22. 23:00Forrás: OpenAI

Az OpenAI fejlesztette a GPT-6 család promptgyorsítótárát, amely alapértelmezés szerint magasabb találati arányt ígér. A fejlesztők most műszerfallal, hibakereső eszközzel és új vezérlési lehetőségekkel követhetik és optimalizálhatják a gyorsítótárazást.

A lényeg röviden
  • A GPT-6 promptgyorsítótára alapértelmezés szerint magasabb találati arányt kínál.
  • A jogosult közös előtagok 30 perces időablakban újra felhasználhatók.
  • A fejlesztők akár 90 százalékos kedvezményt kaphatnak a gyorsítótárazott bemeneti tokenekre.
  • Új műszerfal és diagnosztikai eszköz segít a gyorsítótár teljesítményének vizsgálatában.
  • A fejlesztők előmelegíthetik a gyorsítótárat, és szabályozhatják a gyorsítótárazott prompt-előtagokat.

A gyorsítótár a hosszú feladatoknál segít

Az OpenAI szerint a GPT-6 lehetővé teszi, hogy a tartósan működő ügynökök órákon át dolgozzanak összetett feladatokon. Ilyen lehet egy kódbázis átszervezése, illetve alaposan kutatott dokumentumok és prezentációk elkészítése.

Az ezek mögött álló alkalmazások egymásra épülő API-kéréseket küldenek. A kérések gyakran ugyanazokat az utasításokat, eszközdefiníciókat és korábbi kontextuselemeket viszik tovább. Az OpenAI ezt a közös kontextust gyorsítótárazza, így a rendszer újra felhasználhatja a korábban elvégzett számításokat.

Ez rövidebb válaszidőt eredményezhet, a fejlesztők pedig az OpenAI közlése szerint akár 90 százalékos kedvezményt kaphatnak a gyorsítótárból kiszolgált bemeneti tokenekre. A GPT-6 családdal bevezetett rendszerben a jogosult, közös előtagok 30 perces időablakon belüli újrafelhasználására is jár a kedvezmény.

Műszerfal és diagnosztika a gyorsítótár figyeléséhez

Az új Prompt Caching Dashboard azt mutatja meg, hogy az alkalmazás bemenetének mekkora része érkezik a gyorsítótárból. A fejlesztők időben követhetik a találati arányokat, az inputösszetételi grafikonon pedig összehasonlíthatják a gyorsítótárazott és a gyorsítótár nélküli tokeneket.

Az adatok segítségével észrevehetők a találati arány csökkenései, valamint megvizsgálható, hogy egy alkalmazás módosításai milyen hatással vannak a gyorsítótárazás teljesítményére. Váratlan gyorsítótárhiba esetén a prompt caching diagnosztikai eszköz összeveti a kérést egy korábbi, friss válasszal.

A vizsgálat feltárhatja, hogy a modell, az eszközök, a beállítások vagy a bemenet változása akadályozta meg az újrafelhasználást. A fejlesztő azt is megbecsülheti, hány token érintett. Az OpenAI példája szerint egy eszközváltozás miatt 5629 újrafelhasználható token maradt ki a gyorsítótárból.

A fejlesztők szabályozhatják, mi maradjon gyorsítótárban

Az OpenAI lehetővé teszi explicit gyorsítótár-határpontok megadását, így a fejlesztők kiválaszthatják, mely prompt-előtagokat szeretnék újra felhasználni. A frissített útmutató ismerteti a használat módját, a gyorsítótárazott előtagok jogosultságának időtartamát, valamint azt, hogyan befolyásolják az újrafelhasználást az eszközök és a bemenetek változásai.

GPT-6 modelleken a válaszok között módosítható a gondolkodási erőfeszítés anélkül, hogy ez megszakítaná a gyorsítótár használatát. A fejlesztő egy configuration_update hozzáadásával növelheti az erőfeszítést nehezebb feladatnál, vagy csökkentheti egy rutinszerű folytatásnál, miközben a kérés szintjén változatlanul hagyja ezt a beállítást.

Az OpenAI azt javasolja, hogy az ügynökök eszközdefiníciói, sémái és sorrendje maradjon stabil. Az allowed_tools csak a szükséges eszközöket teheti elérhetővé, a tool_choice pedig none értékkel kikapcsolhatja az eszközhasználatot a definíciók eltávolítása nélkül. Új utasítások a kontextus végére fűzhetők, hogy felülírják a korábbiakat.

A gyorsítótár előmelegítése szintén választható lehetőség. Az alkalmazás indulásakor előkészítheti a közös utasításokat, az eszközdefiníciókat vagy a referenciaanyagokat, így ez a feldolgozás még az első felhasználói kérés előtt megtörténhet. A bejelentést az OpenAI 2026. szeptember 22-én tette közzé. A fejlesztők a műszerfalat, a diagnosztikai eszközt és a gyorsítótárazási útmutatót használhatják a beállításaik javításához, illetve a Codex segítségével is felülvizsgálhatják a kódjukat és mérhetik az eredményeket.

Kapcsolódó hírek

A Kilo Code szerint a biztonság lett az LLM-ek új kulcstényezője
Biztonság és etika2026. október 2. 23:19

A Kilo Code szerint a biztonság lett az LLM-ek új kulcstényezője

A nagy nyelvi modellek értékelésében a költség, a teljesítmény és a hatékonyság mellé a biztonság is bekerült. A Kilo Code szerint egy gyors és olcsó modell vállalati…

Modellek
Modellek2026. október 2. 18:15

Az OpenAI útmutatót adott ki a GPT-6 modellek használatához

Az OpenAI gyakorlati útmutatóban mutatja be, hogyan érdemes kiválasztani és használni a GPT-6 család modelljeit. A dokumentum a fejlesztési feladatoktól a több napon át…

Olcsóbb és specializáltabb modellekkel gyorsul az AI-verseny
Modellek2026. szeptember 23. 00:09

Olcsóbb és specializáltabb modellekkel gyorsul az AI-verseny

Két nap alatt három jelentős AI-labor új modellt mutatott be: a SpaceXAI Grok 4.7-et, az Anthropic Claude Opus 5.5-öt, az OpenAI pedig a GPT-6 Sol és GPT-6 Luna…