Az OpenRouter összehasonlította az AI-ügynökök kódfuttató eszközeit

Az OpenRouter négy szolgáltató szerveroldali kódfuttatási megoldásait hasonlította össze. Az OpenAI, az Anthropic és a Google saját modelljeihez kínál ilyen eszközt, az OpenRouter pedig több modellhez biztosít hozzáférést.
- A szerveroldali eszköz a szolgáltató sandboxjában futtatja a modell parancsait.
- Az OpenAI, az Anthropic és a Google saját modelljeihez kínál kódfuttatást.
- Az OpenRouter eszközei több modellen használhatók, és béta állapotban vannak.
- Az OpenRouter sandboxja másodpercenként 0,0001 dollárba kerül, 30 másodperces minimummal.
- Egyedi képfájlhoz, GPU-s munkához vagy hosszú futtatáshoz saját sandbox szükséges lehet.
Mit jelent a szerveroldali kódfuttatás?
Amikor egy AI-modellnek például egy feltöltött CSV-fájlt kell elemeznie, Python-kódot futtathat az eredmény kiszámításához. Szerveroldali eszköz használatakor a fejlesztő egy eszközt ad hozzá az API-kéréshez, a modell pedig eldönti, mikor van szüksége rá. A parancsokat a szolgáltató saját, elkülönített környezetében hajtja végre, majd az eredményt ugyanazon kérés részeként visszaküldi a modellnek.
A forrás szerint a sandbox elszigetelt Linux-konténer, saját fájlrendszerrel, időkorláttal és alapértelmezés szerint hálózati hozzáférés nélkül. A modell a parancsok kimenetét és hibáit elolvashatja, majd szükség esetén újabb parancsot küldhet. Az OpenRouter szervereszközeinél egy kérésben legfeljebb 30 ilyen lépés engedélyezett.
Négy szolgáltató, eltérő modell- és környezetkorlátokkal
Az OpenAI Responses API-ján futó hosted shell az OpenAI modelljeihez használható. A dokumentált környezet Debian 12, a munkakönyvtár alapértelmezés szerint a /mnt/data. Az előre telepített nyelvek között szerepel a Python 3.11, a Node.js 22.16, a Java 17, a PHP 8.2, a Ruby 3.1 és a Go 1.23. A kimenő hálózati hozzáférés alapértelmezés szerint ki van kapcsolva.
Az Anthropic Messages API-ján elérhető kódfuttató eszköze Python- és Bash-parancsokat futtat Claude-modellekhez. A leírt környezet Linux x86_64 konténer, 5 GiB memóriával, 5 GiB tárhellyel és egy CPU-val. A hálózati kapcsolatok tiltottak. A code_execution_20260120 változat a Python értelmező állapotát több kérés között is megőrzi, ez azonban az Anthropic programozott eszközhívására támaszkodik, és Claude Haiku 4.5 esetén nem érhető el.
A Google eszköze Gemini-modellekhez kínál Python-kódfuttatást. A környezet maximális futási ideje 30 másodperc, saját könyvtárak telepítésére nincs lehetőség. Az OpenRouter ezzel szemben az openrouter:shell eszközt a Responses és a Messages API-n, az openrouter:bash eszközt pedig a Messages API-n kínálja, béta állapotban. Ezek bármely modellen használhatók, ha az OpenRouter végzi a sandboxos futtatást.
Költség, biztonság és a felhasználási határok
Az OpenRouter szerint a saját sandboxja a fiókhoz és a munkaterülethez kötött elszigetelt konténerben fut. A kimenő hálózati hozzáférés alapértelmezés szerint ki van kapcsolva, a parancsokra futási idő- és kimenetihossz-korlátok vonatkoznak. A sandbox használata másodpercenként 0,0001 dollárba kerül, új vagy alvó konténer esetén legalább 30 másodperc számlázásával.
A szolgáltató ezt rövid, kérésenként néhány parancsból álló feladatokra tervezte. Saját sandbox lehet indokolt egyedi alapképfájl, GPU-s feldolgozás vagy órákon át futó munkamenet esetén. Ilyenkor az üzemeltető választja ki a környezetet, kezeli a számítási kapacitást, a futtatások életciklusát és a biztonsági határokat.
Az OpenRouter 2026. október 5-i cikke szerint az openrouter:shell automatikus módban ott használja a modellgyártó saját hosted shelljét, ahol ilyen rendelkezésre áll, egyébként az OpenRouter sandboxjára irányítja a kérést. A globális openrouter.ai végpont támogatja ezeket az eszközöket, a régiós végpontok és a Chat Completions API viszont nem.
OpenRouter: Server-Side Code Execution Tools for AI Agents, Compared


