felhő

Az új Fireworks-tömörítő közel felére csökkenti az RL-frissítések méretét
A Fireworks bemutatta az ARCv3 tömörítőt, amely a vállalat mérései szerint közel 50 százalékkal csökkenti a megerősítéses tanulás során továbbított BF16-súlyfrissítések…

Nyilvános bétába lépett a Vercel Sandbox tartós tárhelye
Nyilvános bétába lépett a Drives for Vercel Sandbox, a Vercel Sandbox környezetekhez használható tartós tárhely. A szolgáltatás a Hobby, Pro és Enterprise csomagokban is…

A Modal szerint trilliónyi token kiszolgálása kell a kódoló ügynökökhöz
A Modal olyan következtetési szolgáltatásokat üzemeltet kódoló AI-ügynökökhöz, amelyek naponta több százmilliárd, összesen pedig trilliónyi tokent dolgoznak fel. A…

NVIDIA Topograph: topológia alapján ütemeznék az AI-terheléseket
Az NVIDIA Topograph azt a problémát célozza, hogy az AI-terhelések ütemezői naprakész képet kapjanak a GPU-k és a hálózati kapcsolatok viszonyairól. A nyílt forrású…

A Vultr új jelentése az AI platformmérnöki hatásait vizsgálja
A Vultr közzétette a platformmérnöki terület mesterségesintelligencia-használatáról szóló 2026-os jelentését. A kutatás azt vizsgálja, hogy az AI által támogatott…

Az ASUS a helyi AI-fejlesztéstől az AI-gyárakig épít infrastruktúrát
Az ASUS olyan NVIDIA-gyorsítású szervermegoldásokat mutatott be a DCD Connect London rendezvényen, amelyek a helyi modellfejlesztéstől a hyperscale AI-adatközpontokig…

A Teradata agentikus munkatárssá alakítja a Terát
A Teradata agentikus munkatárssá alakítja Tera nevű megoldását, és bemutatja a Tera Context Engine, valamint a Tera Harness komponenseket. A vállalat szerint ezek az…

A Nutanix felvásárolta a Ryax Technologies vállalatot az AI-munkafolyamatok javítására
A Nutanix felvásárolta a Ryax Technologies vállalatot, hogy intelligensebb vezérlést és erőforrás-kiosztást építsen jövőbeli Kubernetes- és vállalati AI-platformjaiba. A…

Így épített az Amazon egy évtized alatt saját chipportfóliót
Az Amazon saját és ügyfelei valós munkaterhelései alapján tervezi egyedi chipjeit, ahelyett hogy elsősorban szabványos tesztekkel optimalizálná azokat. A vállalat a…

Leállás nélkül cserélhető modelleket kínál a Together AI
A Together AI új rollout funkciója fokozatosan mozgatja az éles forgalmat egy jelenlegi modellről egy új modellre. A rendszer mérési kapuval is megállíthatja a…

A Google AI-előfizetések része lett több prémium Colab-funkció
A Google AI-előfizetők mostantól prémium Google Colab-előnyöket is kapnak, köztük elsőbbségi hozzáférést gyorsabb gyorsítókhoz és erősebb gépekhez. A Google AI Ultra…

Alibaba 10 billió paraméteres Qwen-modelleket és új AI-chipeket készít
Az Alibaba bemutatta teljes stackre épülő AI-stratégiájának frissített ütemtervét, amely a chipektől és a felhős infrastruktúrától a modelleken át az AI-ügynökökig…

A Scale AI és a Google Cloud közös architektúrát ad vállalati AI-ügynökökhöz
Közös referenciaarchitektúrát tett közzé a Scale és a Google Cloud a Scale GenAI Portfolio Google Cloudon történő futtatásához. A dokumentált telepítési minta a…

Gyorsabban és kisebb fennakadással skálázható a Redis Cloud Pro
A Redis Cloud Pro új Smooth Scaling funkciója gyorsabbá és kíméletesebbé teszi az adatbázisok kapacitásának módosítását. A megoldás a háttérben működik, ezért a…

Egy helyre hozza a Redis teljes flottáját a Redis Radar
Általánosan elérhetővé vált a Redis Radar, amely egyetlen felületen gyűjti össze a különböző Redis-környezetek készlet-, állapot- és használati adatait. A szolgáltatás a…

Új eszközökkel egyszerűsíti a Redis üzemeltetését és skálázását
A Redis több új képességet mutatott be a telepítések áttekintésére, az adatforrások egységesítésére és a kapacitás hatékonyabb kezelésére. A funkciókat felhős, helyben…

A Redis terabájtos keresést hoz a felhőbe, töredéknyi RAM-mal
A Redis Cloud Pro Preview részeként elérhetővé vált a Search on Flex, amely a keresési indexeket rétegzett tároláson, RAM és SSD kombinációjában kezeli. A Redis szerint…

Az OpenRouter Batch API-ja akár féláron dolgozza fel a kéréseket
Az OpenRouter új Batch API-ja nagyobb, azonnali választ nem igénylő feladatokhoz kínál költségcsökkentést. A szolgáltatók egy 24 órás időablakon belül dolgozzák fel a…

VAST DataEnclave: érzékeny adatok mellett futtathatók a védett AI-modellek
A VAST bemutatta a DataEnclave-et, a VAST DataEngine bizalmas AI-képességét, amely lehetővé teszi, hogy a védett modellek és az érzékeny adatok olyan infrastruktúrán…

A LiveKit Private Links privát hozzáférést ad az ügynököknek
A LiveKit Private Links titkosított, menedzselt kapcsolatot biztosít a LiveKit Cloudon futó ügynökök és a vállalatok belső felhő-erőforrásai között. A megoldás célja…

A DigitalOcean mindenki számára elérhetővé tette Managed Agents platformját
A DigitalOcean nyilvános előzetesben elérhetővé tette Managed Agents platformját, amely az AI-ügynökök futtatását, az inferenciát és az eszközhasználatot egyetlen…

Több GPU-n futó TensorRT inferenciát kapott az NVIDIA Dynamo-Triton
Az NVIDIA Dynamo-Triton 26.07-ben elérhetővé vált a TensorRT backend többeszközös inferenciája, amely egyetlen modellvégponton keresztül tud több GPU-t használni. Az…

Az NVIDIA minősítési programmal segíti az AI-gyárak építőit
Az NVIDIA elindította a DSX Ready minősítési programot, amely az AI-gyárak energiaellátási és hűtési megoldásait értékeli. A kezdeményezés elsőként akkumulátoros…

A Microsoft AI-képes felhőinfrastruktúrát épít Indiában
A Microsoft működésbe állította India South Central nevű, Hyderabadban található adatközponti régióját, amelyet Ázsia és a globális dél stratégiai központjának szán. A…