adatközpontok

A RunPod új REST API-val ígéri a GPU-felhő kezelésének egyszerűsítését
A RunPod új REST API-ról szóló bejegyzést tett közzé, amelynek címe szerint az eszköz a GPU-felhő kezelését egyszerűsíti. A 2026. szeptember 13-i forrásrészlet azonban…

A RunPod szerint az AI-piac eltér a megszokott narratívától
A RunPod szerint az AI-piac tényleges működéséről más képet adnak a fejlesztői használati adatok, mint a róla szóló általános narratíva. A vállalat 1,2 millió fejlesztő…
FejlesztőknekA vLLM-ben akár 2,8-szorosára nőtt a Kimi K3 áteresztőképessége
Jelentősen gyorsult a Kimi K3 kiszolgálása a vLLM-ben: a fejlesztések 2,2, 2,8-szoros áteresztőképességet és 56, 60 százalékkal alacsonyabb késleltetést hoztak. A vLLM…

Slackforce Surfaces: élő Salesforce-adatokból készít felületeket a Slack
A Salesforce bemutatta a Slackforce Surfaces funkciót, amely Slackbot segítségével interaktív irányítópultokat, jelentéseket és prezentációkat készít a Slackben elérhető…
FejlesztőknekA Hugging Face Kernels projekt már a Helion keretrendszert is támogatja
A Hugging Face Kernels projekt már támogatja a Heliont, így a fejlesztők hordozható, nagy teljesítményű gépi tanulási kerneleket készíthetnek, hangolhatnak és…

Az Everpure helyben futó AI-val csökkentené az enterprise költségeit
Az Everpure Data Stream a vállalati adatközpontban futó AI-feldolgozást kapcsolja össze az NVIDIA Nemotron 3 Nano modellel és a saját adatokon végzett kereséssel. A Pure…

A Dynatrace összekapcsolja az OpenTelemetry jeleit a teljes informatikai környezetben
A Dynatrace az OpenTelemetry jeleit a felhasználói élményektől a háttérszolgáltatásokon és infrastruktúrán át az AI-munkafolyamatokig kapcsolja össze. A vállalat szerint…

A chatbotok után az AI-ügynököké lehet a főszerep
Az AI fejlődésének következő szakaszában a felhasználók egyre gyakrabban bízhatnak feladatokat olyan ügynökökre, amelyek érzékelnek, következtetnek és cselekszenek. A…

Öt döntés, amely meghatározza az AI-alkalmazások működését
Az AI-alkalmazások fejlesztésében a modell kiválasztása csak a kezdet. Az Arm Create 2026 sanghaji és sencseni eseményein a fejlesztők azt vizsgálták, hogyan lehet az…
FejlesztőknekAz OpenAI tárhelyplatformja már másodpercenként 70 millió kérést kezel
Az OpenAI Habitat nevű online tárhelyplatformja másodpercenként több mint 70 millió kérést kezel, és több mint 500 petabájtnyi adatot szolgál ki. A rendszer a vállalat…

A Microsoft vezető lett a Gartner konténerkezelési rangsorában
A Microsoft vezetőként szerepel a Gartner 2026-os, konténerkezelési megoldásokat értékelő Magic Quadrant jelentésében. A vállalat szerint Azure-platformjaival a felhős…

Az NVIDIA szerint 2,5-szer több felhasználót bír a Nemotron 3 Ultra NIM
Akár 2,5-szer nagyobb rendszer-áteresztést ért el a Nemotron 3 Ultra NIM az NVIDIA mérése szerint egy 4xB200 konfiguráción, a NIM nélküli alap kiszolgálási stackhez…

Nokia épít AI-képes optikai hálózatot Georgia vidéki térségeiben
A Nokia építi a Planters Broadband Cooperative új, AI-képes optikai hálózatát Georgia délkeleti részén. A részben amerikai BEAD-programból finanszírozott fejlesztés…

Az NVIDIA BioIR rendszere felgyorsítja a biomolekulák szerkezetjóslását
Az NVIDIA BioNeMo Inference Runtime a vállalat szerint felgyorsítja a támogatott biomolekuláris szerkezetjósló modellek futtatását NVIDIA GPU-kon. A rendszer a…

A d-Matrix NVLink Fusionnel vinné rack szintre Raptor XPU-it
Az NVIDIA 2026. szeptember 10-i blogbejegyzése szerint a d-Matrix az NVLink Fusion technológiát választotta következő generációs Raptor XPU-inak NVIDIA…

A Cisco az irányítható AI-infrastruktúra egyszerűbb bevezetéséről ír
Az AI-infrastruktúra bevezetésének egyszerűsítését állítja középpontba a Cisco „Deploying AI You Control Doesn’t Need to be So Hard” című anyaga. A 2026. szeptember…

Az Ayar Labs 650 millió dollárra növelte 2026-os finanszírozását
Az Ayar Labs további 150 millió dollár finanszírozást szerzett, ezzel 650 millió dollárra emelkedett a 2026-ban bevont elsődleges tőkéje. A vállalat a pénzt a gyártásra…

Mistral és Cloudera partnerség indul vállalati, szuverén AI-hoz
A Mistral AI 2026. szeptember 10-én jelentette be, hogy partnerségre lép a Clouderával. Az együttműködés célja, hogy a vállalatok saját környezetükben futtatható, saját…

A Nokia és az Orange France élő hálózaton tesztelte a hálózati tomográfiát
A Nokia és az Orange France befejezte a vállalatok közlése szerint első világméretű, szolgáltatói hálózaton végzett élő hálózati tomográfiás tesztet. A technológia közel…

A Together AI 22 petaflops fölé gyorsította GEMM-kernelét Vera Rubinen
A Together AI optimalizálta ThunderKittens nevű kernelkönyvtárának GEMM-műveleteit az NVIDIA Vera Rubin NVL72 platformjára. A vállalat NVFP4 módban több mint 22 PFLOPS…
Chipek és infrastruktúraA vLLM több mint háromszorosára gyorsította a MiniMax M3-at
A vLLM fejlesztései jelentősen javították a MiniMax M3 teljesítményét AMD Instinct MI355X GPU-kon. A standard MXFP8 kiszolgálás egy mérési ponton 3,14-szeresére gyorsult…

Réteges KV-cache-kezelést kapott a vLLM
A vLLM réteges KV-cache-kiürítést vezetett be, amely a gyorsítótár korábban kiszorított adatait CPU-memóriában, tárhelyen vagy távoli gépeken őrzi meg. Így az adatokat…

Szingapúri központtal terjeszkedik az APAC-régióban a FuriosaAI
Új szingapúri leányvállalatot alapít a FuriosaAI, hogy innen irányítsa üzletfejlesztési, értékesítési és műszaki támogatási tevékenységét az ázsiai és csendes-óceáni…

Az NVIDIA szerint akár 7-szer gyorsítható a multimodális kiszolgálás EPD-vel
Az NVIDIA Developer 2026. szeptember 9-én ismertette, mikor érdemes encode-prefill-decode, azaz EPD szétválasztást használni multimodális modellek kiszolgálásához. A cég…