Kimi K3

Kimi K3: Claude-klón vagy önálló fejlesztés?
A Moonshot AI Kimi K3 modellje 2,8 billió paraméterével az első nyílt súlyú modell ezen a méreten. A megjelenés után felmerült, hogy a fejlesztés Anthropic-modellből…

Az agent harnesses nem tűnnek el, de gyorsabban kell fejlődniük
Egy új kutatás szerint az agent harnesses, vagyis az ügynöki rendszereket eszközökkel, szabályokkal és memóriával támogató rétegek bizonyos részei betaníthatók magába a…

A modellek átvehetik az ügynöki keretek egy részét
Egy új kutatás szerint az ügynöki keretek, vagyis a modelleket eszközökkel és szabályokkal segítő rendszerek egyes részei közvetlenül betaníthatók a modellbe. A keretek…

Elérhető a Fireworks Ember-1 modellje a Vercel AI Gateway-en
A Fireworks Ember-1 modellje megérkezett a Vercel AI Gateway-re. A Kimi K3-ra épülő, kutatási előzetesként kiadott modell kódolási és ügynökalapú munkafolyamatokat…

A Snowflake Cortex AI-ba érkezik a Kimi K3
Privát előzetesben elérhetővé vált a Moonshot AI nyílt súlyú Kimi K3 modellje a Snowflake Cortex AI platformján. A vállalatok így saját feladataikon tesztelhetik a…

Kevesebb tokenből hozná a Kimi K3 szintjét a Fireworks Ember-1
A Fireworks Research bemutatta az Ember-1-et, egy Kimi K3-ra épülő specializált modellt, amely a vállalat szerint 40 százalékkal kevesebb tokenből hozza ugyanazt a…

A Modal szerint trilliónyi token kiszolgálása kell a kódoló ügynökökhöz
A Modal olyan következtetési szolgáltatásokat üzemeltet kódoló AI-ügynökökhöz, amelyek naponta több százmilliárd, összesen pedig trilliónyi tokent dolgoznak fel. A…

A d-Matrix Raptor gyorsítói Nvidia NVLink-alapú rackekbe kerülnek
A d-Matrix Nvidia technológiájával épít rackméretű infrastruktúrát Raptor gyorsítóihoz, amely a vállalat szerint ultraalacsony késleltetésű következtetést tesz lehetővé…

Harvey: a generatív jutalmazási modellek segíthetik a jogászok értékelését
A Harvey olyan generatív jutalmazási modelleket, GRM-eket vizsgált, amelyek jogászok preferenciái alapján hasonlítják össze az AI-rendszerek válaszait. A vállalat első…

Három nyílt súlyú modellel bővíti a GitLab Duo Agent Platformot
A GitLab három hosztolt, nyílt súlyú modellel bővíti a Duo Agent Platform modellválasztékát. A Kimi K3, a GLM 5.3 és a MiniMax M3 különböző fejlesztési feladatokhoz…

A vLLM DSpark modellel négyszeresére nőtt a Kimi K3 sebessége
A vLLM Project új DSpark spekulátorral gyorsította fel a 2,8 billió paraméteres Kimi K3 modell kiszolgálását. A vállalat mérése szerint a matematikai feladatoknál az…

Új modellek és Sandbox-funkciók érkeztek a Modalhoz
A Modal négy új, nyílt súlyú modell támogatását, több Sandbox-fejlesztést és költségkezelési eszközt jelentett be. A frissítések között nyilvános alfában elérhető…
FejlesztőknekA vLLM-ben akár 2,8-szorosára nőtt a Kimi K3 áteresztőképessége
Jelentősen gyorsult a Kimi K3 kiszolgálása a vLLM-ben: a fejlesztések 2,2, 2,8-szoros áteresztőképességet és 56, 60 százalékkal alacsonyabb késleltetést hoztak. A vLLM…

Három pillérre épülő frontier AI-stratégiát sürget egy új jelentés
A fejlett mesterségesintelligencia-rendszerek gyors fejlődése miatt átfogó amerikai szakpolitikai programra van szükség, állítja az Institute for AI Policy and Strategy…

A Cognition bemutatta az SWE-2 kódolómodellt
A Cognition bemutatta az SWE-2-t, amely a vállalat szerint eddigi legfejlettebb kódolómodellje. A modell 50,0 százalékot ért el a FrontierCode 1.1 Main teszten, és a…

A vLLM szerint az ügynöki terhelésekhez új kiszolgálási stratégia kell
Az ügynöki mesterségesintelligencia-terhelések miatt a vLLM a teljes kiszolgálási veremet optimalizálja, a gyorsítótár-kezeléstől a párhuzamosításon át a kérések…

Az open-weight modellek több kontrollt adnak, de új felelősséget is
Az open-weight modellek letölthetővé teszik a betanított paramétereket, így a szervezetek saját infrastruktúrán futtathatják és módosíthatják őket. A nagyobb…

Általánosan elérhetővé tette Training API-ját a Fireworks AI
Általánosan elérhetővé vált a Fireworks AI Training API-ja, amely egyedi tanítási ciklusokat kapcsol a vállalat elosztott tanítási és modellfuttatási…

A DeepSeek V4 Flash 12 centből ért el IMO-aranyszintet
A DeepSeek V4 Flash 30 pontot szerzett az IMO 2026 hat feladatán, ezzel átlépte a 29 pontos aranyéremhatárt. A Cline mérése szerint a legjobb futtatás költsége 0,1215…

A Harvey Tenet modellje közel kétszer több jogi feladatot teljesített
A Harvey és a Fireworks AI bemutatta a Tenet nevű modellt, amelyet Kimi K3 alapmodellből, aszinkron megerősítéses tanulással fejlesztettek hosszú, összetett jogi…

A Harvey bemutatta első utótréningezett, nyílt súlyú modelljét
A Harvey bemutatta a Harvey Tenet kutatási előzetesét, a vállalat első utótréningezett, nyílt súlyú modelljét. A Kimi K3 alapjaira épülő rendszert hosszú, ügynöki…

Cache-tudatos útválasztást vezetett be a DigitalOcean Inference Router
A DigitalOcean Inference Router mostantól a modellek gyorsítótárban lévő kontextusát is figyelembe veszi a kérések elosztásakor. A vállalat szerint így elkerülhető, hogy…

A Moonshot bemutatta a 2,8 billió paraméteres Kimi K3 modellt
A Moonshot AI kiadta a Kimi K3-at, amely a Firecrawl szerint 2,8 billió paraméterével 2026 augusztusában a legnagyobb nyílt súlyú modell. A rendszer szöveget, képet és…

A Vercel szerint már elérhetők az önálló támadást kutató AI-modellek
A Vercel szerint az AI-modellek kiberbiztonsági képességei gyorsan fejlődnek, és már ma is elérhetők olyan nyílt súlyú modellek, amelyek támadási lehetőségeket kutatnak.…