Together AI
Az Equinix NVIDIA és Together AI együttműködésével gyorsítja az AI-inferenciát
Az Equinix, a NVIDIA és a Together AI közös megoldással gyorsítaná az AI-inferencia kísérleti fázisból éles környezetbe való átvezetését. Az Equinix Inference Exchange…
Termékek és eszközökAz Equinix, az NVIDIA és a Together AI az AI-következtetést célozza
Az Equinix, az NVIDIA és a Together AI közös platformmal gyorsítaná a vállalati mesterségesintelligencia-modellek éles környezetbe állítását. Az Equinix Inference…

Döntési modelleket támogat az Ollama, három modell már elérhető
Az Ollama 0.35-ös verziójától Jev API-alapú döntési modellek futtathatók helyben, az új /v1/systemone végponton keresztül. A vállalat szerint a megoldás gyors döntéseket…

Az Ollama helyben futó döntési modelleket támogat
Az Ollama 0.35 verziója támogatja a TypeSafe Jev API-jára épülő döntési modelleket, amelyek egyetlen kérésben több, névvel ellátott kérdésre válaszolnak. A funkcióhoz…

A Together AI bemutatja, hogyan tanítható saját Jev-szerű modell 17 dollárból
A Together AI bemutatta saját Jev-szerű osztályozó modelljét, a Qwen3.5 4B-re épülő together/Tev1-4B-experimental rendszert. A vállalat útmutatója azt is részletezi…

Leállás nélkül cserélhető modelleket kínál a Together AI
A Together AI új rollout funkciója fokozatosan mozgatja az éles forgalmat egy jelenlegi modellről egy új modellre. A rendszer mérési kapuval is megállíthatja a…

A Together AI bővíti finomhangolási szolgáltatását
A Together AI több új nyílt súlyú modellel, élő mérőszámokkal és részletesebb finomhangolási beállításokkal bővítette szolgáltatását. A vállalat szerint a változások a…

A Together AI 22 petaflops fölé gyorsította GEMM-kernelét Vera Rubinen
A Together AI optimalizálta ThunderKittens nevű kernelkönyvtárának GEMM-műveleteit az NVIDIA Vera Rubin NVL72 platformjára. A vállalat NVFP4 módban több mint 22 PFLOPS…

Féláron kínál előzetes GPU-kapacitást a Together AI
A Together AI nyilvános előzetesben elérhetővé tette a megszakítható számítási kapacitást Kubernetes-alapú GPU-fürtjein. A csomópontok ugyanazt az NVIDIA-gyorsított…

A GLM-5.3 Flash olcsóbban hozza a teljes modell teljesítményének nagy részét
A GLM-5.3 Flash a DeepSWE szoftverfejlesztési benchmarkon első próbálkozásra gyengébb volt a teljes GLM-5.3-nál, ismételt futtatásokkal azonban jelentősen csökkent a…

A GLM-5.3 ötödannyiba kerül, mint a Claude Fable 5
A GLM-5.3 és a Claude Fable 5 első próbálkozásra gyakorlatilag döntetlenre végzett a DeepSWE szoftvermérnöki tesztjén, a GLM-5.3 azonban 5,4-szer olcsóbbnak bizonyult.…

A GLM-5.3 olcsóbban hoz több megoldást, ha lehet újrapróbálkozni
A GPT-5.6 Sol pontosabb első próbálkozásra a DeepSWE programozási feladatain, a GLM-5.3 viszont olcsóbb, több próbálkozással megelőzi, és a két modell együtt adja a…

A DeepSeek V4 Pro olcsón előzi meg a GPT-5.6 Solt több próbálkozással
A GPT-5.6 Sol pontosabb és gyorsabb egyetlen próbálkozásnál, a DeepSeek V4 Pro 0813 viszont 35-ször olcsóbb, és több újrapróbálkozással magasabb eredményt ér el a…

A DeepSeek V4 Pro olcsóbban és több próbálkozással felülmúlta a Fable 5-öt
A DeepSeek V4 Pro 0813 első próbálkozásra gyengébb volt a Claude Fable 5-nél a DeepSWE programozási tesztjein, több próbálkozással azonban megelőzte, miközben egy…

A Together AI éles forgalomban tesztelhetővé teszi a modelleket
A Together AI végpontszintű A/B tesztelést vezetett be, amellyel a fejlesztők valós felhasználói forgalmon mérhetik össze a jelenlegi és a jelölt modellek…

A DeepSeek olcsóbban hoz jobb eredményt a GPT-5.6 Lunánál, ha együtt használják
A GPT-5.6 Luna minden vizsgált minőségi mutatóban megelőzte a DeepSeek-V4 Flash 0731 modellt, az olcsóbb modellre épülő kétlépcsős rendszer mégis pontosabb és olcsóbb…