Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Harbor

A Vercel Sandboxban is futtathatók a Harbor értékelései
Fejlesztőknek2026. szeptember 17.

A Vercel Sandboxban is futtathatók a Harbor értékelései

A Vercel Sandbox támogatja a Harbor nyílt forráskódú értékelési keretrendszerét, így a Terminal-Bench és több más benchmark is futtatható a Vercel infrastruktúráján. Az…

A LangChain WikiBenchkel méri, mennyire segítik a wikik a kódoló ügynököket
Fejlesztőknek2026. augusztus 26.

A LangChain WikiBenchkel méri, mennyire segítik a wikik a kódoló ügynököket

A LangChain elkészítette a WikiBench benchmarkot az OpenWiki által generált kódbázis-dokumentációk értékelésére. A rendszer azt is vizsgálja, hogy a wiki ténylegesen…

A Cline nyílttá teszi az open-weight ügynökök értékelési adatait
Fejlesztőknek2026. augusztus 18.

A Cline nyílttá teszi az open-weight ügynökök értékelési adatait

A Cline nyílttá teszi az open-weight modellekkel működő kódoló ügynökök értékeléséhez használt módszereit, eredményeit és nyomvonalait. A vállalat szerint a cél annak…