nyelvi modellek

A Fireworks szerint a modellek együtt többre képesek, mint külön-külön
A megfelelő modell feladatonkénti kiválasztásával jelentősen javítható egy kódoló ügynök teljesítménye, miközben a költség is csökkenthető. A Fireworks AI elemzése…

Elérhető a Grok 4.7 a Vercel AI Gateway szolgáltatásában
A SpaceXAI Grok 4.7 modellje elérhetővé vált a Vercel AI Gateway, az fx és az eve felületén. Az AI Gatewayen szeptember 27-ig 40 százalékos kedvezmény jár a modell…

Tencent Hy4 Preview: egymillió tokenes MoE-modell érkezett a Novitára
A Novita AI szerver nélküli szöveges API-ként tette elérhetővé a Tencent Hy4 Preview modellt. A 770 milliárd paraméteres, szakértőkeverék-alapú rendszer egymillió…

Öt Berkeley-hallgató kapta meg a Siebel Scholars ösztöndíját
Öt, számítástechnikát tanuló UC Berkeley-hallgatót választottak be a Siebel Scholars Foundation 2027-es évfolyamába. A program kiválasztott egyetemistáknak 35 000…

Apple-kutatás: DSO módszerrel csökkentenék az AI-modellek torzítását
A Direct Steering Optimization, röviden DSO, az Apple kutatói szerint futtatás közben teheti szabályozhatóbbá az AI-modellek torzításcsökkentését. A CVPR-hez kapcsolódó…

Az Apple ritka jellemzőkkel védené a nyelvi modelleket a jailbreaktől
Az Apple kutatói olyan, ritka autoenkóderekre épülő védelmi módszert mutattak be, amely a nyelvi modellek jailbreak-támadásait hivatott mérsékelni. A Context-Conditioned…

Az Apple kutatói szerint jól értelmezhetők az aktivációs jellemzők
Az Apple kutatói az ExpertLens nevű módszerrel vizsgálták, hogy értelmezhetők-e a nagy nyelvi modellek aktiváció-vezérléssel azonosított jellemzői. Eredményeik szerint a…

Az Apple LinEAS módszere kevés adattal irányítja a generatív modelleket
Az Apple kutatói a LinEAS nevű módszert mutatták be, amely a generatív modellek aktivációinak módosításával igyekszik biztonságosabbá és jobban irányíthatóvá tenni a…

A Vercel AI Gatewayre érkezett a GLM 5.3 FlashX
A Vercel AI Gatewayen elérhetővé vált a Z.ai multimodális kódolási modelljének nagy sebességű kiszolgálási változata, a GLM 5.3 FlashX. A Vercel szerint a modell…

A Proton Lumo asszisztensében lesz elérhető az Apertus 1.5
A Proton integrálja az Apertus 1.5 nyílt nyelvi modellt a Lumo AI-asszisztensbe. Az együttműködés révén a modellt fejlesztő kutatók először kaphatnak visszajelzéseket…

A beállítások többet számítanak, mint a helyi LLM-szerverek neve
A Mozilla.ai négy népszerű helyi LLM-szervert hasonlított össze Mac Studio M4-en, NVIDIA L40S-en és Steam Decken. A mérések szerint a teljesítményt sok esetben inkább a…
Termékek és eszközökAz OpenAI jogi munkára szabott modellt mutatott be Astra for Law néven
Jogi irodák és jogi technológiai cégek számára készített AI-alapot az OpenAI: az Astra for Law a GPT-6 Astrát jogi kereséssel, szakmai utasításokkal, integrációkkal és…

Harvey: a generatív jutalmazási modellek segíthetik a jogászok értékelését
A Harvey olyan generatív jutalmazási modelleket, GRM-eket vizsgált, amelyek jogászok preferenciái alapján hasonlítják össze az AI-rendszerek válaszait. A vállalat első…

Az open-weight modellek vitték az AI Gateway tokenforgalmának többségét
Először kerültek többségbe az open-weight modellek a Vercel AI Gateway forgalmában: augusztusban az összes token 56 százalékát dolgozták fel. A Vercel adatai szerint…

Az n8n Gateway credits fióknyitás nélkül teszi kipróbálhatóvá az AI-szolgáltatásokat
Az n8n új Gateway credits funkciója lehetővé teszi, hogy a felhasználók támogatott AI-modelleket és szolgáltatásokat külön szolgáltatói fiók, fizetési mód és API-kulcs…

A Jetson AGX Thoron 6,4-szer gyorsabban futott az agentikus teszt
Az NVIDIA TensorRT Edge-LLM 24 perc 36 másodperc alatt futtatta le az MLPerf Inference v6.1 Edge Agentic benchmark teljesítménytesztjét egyetlen Jetson AGX Thor…

Az NVIDIA Vera Rubin NVL72 akár 3,7-szer gyorsabb a GB300-nál
Az NVIDIA Vera Rubin NVL72 rendszerének első MLPerf Inference szereplése jelentős teljesítményelőnyt mutatott a GB300 NVL72-höz képest. A vállalat szerint Qwen3-VL alatt…

A Mistral modelljei működtetik a Firefox új AI-asszisztensét
A Mistral modelljei működtetik a Mozilla Firefox Smart Window nevű, mesterséges intelligenciával támogatott böngészési asszisztensét. A béta elsőként Franciaországban és…

Olcsó módszerrel csökkentené a többnyelvű RAG nyelvi torzítását a Qdrant
A többnyelvű RAG-rendszerek gyakran a kérdés nyelvén keresnek választ akkor is, ha egy másik nyelvű dokumentum relevánsabb lenne. A Qdrant egy friss kutatás alapján a…

Az Apple új módszert javasol a nyelvi modellek személyre szabására
Az Apple kutatói a Personalized Group Relative Policy Optimization, röviden P-GRPO nevű módszert mutatták be, amely a nyelvi modellek különböző emberi preferenciákhoz…

Az Apple új módszere pontosabban írhatja le az LLM-ek működését
Az Apple kutatói a Semantic Regexes nevű strukturált nyelvet mutatták be, amely nagy nyelvi modellek jellemzőinek pontosabb és következetesebb leírását célozza. A…

Saját CRM-modellt épített az NVIDIA Nemotron 3 Super alapjaira a Salesforce
A Salesforce bemutatta első CRM-reasoning modelljét, a Koa-t, amelyet az NVIDIA Nemotron 3 Super modelljének továbbképzésével hozott létre. A vállalat szerint a rendszer…

A Google módszere gyorsabbá teheti az összetett AI-keresést
A Google Research olyan keretrendszert mutatott be, amely az összetett keresési feladatokhoz szükséges gondolkodást előre, a tanítás során végezné el. A…

Új Windows PC-ket mutattak be a Microsoft partnerei az IFA-n
Új Windows PC-k széles kínálatát mutatták be a Microsoft partnerei az IFA-n. A felhozatalban hétköznapi laptopok, prémium és játékeszközök, üzleti gépek, valamint helyi…