kutatási eredmény

A Fireworks AI elindította a valós munkát mérő modellindexet
A Fireworks AI elindította a Specialized Intelligence Indexet, amely iparág-specifikus, gyakorlati feladatokon méri a nyílt, zárt és specializált AI-modellek…

A jogi AI több időt ad a vállalati jogászoknak a stratégiai munkára
A Harvey-t használó vállalati jogi csapatok gyorsabban válaszolnak az üzleti területeknek, és az így felszabaduló időt magasabb értékű feladatokra fordítják. Az RSGI…

A Datadog telemetria alapján becsüli meg az agentek felhasználói értékelését
A Datadog olyan módszert és nyilvános osztályozási készséget mutatott be, amely a felhasználói visszajelzések hiányában telemetria alapján becsüli meg, pozitív vagy…
KutatásA Jev kiválthatja az LLM-es bírákat? Az MLflow tesztelte
A TypeSafe Jev modellje 30 MLflow-val kapcsolatos kérdés mindegyikén egyezett az emberi értékeléssel, miközben a tesztben ez volt a leggyorsabb és legolcsóbb bíró. A…

Az NVIDIA szerint így érdemes mérni az AI-ügynökök valódi teljesítményét
Az AI-ügynökök értékelésénél az NVIDIA Developer szerint már nem elég azt nézni, hogy egy modell helyesen hív-e meg egy eszközt. A lényeg az, hogy a több lépésből álló…

Az Amazon és a Stanford új kutatási kezdeményezést indít
Az Amazon és a Stanford University elindította a Stanford and Amazon Research Initiative nevű együttműködést, amely a mesterséges intelligencia, az energia és az…

Három AI-módszert mutatott be az Amazon az antitestfejlesztéshez
Az Amazon Bio Discovery három mesterségesintelligencia-módszert fejlesztett az antitestgyógyszerek tervezésének gyorsítására. A megoldások a kötődő jelöltek…

Az EGInterpolator gyorsíthatja az AI-alapú molekuladinamikát
A Lambda és a Stanford University kutatói olyan keretrendszert mutattak be, amely a statikus molekulaszerkezetekből szerzett tudást használja fel a molekuladinamikai…

A Microsoft RetroChimera modellje gyorsíthatja a molekulatervezést
A Microsoft Research nyílt forrásúvá tette a RetroChimera nevű modellt, amely kisebb molekulák előállításához javasol szintézisútvonalakat. A Nature folyóiratban…

Az NVIDIA Earth-2 valós idejű megfigyelésekkel javítja az időjárási előrejelzéseket
Az NVIDIA Earth-2 adatasszimilációs eszközei saját vagy külső forrásból származó megfigyeléseket építenek be az AI-alapú időjárási modellekbe. A cél a gyakoribb…

A China Telecom AI Flow rendszere jelentést küld bitek helyett
A China Telecom kutatói olyan kommunikációs keretrendszert mutattak be, amely a teljes jel továbbítása helyett jelentéssel bíró tokeneket küldene a hálózaton. Az AI Flow…
KutatásAz OpenAI matematikai tanácsadó csoportot hozott létre
Az OpenAI szerint egy augusztus 28-án megkezdett belső modell több mint 100, régóta megoldatlan matematikai problémát oldott meg, köztük a Navier, Stokes-egyenletekhez…
Szabályozás és politikaAz OpenAI globális biztonsági szabványokat sürget a fejlett AI-hoz
Az OpenAI szerint az Egyesült Államoknak más országokkal együttműködve globális technikai szabványokat kell kidolgoznia a fejlett mesterséges intelligenciához, köztük a…

Az Iambic bemutatta az Enchant v3 gyógyszerkutató modellt
Az Iambic bemutatta az Enchant v3 multimodális transzformermodelt, amelyet a gyógyszerkutatás és -fejlesztés teljes folyamatának támogatására terveztek. A modell 41…

A több adat önmagában nem teszi okosabbá az ügyfélszolgálati AI-t
Az ügyfélszolgálati AI-rendszerek teljesítményét sok esetben nem az adatok hiánya korlátozza, hanem az, hogy az információk nem kapcsolódnak össze a különböző…
KutatásA ProteinGuide kísérleti adatokkal tereli a fehérjetervező AI-t
A Berkeley kutatói kifejlesztették a ProteinGuide módszert, amely kísérleti adatokkal irányítja a meglévő fehérjegeneráló modelleket a kívánt tulajdonságok felé, azok…

Nobel-díjas közgazdásszal bővíti AI-kutatási programját a Google
Nobel-díjas közgazdász és vezető egyetemi kutatók csatlakoznak a Google AI & Economy Research Programjához. A vállalat az AI gazdasági hatásait, a munkaerőpiaci…

AI segít kevesebb acélhulladékkal gyártani a nehézgépeket
A China Unicom mesterséges intelligenciára épülő rendszere megmutatja, mely gyártási kombinációk használják ki hatékonyabban az acéllemezeket. A megoldást több üzemben…

Az Anthropic beengedi az Accenture-t a frontier AI-modellek értékelésébe
Beágyazott, független értékelőkkel tenné ellenőrizhetőbbé frontier AI-modelljeinek biztonságát az Anthropic. A vállalat az Accenture-rel kötött partnerséget, amely…

Apple-kutatás: DSO módszerrel csökkentenék az AI-modellek torzítását
A Direct Steering Optimization, röviden DSO, az Apple kutatói szerint futtatás közben teheti szabályozhatóbbá az AI-modellek torzításcsökkentését. A CVPR-hez kapcsolódó…

Az Apple ritka jellemzőkkel védené a nyelvi modelleket a jailbreaktől
Az Apple kutatói olyan, ritka autoenkóderekre épülő védelmi módszert mutattak be, amely a nyelvi modellek jailbreak-támadásait hivatott mérsékelni. A Context-Conditioned…

Az Apple kutatói szerint jól értelmezhetők az aktivációs jellemzők
Az Apple kutatói az ExpertLens nevű módszerrel vizsgálták, hogy értelmezhetők-e a nagy nyelvi modellek aktiváció-vezérléssel azonosított jellemzői. Eredményeik szerint a…

Az Apple LinEAS módszere kevés adattal irányítja a generatív modelleket
Az Apple kutatói a LinEAS nevű módszert mutatták be, amely a generatív modellek aktivációinak módosításával igyekszik biztonságosabbá és jobban irányíthatóvá tenni a…

A teljes sandboxmentés segíthet a kódolóügynököknek, de nem mindig
A Daytona azt vizsgálta, hogy a kódolóügynökök korábbi munkakörnyezeteinek teljes mentése javítja-e a sikertelen próbálkozások folytatásának esélyét. A Terminal-Bench…