ICLR

Az Apple módszere 128-szor gyorsabb szöveggenerálást ígér
Az Apple kutatói bemutatták az FS-DFM nevű módszert, amely kevés lépéssel gyorsítja fel a diffúziós nyelvi modellek szöveggenerálását. A vállalat szerint a rendszer…

BED-LLM: így kérdezhetnek hatékonyabban a nyelvi modellek
Az Apple kutatói a BED-LLM nevű módszert javasolják arra, hogy a nagy nyelvi modellek célzottabban gyűjtsenek információt a felhasználóktól vagy külső forrásokból. A…

Az Apple bemutatta a Manzano egységes multimodális modellt
Az Apple kutatói bemutatták a Manzano nevű multimodális modellt, amely ugyanabban a rendszerben képes vizuális tartalmak megértésére és létrehozására. A kutatók szerint…

Apple-kutatás: a CoT-válaszokban a gondolatmenet hatása gyakran ugrásszerű
A chain-of-thought módszer nem egyenletesen viszi közelebb a nagy nyelvi modelleket a jó válaszhoz: az Apple kutatói szerint a gondolatmenetekben kitérők, hirtelen…

Az Apple olcsóbb módszert mutatott be multimodális modellek tanítására
Az Apple kutatói bemutatták a MixAtlas nevű keretrendszert, amely kisebb proxy modellek segítségével optimalizálja a multimodális nagy nyelvi modellek tanításához…

Egyetlen látens tokennel tenné hatékonyabbá a képgenerálást az RepTok
Egyetlen folytonos látens tokennel reprezentálja a képeket a RepTok nevű generatív modellezési keretrendszer. A módszer önfelügyelt látásalapú transzformerek…

Az Apple 829 órányi videóval tanítaná ügyesebb robotkezeket
Az Apple bemutatta az EgoDex nevű, nyílt forrású adatbázist és benchmarkot, amely 829 órányi, emberi kézmozdulatokat rögzítő, nézőponti videót tartalmaz. A kutatók 194…

Az Apple LaCy módszere megtanítja a kis nyelvi modelleket segítséget kérni
Az Apple kutatói bemutatták a LaCy nevű előtanítási módszert, amely segít a kis nyelvi modelleknek eldönteni, mely tokeneket tanulják meg, és mikor kérjenek segítséget…