Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

multimodális AI

A Google többügynökös rendszert fejleszt koherens videókhoz
Kutatás2026. szeptember 24. 21:40

A Google többügynökös rendszert fejleszt koherens videókhoz

A Google Research többügynökös keretrendszert fejlesztett hosszú, több jelenetből álló videók önálló létrehozására. A rendszer a szereplők, helyszínek és tárgyak…

Új előnézeteket és pontosabb képszerkesztést kapott a Midjourney
Termékek és eszközök2026. szeptember 24. 21:36

Új előnézeteket és pontosabb képszerkesztést kapott a Midjourney

A Midjourney több ponton frissítette képalkotó felületét: előnézetet ad a stílusokról, pontosabbá tette a kijelölt képrészletek szerkesztését, és javított a csempézett…

Élő avatárt kapott a Gemini 3.8 Live
Termékek és eszközök2026. szeptember 24. 18:20

Élő avatárt kapott a Gemini 3.8 Live

A Google DeepMind bemutatta a Gemini 3.8 Live with Live Avatar rendszert, amely valós idő közeli videógenerálással egészíti ki a hangalapú párbeszédet. A vállalat…

Elérhetővé vált a Gemini 3.8 Live Live Avatar funkcióval
Cégek és üzlet2026. szeptember 24. 17:00

Elérhetővé vált a Gemini 3.8 Live Live Avatar funkcióval

A Google Cloud általánosan elérhetővé tette a Gemini 3.8 Live Live Avatar funkcióval kiegészített változatát a Gemini Enterprise vállalati ügyfelei számára. A rendszer…

Gyorsabb lehet a képfeldolgozó LFM2.5-VL modell
Kutatás2026. szeptember 24. 16:08

Gyorsabb lehet a képfeldolgozó LFM2.5-VL modell

A Hugging Face bemutatta az LFM2.5-VL-DSpark megoldást, amely a képet és szöveget is kezelő modellek következtetését gyorsíthatja. A közzétett adatok szerint a gyorsulás…

Élő stíluselőnézeteket és koreai nyelvet kapott a Midjourney
Termékek és eszközök2026. szeptember 24. 03:59

Élő stíluselőnézeteket és koreai nyelvet kapott a Midjourney

Élő stíluselőnézetekkel, menthető alapértelmezett paraméterekkel és átdolgozott Create feeddel bővült a Midjourney alpha felülete. A koreai nyelv, amely az előző héten…

A Liquid AI látásmodellje akár 3,13-szor gyorsabban dekódol
Modellek2026. szeptember 24.

A Liquid AI látásmodellje akár 3,13-szor gyorsabban dekódol

A Liquid AI bemutatta az LFM2.5-VL-DSpark kísérleti modellt, amely az LFM2.5-VL-3B látásnyelvi modell dekódolását gyorsítja. A vállalat mérései szerint a dekódolási…

Az NVIDIA nyílt 3D CT-modellt mutatott be radiológiai következtetéshez
Kutatás2026. szeptember 24. 00:54

Az NVIDIA nyílt 3D CT-modellt mutatott be radiológiai következtetéshez

Az NVIDIA bemutatta az NV-Reason-CT-t, egy 3D CT-vizsgálatok elemzésére fejlesztett látásnyelvi modellt. A rendszer strukturált leleteket és radiológusi gondolkodást…

LanceDB: új AI-adatkezelési útmutató és fejlesztések érkeztek
Termékek és eszközök2026. szeptember 23. 23:38

LanceDB: új AI-adatkezelési útmutató és fejlesztések érkeztek

A LanceDB új AI-adatkezelési útmutatót és több vállalati fejlesztést tett közzé, miközben bemutatta a november 5-i Reverie szakmai csúcstalálkozó programját. A vállalat…

A LanceDB összevetette a Lance, a Delta Lake és az Iceberg teljesítményét
Kutatás2026. szeptember 23. 23:38

A LanceDB összevetette a Lance, a Delta Lake és az Iceberg teljesítményét

A LanceDB S3-on végzett, 10 000 commitot vizsgáló benchmarkja szerint a Lance rövidebb commitkésleltetést és kisebb aktív metaadat-lábnyomot ért el, mint a Delta Lake és…

A LanceDB DuckDB-integrációval és 1,5 millió IOPS-szal erősít
Fejlesztőknek2026. szeptember 23. 23:38

A LanceDB DuckDB-integrációval és 1,5 millió IOPS-szal erősít

A LanceDB DuckDB-kiterjesztése SQL-alapú vektoros, teljes szöveges és hibrid keresést tesz lehetővé Lance-adathalmazokon. A vállalat emellett több S3-bucketet átfogó…

Hat országban terjeszti tovább a Google a Beam térinformatikai videóhívásait
Chipek és infrastruktúra2026. szeptember 23. 20:00

Hat országban terjeszti tovább a Google a Beam térinformatikai videóhívásait

A Google hat országra terjeszti ki a Beam videóhívási rendszerét, amely speciális hardverrel próbálja a távoli beszélgetéseket személyesebbnek hatóvá tenni. A vállalat…

Új Gemini hangmodellek érkeztek egyedi beszédhangokhoz
Modellek2026. szeptember 23. 17:25

Új Gemini hangmodellek érkeztek egyedi beszédhangokhoz

Két új szövegfelolvasó modellel bővül a Gemini család: a Gemini 3.8 Flash TTS a kreatív hangtervezésre, a Gemini 3.8 Flash-Lite TTS pedig nagy volumenű használatra…

A Picsart közvetlenül a Google Gemini beszélgetéseibe költözött
Termékek és eszközök2026. szeptember 23. 16:57

A Picsart közvetlenül a Google Gemini beszélgetéseibe költözött

A Picsart csatlakoztatható alkalmazásként megjelent a Google Geminiben, így a felhasználók külön szerkesztő megnyitása nélkül készíthetnek és alakíthatnak át vizuális…

Az MLCommons az AIRIS projektben méri majd az orvosi AI megbízhatóságát
Kutatás2026. szeptember 23. 16:11

Az MLCommons az AIRIS projektben méri majd az orvosi AI megbízhatóságát

Az MLCommons csatlakozott az uniós finanszírozású AIRIS kutatási projekthez, amely biológiai ismereteket és klinikai adatokat integráló generatív AI-modelleket fejleszt.…

Termékek és eszközök
Termékek és eszközök2026. szeptember 23. 14:00

Az invideo szerint háromszorosára javult a színezési sikerarány GPT-6 Astrával

Az invideo videószerkesztő ügynöke a GPT-6 Astra használatával pontosabban tud összetett szerkesztéseket megtervezni és végrehajtani az OpenAI szerint. A cég…

Új navigációs és hologramos funkciókat kap a Meta Ray-Ban Display
Termékek és eszközök2026. szeptember 23. 13:53

Új navigációs és hologramos funkciókat kap a Meta Ray-Ban Display

Kerékpáros és tömegközlekedési útvonaltervezéssel, hologramos videóhívással és több új alkalmazással bővíti a Meta Ray-Ban Display képességeit a Meta. A szemüveg az…

A Meta 100 grammos VR-szemüveggel mozizna és dolgozna bárhol
Termékek és eszközök2026. szeptember 23. 13:42

A Meta 100 grammos VR-szemüveggel mozizna és dolgozna bárhol

A Meta bemutatta a Meta VR Glasses nevű, körülbelül 100 grammos virtuálisvalóság-szemüveget. A készülék mozizásra, munkára, játékra, sportközvetítések nézésére és…

WAN 3.0 vagy MiniMax H3: hosszabb videó vagy kész hang
Modellek2026. szeptember 23. 12:49

WAN 3.0 vagy MiniMax H3: hosszabb videó vagy kész hang

A WAN 3.0 és a MiniMax H3 eltérő videós feladatokra lehet ideális: előbbi egyetlen, akár 30 másodperces snittet készít, utóbbi legfeljebb 15 másodperces, 2K-s videót…

Alibaba Cloud: készül a Qwen 4, Európában is új régiókat nyitnak
Modellek2026. szeptember 23.

Alibaba Cloud: készül a Qwen 4, Európában is új régiókat nyitnak

Az Alibaba Cloud bemutatta teljes veremre épülő mesterségesintelligencia-stratégiáját a 2026-os Apsara konferencián. A vállalat készíti a Qwen 4-et, új AI-chipeket…

DLSS 5, új ACE funkciók és RTX Kit frissítések érkeztek fejlesztőknek
Fejlesztőknek2026. szeptember 22. 15:00

DLSS 5, új ACE funkciók és RTX Kit frissítések érkeztek fejlesztőknek

A DLSS 5 új, 3D-Guided Neural Rendering nevű neurális renderelési lépcsőt ad a grafikai folyamat végére, fejlesztői vezérlőkkel és helyben futó feldolgozással GeForce…

Az Alibaba Qwen Intelligence ügynöki képességeket vinne az okostelefonokba
Termékek és eszközök2026. szeptember 22.

Az Alibaba Qwen Intelligence ügynöki képességeket vinne az okostelefonokba

Az Alibaba bemutatta a Qwen Intelligence teljes stackű mesterségesintelligencia-megoldást, amellyel a telefongyártók összetett, több alkalmazáson átívelő feladatokat…

A Xiaomi MiMo V2.6 modelljei megérkeztek a Vercel AI Gatewayre
Modellek2026. szeptember 21.

A Xiaomi MiMo V2.6 modelljei megérkeztek a Vercel AI Gatewayre

A Xiaomi három MiMo V2.6 modellje elérhetővé vált a Vercel AI Gatewayen. A Pro, Flash és Pro UltraSpeed változat szöveges, képi, hang- és videóbemenetet is fogad…

Az Iambic bemutatta az Enchant v3 gyógyszerkutató modellt
Modellek2026. szeptember 21.

Az Iambic bemutatta az Enchant v3 gyógyszerkutató modellt

Az Iambic bemutatta az Enchant v3 multimodális transzformermodelt, amelyet a gyógyszerkutatás és -fejlesztés teljes folyamatának támogatására terveztek. A modell 41…

123456…11