multimodális AI

Az AbbVie és az Iambic AI-val gyorsítja a gyógyszerkutatást
Többéves együttműködésben alkalmazza az AbbVie az Iambic mesterségesintelligencia-platformját kis molekulájú gyógyszerek felfedezésére és fejlesztésére. A partnerség az…

A Google Flow személyre szabott eszközökkel segítette a divattervezőket
A Google Envisioning Studio két divattervezővel közösen fejlesztett személyre szabott eszközöket a Google Flow-ban, hogy egyszerűsítsék a New York-i divathét…

A Roboflow szerint a GPT-6 Astra a legerősebb látásmodell
A Roboflow tesztjei alapján a GPT-6 Astra eddig a legerősebb látásmodell, amelyet a vállalat vizsgált. A modell objektumfelismerésben, számlálásban és vizuális…

Apple-kutatás: DSO módszerrel csökkentenék az AI-modellek torzítását
A Direct Steering Optimization, röviden DSO, az Apple kutatói szerint futtatás közben teheti szabályozhatóbbá az AI-modellek torzításcsökkentését. A CVPR-hez kapcsolódó…

Az Apple LinEAS módszere kevés adattal irányítja a generatív modelleket
Az Apple kutatói a LinEAS nevű módszert mutatták be, amely a generatív modellek aktivációinak módosításával igyekszik biztonságosabbá és jobban irányíthatóvá tenni a…

A Google AI-val készíthető interaktív tananyagokat kutat
A Google Research olyan rendszert mutatott be, amellyel a tanárok saját céljaikhoz és tantervükhöz igazított, interaktív oktatási szimulációkat készíthetnek. A kísérlet…

A Roboflow szerint a GPT-6 Astra objektumokat is képes körberajzolni
A GPT-6 Astra képes azonosított objektumok körvonalát poligonként visszaadni, derül ki a Roboflow tesztjéből. A módszer számoláshoz, kivágáshoz és címkézéshez…

AI-ügynök értékeli, mennyire jól szerkesztenek képeket az új modellek
A Lambda, a Texasi Egyetem austini kampuszával, a UCLA-val és a Microsofttal közösen, EdiVal-Agent néven olyan keretrendszert fejlesztett, amely AI-ügynökkel értékeli a…

Elindult a One UI 9 frissítése, elsőként a Galaxy S26 kapja meg
A Samsung megkezdte a One UI 9 hivatalos terjesztését, elsőként a Galaxy S26, S26+ és S26 Ultra készülékeken. A rendszer több Galaxy-eszközre hoz új Galaxy…

Saját képgeneráló modelleket készített a Character.AI a rajongói történetekhez
A Character.AI bemutatta a CAI-Image képgeneráló modellcsaládot, amelyet az open source Qwen-Image modellek továbbképzett változataiból készített a karakterközpontú…

Az MLPerfben először mértek adatközponti AI-ügynököt
Az MLPerf Inference v6.1 mérésében először szerepelt adatközponti hardveren futtatott ügynöki terhelés, a Lambda pedig egy ezermilliárdnál több paraméteres modellt…

Betegenként alkalmazkodó AI teheti pontosabbá a műtéti röntgenezést
Az MIT és együttműködő intézményei olyan mesterségesintelligencia-módszert fejlesztettek, amely másodpercek alatt, szubmilliméteres pontossággal illeszti a műtét közben…

A Samsung új videós módja a profi objektívek mélységhatását utánozza
A Galaxy Z sorozat továbbfejlesztett Portrait Video módja a Samsung szerint a nagy fényerejű professzionális objektívek mélységhatását és bokeh-rajzolatát utánozza. A…

Az NVIDIA Earth-2 az Egyesült Királyság légszennyezését is előrejelzi
A Manchesteri Egyetem kutatói NVIDIA Earth-2 modellekkel készítettek részletes, Egyesült Királyság egészére kiterjedő légszennyezési modellt. A rendszer egyetlen, nyolc…

Az EncQA megmutatja, hol hibáznak a látó nyelvi modellek a diagramoknál
Az Apple kutatói új benchmarkot mutattak be a látó nyelvi modellek diagramértelmezési képességeinek vizsgálatára. Az EncQA 2076 szintetikus kérdés-válasz párral méri…

A Google bemutatta a Gemini 3.8 Live hangalapú AI-modelleket
A Google bemutatta a Gemini 3.8 Live és a Gemini 3.8 Live Extended Thinking modelleket, amelyek természetesebb hangalapú párbeszédet, valós idejű vizuális értelmezést és…

A Google 1000 nyelven szeretné elérhetővé tenni az AI-t
A Google olyan mesterségesintelligencia-modelleken dolgozik, amelyek a fordítás mellett a hangszínt, az érzelmeket, a szlenget és a kulturális sajátosságokat is…

A Meta One előfizetéssel több AI-funkciót és üzleti eszközt kínál
A Meta új, Meta One nevű előfizetéses szolgáltatást indított, amely több AI-használatot, kiterjesztett önkifejezési lehetőségeket és üzleti eszközöket kínál. Az…

A Meta One előfizetéssel több AI-funkciót és üzleti eszközt kínál
A Meta elindította a Meta One előfizetéses szolgáltatást, amely több mint 50 funkcióval bővíti az Instagram, a Facebook, a WhatsApp és a Meta AI lehetőségeit. A csomagok…

A Claude Fable 5.1 már teljes kreatív munkafolyamatot irányíthat a Picsartban
A Claude Fable 5.1 a Picsart MCP kapcsolaton keresztül képeket, videókat és hanganyagokat készíthet, miközben a kreatív folyamatot a modell irányítja. A Picsart szerint…

A GPT-6 Astra a Picsart modelljeivel készít kreatív anyagokat
A GPT-6 Astra a Picsart MCP csatlakozón keresztül képeket, videókat és hanganyagokat készíthet egyetlen természetes nyelvű briefből. A ChatGPT-ben futó modell megtervezi…

A Vercel AI Gatewayre érkezett a Gemini 3.8 Live
A Vercel AI Gatewayen elérhetővé vált a Google Gemini 3.8 Live és a Gemini 3.8 Live Extended Thinking. A modellek valós idejű beszélt interakciókat kínálnak…

Megérkezett a Siri AI az Apple Intelligence új generációjával
Elindult a Siri AI, az Apple teljesen újragondolt asszisztense, amely személyes kontextust, képernyőtartalom-értést és szélesebb alkalmazásműveleteket használ. A funkció…

Elindultak az Apple új szoftverfrissítései, Siri AI-val
Az Apple megkezdte az iOS 27, az iPadOS 27, a macOS 27 és további platformok új szoftververzióinak terjesztését. A frissítések része a Siri AI angol nyelvű bétája, több…