Mesterséges intelligencia, magyarul.
Az eredeti közleményekből.

Claude Opus 5

Az Amazon Bedrock Indiában is helyben futtatja a Claude modelleket
Termékek és eszközök2026. szeptember 30. 03:13

Az Amazon Bedrock Indiában is helyben futtatja a Claude modelleket

Az Amazon Bedrock Indiában is elérhetővé tette az Anthropic Claude Opus 5, Claude Sonnet 5 és Claude Haiku 4.5 modelleket. A kérések az országon belül, Mumbai és…

Három Claude-modell érhető el indiai adatfeldolgozással az Amazon Bedrockon
Termékek és eszközök2026. szeptember 30. 03:13

Három Claude-modell érhető el indiai adatfeldolgozással az Amazon Bedrockon

Az Amazon Bedrock Indiában is elérhetővé tette az Anthropic Claude Opus 5, Claude Sonnet 5 és Claude Haiku 4.5 modelleket. Az indiai földrajzi régióközi inferencia a…

Az AWS Dél-Koreában és Szingapúrban is helyben futtatja a Claude modelleket
Termékek és eszközök2026. szeptember 30. 03:13

Az AWS Dél-Koreában és Szingapúrban is helyben futtatja a Claude modelleket

Az Amazon Bedrock mostantól régión belüli következtetést kínál Anthropic Claude modellekhez Szöulban és Szingapúrban. A kérelmek, a bemenetek és a válaszok az adott…

Helyben maradnak a Claude-modellek az AWS szöuli és szingapúri régiójában
Termékek és eszközök2026. szeptember 30. 03:13

Helyben maradnak a Claude-modellek az AWS szöuli és szingapúri régiójában

Az Amazon Bedrock már támogatja az Anthropic Claude Opus 5 és Claude Sonnet 5 modelleket Szöulban, valamint a Claude Sonnet 5 modellt Szingapúrban, régión belüli…

Jev-as-a-Judge értékelés érkezett az Arize AX platformra
Termékek és eszközök2026. szeptember 28. 23:00

Jev-as-a-Judge értékelés érkezett az Arize AX platformra

Az Arize AX közvetlenül integrálta a TypeSafe AI Jev döntési modelljét, így a csapatok natív módon értékelhetik a gyártási nyomokat. A Jev-as-a-Judge strukturált…

Az Arize AX közvetlenül támogatja a Jev-as-a-Judge értékeléseket
Termékek és eszközök2026. szeptember 28. 23:00

Az Arize AX közvetlenül támogatja a Jev-as-a-Judge értékeléseket

Az Arize AX natív integrációt kapott a TypeSafe AI Jev rendszerével, így a csapatok közvetlenül a platformon értékelhetik a gyártásból származó nyomkövetéseket. A Jev…

A GPT-5.6 Sol vezeti a régi rendszerekre szabott tesztet
Kutatás2026. szeptember 24.

A GPT-5.6 Sol vezeti a régi rendszerekre szabott tesztet

A GPT-5.6 Sol érte el a legjobb eredményt a Factory Legacy-Bench nevű tesztjén, amely a COBOL, a Java 7, a BASIC, a C89, a Fortran és az Assembly kezelését vizsgálja. A…

Az Arize szerint a Jev 300-szor olcsóbban érte el Claude Opus 5 pontosságát
Kutatás2026. szeptember 24. 00:55

Az Arize szerint a Jev 300-szor olcsóbban érte el Claude Opus 5 pontosságát

A Jev a Claude Opus 5-tel azonos, 87 százalékos pontosságot ért el az Arize hallucination detection tesztjén, miközben a vállalat szerint körülbelül 300-szor olcsóbb és…

Az NVIDIA tesztje szerint sok kódolóügynök elbukik éles kiszolgálásban
Kutatás2026. szeptember 23. 18:00

Az NVIDIA tesztje szerint sok kódolóügynök elbukik éles kiszolgálásban

Az NVIDIA új SWE-Serve benchmarkja azt vizsgálja, hogy az AI-kódolóügynökök javításai működnek-e valódi modellkiszolgálás közben. A 19, éles szervert indító feladatnál a…

Egy újabb modell tette lehetővé az OpenAI fórumának feltörését
Biztonság és etika2026. szeptember 22. 02:50

Egy újabb modell tette lehetővé az OpenAI fórumának feltörését

Egy korábban sikertelen támadási kísérletből teljes behatolás lett, miután a Hacktron kutatói az újonnan kiadott Claude Opus 5 modellt vetették be. A Kilo Code…

A Jev gyorsabb és olcsóbb, de kevésbé pontos a Claude Opus 5-nél
Kutatás2026. szeptember 22.

A Jev gyorsabb és olcsóbb, de kevésbé pontos a Claude Opus 5-nél

A Jev 1.13 a Banking77 szándékfelismerési tesztjén 81,0 százalékos pontosságot ért el, a Claude Opus 5 pedig 84,4 százalékot. Az OpenRouter mérése szerint a Jev medián…

A Fireworks szerint a modellek együtt többre képesek, mint külön-külön
Kutatás2026. szeptember 21.

A Fireworks szerint a modellek együtt többre képesek, mint külön-külön

A megfelelő modell feladatonkénti kiválasztásával jelentősen javítható egy kódoló ügynök teljesítménye, miközben a költség is csökkenthető. A Fireworks AI elemzése…

Az OpenAI GPT-6 Astra megérkezett a Snowflake Cortex AI-ba
Modellek2026. szeptember 9. 18:00

Az OpenAI GPT-6 Astra megérkezett a Snowflake Cortex AI-ba

A Snowflake privát előzetesben elérhetővé tette az OpenAI GPT-6 Astra modelljét a Cortex AI platformon. A modell a vállalati adatokkal végzett összetett, több lépéses…

Az OpenRouter régióhoz köti az AI-kérések feldolgozását
Termékek és eszközök2026. szeptember 9.

Az OpenRouter régióhoz köti az AI-kérések feldolgozását

Az OpenRouter elindította az amerikai régión belüli útválasztást, és az EU-s lehetőséggel együtt garantált adatfeldolgozási helyet kínál az AI-munkaterhelésekhez. A…

Kutatás
Kutatás2026. szeptember 8. 22:25

A Sierra új tesztje azt méri, képesek-e az AI-modellek ügynököt építeni

A Sierra nyílt forrású hyper-𝜏-bench tesztet készített annak mérésére, hogy az AI-modellek képesek-e önállóan ügyfélszolgálati ügynököt felépíteni. A vállalat szerint a…

A GitHub bemutatta a Project HydraFusion kutatási előzetesét
Termékek és eszközök2026. szeptember 4. 18:04

A GitHub bemutatta a Project HydraFusion kutatási előzetesét

A GitHub 2026. szeptember 4-én bemutatta a Project HydraFusion nevű kutatási előzetest. A rendszer a GitHub Copilotban több szolgáltató modelljei közül választ, és futás…

A Hebbia új AI-platformokat és adatforrásokat tett elérhetővé
Termékek és eszközök2026. augusztus 31.

A Hebbia új AI-platformokat és adatforrásokat tett elérhetővé

A Hebbia két jelentős platformfrissítést mutatott be: a Max AI-teammate-ként, a Matrix 2.0 pedig többféle üzleti dokumentum létrehozására használható. A vállalat…

Miért buknak el a frontier AI-ügynökök a valódi mérnöki munkán?
Kutatás2026. augusztus 24. 20:16

Miért buknak el a frontier AI-ügynökök a valódi mérnöki munkán?

A Terminal-Bench 3.0 legjobb modellje, Claude Opus 5 is csak 43,5 százalékos eredményt ér el az új teszten. A Snorkel AI két feladaton keresztül mutatja be, miért nehéz…

Az NVIDIA AVO 100 százalékot ért el az ARC-AGI-3 nyilvános tesztjén
Kutatás2026. augusztus 21. 15:00

Az NVIDIA AVO 100 százalékot ért el az ARC-AGI-3 nyilvános tesztjén

Az NVIDIA Developer 2026. augusztus 21-én közölte, hogy az Agentic Variation Operators, röviden AVO kutatási projekt 100.00 RHAE pontszámot ért el az ARC-AGI-3 nyilvános…

Toast 1: olcsóbb és gyorsabb keresőügynököt mutatott be a Mixedbread
Termékek és eszközök2026. augusztus 13.

Toast 1: olcsóbb és gyorsabb keresőügynököt mutatott be a Mixedbread

Elérhetővé vált a Mixedbread első specializált keresőügynöke, a Toast 1. A cég szerint az eszköz a Claude Opus 5 és a GPT-5.6 Sol szintjét elérő keresési minőséget…

Az Anthropic bemutatta a Claude Opus 5 modelltFontos hír
Modellek2026. július 24.

Az Anthropic bemutatta a Claude Opus 5 modellt

Elérhetővé vált a Claude Opus 5, amelyet az Anthropic a Claude Fable 5 intelligenciájához közeli, annál feleannyiba kerülő modellként mutatott be. A vállalat szerint a…