Az Anthropic bemutatta a Claude Opus 5 modellt

Elérhetővé vált a Claude Opus 5, amelyet az Anthropic a Claude Fable 5 intelligenciájához közeli, annál feleannyiba kerülő modellként mutatott be. A vállalat szerint a rendszer több kódolási és tudásmunkás értékelésben is új csúcsot állított fel.
- Elérhetővé vált a Claude Opus 5 2026. július 24-én.
- Az Anthropic szerint több kódolási és tudásmunkás teszten első helyet szerzett.
- Az Opus 5 ugyanannyiba kerül, mint az Opus 4.8, de jobb teljesítményt kínál.
- A modell a Claude Max alapértelmezett, a Claude Pro legerősebb modellje lett.
- Tudományos kutatásban, automatizálásban és hosszú munkafolyamatokban is javult.
Kódolásban és tudásmunkában is erős eredmények
Az Anthropic 2026. július 24-én jelentette be a Claude Opus 5 megjelenését. A vállalat közlése szerint a modell a Frontier-Bench és a GDPval-AA értékeléseken a jelenlegi élmezőnybe került, miközben kiberbiztonsági feladatokban továbbra is a Mythos 5 mögött marad.
A Claude Opus 5 ugyanannyiba kerül, mint elődje, a Claude Opus 4.8, az Anthropic szerint azonban jelentősen jobb teljesítményt nyújt. A felhasználók a modell erőfeszítési szintjét is beállíthatják. Ezzel a nagyobb intelligenciát igénylő működés és a gyorsabb, olcsóbb válaszok között választhatnak.
A Frontier-Bench v0.1 teszten az Opus 5 minden más modellnél jobban teljesített, és több mint kétszeresen múlta felül az Opus 4.8 eredményét, alacsonyabb feladatonkénti költség mellett. A CursorBench 3.2 maximális erőfeszítési szintjén a modell 0,5 százalékponton belül került a Fable 5 csúcseredményéhez, feleakkora feladatonkénti költséggel.
Az ARC-AGI 3 új problémák megoldását vizsgáló tesztjén az Opus 5 pontszáma háromszorosa volt a következő legjobb modellének. A Zapier AutomationBench üzleti feladatokat mérő értékelésén azonos költség mellett nagyjából másfélszeres volt a teljesítménye, az OSWorld 2.0 számítógéphasználati teszten pedig az Anthropic szerint minden költségszinten felülmúlta a többi modellt.
Önálló ellenőrzés és hosszabb munkafolyamatok
Az Anthropic szerint a Claude Opus 5 az előző modelleknél alaposabban ellenőrzi a saját munkáját, és addig iterál, amíg sikerrel nem jár. Egy Frontier-Bench feladatban egy gépalkatrész rajza alapján kellett 3D FreeCAD-modellt készítenie, miközben közvetlenül nem láthatta a képet. A modell saját számítógépes látási folyamatot írt, amely a nyers képpontokból nyerte ki a geometriát, majd többször is rekonstruálta az alkatrészt.
A vállalat további példái között szerepel egy népszerű nyílt forráskódú csomagkezelő hibájának javítása, ahol az Opus 5 a közösségi javítás által kihagyott peremesetet is kezelte. Egy kereskedési cég mérnöke egy új tőzsde piaciadat-csatornáját készítette el vele egyetlen munkamenetben. Mivel nem volt élő adatfolyam az ellenőrzéshez, a modell saját tesztelési környezetet is létrehozott.
A modell tudományos kutatásban is javult az Opus 4.8-hoz képest. Az Anthropic minden élettudományi értékelésén jobb eredményt mért, különösen szerves kémiában és fehérjékkel kapcsolatos feladatokban. A vállalat belső tesztjén a molekulaszerkezetek spektroszkópiai adatokból történő meghatározásában 10,2 százalékponttal, a fehérjeszekvencia-változások hatásának előrejelzésében 7,7 százalékponttal ért el magasabb pontszámot.
Helye a Claude kínálatában
A Claude Opus 5 a bejelentés szerint azonnal elérhető. Ez lett a Claude Max új alapértelmezett modellje, a Claude Pro előfizetésben pedig ez számít a legerősebb modellnek. Az Anthropic a Claude Fable 5-höz közeli intelligenciát, az Opus 5 sebességét és költségszintjét emeli ki.
A vállalat korai hozzáférési programjának ügyfelei több területen is javulásról számoltak be. A beszámolók szerint a modell összetett hibakeresési, pénzügyi modellezési, jogi, genomikai és automatizálási feladatokban is használhatóbbnak bizonyult. A Box értékelése alapján az Opus 5 8 százalékkal teljesített jobban az Opus 4.8-nál, az adatelemzési munkafolyamatokban 11, az átvilágítási feladatokban pedig 17 százalékos javulással.
Az Anthropic adatai szerint a modell egyes feladatokban kevesebb tokent és eszközhívást használ, miközben megtartja a teljesítményét. A jogi munkát vizsgáló teszteken például alacsonyabb érvelési szinten hasonló eredményt ért el, átlagosan 26 százalékkal kevesebb token generálásával, mint az Opus 4.8 maximális érvelés mellett.
Az új modell így elsősorban azoknak lehet fontos, akik hosszabb, több lépésből álló munkafolyamatokat bíznának egy mesterséges intelligenciára. A forrás szerint a Claude Opus 5 a kódolástól és a kutatástól az üzleti automatizálásig több feladattípusban kínál nagyobb teljesítményt az Opus 4.8 költségszintjén.
Anthropic: Introducing Claude Opus 5


