Společnost Anthropic uvedla novou generaci modelu Opus 5. Ten má nabízet výkon podobný Fable 5 za poloviční náklady.
Společnost Anthropic představila svůj nejnovější model Claude Opus 5, který vylepšuje své schopnosti v oblastech programování, vědeckého výzkumu a byznysu. Má jít o výrazný skok ve výkonu oproti předchozí verzi Opus 4.8, přičemž Anthropic ponechal stejnou cenu za API (5 USD za milion vstupních tokenů a 25 USD za milion výstupních). Model je výchozím pro předplatitele Claude Max a nejsilnější dostupnou volbou v rámci plánu Claude Pro.

V oblasti softwarového inženýrství Opus 5 vykazuje velmi silné výsledky. V testu Frontier-Bench v0.1 dokázal více než zdvojnásobit výkon svého předchůdce a překonal i Fable 5. V CursorBench byl jen o 0,5 % horší, přitom náklady na jednotlivé úlohy byly poloviční. Model je navíc lépe schopný verifikovat vlastní práci a opakovat svou snahu až do úspěšného splnění úlohy. Např. si sám napsal vizuální pipeline, aby mohl z pixelů vytvořit geometrii součástky a následně ji zrekonstruovat jako 3D model FreeCAD, což konkurenční modely nezvládly ani po pěti pokusech.
Z hlediska bezpečnosti jde podle Anthropicu o jejich dosud nejstabilnější model. Má nejnižší míru lživého chování a je méně náchylný k manipulaci. V oblasti kyberbezpečnosti je však záměrně za modelem Mythos 5 a na rozpoznávání bezpečnostních chyb nebyl cíleně trénován. Přestože dokáže Opus 5 zranitelnosti v kódu identifikovat podobně dobře jako Mythos 5, jejich následné zneužití mu ale nejde tak snadno. V případě závadných požadavků na něco takového se model přepne na méně schopný Opus 4.8. K dispozici je také Fast Mode, který zvyšuje rychlost běhu modelu zhruba 2,5× za 2násobnou cenu.






















