Přejít k navigační liště

Zdroják » AI » Anthropic vydává Claude Opus 5

Anthropic vydává Claude Opus 5

Články AI

Anthropic vydal Claude Opus 5 — model, který se má výkonem blížit špičkovému Fable 5 za poloviční cenu a míří hlavně na agentické kódování. Cena zůstává na 5/25 USD za milion tokenů, přibývají API novinky jako mid-conversation tool changes a automatické fallbacky.

Nálepky:

Anthropic 24. července 2026 uvedl nový model Claude Opus 5. Firma ho pozicuje jako model do každodenního nasazení, který se výkonem blíží svému nejsilnějšímu modelu Fable 5, ale stojí zhruba polovinu. Opus 5 se zároveň stává výchozím modelem v plánu Claude Max a nejsilnějším modelem dostupným v Claude Pro.

Cena zůstává stejná jako u předchůdce Opus 4.8: 5 USD za milion vstupních tokenů a 25 USD za milion výstupních tokenů. Model je od dnešního dne dostupný na všech platformách pod identifikátorem claude-opus-5 v Claude API.

Výkon: hlavně agentické kódování

Podle Anthropicu je hlavní posun na úlohách softwarového inženýrství. Na interním benchmarku Frontier-Bench v0.1 prý Opus 5 víc než zdvojnásobuje skóre Opus 4.8, a to při nižších nákladech na úlohu. Na CursorBench 3.2 se má při maximálním nastavení „effortu“ dostat na 0,5 % pod špičkové skóre modelu Fable 5, ovšem za poloviční cenu za úlohu.

Za pozornost stojí koncept effort settingu – zákazník může u modelu volit mezi vyšší inteligencí a úsporou tokenů (a tedy rychlejšími a levnějšími výsledky). Většina prezentovaných grafů ukazuje výkon právě v závislosti na tomto nastavení, ne jako jedno číslo.

Anthropic dále zmiňuje trojnásobek skóre nejbližšího konkurenta na ARC-AGI 3 (řešení nových problémů), zhruba 1,5x vyšší pass rate na Zapier AutomationBench a lepší poměr cena/výkon na počítačovém benchmarku OSWorld 2.0. Jde o čísla od výrobce, takže je namístě brát je s rezervou a počkat na nezávislé srovnání.

Firma také uvádí příklady „agentické“ samostatnosti, třeba že model při jedné úloze, kde neměl přímý přístup k obrázku výkresu, sám napsal vlastní pipeline pro počítačové vidění, aby geometrii vytáhl z pixelů, a pak podle ní zrekonstruoval 3D model součástky. Podle Anthropicu žádný konkurenční model se stejným zadáním úlohu nevyřešil ani po pěti pokusech. V dalším příkladu měl model najít příčinu reálné chyby v populárním package manageru – a našel a opravil i okrajový případ, který komunitní patch přehlédl, zatímco konkurenční model spravil jen povrchový symptom.

Mimo kód Anthropic zmiňuje i posun ve vědeckých úlohách. Opus 5 má být lepší než Opus 4.8 na všech interních benchmarkách z oblasti life sciences, přičemž největší zlepšení firma hlásí u organické chemie (odvozování molekulární struktury ze spektroskopických dat) a u úloh spojených s proteiny. K tomu přidává silnější vizuální výstupy, jako ukázky slouží interaktivní simulace proudění vzduchu v aerodynamickém tunelu a zjednodušená interaktivní ilustrace buňky.

Novinky pro vývojáře: API a nástroje

Spolu s Opus 5 vycházejí dvě beta novinky, které se týkají přímo práce s API:

Mid-conversation tool changes na Claude Platform. Vývojáři mohou uprostřed konverzace měnit, které nástroje má Claude k dispozici, aniž by tím invalidovali prompt cache. To je praktické u delších agentických běhů, kde se sada nástrojů mění podle fáze úlohy.

Automatic fallbacks na API. Požadavky, které označí bezpečnostní klasifikátory na Opus 5 (nebo Fable 5), lze nechat automaticky přesměrovat na jiný model, místo aby byly rovnou zablokované. Se zapnutými fallbacky tak požadavek podle Anthropicu vždy směřuje na nejlepší dostupný model.

Opus 5 je nabízen i ve Fast módu, který běží zhruba 2,5x rychleji než výchozí režim. Na Claude Platform za dvojnásobek základní ceny, v Claude Code přes usage credits. Model nemá pro běžný přístup požadavky na uchovávání dat (data retention).

Bezpečnost a classifiery

Anthropic tvrdí, že Opus 5 je jejich dosud nejlépe aligned model – v automatizovaném behaviorálním auditu dosáhl nejnižšího skóre nežádoucího chování mezi nedávnými modely a má nejnižší míru klamavého chování.

Pro vývojáře je zajímavější praktická stránka bezpečnostních klasifikátorů. V oblasti kyberbezpečnosti jsou classifiery Opus 5 méně restriktivní než u Fable 5 – dovolují hledání zranitelností ve zdrojovém kódu, ale blokují „binary-based“ skenování zranitelností, penetrační testování a generování exploitů. Anthropic očekává, že klasifikátory budou zasahovat zhruba o 85 % méně často než u Fable 5. V Claude.ai, Claude Code a Claude Cowork označené požadavky ve výchozím stavu spadnou zpět na Opus 4.8.

Tady je dobré počítat s tím, že narazit na fallback nebo blok lze i u legitimní bezpečnostní práce. Pro takové případy má Anthropic Cyber Verification Program, jehož účastníci dostávají verzi modelu s méně restrikcemi.

Na straně biologie mají requesty, které jsou blokované na Fable 5, nově směřovat na Opus 5 místo Opus 4.8. Anthropic zároveň uvádí, že v dlouhotrvajících autonomních výzkumných úlohách, kde vidí největší riziko, zůstává silnějším modelem Mythos 5.

Shrnutí

Opus 5 vypadá především jako iterace mířená na agentické workflow a každodenní nasazení: podobná cena jako u Opus 4.8, znatelně vyšší deklarovaný výkon a několik konkrétních API vylepšení pro delší běhy. Zajímavá je i zvolená pozice v rámci nabídky Anthropicu – model se nesnaží být nejsilnější napříč všemi disciplínami (v kyberbezpečnosti i biologii zůstává za Mythos 5), ale mířit na nejlepší poměr cena/výkon pro běžné použití. Právě effort setting a možnost volit mezi inteligencí a úsporou tokenů z něj dělá kandidáta na model, který se vyplatí testovat i tam, kde dosud kvůli ceně nebo latenci padala volba na levnější varianty.

Jak čísla obstojí mimo marketingové grafy, ukážou až nezávislé benchmarky a reálné nasazení. Podrobnosti k modelu shrnuje System Card a prompting guide.

Komentáře

Odebírat
Upozornit na
guest
0 Komentářů
Nejstarší
Nejnovější Nejvíce hlasů
AI

… reposted this!