Claude Opus 5 je venku. Než přepíšete jméno modelu v produkci, přečtěte si tohle

24. července 2026 vydal Anthropic Claude Opus 5. Cena zůstala stejná jako u Opusu 4.8 — 5 $/25 $ za milion tokenů, kontext 1M. Zajímavější než benchmarky je ale jedna věta, kterou v oznámení nikdo nedal tučně.

Claude Opus 5 je venku — než přepíšete jméno modelu v produkci, přečtěte si tohle

Co se změnilo

Na první pohled skoro nic: stejná cena, stejný kontext 1M tokenů, výkon zase o kus dál. Přesně ten typ upgradu, který láká přepsat jedno jméno modelu v konfiguraci a jít na oběd.

Cena $5/$25 za milion tokenů, stejná jako Opus 4.8, kontext 1M

Věta, kterou nikdo nedal tučně

Thinking je nově zapnutý defaultně. A protože max_tokens je strop na celý výstup — thinking i text dohromady — limit, který vám dva roky bohatě stačil, najednou stačit nemusí.

Thinking je nově zapnutý defaultně a max_tokens limituje thinking i text dohromady

Co to znamená v praxi

Máte v provozu automatizaci napsanou pro Opus 4.8. Přepíšete jméno modelu a ono to začne vracet osekané odpovědi.

Nic nespadne. Nepřijde žádná chybová hláška. Nikdo vám nezavolá. Prostě to bude tiše horší — a zjistíte to za tři týdny z reklamace zákazníka.

Odpovědi vám můžou začít tiše docházet uprostřed — nic se nerozbije nahlas

Tři věci, které patří do checklistu při upgradu

  • max_tokens — thinking se do něj teď počítá. Zvedněte limit, ať zbyde na odpověď.
  • thinking: disabled — v kombinaci s effortem xhigh/max vrací chybu 400.
  • Instrukce typu „na konci zkontroluj svoji práci“ — Opus 5 se kontroluje sám. S touhle instrukcí přeověřuje a pálí tokeny navíc.
Checklist bod 1: max_tokens — thinking se do něj teď počítá

Upgrade modelu není přepsání jednoho stringu

Je to přetestování celého procesu. A nové generace modelů chodí několikrát do roka.

U klientů, kterým automatizace stavíme a spravujeme, tohle běží na naší straně. Po každé změně modelu projede sada testů reálné vstupy a řekne, jestli výstup pořád sedí. Klient se o upgradu dozví z reportu, ne z reklamace.

Příště ukážeme konkrétně, jak taková testovací sada vypadá v praxi — a proč se vyplatí i u automatizace, která „jenom“ třídí e-maily.

Související: Proč na většinu firemní práce stačí levnější model a kde se vyplatí frontier, rozebíráme v článku Kimi K3: čínský open-weight model poprvé v čele coding žebříčku.

Chcete mít upgrady modelů bez starostí?

Postavíme a spravujeme vaše AI automatizace včetně testování při každé změně modelu. Ozvěte se nám.

Držíme vás na první pozici. Teď i s AI. 💚

Náskok napřed

Náskok napřed. Teď i s AI.

Pojďme to rozjet