Přejít na obsah
Bitcoin, akcie, ekonomika, AI
Menu
Začněte otázkou

Co vás zajímá?

Články, analýzy a nové pohledy na svět peněz.

ÚvodTechnologie84 5176 min čtení

Anthropic vydal Claude Opus 5.5. Dotahuje Fable, je levnější a píše srozumitelněji

Anthropic představil Claude Opus 5.5. Podle firmy zvládá většinu práce na úrovni Fable 5.1 a typické úlohy vyjdou o 40 % levněji než na Opusu 5. Co ukazují benchmarky a na co si musí dát pozor vývojáři?

Americká společnost Anthropic v úterý představila jazykový model Claude Opus 5.5, první z nové řady 5.5. Podle firmy zvládá většinu práce na úrovni modelu Claude Fable 5.1, text generuje o více než 30 % rychleji a typické úlohy na něm vyjdou o 40 % levněji než na předchozím Opusu 5. Vývojáře ale čeká i několik změn, které jim mohou rozbít stávající nástroje.

Stručně:

  • Opus 5.5 je k dispozici od 22. září v aplikacích Claude, přes API a v cloudech Amazon Web Services, Google Cloud a Microsoft Azure.
  • Milion vstupních tokenů stojí 4 dolary a milion výstupních 20 dolarů. Oproti Opusu 5 je to o pětinu méně.
  • V řadě zveřejněných testů programování a samostatné práce vede, v některých ho ale předstihuje GPT-6 Astra od OpenAI.
  • Režim přemýšlení už nejde vypnout.
  • Menší modely Sonnet 5.5 a Haiku 5.5 mají přijít během několika týdnů.

Programování: 680 tisíc řádků kódu za den

Nejvíc se nový Opus posunul v tzv. agentním programování, tedy v práci, kdy model sám a v mnoha krocích píše, spouští a opravuje kód. V testu Terminal-Bench 4.0 zjišťují autoři, jestli model zvládne samostatně plnit úlohy v příkazové řádce. Opus 5.5 v něm dosáhl úspěšnosti 66,4 %, Opus 5 měl 52,3 % a GPT-6 Astra 57,9 %.

Terminal-Bench 4.0: Opus 5.5 dosáhl 66,4 %, GPT-6 Astra 57,9 %, Fable 5.1 55,8 % a Opus 5 52,3 %.
Úspěšnost v Terminal-Bench 4.0 podle srovnání zveřejněného Anthropicem. Opus 5.5 běžel na úrovni xhigh, GPT-6 Astra na high. Grafika: Kryptomagazín. Zdroj: Anthropic.

Podle Anthropicu jeden z testerů s novým modelem za necelý den převedl 680 tisíc řádků kódu na novou technologii. Vývojářskému týmu by podle firmy taková práce zabrala týdny. V jiném pokusu Opus 5.5 přepsal proxy server HAProxy z jazyka C do Rustu. Hotovo měl za 9,5 hodiny, zatímco Fable 5.1 potřeboval 12 hodin, a úloha vyšla o 51 % levněji. Obě verze podle Anthropicu prošly téměř všemi regresními testy HAProxy.

Na rozdíl od svého předchůdce se Opus 5.5 k výsledku dostane na méně pokusů. Mario Rodriguez, šéf produktu GitHubu, uvádí, že ve VS Code vyřešil víc úloh v terminálu než Opus 5 za méně než polovinu kroků. Ve firmě Clio podle vývojáře Seana Heintze model u jednoho zadání pracoval přes 18 hodin, aniž ztratil přehled, co má dělat.

Méně vymyšlených čísel a čtivější texty

Druhou oblastí je kancelářská práce: analýzy, reporty a podklady pro rozhodování. Anthropic nechal model připravovat zprávy o čtvrtletních výsledcích firmy. Za neúspěch se počítalo každé vymyšlené číslo nebo citace. Při různých nastaveních úsilí zprávy prošly v 16 z 18 případů. Analýzu fúze dvou smyšlených firem Opus 5.5 dokončil za 63 minut, Opus 5 za 93.

Změnil se i styl psaní. Podle Anthropicu dává nový model nejdůležitější informace na začátek a je méně upovídaný. John Ruelas ze společnosti Ramp popsal, že Opus 5.5 řeší rozvláčné výstupy a dodržuje zadaná pravidla pro psaní.

Kde soupeři vedou

Následující srovnání vychází z tabulky zveřejněné Anthropicem. Firma v ní vedle vlastních měření používá také výsledky uváděné OpenAI a Zapierem. Nejde tedy o jednotný nezávislý test všech modelů. Ani firemní tabulka přitom nepředstavuje Opus 5.5 jako vítěze ve všem:

TestOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.0 (programování v terminálu)66,4 %55,8 %52,3 %57,9 %
FrontierCode v1.154,4 %50,3 %48,0 %53,3 %
Humanity’s Last Exam (s nástroji)67,7 %65,6 %63,6 %57,2 %
AutomationBench (automatizace)40,0 %31,4 %26,9 %41,4 %
Terminal-Bench-Science 0.1 (vědecké úlohy)58,7 %52,6 %29,0 %64,6 %
OSWorld 2.0 (ovládání počítače, dílčí výsledky)81,8 %80,7 %74,0 %
Zdroj: Anthropic, 22. září 2026. Pomlčka znamená, že tabulka výsledek neuvádí. Tučně je nejlepší hodnota mezi zde srovnávanými modely.

Výsledky závisí na nastavení a metodice. Anthropic u Opusu 5.5 většinou používá maximální úsilí, u Terminal-Bench 4.0 úroveň xhigh. Při zásahu bezpečnostních ochran navíc některé úlohy přebíraly starší modely. OSWorld 2.0 firma označuje jako dílčí výsledky.

V automatizaci a ve vědeckých úlohách vede GPT-6 Astra od OpenAI, ve vědě o 5,9 procentního bodu. Samotný Anthropic zároveň upozorňuje, že rozdíly v benchmarcích při této úrovni schopností nevystihují spolehlivě všechny rozdíly v praxi.

Ceny: levnější tokeny a méně tokenů na úlohu

Tokeny jsou úseky textu, za které se u AI modelů platí. U Opusu 5.5 stojí vstupní tokeny 4 dolary za milion a výstupní 20 dolarů za milion, takže zlevnily o 20 %. Víc zlevnilo tzv. čtení z mezipaměti, které se účtuje, když model opakovaně pracuje se stejným kontextem, například s celým projektem. Stojí 20 centů za milion tokenů, tedy o 60 % méně. U agentní práce a programování podle Anthropicu tvoří tato položka většinu nákladů.

Vstupní a výstupní tokeny Opusu 5.5 zlevnily o 20 %, čtení z mezipaměti o 60 % proti Opusu 5.
Vstup a výstup zlevnily o pětinu, čtení z mezipaměti o 60 %. Graf zachycuje jednotkové ceny, nikoli celkové náklady úlohy. Grafika: Kryptomagazín. Zdroj: Anthropic.

Zlevnění o 40 %, kterým se firma chlubí, tedy není jen o ceníku. Model navíc na stejnou úlohu spotřebuje méně tokenů. Jde o výsledek firemních testů typických úloh při výchozím nastavení, nikoli o zaručenou úsporu u každého zadání. Kdo potřebuje odpovědi rychle, může použít rychlý režim, který je až 2,5krát rychlejší a stojí 8 dolarů za milion vstupních a 40 dolarů za milion výstupních tokenů. Předplatitelům tarifů Pro, Max, Team a Enterprise s platbou za uživatelská místa Anthropic zvedá pětihodinové limity používání.

Na co si dát pozor: přemýšlení nevypnete

Pro vývojáře je nejdůležitější změna v režimu přemýšlení. V něm si model před odpovědí interně rozmyslí postup. U Opusu 5.5 je tento režim vždy zapnutý a požadavek na jeho vypnutí API odmítne chybou. Místo toho se nastavuje „úsilí“ (effort) v pěti stupních od low po max. Výchozí hodnota klesla z high na medium.

Model také nepodporuje vynucené volání nástrojů: API odmítne nastavení tool_choice typu any i tool. Na Claude API a Google Cloud končí podpora staršího nástroje pro ovládání počítače computer_20251124. Kdo na Opus 5.5 přechází, měl by si nejdřív otestovat své integrace podle migračního průvodce Anthropicu.

Bezpečnost: přísnější pravidla pro kybernetiku a biologii

V automatickém auditu chování, nejrozsáhlejším testu, kterým Anthropic ověřuje, jestli se model chová v souladu se svými pravidly, dopadl Opus 5.5 nejlépe ze všech dosud testovaných modelů. V samostatném testu překračování stanovených hranic se je pokoušel obejít zhruba o 85 % méně často než Opus 5. Před vydáním ho prověřili i externí hodnotitelé, mezi nimi organizace METR.

Protože je model v kybernetické bezpečnosti a biologii velmi schopný, dostal přísnější ochrany. Většinu požadavků týkajících se kybernetické bezpečnosti přesměruje na starší Opus 4.8. Ověření odborníci mají brzy získat přístup přes program Cyber Verification Program.

Opus 5.5 také používá opatření pro označování generovaného obsahu vodoznakem, která Anthropic zavedl v souvislosti s evropským AI Actem. Dostupný je i režim s nulovým uchováváním dat.

Model přebírá tzv. preserved thinking, ochranu proti destilaci zavedenou u Fable 5.1. Ta omezuje úpravy dřívějšího kontextu kolem bloků přemýšlení, kterými by se někdo mohl pokoušet získat interní uvažování Clauda pro trénink konkurenčních modelů. Podle dokumentace Anthropicu se u Opusu 5.5 týká API účtů založených od 31. srpna 2026.

Co bude dál

Opus je v nabídce Anthropicu model pro náročné úlohy. Pro běžné použití jsou levnější a rychlejší Sonnet a Haiku, jejichž verze 5.5 mají přijít v následujících týdnech. Teprve pak se ukáže, jestli nižší ceny a úspornější práce s tokeny zlevní i to, co lidé s Claudem dělají nejčastěji.

Titulní obrázek: Anthropic.

Zdroje: oznámení Anthropicu a výsledky testů, přehled modelu, migrační průvodce, preserved thinking.

Klikni na hvězdičky pro hodnocení!

Průměrné hodnocení 4.5 / 5. Počet hlasujících 2

Buď první kdo článek ohodnotí

O autorovi

Dariusz Matuszyński

Jsem zakladatel portálu Kryptomagazin.cz a kryptoměnám se profesně věnuji každý den. Magazín jsem založil v době, kdy na českém internetu bylo o bitcoinu a dalších kryptoměnách minimum informací. Chtěl jsem vytvořit místo, které čtenářům pomůže zorientovat se v tomto odvětví a porozumět jeho vývoji.

Na kryptoměnách mě vedle technologií oslovuje především myšlenka decentralizace. Blízké jsou mi také principy cypherpunku a kryptoanarchie, které zdůrazňují soukromí a osobní svobodu. Krypto je mou každodenní prací i osobním zájmem. Na Kryptomagazínu chci tento svět přibližovat srozumitelně a v souvislostech.

Přihlásit k odběru
Upozornit na
guest
0 Komentáře
nejstarší
Nejnovější S nejvíce hlasy
Čtěte dál

Další články od nejnovějších