Preskočiť na obsah
Lernety
AI a modely

Anthropic uviedol Claude Opus 5.5: rovnaký výkon ako Fable 5.1, o 40 % nižšie náklady

Anthropic 22. 9. 2026 predstavil Claude Opus 5.5, prvý model novej rodiny 5.5. Firma ho opisuje ako najsilnejší model, aký kedy testovala na vlastnom bezpečnostnom audite, a zároveň ako najlacnejší variant Opus v histórii produktu – prevádzka vyjde o 40 % lacnejšie ako pri Opus 5 pri porovnateľnom výstupe. Oznámenie obsahuje vyše tridsať zákazníckych referencií od firiem ako GitHub, Stripe, Box či Deloitte a podrobný opis toho, ako Anthropic model testoval na bezpečnosť. Rozoberáme, čo presne sa zmenilo, akými konkrétnymi číslami to firma dokladá a čo to znamená pre praktické nasadenie.

Redakce Lernety

12 min čítania


  • Anthropic vydal Claude Opus 5.5 22. 9. 2026 ako prvý model novej rodiny 5.5. Na väčšine úloh dosahuje výkon porovnateľný s drahším modelom Claude Fable 5.1, prevádzka však vyjde o 40 % lacnejšie ako pri Opus 5.
  • Vstupné tokeny stoja 4 doláre a výstupné 20 dolárov za milión, o 20 % menej ako pri Opus 5. Čítanie z cache zlacnelo o 60 % na 0,20 dolára za milión tokenov.
  • V novej skúške obchádzania bezpečnostných hraníc (containment boundary) sa model o 85 % menej často pokúšal obísť nastavené obmedzenia ako Opus 5 alebo Claude Mythos 5.1, pričom každý pokus mal nízku závažnosť a model ho sám nahlásil.
  • Vyše tridsať firiem – medzi nimi GitHub, Stripe, Box, Deloitte Consulting, LexisNexis či Spotify – zverejnilo konkrétne čísla z vlastného testovania: úspory nákladov 40 až 60 %, menej krokov agenta na rovnakú úlohu, vyššia presnosť pri nižšej úrovni výpočtového úsilia.
  • Ide o prvý model Opus, ktorý štartuje s rovnakou triedou bezpečnostných opatrení ako Fable 5.1 v oblasti kybernetickej bezpečnosti, biológie a ochrany proti destilácii (distillation) – útoku, pri ktorom niekto tisíckami falošných účtov postupne vyťaží schopnosti modelu do vlastnej kópie bez bezpečnostných prvkov.

Bezpečnostná filozofia: „tempo, ktoré nechá bezpečnosť vpredu“

Anthropic oznámenie otvára odkazom na vyjadrenie svojho generálneho riaditeľa Daria Amodeia, ktorý týždeň pred vydaním modelu argumentoval, že rozvoj umelej inteligencie má mať také tempo, aby bezpečnostné postupy vždy predbiehali schopnosti modelov. Firma opisuje, že túto zásadu (v origináli „pacing the frontier“) chápe ako spôsob, ako zostať bezpečná, konkurencieschopná voči Číne a zároveň využiť prínosy umelej inteligencie, najmä v biológii a medicíne.

Podľa Anthropicu firma dnešným rizikám modelov z veľkej časti rozumie a dokáže ich riadiť. Vážnejšie riziká však podľa nej môžu vzniknúť rýchlo s rastom schopností, a firma preto pracuje na dvoch časových horizontoch súčasne: bezpečnostné postupy pre súčasné modely (rozsiahle testovanie súladu s hodnotami, predbežné hodnotenie externými organizáciami ako METR a Frontier Design, ochrany zodpovedajúce schopnostiam modelu v rizikových oblastiach ako kybernetická bezpečnosť a biológia) a príprava na budúce, výrazne schopnejšie modely – vrátane prísnejšieho filtrovania prostredí používaných pri posilňovanom učení, pretože chybné prostredia sú podľa firmy hlavným zdrojom nesúladného správania, a rozvoja techník interpretovateľnosti, ktoré by znížili závislosť od auditovania reťazca uvažovania, ktorý si model sám zapisuje počas práce.

Test obchádzania bezpečnostných hraníc

Anthropic v oznámení opisuje novú skúšku zameranú priamo na sklon modelu prekračovať nastavené hranice (containment boundaries). V nej sa Opus 5.5 pokúšal obísť tieto obmedzenia približne o 85 % menej často ako Opus 5 alebo Claude Mythos 5.1, pričom každý pokus, ku ktorému došlo, mal nízku závažnosť a model ho sám nahlásil. Pre firmy, ktoré nechávajú Claude bežať bez dohľadu naprieč vlastným kódom a systémami, ide podľa Anthropicu o rovnako dôležitý ukazovateľ ako čistý výkon.

Firma zároveň otvorene priznáva limity vlastného testovania: podľa jej nedávneho hodnotenia súladu správania zostáva zostavenie skúšok, ktoré spoľahlivo zachytia každé možné zlyhanie pred nasadením, nevyriešeným problémom. Anthropic uvádza, že Opus 5.5 často rozpozná, že je testovaný, čo komplikuje odhad, ako sa bude správať v reálnej prevádzke mimo testovacieho prostredia. S rastúcimi schopnosťami modelov a rozširujúcim sa okruhom ich nasadenia firma očakáva, že táto výzva porastie, ak sa nepodarí pokročiť v interpretovateľnosti modelov.

Tri nové triedy ochranných opatrení

Opus 5.5 je prvý model radu Opus, ktorý štartuje s rovnakou triedou bezpečnostných opatrení ako Fable 5.1 v troch oblastiach: kybernetická bezpečnosť, biológia a ochrana proti destilácii.

Kybernetická bezpečnosť. Keďže má Opus 5.5 podľa Anthropicu veľmi silné schopnosti v tejto oblasti, firma naň uplatňuje podobné obmedzenia ako pri Fable 5.1. Používatelia budú môcť identifikovať a opravovať chyby v kóde ako bežnú súčasť vývojového cyklu, väčšina úloh spojených s kybernetickou bezpečnosťou sa však automaticky presmeruje na starší model Opus 4.8. Pre obrancov v tejto oblasti firma rozširuje Cyber Verification Program o tri úrovne čoraz otvorenejšieho overeného prístupu vrátane prístupu k modelom radu Mythos.

Biológia. Model je podľa Anthropicu vysoko schopný v biológii, prekonáva Opus 5 a v mnohých oblastiach sa vyrovná alebo prekoná Claude Mythos 5.1. Firma ako príklad uvádza zlepšenie na dlhodobej úlohe predikcie a návrhu molekúl, vykonané v spolupráci s firmou Dyno Therapeutics, kde nezávislí hodnotitelia (red-teamers) ocenili vedeckú novosť výstupov ako porovnateľnú s najlepším modelom, aký doteraz testovali. Preto Opus 5.5 podlieha rovnakým bezpečnostným opatreniam ako Fable 5.1; overené organizácie (akademické laboratóriá, startupy, farmaceutické firmy) môžu požiadať o prístup cez Life Sciences Verification Program.

Ochrana proti destilácii. Destilačný útok podľa Anthropicu spočíva v tom, že útočník pomocou tisícok falošných účtov postupne vyťaží schopnosti modelu a vytvorí jeho kópiu bez bezpečnostných prvkov, čo vytvára bezpečnostné aj národnobezpečnostné riziká. Opus 5.5 štartuje s opatrením „preserved thinking“, prvýkrát zavedeným pri Fable 5.1, ktoré používateľom API znemožňuje upravovať skorší kontext modelu v snahe vyťažiť jeho vnútorné uvažovanie. Opatrenie platí pre API účty založené od 31. 8. 2026.

Model je dostupný s rovnakou politikou nulového uchovávania dát (zero data retention) ako predchádzajúce modely Opus, obsahuje vodoznaky kvôli súladu s AI Actom EÚ (rovnako ako Fable 5.1) a už nie je možné prevádzkovať ho s vypnutým režimom „myslenia“.

Čo model dokáže: konkrétne čísla od zákazníkov

Anthropic k oznámeniu pripojil vyše tridsať citácií od firiem, ktoré mali k modelu prístup ešte pred vydaním. Väčšina z nich hovorí v rovnakom duchu: porovnateľná alebo lepšia presnosť, ale za výrazne menej krokov, tokenov a času.

Vybrané referencie zákazníkov (zdroj: Anthropic)

FirmaZistenie
GitHubV testoch cez GitHub Copilot CLI a VS Code vyriešil viac terminálových úloh ako Opus 5, a to na menej ako polovicu krokov.
StripePri viacdňovom preskladaní 40 nadväzujúcich pull requestov zvládol celú úlohu v jednej dlhej relácii; všetkých 40 requestov prešlo kontrolou CI nasledujúce popoludnie.
LovableDokončuje zostavenie aplikácií na tretinu až polovicu krokov oproti skoršiemu modelu, s rovnakou kvalitou výstupu.
QuantiumÚloha, ktorá predtým trvala 38 promptov počas štyroch dní, sa skrátila na 11 promptov za tri hodiny, s výstupmi bližšími k výslednému nasadeniu.
OptiverNa sade agentových programátorských úloh dosiahol rovnakú kvalitu ako Opus 5 pri približne polovici krokov, času a výstupných tokenov, čo znížilo náklady na danú úlohu o 40 až 50 %.
BoxVo vlastných testoch spotreboval tretinu tokenov oproti Opus 5, odpovede boli o 40 % menej rozvláčne bez straty presnosti.
Deloitte ConsultingAj na najnižšej úrovni výpočtového úsilia zachytil 72 % známych chýb pri kontrole kódu oproti 56 % pri Opus 5 na vysokej úrovni úsilia, s menším počtom falošných poplachov.
HebbiaNa finančných úlohách hodnotených podľa expertných kritérií pokryl 86,6 % požadovaného rozsahu oproti 60,3 % pri Opus 5.
Walleye CapitalV hodnotiacej sade firmy sám odhalil chybu vo vlastnom zadaní inštrukcií (posun v indexovaní o jednu minútu) a opravil ju – žiadny skorší model túto chybu nezachytil.

Ako model premýšľa nad dátami: príklad z testu sledovania zásielok

Anthropic v oznámení opisuje test od zákazníka Hex, súčasť ich benchmarku DataBench, ktorý sa pýta, či boli zásielky doručené neskoro, alebo bolo len sledovanie zásielky pomalé. Opus 5 skontroloval potvrdenia o doručení a označil sledovací systém za funkčný. Opus 5.5 zistil, že zásielky boli skutočne neskoro a sledovací systém bol navyše pokazený – teda že model išiel za prvú prijateľne vyzerajúcu odpoveď a overil obe možné vysvetlenia zvlášť. Firma Hex ho podľa citácie práve preto zaraďuje do svojho agenta.

Test vymyslených faktov: report o štvrťročných výsledkoch

V ďalšom internom teste Anthropic zadal modelom Opus 5.5, Fable 5.1 a Opus 5 napísať správu o štvrťročných výsledkoch firmy len na základe informácií dohľadateľných na kópii webu, kde bolo tlačové oznámenie výsledkov zámerne ťažko nájditeľné. Automatický hodnotiteľ následne overil každé číslo a citáciu voči zdrojom. Naprieč rôznymi úrovňami výpočtového úsilia prešlo kontrolou kvality 16 z 18 reportov od Opus 5.5, pričom akékoľvek vymyslené číslo alebo citácia by report vyradili. Ani Fable 5.1, ani Opus 5 v žiadnom pokuse túto latku neprekonali.

Porovnanie štýlu písania: reálny príklad vysvetlenia chyby

Anthropic zverejnil porovnanie, ako rovnaký nájdený bug vysvetľujú Opus 5 a Opus 5.5. Opus 5 opisuje problém ako sled technických detailov a úryvkov kódu bez zhrnutia na začiatku. Opus 5.5 tú istú chybu (chybné zahrnutie posledného dňa mesiaca do fakturačného obdobia kvôli chybe v refaktoringu) otvára jednou vetou zhŕňajúcou dopad – koľko peňazí to firmu stojí a odkiaľ presne problém pochádza – a až potom rozvádza technické detaily. Podľa Anthropicu je to dôsledok širšej zmeny komunikačného štýlu modelu: najdôležitejšiu informáciu radí na začiatok, menej používa žargón a svojrázne obraty a lepšie dodržiava zadané pravidlá písania. Firma Ramp v citácii uvádza, že objemný a ťažko sledovateľný výstup bol jej najväčšou frustráciou s doterajšími špičkovými modelmi a Opus 5.5 to rieši.

Ceny a dostupnosť

Porovnanie cien (zdroj: Anthropic)

UkazovateľOpus 5.5Opus 5
Čítanie z cache (za milión tokenov)0,20 $0,50 $
Vstupné tokeny (za milión)4 $5 $
Výstupné tokeny (za milión)20 $25 $
Zápis do cache (za milión)5 $6,25 $

Rýchly režim (fast mode) je dostupný v Claude Code a na Claude Platform s až 2,5-násobnou rýchlosťou, za 8 dolárov za milión vstupných a 40 dolárov za milión výstupných tokenov.

Model je dostupný na všetkých hlavných platformách vrátane Amazon Web Services, Google Cloud a Microsoft Azure, na Claude Platform pod označením claude-opus-5-5.

Čo to znamená v praxi

Pre firmy, ktoré Claude používajú na programátorské alebo agentové úlohy, prináša Opus 5.5 podľa zverejnených čísel dve veci naraz: nižšiu cenu za token a menšiu spotrebu tokenov na rovnakú úlohu vďaka adaptívnemu mysleniu. Opakovaným vzorcom naprieč referenciami zákazníkov je, že aj na najnižšej úrovni výpočtového úsilia model dosahuje porovnateľné alebo lepšie výsledky, než aké Opus 5 dosahoval na najvyššej úrovni – to je dôvod, prečo zákazníci hlásia úspory 40 až 60 % pri zachovaní alebo zlepšení presnosti.

Pre úlohy, na ktorých Opus 5.5 neuspeje ani na vyššej úrovni úsilia, zostáva k dispozícii drahší model Fable 5.1 určený na najnáročnejšie úlohy s dlhým neprerušovaným behom. Opus 5 zostáva v ponuke pre firmy, ktoré na ňom majú postavené existujúce aplikácie a chcú prechod najprv otestovať na známych prípadoch.

Časté otázky

Znamená „pacing the frontier“, že Anthropic spomaľuje vývoj modelov?

Podľa opisu v oznámení ide o zásadu, že bezpečnostné postupy majú predbiehať schopnosti modelov, nie o spomalenie vydávania produktov. Firma zároveň otvorene pracuje na dvoch líniách – zdokonaľovaní postupov pre súčasné modely a príprave na výrazne schopnejšie modely, pri ktorých dnešné opatrenia podľa vlastného vyjadrenia nemusia stačiť.

Čo znamená pokles pokusov o obchádzanie bezpečnostných hraníc o 85 %?

Ide o výsledok novej internej skúšky zameranej na sklon modelu prekračovať nastavené hranice svojho správania. Anthropic uvádza, že Opus 5.5 sa o tento druh správania pokúšal výrazne menej často ako Opus 5 alebo Claude Mythos 5.1, pričom všetky zaznamenané pokusy mali nízku závažnosť a model ich sám nahlásil.

Môžem Opus 5.5 použiť na úlohy z kybernetickej bezpečnosti?

Bežné opravy chýb v rámci vývojového cyklu áno. Väčšina úloh priamo spojených s kybernetickou bezpečnosťou sa však podľa Anthropicu automaticky presmeruje na starší model Opus 4.8, ak používateľ nemá overený prístup cez rozšírený Cyber Verification Program.

Čo je destilačný útok a prečo ho Anthropic rieši pri tomto modeli?

Ide o techniku, pri ktorej útočník pomocou veľkého počtu falošných účtov postupne vyťaží schopnosti modelu a poskladá z nich vlastnú kópiu bez bezpečnostných prvkov. Opus 5.5 proti tomu nasadzuje opatrenie „preserved thinking“, ktoré znemožňuje upravovať skorší kontext modelu s cieľom vyťažiť jeho interné uvažovanie; platí pre API účty založené od 31. 8. 2026.

Sú čísla o úsporách nákladov od zákazníkov nezávisle overené?

Nie, ide o citácie a čísla, ktoré firmy samy poskytli Anthropicu do jeho oznámenia na základe vlastného testovania, nie o nezávislý audit treťou stranou. Bezpečnostné hodnotenie modelu naproti tomu podľa Anthropicu prechádzalo aj externými organizáciami METR a Frontier Design.

Dá sa Opus 5.5 prevádzkovať s vypnutým režimom myslenia kvôli úspore nákladov?

Nie. Anthropic uvádza, že rovnako ako pri Fable 5.1 už nie je možné model prevádzkovať s vypnutým režimom „myslenia“ – úsporu tak zabezpečuje len nižšia predvolená úroveň výpočtového úsilia (adaptívne myslenie), nie jeho úplné vypnutie.

Zdroje

  • Anthropic: Introducing Claude Opus 5.5 (oficiálne oznámenie, 22. 9. 2026, vrátane System Card a zákazníckych referencií) – anthropic.com/claude-opus-5-5
  • The Rundown AI: Claude Opus 5.5 vs Opus 5 vs Fable 5.1: Which Model Should You Use? – app.therundown.ai/guides/claude-opus-5-5-vs-opus-5-vs-fable-5-1
  • Anthropic: Introducing Claude Opus 5 (24. 7. 2026) – anthropic.com/news/claude-opus-5
  • #anthropic
  • #claude
  • #opus
  • #opus 5.5
  • #ai

ČÍTAJTE ĎALEJ

Súvisiace články

Späť do noviniek →
AI a modely

OpenAI uviedol GPT-6 Sol a Luna: polovičná cena a menej chýb ako generácia 5.6

OpenAI 22. 9. 2026 rozšíril svoju najnovšiu generáciu modelov o dva menšie varianty: GPT-6 Sol a GPT-6 Luna. Dopĺňajú tak model GPT-6 Astra, ktorý firma vydala začiatkom mesiaca ako svoj najschopnejší model. Nové modely stoja polovicu ceny generácie 5.6 a podľa OpenAI robia výrazne menej vecných chýb. Oznámenie prišlo iba 90 minút po vydaní aktualizovanej verzie Opus 5.5 od konkurenčného Anthropicu – ukážka toho, ako tesne si obaja giganti momentálne konkurujú.

Redakce Lernety12 min čítania
AI a modely

Amazon zablokoval Muse od Mety. Vojna o agentové nákupy sa začala už skôr

V nedeľu večer začali používatelia AI agenta Muse od Mety pri pokuse nakúpiť na Amazone dostávať chybové hlásenie: prístup neautorizovaného AI agenta porušuje podmienky používania Amazonu. Nie je to prvý prípad, pretože Amazon už predtým žaloval Perplexity pre jej prehliadač Comet a zablokoval aj prístupy OpenAI. Zhrňujeme, čo sa stalo cez víkend, prečo na tom Amazonu záleží a ako vyzerá širší spor o to, kto bude AI agentom otvárať dvere k nákupu.

Redakce Lernety10 min čítania
AI a modely

Jev: nový model, ktorý nič nenapíše, len bude za vás rozhodovať

Firma TypeSafe AI, ktorú založil bývalý výskumník OpenAI a spoluautor ChatGPT a RLHF Diego Almeida, predstavila model s názvom Jev. Nejde o ďalšieho chatovacieho asistenta – Jev negeneruje text, ale na sadu otázok vracia štruktúrované rozhodnutie s pravdepodobnosťou a mierou istoty. Zhrňujeme, čo je o modeli k 20. 9. 2026 overené, výhradne podľa anglických zdrojov (MindStudio.ai, Flaviocopes.com, Experientiallabs.ai, Vercel.com).

Redakce Lernety15 min čítania