Uvnitř AI cyber-závodů: Mythos našel 27letou díru v OpenBSD, OpenAI reagoval za týden
27 let. Tak dlouho vydržela chyba v OpenBSD — systému, který má v bezpečnostní komunitě reputaci nejlépe auditovaného unixu planety — než ji Claude Mythos Preview v dubnu 2026 během interního testování našel. Během stejného běhu objevil Mythos další stovky zero-day zranitelností v operačních systémech, prohlížečích a kritické infrastruktuře. Mezi nimi CVE-2026-4747: 17 let staré dálkové vykonání kódu v implementaci NFS ve FreeBSD, které by útočníkovi umožnilo získat roota z libovolného bodu na internetu. Model Anthropic veřejnosti nedá. OpenAI o týden později spustil vlastní uzavřený cyber-model. Tento text je rozbor osmi dnů, které posunuly AI v kyberbezpečnosti do nového režimu — a toho, co to znamená pro české firmy pod NIS2.
TL;DR — Klíčová zjištění
- 7. 4. 2026 Anthropic zveřejnil Claude Mythos Preview: model, který autonomně našel tisíce zero-days v každém velkém OS a prohlížeči. Nejde do veřejného API — přístup pouze přes Project Glasswing (AWS, Apple, Cisco, CrowdStrike, Google, JPMorgan, Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks).
- 14. 4. 2026 OpenAI odpověděl modelem GPT-5.4-Cyber: fine-tuned varianta se sníženými refusal boundaries pro cyber úkoly, binary reverse engineeringem, analýzou malwaru. Dostupný přes Trusted Access for Cyber (TAC) pouze ověřeným odborníkům.
- Pro české firmy pod NIS2 to otevírá právní problém: „state-of-the-art" obrana existuje, ale 99 % organizací k ní nemá přístup. Co dělat mezitím — viz checklist a kalkulace na konci.
Navazující analýza (17. 4. 2026): Claude Opus 4.7: tichý zdražovák přes tokenizer — rozebírá, jak Anthropic dvoustupňovou distribucí „Mythos pro Glasswing, Opus 4.7 pro trh" osekal cyber capabilities u veřejně dostupného modelu, a co to znamená pro 33% refusal rate na legitimním bezpečnostním výzkumu.
Co se stalo: osm dnů chronologicky
Anthropic 7. 4. 2026 představil Claude Mythos Preview — nejpokročilejší model firmy s 93,9 % na SWE-bench Verified, 97,6 % na USAMO 2026 a 83,1 % na CyberGym benchmarku 1 507 reálných zranitelností. Během interního testování model autonomně objevil tisíce zero-day chyb v každém velkém operačním systému, prohlížeči a velké části kritického softwaru. Anthropic rozhodl model nezveřejnit — místo toho vzniká konsorcium Project Glasswing. 14. 4. 2026 OpenAI spouští GPT-5.4-Cyber, obdobně uzavřený.
7. dubna: Claude Mythos a Project Glasswing
V pondělí 7. dubna 2026 vydal Anthropic tři propojené dokumenty: oznámení Claude Mythos Preview, technický model card a Project Glasswing. Benchmarkové výsledky model staví na špici žebříčků v reasoning i v autonomním software engineeringu:
- SWE-bench Verified: 93,9 % — na autonomní opravu reálných GitHub issues. Pro srovnání: Opus 4.6 má kolem 77 %.
- USAMO 2026: 97,6 % — americká matematická olympiáda, úlohy na důkazy.
- CyberGym: 83,1 % — benchmark z Berkeley RDI, 1 507 reálných CVE ze 188 open-source projektů, úloha reprodukovat exploit pouze z popisu a kódové báze před patchem. Opus 4.6: 66,6 %.
Klíčovou novinkou ale nebyl benchmark. Během interní red-teamové kampaně Mythos autonomně objevil a exploitoval tisíce dosud neznámých zranitelností. Anthropic zmiňuje konkrétně:
- 27 let starou chybu v OpenBSD (již patchovanou po nálezu). OpenBSD má pověst nejlépe auditovaného unixu — projekt s formálním manuálním review každého commitu.
- CVE-2026-4747: 17 let starou RCE v implementaci NFS ve FreeBSD. Neautentizovaný útočník z internetu by získal roota na zasažených serverech.
- Funkční zero-day sekvence v každém velkém prohlížeči (Chrome, Firefox, Safari, Edge).
- Chyby v hypervizorech, mobilních OS a průmyslových řídicích systémech.
Druhou polovinu ohlášení tvořil Project Glasswing — konsorcium, které Mythos dostane k dispozici pro účely identifikace a opravy zranitelností v kritickém softwaru. Zakládající partneři: AWS, Apple, Cisco, CrowdStrike, Google, JPMorgan Chase, Linux Foundation, Microsoft, NVIDIA a Palo Alto Networks. Pro zbytek světa Mythos Preview nejde — ani přes API, ani přes Claude.ai, ani přes Bedrock. Přístup je explicitně vyhrazen a Anthropic uvádí ochranné důvody.
Okolo 10. dubna: nezávislá evaluace z UK AISI
V rámci pre-release red-teamingu proběhla nezávislá evaluace od britského AI Security Institute. Závěr: Mythos potvrzuje schopnosti, jež dosud existovaly pouze u lidských specialistů s letitou praxí. Zároveň ale institut označil několik limitů — halucinace CVE identifikátorů, brittleness u dlouhých řetězců kroků a omezená schopnost fuzzingu s vlastní heuristikou mimo již známé kategorie. AISI doporučilo neveřejné vydání.
14. dubna: OpenAI spouští GPT-5.4-Cyber
Přesně týden po Mythos OpenAI reagoval. 14. 4. 2026 zveřejnil blog post „Scaling Trusted Access for Cyber Defense" a s ním model GPT-5.4-Cyber. Jde o fine-tuned variantu GPT-5.4 se třemi hlavními odlišnostmi:
- Cyber-permissive refusals: model nezamítá legitimní úlohy typu „analyzuj tento payload", „vytvoř PoC pro CVE-X", „navrhni exploit pro interní red-team", které standardní GPT-5.4 často blokuje.
- Binary reverse engineering: model analyzuje zkompilované binární soubory — malware, firmware, uzavřený software — bez potřeby zdrojového kódu.
- Malware triage a analýza: klasifikace, identifikace rodiny, extrakce indikátorů kompromitace.
OpenAI současně rozšířil program Trusted Access for Cyber (TAC) z několika desítek partnerů na tisíce ověřených odborníků. Přístup získává jen jedinec nebo organizace, která projde identifikačním procesem na chatgpt.com/cyber — ověřují pracovní zařazení (penetration tester, SOC analytik, ISO/CISO role, akademický výzkum) a žádají o potvrzení od zaměstnavatele.
Proč se dva kroky OpenAI a Anthropic tolik podobají
Ani jeden model nejde do veřejného API. Oba mají gatekeeping — jeden přes konsorcium velkých firem (Glasswing), druhý přes individuální ověření (TAC). To je podstatný odklon od strategie posledních let, kdy se frontierové schopnosti dříve nebo později objevily v ChatGPT i v Claude.ai pro kohokoliv s platební kartou.
Proč to najednou: skok schopností AI v cyberu za 21 měsíců
Mezi srpnem 2025 a dubnem 2026 se schopnost AI modelů v cybersecurity úlohách ztrojnásobila. GPT-5 měl 27 % na OpenAI Capture-the-Flag benchmarku. GPT-5.1-Codex-Max o tři měsíce později 76 %. Claude Mythos v dubnu 2026 dosáhl 83,1 % na podstatně tvrdším CyberGym. Za tímto skokem stojí kombinace zralejších reasoning modelů, delšího kontextu pro autonomní akce a cíleného fine-tuningu na datech z bug bounty programů.
| Model | Datum | Benchmark | Skóre | Veřejný přístup |
|---|---|---|---|---|
| GPT-4o | Q3 2024 | CTF (OpenAI) | ~14 % | ✓ |
| GPT-5 | 8/2025 | CTF | 27 % | ✓ |
| GPT-5.1-Codex-Max | 11/2025 | CTF | 76 % | ✓ |
| Claude Opus 4.6 | Q1 2026 | CyberGym | 66,6 % | ✓ |
| Claude Mythos Preview | 4/2026 | CyberGym | 83,1 % | ✗ (Glasswing) |
| GPT-5.4-Cyber | 4/2026 | CTF + reverse eng. | neoznámeno | ✗ (TAC) |
Proč skok ze 14 % na 83 % za zhruba 21 měsíců? Tři pohyby se složily do jednoho. Zaprvé reasoning: modely typu GPT-5 nebo Opus 4 zvládnou několikahodinový plán–kroky–verifikaci, což je přesně styl práce penetration testera. Zadruhé delší kontextové okno a trvalá paměť: model drží v hlavě celou kódovou bázi projektu, ne jen jeden soubor. Zatřetí cílený fine-tuning na cyber datech — Anthropic i OpenAI potvrdily, že vedle veřejných benchmarků trénovaly na datech z HackerOne, Google OSS-Fuzz a z vlastních interních red-teamů.
Výsledek: AI se přiblížila ke stropu lidských specialistů u reprodukce známých tříd chyb. U netypických vektorů, custom protokolů a non-memory-safety bugů zatím zaostává — o tom více v sekci o limitech.
Důležité upřesnění — „prý" a „údajně"
Několik čísel v této části se opírá o souhrn od třetích stran (VentureBeat, The Hacker News), nikoliv o ověřený původní whitepaper. Přesné CyberGym podskóre Mythos napříč jednotlivými kategoriemi Anthropic ke dni publikace neuvolnil. Stejně tak OpenAI neoznámil skóre GPT-5.4-Cyber na žádném veřejném benchmarku — veřejně uvádí jen progresi původní rodiny GPT-5.x.
Kdo z toho co vytěží: vítězové, poražení, slepé body
Za každou takovou událostí stojí skupina s vyhraněnými zájmy. Vyplatí se je rozlišit.
Vítězové
- Anthropic: posílil enterprise narrativ „bezpečná AI pro kritickou infrastrukturu". Zároveň nabídl 10 nejvýznamnějším dodavatelům IT na planetě páku, kterou dosud neměli — přednostní obranu před útoky, které AI objevuje. To má cenu, kterou nelze ocenit API minutami.
- OpenAI: nemohl si dovolit zůstat stranou. Reakce do sedmi dnů znamená, že interní pipeline byla připravená — pravděpodobně GPT-5.4-Cyber existoval jako projekt paralelně s Mythos. Trusted Access for Cyber dává OpenAI řízený kanál k tisícům security profesionálů, což je kvalitní enterprise lead funnel.
- Partneři Glasswing: získávají 3–6měsíční předstih v obraně vlastní kritické infrastruktury. Pro JPMorgan to znamená reálnou ochranu tradingových systémů. Pro Linux Foundation průchozí kanál fixů do upstreamu.
- Specializovaní pen-testeři s TAC přístupem: skokově zvyšují produktivitu. Jeden senior konzultant s GPT-5.4-Cyber nahradí tým tří juniorů — pokud firma projde ověřením.
Prohrávající a nejistí
- Bug bounty platformy (HackerOne, Bugcrowd): pokud Glasswing identifikuje a patchne chyby v upstreamu dříve, poklesnou výplaty. Hunteři to už diskutují na HackerNews a r/netsec.
- Malé a střední antivirové firmy bez Glasswing přístupu: ESET, Avast/Gen Digital, GreyCortex, Whalebone. Všechny české bezpečnostní vendory jsou mimo konsorcium. V reakci na Mythos avizují vlastní AI pipeline, ale přístup ke srovnatelnému modelu zatím nemají.
- Open-source projekty: částečně výhodu (Linux Foundation je partner, tedy fixy půjdou do jádra), částečně nevýhodu (menší projekty mimo rámec Linuxu nebo BSD nemají proaktivní audit).
- 99 % evropských firem včetně českých: mimo kruh, bez přímého přístupu, ale pod NIS2 požadavkem „state-of-the-art".
Co tomu odporuje: tři skeptické hlasy
Narativ „AI dospělá k nejbezpečnější obraně historie" má tři vážné protipohledy. Zaslouží si pozornost, protože všechny tři pocházejí z odborného prostředí, ne z klickbaitu.
AISI: jagged frontier, ne plná autonomie
Britský AI Security Institute v evaluaci z dubna 2026 vyzdvihl dvě konkrétní slabiny. Zaprvé halucinace CVE identifikátorů: Mythos občas uvede kombinaci čísel, která v NVD neexistuje, a smíchá ji s reálným popisem. To není destruktivní u interního red-teamu s verifikací, ale u automatizovaných SOC pipeline by vedlo k falešným ticketům. Zadruhé brittleness u dlouhých řetězců: 10+ krokové sekvence s postranním nákladem (navigace v souborovém systému, komunikace se service mesh) selhávají ve 15–25 % případů v závislosti na úloze.
Podrobnější rozbor limitů obecných AI reasoning modelů najdete v článku AI halucinace: Proč AI lže a jak ověřit každý výstup. Pravidla ověření tam popsaná platí i pro bezpečnostní výstupy — nepotvrzený nález je pouze hypotéza.
AISLE: excelentní v reprodukci, horší v invenci
Bezpečnostní firma AISLE ve vlastním rozboru upozornila, že CyberGym měří reprodukci historických CVE z OSS-Fuzz — tedy převážně memory safety chyb a web vuln tříd, které jsou v trénovacích datech husté. U netypických vektorů (custom protokoly, industrial control systems, embedded firmware, novotné mikroarchitekturní postranní kanály) Mythos pravděpodobně sklouzne na úroveň, která je podstatně nižší. Zkrátka: 83,1 % CyberGym ≠ 83,1 % na libovolné cyber úloze. AISLE označuje tento stav jako „jagged frontier" — velmi vysoké špičky, ale mezi nimi hluboká údolí.
Asymetrie útočník vs. obránce
Konečný protinarativ přichází od Security Boulevard a od celé řady komentátorů: útočníci získají srovnatelné nástroje rychleji, než je obránci dokážou nasadit. Open-source modely (Llama 4.5, DeepSeek-V3, Qwen 3) se už nyní fine-tunují na cyber datech. Leak vah Mythos by scénář uzavřel okamžitě — jeden účet s přístupem stačí, aby se váhy dostaly ven. Historie leaků v AI je přitom netriviální: LLaMA 1, Llama 3 early-checkpoint i některé proprietární weights se v letech 2023–2025 objevily na torrentech do týdnů od interního testování.
Paradox gatekeepingu
Každý den, kdy Mythos existuje jen uvnitř Glasswing, je dnem asymetrie ve prospěch konsorcia. Jakmile ale srovnatelný open-source model dorazí — otázka měsíců, ne let — asymetrie se obrací. Obránce má patchnutou díru, útočník má nástroj k nálezu deseti dalších. Debata, zda Glasswing urychluje nebo zpomaluje tuto konvergenci, je jádrem současného sporu.
Co to znamená pro Česko: NIS2, NÚKIB a praktická kalkulace
České firmy pod NIS2 (zhruba 6 000 subjektů) mají povinnost implementovat „state-of-the-art" kybernetická opatření a notifikovat vážné incidenty do 24 hodin. Mythos a GPT-5.4-Cyber jsou prvními modely, u kterých regulátor může argumentovat, že představují nový standard obrany. Zároveň ale 99 % českých firem k nim nemá přístup. Kombinace těchto dvou faktů vytváří právní a provozní prostor, který žádný český metodický dokument zatím neřeší.
NIS2 a „state-of-the-art" argument
Český zákon o kybernetické bezpečnosti (novelizovaný podle NIS2, účinnost 10/2024 s postupnou vynutitelností do 2026) ukládá povinným subjektům zavést opatření odpovídající aktuálnímu stavu techniky. Formulace „state-of-the-art" je pružná — regulátor ji interpretuje kombinací mezinárodních norem (ISO/IEC 27001, ENISA doporučení) a dostupné praxe v oboru.
Otevřená otázka: patří AI-augmented vulnerability management na úroveň Mythos / GPT-5.4-Cyber do „state-of-the-art"? Tři argumenty pro: ukazují dosud nedosažené schopnosti, adoptují je největší vendoři kritické infrastruktury, AISI je uznala za tech-level frontierový. Tři argumenty proti: nejsou veřejně dostupné, nejsou zatím dokumentované v žádné normě, přesnost v reálných incidentech není veřejně ověřená.
NÚKIB v roce 2026 připravuje metodický dopis k AI v ochraně před kybernetickými hrozbami. Jeho načasování a formulace budou klíčové — NÚKIB může Glasswing označit za mezník a tím vyhrotit NIS2 interpretace, nebo zvolit konzervativní linii „dokud to není v ISO, není to SOTA".
Praktický důsledek pro compliance tým
Do vydání metodiky NÚKIB doporučují zkušení auditoři dokumentovat, že organizace aktivně sleduje vývoj AI v bezpečnosti, má plán adopce (přes MSSP s přístupem nebo přes Glasswing partner vendory) a má kompenzační opatření (zvýšená frekvence pen-testů, nasazení EDR s AI komponentou). Pokud NÚKIB později začne vymáhat AI detekci, tato dokumentace bude klíčová.
Přímý dopad na český software
Dvě oblasti mají okamžitou praktickou relevanci:
- FreeBSD / OpenBSD servery v ČR: CESNET, některé VPSka v DataGridu, NAS systémy založené na TrueNAS (který běží na FreeBSD) a specializované firewally. CVE-2026-4747 (17letá RCE v NFS FreeBSD) musí být patchnutá okamžitě. Kdo spravuje takové stroje: zkontrolovat verzi, aplikovat fix. Patch je součástí FreeBSD 14.2 a dodatečně byl backportován do 13.4.
- České webové aplikace s cookies session managementem: součástí Mythos nálezů byly chyby v parsingu cookies napříč prohlížeči. Pokud aplikace spoléhá na nestandardní atributy nebo na chování prohlížeče před patchi, otestovat proti aktuálním verzím Chrome/Firefox/Safari. Souvisí to s běžnými problémy, které detailně rozebírá článek o prompt injection bezpečnosti.
Kalkulace: kolik NIS2 compliance s AI a bez
Hrubá ekonomika pro modelového středně velkého českého subjektu (200 zaměstnanců, regulovaný NIS2):
| Položka | Dosavadní model | S AI (Glasswing/TAC) | Bez přístupu k AI |
|---|---|---|---|
| EDR / antimalware | 500 tis. Kč | 500–800 tis. Kč (AI modul) | 500–600 tis. Kč |
| SIEM / log mgmt | 600 tis. Kč | 700 tis. Kč | 650 tis. Kč |
| Penetrační testy (2×/rok) | 400–600 tis. Kč | 200–300 tis. Kč (AI-augmented) | 500–800 tis. Kč |
| Vulnerability management | 300 tis. Kč | 150 tis. Kč | 350–500 tis. Kč |
| SOC / monitoring (sdílený MSSP) | 600 tis. Kč | 700–900 tis. Kč | 700–1 000 tis. Kč |
| Školení a audit | 200 tis. Kč | 200 tis. Kč | 250 tis. Kč |
| Součet | ~2,6 mil. Kč | ~2,5–3,1 mil. Kč | ~3,0–3,5 mil. Kč |
Dvě pozorování. Zaprvé, firmy s přístupem k AI cyber-nástrojům ušetří na penetračních testech a vulnerability managementu, zatímco zaplatí mírně víc za EDR s AI modulem. Součet vychází srovnatelně s dosavadním stavem, někdy mírně níže. Zadruhé, firmy bez přístupu musí kompenzovat — častější externí pen-testy, silnější vulnerability scanning, větší sdílený SOC — a dostanou se 15–20 % nad dosavadní rozpočet.
Náklady na samotné AI licence (TAC cena v publikovaných zdrojích chybí) budou předmětem dalších kol jednání. Některé leaky (zatím nepotvrzené) mluví o tarifech srovnatelných s enterprise GPT-5.4 ceníkem. Detailněji o struktuře nákladů AI API popisuje článek Náklady na AI API: Jak nekrvácet na tokenech.
Co musí platit, aby Glasswing skutečně fungoval: 6 podmínek
Narativ „uzavřené AI chrání všechny" stojí na řetězci předpokladů. Pokud kterýkoliv selže, logika se hroutí. Následující framework slouží jako test, který lze aplikovat na libovolný podobný program.
- Model musí být aspoň 2× přesnější než paralelní open-source alternativa. Jinak obrana ztrácí předstih proti útočníkům.
- Konsorcium musí sdílet nálezy rychleji než potenciální leak. Průměrný čas od identifikace po patch distribuovaný do upstream repozitářů musí být pod dobou, za kterou se srovnatelný model dostane veřejně.
- Downstream-fix channel pro malé subjekty musí existovat. Pokud velcí vendoři nezařadí nálezy do bezpečnostních updatů svých produktů, fixy se k 99 % firem vůbec nedostanou.
- Váhy modelu nesmí uniknout. Historicky je to otázka 6–18 měsíců u libovolného modelu s významnou hodnotou; Mythos bude cílem.
- Regulátor (NÚKIB, ENISA, NIST) musí uznat „gatekept AI" za kompatibilní s NIS2 / EU AI Act. Jinak firmy bez přístupu dostanou právní pokuty za nedodržení SOTA.
- Útočníci nezískají ekvivalentní nástroj do 12 měsíců. Platí pouze pokud 1–5 pokračují bez závažného selhání.
K dubnu 2026 jsou body 1 a 5 otevřené (neveřejné), bod 2 částečně splněn (Anthropic uvádí průběžné CVE fix cykly s Linux Foundation), bod 3 nedefinován, bod 4 závisí na provozní bezpečnosti Anthropicu a partnerů, bod 6 je empirická otázka dalších 6–12 měsíců.
Co sledovat dál: šest signálů příštích šesti měsíců
Pokud se Glasswing osvědčí, příběh dostane trajektorii. Pokud selže, příběh se zvrtne. Následující signály jsou konkrétní pointery, které stojí za sledování.
- Počet veřejně zpracovaných CVE z Glasswing. Anthropic uvedl, že pravidelně zveřejní souhrn nalezených a opravených chyb. První reporting kvartálu je avizován na červenec 2026.
- Rozšíření Glasswing o evropské partnery. Přidání ENISA, BSI (Německo) nebo ANSSI (Francie) by změnilo regulační dynamiku v EU.
- Vydání NÚKIB metodického dopisu k AI v bezpečnosti. Pokud bude obsahovat explicitní zmínku o gatekept AI modelech, bude to první evropský regulační dokument tohoto typu.
- První open-source Mythos-level model. Nejbližší kandidáti: DeepSeek-V4, Qwen 3.5, Llama 4.5. Odhadované okno: Q3–Q4 2026.
- Leaky o Opus 4.7 / Claude Studio (viz dřívější analýza shadow AI a související interní dokumenty Anthropicu) naznačují, že Anthropic bude brzy posouvat i ne-cyber frontier model. Vztah Mythos ↔ Opus 4.7 bude klíčový pro strategii.
- Hypotetický leak vah Mythos nebo GPT-5.4-Cyber. Je to scénář, který by Glasswing ze dne na den znehodnotil. Sledovat: torrenty na scraper sítích, zveřejnění na HuggingFace mirror účtů, diskuze na 4chan /g/ a na r/LocalLLaMA.
- Foundation modely v průmyslu jako paralelní pattern. Stejně jako Mythos v cyber, posunul Google DeepMind + Boston Dynamics s Gemini Robotics-ER 1.6 ve Spotovi hranici autonomie v průmyslové inspekci (23 → 93 % u čtení manometrů). Oba případy ukazují stejnou dynamiku: prudký skok schopnosti, úzký pás úloh, kde funguje, a řízené nasazení přes vybrané partnery.
7 kroků pro české firmy teď
- Zmapujte, kde provozujete OpenBSD / FreeBSD — zkontrolujte patch stav proti CVE-2026-4747 a souvisejícím záznamům.
- Aktualizujte prohlížeče na nejnovější verze (Chrome 135+, Firefox 136+, Safari 18.3+, Edge 135+) napříč firemními stroji.
- Zvedněte frekvenci penetračních testů, pokud firma pod NIS2 zatím neplánuje adopci AI-augmented security.
- Dokumentujte plán adopce AI v bezpečnosti — aktivní sledování Glasswing / TAC, kompenzační opatření, časový horizont.
- Pokud spolupracujete s MSSP, zeptejte se, jestli usiluje o přístup do TAC programu OpenAI a jaký je časový plán.
- Vytvořte interní policy pro použití veřejných AI nástrojů v bezpečnostních úlohách — viz shadow AI governance.
- Sledujte NÚKIB metodiku — očekávaná 2. pololetí 2026.
Často kladené otázky
Co je Claude Mythos a čím se liší od běžného Claude Opus?
Claude Mythos Preview je nejpokročilejší model Anthropicu zveřejněný 7. 4. 2026. Oproti Claude Opus 4.6 dosahuje podstatně lepších výsledků v reasoning úlohách (97,6 % USAMO 2026), autonomním software engineeringu (93,9 % SWE-bench Verified) a v kyberbezpečnosti (83,1 % CyberGym). Klíčový rozdíl ale není v benchmarcích — Anthropic se rozhodl Mythos nezveřejnit ani přes API, ani přes Claude.ai. Přístup je vyhrazen pouze partnerům Project Glasswing.
Co je GPT-5.4-Cyber a jak k němu získat přístup?
GPT-5.4-Cyber je fine-tuned varianta GPT-5.4 představená OpenAI 14. 4. 2026. Má sníženou míru odmítnutí u legitimních cyberbezpečnostních úloh (ofenzivní i defenzivní), umí binary reverse engineering a analyzovat malware. Přístup je vyhrazen účastníkům programu Trusted Access for Cyber (TAC). Jednotlivec ověří identitu na chatgpt.com/cyber (pracovní zařazení, potvrzení zaměstnavatele), organizace žádá přes svého OpenAI kontaktního zástupce.
Jak funguje Project Glasswing?
Project Glasswing je konsorcium deseti zakládajících organizací (AWS, Apple, Cisco, CrowdStrike, Google, JPMorgan, Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks), které získaly přístup k Claude Mythos Preview výhradně pro účely identifikace a opravy zranitelností v kritickém softwaru. Anthropic program koordinuje, partneři hlásí nálezy zpět do upstream repozitářů a bezpečnostních updatů svých produktů. Program byl oznámen 7. 4. 2026.
Může česká firma k těmto modelům získat přístup?
Přímý přístup mají pouze partneři Glasswing, žádný český subjekt mezi nimi není. U GPT-5.4-Cyber je dostupnost širší — každý ověřený security profesionál se zaměstnavatelem v cyber oboru může požádat přes chatgpt.com/cyber. Pro firmy pod NIS2, které nesplňují kritéria ověření, zbývají kompenzační opatření: spolupráce s MSSP s přístupem, pravidelné pen-testy, aktivní monitoring dostupnosti evropských variant programu.
Co NIS2 vyžaduje ve světle těchto modelů?
NIS2 (v ČR implementovaný novelou zákona č. 181/2014 Sb., účinnost 10/2024 s postupnou vynutitelností) vyžaduje opatření odpovídající „aktuálnímu stavu techniky" (state-of-the-art). Zda Mythos a GPT-5.4-Cyber spadají pod tento pojem, není jednoznačné — regulátor (NÚKIB) zatím neaktualizoval metodiku. Doporučený postup: dokumentovat aktivní sledování vývoje, mít plán adopce a kompenzační opatření pro období, než bude AI detekce dostupnější.
Zdroje
- Anthropic — Claude Mythos Preview, oficiální blog, 7. 4. 2026: anthropic.com/news/claude-mythos-preview
- Anthropic — Project Glasswing: Securing critical software for the AI era: anthropic.com/glasswing
- Anthropic Red — Claude Mythos Preview technical deep-dive: red.anthropic.com/2026/mythos-preview
- OpenAI — Scaling Trusted Access for Cyber Defense, 14. 4. 2026: openai.com/index/scaling-trusted-access-for-cyber-defense
- UK AI Security Institute — Our evaluation of Claude Mythos Preview's cyber capabilities: aisi.gov.uk/blog/our-evaluation-of-claude-mythos-previews-cyber-capabilities
- Bloomberg — OpenAI Releases Cyber Model to Limited Group in Race With Mythos, 14. 4. 2026: bloomberg.com/news/articles/2026-04-14/openai-releases-cyber-model-to-limited-group-in-race-with-mythos
- TechCrunch — Anthropic debuts preview of powerful new AI model Mythos in new cybersecurity initiative, 7. 4. 2026: techcrunch.com/2026/04/07/anthropic-mythos-ai-model-preview-security
- The Hacker News — Anthropic's Claude Mythos Finds Thousands of Zero-Day Flaws Across Major Systems: thehackernews.com/2026/04/anthropics-claude-mythos-finds.html
- SiliconANGLE — OpenAI launches GPT-5.4-Cyber model for vetted security professionals, 14. 4. 2026: siliconangle.com/2026/04/14/openai-launches-gpt-5-4-cyber-model-vetted-security-professionals
- eWeek — OpenAI Debuts GPT-5.4-Cyber, a Locked-Down AI Model for Cyber Defense: eweek.com/news/openai-gpt-5-4-cyber
- VentureBeat — Mythos autonomously exploited vulnerabilities that survived 27 years of human review: venturebeat.com/security/mythos-detection-ceiling-security-teams-new-playbook
- Zvi Mowshowitz — Claude Mythos #2: Cybersecurity and Project Glasswing: thezvi.substack.com/p/claude-mythos-2-cybersecurity-and
- AISLE — AI Cybersecurity After Mythos: The Jagged Frontier: aisle.com/blog/ai-cybersecurity-after-mythos-the-jagged-frontier
- Security Boulevard — AI Could Trigger a Zero-Day Exploit Tsunami: securityboulevard.com/2026/04/saturday-security-ai-could-trigger-a-zero-day-exploit-tsunami
- arXiv 2506.02548 — CyberGym: Evaluating AI Agents' Real-World Cybersecurity Capabilities at Scale: arxiv.org/abs/2506.02548
- NÚKIB — NIS2 implementace, metodické dokumenty: nukib.cz