Aktualności, narzędzia i prawo AIPolska · codziennie
Narzędzia

Cyber Verification Program: trzy poziomy dostępu do Mythos

Anthropic łączy Project Glasswing i Cyber Verification Program w jedną ofertę z trzema poziomami dostępu. Zespoły bezpieczeństwa mogą wnioskować o Mythos 5.1.

Kobieta z krótkimi siwymi włosami i brodaty mężczyzna analizują na monitorach graf sieci i okna terminala w biurze z ceglanymi ścianami i widokiem na stare miasto, na stole leży lista kontrolna i klucz sprzętowy
Ilustracja redakcyjna dailyAI

Anthropic ogłosił 6 października 2026 roku nową wersję Cyber Verification Program (CVP). Program daje zweryfikowanym zespołom bezpieczeństwa dostęp do modeli Claude z łagodniejszymi blokadami w zadaniach cybernetycznych, w tym do Claude Mythos 5.1, Opus 5.5 i Sonnet 5.5. Zamiast jednego progu są teraz trzy poziomy: Defense Access dla obrońców, Red Team Access dla autoryzowanych testów penetracyjnych i Specialized Access dla podmiotów testujących systemy krytyczne. Udział w programie jest bezpłatny, ale wymaga weryfikacji, zabezpieczeń konta i przechowywania danych przez Anthropic.

Co zmienia nowy Cyber Verification Program

Ogólnie dostępne modele Anthropic, takie jak Claude Opus 5.5, Fable 5.1 i Sonnet 5.5, mają zachowawcze zabezpieczenia, które blokują większość prac ofensywnych w cyberbezpieczeństwie. Firma uzasadnia to tym, że te same umiejętności pomagają obrońcy znaleźć lukę, a napastnikowi ją wykorzystać. Bez dodatkowej weryfikacji model nadal może przeglądać kod, łatać znane błędy, szukać podatności we własnym kodzie źródłowym i porządkować alerty bezpieczeństwa.

Przez ostatnie pół roku szerszy dostęp zapewniały dwa osobne programy. Project Glasswing dawał Claude Mythos organizacjom zabezpieczającym najważniejsze oprogramowanie, a CVP obniżał blokady w modelach Opus i Sonnet dla sprawdzonych zespołów. Teraz oba programy połączono w jedną ofertę z trzema progami, a każdy próg obejmuje najmocniejsze modele, w tym Mythos 5.1 i przyszłe wydania.

Trzy poziomy dostępu i kto się kwalifikuje

Poziomy różnią się zakresem dozwolonych prac, wymogami weryfikacji i kontrolami bezpieczeństwa. Zestawienie poniżej opracowaliśmy na podstawie komunikatu Anthropic i artykułu w centrum pomocy.

  • Defense Access - prace obronne: centrum operacji bezpieczeństwa (SOC), reagowanie na incydenty, inżynieria wsteczna złośliwego oprogramowania, analiza i walidacja podatności. Mogą się zgłosić zespoły bezpieczeństwa firm, uczelni, organizacji non-profit i administracji, operatorzy infrastruktury krytycznej dowolnej wielkości, mniejsze firmy z branży, opiekunowie projektów open source i badacze z historią zgłoszonych luk. Dostępny także dla osób na płatnych planach.
  • Red Team Access - wszystko z poziomu Defense oraz autoryzowane testy penetracyjne i red teaming, czyli symulowane ataki na systemy, do których testowania organizacja ma zgodę. Tylko dla organizacji, np. wewnętrznych zespołów red team i firm pentesterskich. Blokady w czasie rzeczywistym nadal obejmują działania grożące szkodą fizyczną lub masowymi zakłóceniami, np. wdrażanie ransomware.
  • Specialized Access - najmniej blokad, dla wąskiej grupy organizacji uprawnionych do testowania systemów, od których zależy życie ludzi lub działanie rynków: sterowania lotami, sieci energetycznych, telekomunikacji, rozliczeń międzybankowych i sieci administracji. Każdą organizację Anthropic sprawdza obecnie we współpracy z rządem USA. Dotychczasowi członkowie Project Glasswing trafiają tu bez ponownej weryfikacji.

Jak działają blokady według testów Anthropic

Anthropic sprawdził skuteczność progów na Claude Opus 5.5 w teście CyScenarioBench, który mierzy, czy model potrafi zaplanować i przeprowadzić wieloetapową operację cybernetyczną. Każde z 10 zadań powtórzono pięć razy na każdym poziomie. Bez dostępu do CVP wszystkie próby zostały zablokowane już przy pierwszym poleceniu.

Na poziomie Defense blokada zadziałała w 46 z 50 prób, a cztery zadania zakończyły się sukcesem. Na poziomie Red Team nie było żadnej blokady i model wykonał 34 z 50 zadań. Według firmy odpowiada to 67,6 proc. skuteczności modelu bez zabezpieczeń, czyli wynikowi reprezentatywnemu dla Specialized Access. To pomiar przeprowadzony przez samego producenta, bez niezależnej weryfikacji.

Wymagania: retencja danych i zabezpieczenia konta

Uczestnicy programu muszą zgodzić się na przechowywanie danych przez Anthropic, aby firma mogła wykrywać nadużycia. Klienci, którzy mają już dostęp do Fable 5.1 lub Mythos 5.1 z zerową retencją danych (zero data retention), mogą korzystać z CVP na tych samych zasadach. Później tej jesieni ma ruszyć Enterprise Frontier Safeguards, rozwiązanie pozwalające trzymać dane w chmurze kontrolowanej przez klienta.

Wniosek składa się przez portal weryfikacyjny Anthropic, podając dane organizacji, opis prac i oświadczenie o wdrożonych kontrolach bezpieczeństwa. Wymagane jest uwierzytelnianie wieloskładnikowe, a uczestnicy poziomu Defense mają czas do 15 grudnia 2026 roku na przejście na metody odporne na phishing, np. klucze sprzętowe. Program działa w Claude Platform, Vertex AI w Google Cloud i Microsoft Foundry, a w Amazon Bedrock tylko dla klientów uprawnionych do Enterprise Frontier Safeguards.

Wyniki Project Glasswing i ich ograniczenia

Anthropic podaje, że partnerzy Project Glasswing znaleźli od kwietnia do lipca 2026 roku co najmniej 129 tys. potwierdzonych podatności, a własne skanowanie projektów open source dodało kolejne 5,5 tys. Ponad 33 tys. z nich oceniono jako krytyczne lub wysokie. Firma szacuje, że faktyczny efekt jest co najmniej pięć razy większy.

Te liczby wymagają ostrożności. Pochodzą z ankiet wypełnionych przez część partnerów, 33 raportów i danych samego Anthropic, a mniej niż połowa partnerów podała, ile luk załatano. Komunikat nie zawiera też informacji o opłatach ani o tym, czy poziom Specialized Access będzie dostępny dla organizacji spoza USA, skoro weryfikacja odbywa się z udziałem amerykańskiego rządu.

Co to oznacza dla polskich zespołów bezpieczeństwa

Polskie firmy pentesterskie, zespoły SOC i operatorzy usług kluczowych mogą ubiegać się co najmniej o poziom Defense lub Red Team, bo komunikat nie wyklucza żadnego kraju. Dla podmiotów objętych krajowym systemem cyberbezpieczeństwa i unijną dyrektywą NIS2 szybsza analiza podatności może skrócić czas reakcji na incydenty. Trzeba jednak sprawdzić, czy przekazywanie Anthropic danych z analiz, w tym fragmentów logów i kodu klientów, mieści się w umowach powierzenia i zasadach RODO.

W naszej ocenie najprostszy pierwszy krok to wniosek o Defense Access dla zespołu, który już analizuje incydenty i podatności we własnych systemach. Przed złożeniem warto przygotować dowody wdrożenia uwierzytelniania odpornego na phishing oraz opis zakresu prac, a przy pracach red team także dokumenty potwierdzające zgodę klientów na testy.

Źródła i data sprawdzenia

  1. Expanding the Cyber Verification ProgramAnthropic, publikacja: 2026-10-06, sprawdzono: 2026-10-06
  2. Real-time cyber safeguards on Claude Opus and SonnetAnthropic Help Center, publikacja: 2026-09-30, sprawdzono: 2026-10-06
  3. Project GlasswingAnthropic, publikacja: 2026-04-07, sprawdzono: 2026-10-06
  4. How Comcast and Booz Allen use Claude Mythos to secure their codebasesClaude Blog, publikacja: 2026-10-06, sprawdzono: 2026-10-06
Nota redakcyjna

Artykuł ma charakter informacyjny. Przy decyzjach prawnych, finansowych lub organizacyjnych warto zweryfikować wnioski w odniesieniu do konkretnej sytuacji.