Anthropic ogłosił 6 października 2026 roku nową wersję Cyber Verification Program (CVP). Program daje zweryfikowanym zespołom bezpieczeństwa dostęp do modeli Claude z łagodniejszymi blokadami w zadaniach cybernetycznych, w tym do Claude Mythos 5.1, Opus 5.5 i Sonnet 5.5. Zamiast jednego progu są teraz trzy poziomy: Defense Access dla obrońców, Red Team Access dla autoryzowanych testów penetracyjnych i Specialized Access dla podmiotów testujących systemy krytyczne. Udział w programie jest bezpłatny, ale wymaga weryfikacji, zabezpieczeń konta i przechowywania danych przez Anthropic.
Co zmienia nowy Cyber Verification Program
Ogólnie dostępne modele Anthropic, takie jak Claude Opus 5.5, Fable 5.1 i Sonnet 5.5, mają zachowawcze zabezpieczenia, które blokują większość prac ofensywnych w cyberbezpieczeństwie. Firma uzasadnia to tym, że te same umiejętności pomagają obrońcy znaleźć lukę, a napastnikowi ją wykorzystać. Bez dodatkowej weryfikacji model nadal może przeglądać kod, łatać znane błędy, szukać podatności we własnym kodzie źródłowym i porządkować alerty bezpieczeństwa.
Przez ostatnie pół roku szerszy dostęp zapewniały dwa osobne programy. Project Glasswing dawał Claude Mythos organizacjom zabezpieczającym najważniejsze oprogramowanie, a CVP obniżał blokady w modelach Opus i Sonnet dla sprawdzonych zespołów. Teraz oba programy połączono w jedną ofertę z trzema progami, a każdy próg obejmuje najmocniejsze modele, w tym Mythos 5.1 i przyszłe wydania.
Trzy poziomy dostępu i kto się kwalifikuje
Poziomy różnią się zakresem dozwolonych prac, wymogami weryfikacji i kontrolami bezpieczeństwa. Zestawienie poniżej opracowaliśmy na podstawie komunikatu Anthropic i artykułu w centrum pomocy.
- Defense Access - prace obronne: centrum operacji bezpieczeństwa (SOC), reagowanie na incydenty, inżynieria wsteczna złośliwego oprogramowania, analiza i walidacja podatności. Mogą się zgłosić zespoły bezpieczeństwa firm, uczelni, organizacji non-profit i administracji, operatorzy infrastruktury krytycznej dowolnej wielkości, mniejsze firmy z branży, opiekunowie projektów open source i badacze z historią zgłoszonych luk. Dostępny także dla osób na płatnych planach.
- Red Team Access - wszystko z poziomu Defense oraz autoryzowane testy penetracyjne i red teaming, czyli symulowane ataki na systemy, do których testowania organizacja ma zgodę. Tylko dla organizacji, np. wewnętrznych zespołów red team i firm pentesterskich. Blokady w czasie rzeczywistym nadal obejmują działania grożące szkodą fizyczną lub masowymi zakłóceniami, np. wdrażanie ransomware.
- Specialized Access - najmniej blokad, dla wąskiej grupy organizacji uprawnionych do testowania systemów, od których zależy życie ludzi lub działanie rynków: sterowania lotami, sieci energetycznych, telekomunikacji, rozliczeń międzybankowych i sieci administracji. Każdą organizację Anthropic sprawdza obecnie we współpracy z rządem USA. Dotychczasowi członkowie Project Glasswing trafiają tu bez ponownej weryfikacji.
Jak działają blokady według testów Anthropic
Anthropic sprawdził skuteczność progów na Claude Opus 5.5 w teście CyScenarioBench, który mierzy, czy model potrafi zaplanować i przeprowadzić wieloetapową operację cybernetyczną. Każde z 10 zadań powtórzono pięć razy na każdym poziomie. Bez dostępu do CVP wszystkie próby zostały zablokowane już przy pierwszym poleceniu.
Na poziomie Defense blokada zadziałała w 46 z 50 prób, a cztery zadania zakończyły się sukcesem. Na poziomie Red Team nie było żadnej blokady i model wykonał 34 z 50 zadań. Według firmy odpowiada to 67,6 proc. skuteczności modelu bez zabezpieczeń, czyli wynikowi reprezentatywnemu dla Specialized Access. To pomiar przeprowadzony przez samego producenta, bez niezależnej weryfikacji.
Wymagania: retencja danych i zabezpieczenia konta
Uczestnicy programu muszą zgodzić się na przechowywanie danych przez Anthropic, aby firma mogła wykrywać nadużycia. Klienci, którzy mają już dostęp do Fable 5.1 lub Mythos 5.1 z zerową retencją danych (zero data retention), mogą korzystać z CVP na tych samych zasadach. Później tej jesieni ma ruszyć Enterprise Frontier Safeguards, rozwiązanie pozwalające trzymać dane w chmurze kontrolowanej przez klienta.
Wniosek składa się przez portal weryfikacyjny Anthropic, podając dane organizacji, opis prac i oświadczenie o wdrożonych kontrolach bezpieczeństwa. Wymagane jest uwierzytelnianie wieloskładnikowe, a uczestnicy poziomu Defense mają czas do 15 grudnia 2026 roku na przejście na metody odporne na phishing, np. klucze sprzętowe. Program działa w Claude Platform, Vertex AI w Google Cloud i Microsoft Foundry, a w Amazon Bedrock tylko dla klientów uprawnionych do Enterprise Frontier Safeguards.
Wyniki Project Glasswing i ich ograniczenia
Anthropic podaje, że partnerzy Project Glasswing znaleźli od kwietnia do lipca 2026 roku co najmniej 129 tys. potwierdzonych podatności, a własne skanowanie projektów open source dodało kolejne 5,5 tys. Ponad 33 tys. z nich oceniono jako krytyczne lub wysokie. Firma szacuje, że faktyczny efekt jest co najmniej pięć razy większy.
Te liczby wymagają ostrożności. Pochodzą z ankiet wypełnionych przez część partnerów, 33 raportów i danych samego Anthropic, a mniej niż połowa partnerów podała, ile luk załatano. Komunikat nie zawiera też informacji o opłatach ani o tym, czy poziom Specialized Access będzie dostępny dla organizacji spoza USA, skoro weryfikacja odbywa się z udziałem amerykańskiego rządu.
Co to oznacza dla polskich zespołów bezpieczeństwa
Polskie firmy pentesterskie, zespoły SOC i operatorzy usług kluczowych mogą ubiegać się co najmniej o poziom Defense lub Red Team, bo komunikat nie wyklucza żadnego kraju. Dla podmiotów objętych krajowym systemem cyberbezpieczeństwa i unijną dyrektywą NIS2 szybsza analiza podatności może skrócić czas reakcji na incydenty. Trzeba jednak sprawdzić, czy przekazywanie Anthropic danych z analiz, w tym fragmentów logów i kodu klientów, mieści się w umowach powierzenia i zasadach RODO.
W naszej ocenie najprostszy pierwszy krok to wniosek o Defense Access dla zespołu, który już analizuje incydenty i podatności we własnych systemach. Przed złożeniem warto przygotować dowody wdrożenia uwierzytelniania odpornego na phishing oraz opis zakresu prac, a przy pracach red team także dokumenty potwierdzające zgodę klientów na testy.
Źródła i data sprawdzenia
- Expanding the Cyber Verification ProgramAnthropic, publikacja: 2026-10-06, sprawdzono: 2026-10-06
- Real-time cyber safeguards on Claude Opus and SonnetAnthropic Help Center, publikacja: 2026-09-30, sprawdzono: 2026-10-06
- Project GlasswingAnthropic, publikacja: 2026-04-07, sprawdzono: 2026-10-06
- How Comcast and Booz Allen use Claude Mythos to secure their codebasesClaude Blog, publikacja: 2026-10-06, sprawdzono: 2026-10-06
Artykuł ma charakter informacyjny. Przy decyzjach prawnych, finansowych lub organizacyjnych warto zweryfikować wnioski w odniesieniu do konkretnej sytuacji.



