Modele AI

Anthropic: CryptanalysisBench pokazuje, że model Claude Mythos złamał w 60 godzin połowę klucza HAWK i przyspieszył ataki na AES nawet 800-krotnie

Anthropic opublikował benchmark CryptanalysisBench wraz z wynikami pokazującymi, że modele frontier potrafią prowadzić oryginalną kryptoanalizę na poziomie badawczym niemal bez udziału człowieka. Wewnętrzny wariant Claude Mythos w około 60 godzin i za mniej więcej 100 tys. dol. w kosztach API zredukował o połowę efektywną siłę klucza podpisów HAWK oraz przyspieszył znane ataki na 7-rundowy AES od 200 do 800 razy.

Anthropic opublikował w środę, 29 lipca, CryptanalysisBench — benchmark oceniający zdolność modeli językowych do prowadzenia kryptoanalizy. Razem z narzędziem firma przedstawiła wyniki testów, które pokazują, że modele frontier potrafią samodzielnie prowadzić oryginalną kryptoanalizę na poziomie badawczym, przy minimalnym udziale człowieka.

Co dokładnie znalazł Claude Mythos?

Do testów Anthropic użyło Claude Mythos — wewnętrznego wariantu Claude Fable 5 pozbawionego części ograniczeń dual-use, udostępnianego wyłącznie zatwierdzonym organizacjom badawczym. W ciągu około 60 godzin pracy model znalazł istotne słabości w dwóch niezależnych systemach kryptograficznych: zredukował o połowę efektywną siłę klucza schematu podpisów HAWK — jednego z kandydatów NIST do standardu kryptografii postkwantowej — oraz przyspieszył znane ataki na wariant AES zredukowany do 7 rund nawet 200-800-krotnie względem dotychczasowych metod. Koszt samego odkrycia w API Anthropic wyceniło na około 100 tys. dol.

Czy to zagraża pełnemu szyfrowaniu AES?

Nie w obecnej formie. Atak dotyczy wariantu ograniczonego do 7 z 14 rund, jakie stosuje pełny AES-256 — standardowe, niezredukowane wdrożenia pozostają bezpieczne. Anthropic podkreśla jednak, że tempo, w jakim model samodzielnie doszedł do wyniku, nie ma precedensu: dotychczas tego rodzaju postępy w kryptoanalizie zajmowały zespołom badawczym miesiące lub lata, a nie dni.

Co Anthropic zrobił z tymi ustaleniami?

Firma poinformowała o wynikach amerykański NIST oraz zespoły zaangażowane w rozwój HAWK i badania nad AES, zanim upubliczniła benchmark — to standardowa procedura odpowiedzialnego ujawniania podatności, przeniesiona z cyberbezpieczeństwa na grunt kryptoanalizy.

Publikacja to kolejny w lipcu sygnał, że modele frontier przestają być wyłącznie narzędziem wspomagającym pracę badaczy. Kilka dni wcześniej AIDziennik pisał, że brytyjski UK AISI i amerykański CAISI ocenili zdolności cybernetyczne chińskiego Kimi K3 na 32,2 proc. wobec 76,2 proc. dla czołowych modeli z USA — tam jednak chodziło o wykonanie gotowych zadań ofensywnych, nie o oryginalne odkrycia badawcze, jakie opisuje CryptanalysisBench. Wyniki Anthropic podgrzewają debatę o zastosowaniach dual-use modeli AI dokładnie w momencie, w którym waszyngtońska administracja ma do 1 sierpnia przedstawić ramy oceny modeli frontier pod kątem zdolności ofensywnych.

Źródło: TechStartups

Komentarze

Dołącz do dyskusji

Komentarze są moderowane przed publikacją.