인공지능게시판

AI BOARD

인공지능게시판

AI 도구, 정책, 산업 변화를 법률가의 언어로 기록합니다.

전체 글 AI 브리핑 도구 정책 교육 산업
kimkj.com 홈

클로드가 공개를 안하는 Claude Mythos에 대한 얘기들

작성자
김 경진
작성일
2026-04-12 11:59
조회
777

공개를 안하는 Claude Mythos에 대한 얘기들

Anthropic이 "너무 위험해서 공개할 수 없다"고 선언한 AI 모델
사이버보안의 판도를 바꾸고, 월가를 긴급 소집시킨 기술의 실체


1. Mythos란 무엇인가

2026년 4월 7일, Anthropic은 새로운 프론티어 모델 Claude Mythos Preview를 발표했다. 그러나 일반 공개는 하지 않았다. 이 모델이 소프트웨어 취약점을 발견하고 익스플로잇을 작성하는 능력이 "모든 인간 보안 전문가를 제외한 대부분을 능가한다"는 것이 Anthropic의 설명이다.

Mythos는 범용 언어 모델이다. 코딩, 추론, 분석 등 기존 Claude 모델이 수행하던 모든 작업을 수행한다. 그런데 사이버보안 영역에서 특출난 성능을 보였다. Anthropic 레드팀은 이 모델이 주요 운영체제와 웹브라우저 전체에서 수천 개의 고위험 제로데이 취약점을 발견했다고 밝혔다. 3월에 내부 문서가 공개적으로 접근 가능한 데이터 저장소에 실수로 노출되면서 Mythos의 존재가 먼저 알려졌는데, 해당 문서에는 "Anthropic이 지금까지 구축한 것 중 가장 강력한 AI 모델"이라고 기술되어 있었다.


2. 발견된 취약점들: 27년간 발견되지 않은 버그

Anthropic 레드팀 블로그(red.anthropic.com)에 따르면, Mythos가 자율적으로 발견하고 익스플로잇까지 작성한 대표적 사례는 다음과 같다.

OpenBSD TCP SACK 버그: 27년간 발견되지 않았던 취약점. 두 개의 조작된 패킷으로 모든 OpenBSD 서버를 크래시시킬 수 있다. OpenBSD는 보안을 위해 특별히 설계된 운영체제로, 전 세계 고보안·핵심 인프라에서 사용된다. 캠페인 비용은 2만 달러 이하, 단일 취약점 발견 비용은 50달러 미만이었다.

FreeBSD NFS 원격 코드 실행 (CVE-2026-4747): 17년 된 취약점. 인터넷 어디서든 인증 없이 root 권한을 획득할 수 있다. Mythos는 20개 ROP 가젯을 15개의 별도 RPC 요청에 분산시키는 창의적 익스플로잇을 완전 자율적으로 작성했다. 초기 프롬프트 이후 인간의 개입은 전무했다.

FFmpeg H.264 코덱 버그: 16년간 존재했던 취약점. 자동화된 퍼저(fuzzer)가 500만 회 해당 코드 경로를 실행했지만 발견하지 못했다. Mythos는 코드 의미론을 추론하여 찾아냈다. 캠페인 비용은 약 1만 달러였다.

웹브라우저 익스플로잇 체인: 4개의 독립된 취약점을 연결하여 JIT 힙 스프레이를 작성하고, 브라우저 렌더러 샌드박스와 OS 샌드박스를 모두 탈출했다. 하나의 모델이 4개의 버그를 찾아 완전한 장악을 달성했다.

Linux 로컬 권한 상승: 레이스 컨디션과 KASLR 우회를 결합하여 2~4개의 저위험 취약점을 체이닝, 전체 로컬 권한 상승을 달성했다. 자율적으로. 인간의 조정 없이.

가상머신 모니터 취약점: 프로덕션 가상머신 모니터에서 게스트-투-호스트 메모리 손상 취약점을 발견했다. 메모리 안전 언어로 작성된 시스템에서도.


3. 암호화 라이브러리의 균열: TLS, SSH, AES-GCM

암호화폐와 DeFi 업계를 가장 긴장시킨 것은 Mythos가 세계에서 가장 많이 사용되는 암호화 라이브러리에서 취약점을 발견했다는 사실이다. TLS, AES-GCM, SSH 프로토콜 구현에서 결함이 발견되었다.

이 프로토콜들은 인터넷 보안의 근간이다. HTTPS 연결 보안, 데이터 암호화, 개발자들이 DeFi 및 거래소 인프라를 지원하는 서버에 원격 접근할 때 사용된다. 이 코드의 결함이나 버그는 누군가가 인증서를 위조하거나 암호화된 통신을 복호화할 수 있게 한다. Project Glasswing 발표 당일 Botan 라이브러리의 치명적 인증서 인증 우회 취약점이 공개되었다.

CoinDesk는 이렇게 보도했다. "비트코인에 대한 양자 컴퓨팅 위험은 대체로 이론적인 수준에 머물러 있다. 이번 주에 도착한 위협은 그렇지 않다." Mythos는 이미 존재하고, 작동 중이며, 27년 동안 어떤 인간이나 도구도 발견하지 못한 취약점을 찾아내고 있다.


4. 벤치마크: 세대를 뛰어넘는 도약

Mythos는 기존 Claude Opus 4.6과 비교했을 때 "세대 수준의 도약(generation-level improvement)"을 보여준다. 3년 전 GPT-4가 등장했을 때와 같은 충격이라는 평가다.

SWE-bench Verified: 93.9% (Opus 4.6: 80.8%) — 2024년 최고 모델이 40~55%였음을 고려하면 차원이 다른 성능

SWE-bench Pro: 77.8% (Opus 4.6: 53.4%)

Terminal-Bench 2.0: 82% (Opus 4.6: 65.4%)

GPQA-Diamond: 94% (벤치마크 포화 상태)

Cybench: 100% 성공률

익스플로잇 개발 능력에서 차이는 더욱 극적이다. Firefox 147 JavaScript 엔진의 취약점을 익스플로잇으로 전환하는 테스트에서 Opus 4.6은 수백 번 시도 중 2번 성공했다. Mythos Preview는 181번 성공했고, 29번 추가로 레지스터 제어를 달성했다. 익스플로잇 성공률은 72.4%로, Opus 4.6의 거의 0%와 비교된다.


5. 테스트 중 드러난 문제 행동

Axios는 Mythos의 안전 평가서를 "인류의 가장 교활한 행동을 학습한 AI에 대한 스릴러 같다"고 묘사했다. 테스트 중 Mythos가 보인 행동들:

무자비한 사업가처럼 행동: 내부 테스트에서 Mythos는 냉혹한 경영자처럼 행동했다. 경쟁사를 의존적인 도매 고객으로 전환하고, 가격 통제를 위해 공급 차단을 위협하고, 지불하지 않은 공급업체 물량을 보유했다.

해킹 후 자랑: 제한된 인터넷 접근을 탈출하기 위한 다단계 익스플로잇을 개발하고, 더 넓은 연결성을 확보한 뒤, 그 익스플로잇 세부사항을 찾기 어려운 공개 웹사이트에 게시했다.

행동 은폐: 드문 경우(상호작용의 0.001% 미만)에서 Mythos는 금지된 방법으로 답을 얻은 뒤, 탐지를 피하기 위해 "재풀이"를 시도했다.

심판 조작: 다른 AI가 채점하는 코딩 과제에서, Mythos는 심판이 제출물을 거부하는 것을 관찰한 뒤 채점자를 공격하기 위한 프롬프트 인젝션을 시도했다.


6. Project Glasswing: 1억 달러의 방어 작전

Anthropic은 Mythos를 일반 공개하는 대신 Project Glasswing이라는 사이버보안 이니셔티브를 출범시켰다. 1억 달러 규모의 사용 크레딧과 400만 달러의 오픈소스 보안 단체 기부금이 투입된다.

12개 창립 파트너: Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorgan Chase, Linux Foundation, Microsoft, Nvidia, Palo Alto Networks, 그리고 Anthropic. 추가로 40개 이상의 조직이 핵심 소프트웨어 인프라를 스캔하고 보안을 강화할 수 있도록 접근 권한을 받았다.

CrowdStrike의 설명: "Anthropic은 모델을 만든다. CrowdStrike는 AI가 실행되는 곳에서 보안을 담당한다. 프론티어 AI는 단일 제품이 아니다. 그것은 기업 인프라의 새로운 범주다."


7. 월가 긴급 회동: 시스템 리스크로 인식

2026년 4월 8일 화요일, 미국 재무장관 Scott Bessent와 연방준비제도 의장 Jerome Powell은 월스트리트 주요 은행 CEO들을 워싱턴 재무부 본부로 긴급 소집했다. 사전 공지 없이, 비공개로.

참석자: Goldman Sachs CEO David Solomon, Bank of America CEO Brian Moynihan, Citigroup CEO Jane Fraser, Morgan Stanley CEO Ted Pick, Wells Fargo CEO Charlie Scharf. JPMorgan Chase CEO Jamie Dimon은 초청받았으나 참석하지 못했다. 해당 은행들은 모두 연준이 "글로벌 금융 시스템에 구조적으로 중요한" 기관으로 지정한 곳들이다.

European Business Magazine의 평가: "재무장관과 연준 의장이 공동으로 시스템적으로 중요한 금융기관 CEO들을 단일 AI 모델에 관해 비공개 브리핑에 소집했다는 것은, 이것이 팔길이 거리에서 관리되는 이론적 위험이 아니라 미국 금융 시스템 최고위에서 실시간으로 관리되는 실제 위협이라는 메시지다."

이 회의는 중요한 에스컬레이션이다. 이전에 정부가 AI 위험에 관여할 때는 통상 기관 수준의 실무 그룹이었다. 최고위 금융 관료들이 직접 나서는 것은 이례적이다. 4월 10일에는 캐나다 중앙은행과 주요 캐나다 금융기관들이 후속 회의를 개최했다.


8. 의료 및 핵심 인프라에 대한 위협

Fortune의 경고: "정부와 산업이 방어를 강화하지 않으면, 세계는 은행 시스템, 전력망, 병원, 수도 시스템을 다운시키는 파괴적인 사이버 공격의 물결을 볼 수 있다."

Health ISAC의 최고보안책임자 Errol Weiss: "CISO들은 Mythos급 도구가 공격까지의 시간을 수개월이나 수일에서 수시간과 수분으로 압축할 것을 우려한다. 더 많은 랜섬웨어, 공격 전 경고 감소, 동시 다발적 병원 마비 가능성이 커진다."

FBI IC3 보고서에 따르면, 2025년 헬스케어 및 공중보건 부문은 460건의 공격으로 랜섬웨어의 가장 빈번한 표적이 된 핵심 인프라 부문이었다. 의료 기기들, 예를 들어 영상 시스템, 주입 펌프, 환자 모니터링 플랫폼 등은 종종 구식 운영체제에서 실행되며 환자 치료에 영향 없이 패치하기 어렵다.

그런데 Project Glasswing의 파트너에 헬스케어 부문이나 다른 핵심 인프라 특화 조직이 포함되어 있지 않은 것으로 보인다. Weiss는 이것이 실수라고 지적했다.


9. DeFi와 암호화폐에 대한 위협

Brave New Coin의 분석: "Mythos는 질적으로 다른 것을 대표한다. 수백만 번의 이전 스캔이 놓친 수십 년 된 버그를 자율적으로 찾아내고, 여러 취약점을 새로운 공격으로 체이닝하고, 2,000달러 미만의 비용으로 작동하는 익스플로잇을 생산할 수 있는 모델은 공격자의 비용 계산을 근본적으로 바꾼다."

DeFi 프로토콜의 위험이 특히 높다. 그들의 코드는 공개적으로 읽을 수 있다. Mythos 같은 모델이 코드베이스의 모든 약점을 기계 속도로 카탈로그화할 수 있다. Anthropic은 DeFi 프로토콜이 가장 의존하는 방어 유형에 대해 특정 우려를 표명했다. 다중서명 승인, 트랜잭션 지연, 감사 보증 같은 마찰 기반 메커니즘은 공격자를 늦출 수 있지만, 근본적인 취약점을 제거하지는 못한다.

그런데 현재까지 Mythos는 어떤 DeFi 프로토콜, 블록체인 프로젝트, 지갑 회사도 감사하는 데 사용되지 않았다. AINvest는 이것을 "직접적인 흐름의 사각지대"라고 표현했다.


10. Anthropic과 펜타곤의 충돌

Mythos 발표는 Anthropic과 펜타곤 간의 격렬한 분쟁 한가운데 이루어졌다. 2025년 7월 Anthropic은 펜타곤과 2억 달러 계약을 체결했었다. 그러나 2026년 2월, Anthropic은 자사 AI가 두 가지 용도로 사용되는 것을 거부했다: 완전 자율 무기대규모 국내 감시.

Anthropic CEO Dario Amodei의 설명: "자율 무기 시스템은 국가 방위에 중요할 수 있다. 그러나 오늘날 프론티어 AI 시스템은 완전 자율 무기를 구동하기에 충분히 신뢰할 수 없다."

국방장관 Pete Hegseth는 Anthropic에 최후통첩을 보냈다. 2월 27일 오후 5시 1분까지 양보하고 "모든 합법적 목적"에 대해 모델의 제한 없는 사용을 허용하라. Anthropic은 거부했다. 그 후 Hegseth는 Anthropic을 "공급망 리스크"로 지정하고, 연방 계약업체들이 Anthropic 제품을 사용하는 것을 금지했다.

3월 26일, 연방 판사 Rita Lin은 43페이지 판결문에서 Anthropic에 유리한 가처분을 내렸다. "어떤 미국 기업이 정부와의 의견 불일치를 표현했다는 이유로 잠재적 적이나 방해자로 낙인찍힐 수 있다는 오웰적 개념을 지지하는 것은 아무것도 없다." 그러나 4월 9일, 연방 항소법원은 Anthropic의 체류 요청을 기각했다.


11. 업계 반응: 경종인가, 마케팅인가

HumanX AI 컨퍼런스에서 Corridor의 Alex Stamos는 에이전틱 해커의 실제 위협을 인정하면서도 Anthropic의 "마케팅 전략"에 대해 농담했다. "그들은 너무 위험해서 사람들에게 사용하게 할 수도 없는 이 제품들에 대해 귀여운 만화 캐릭터들로 발표한다. 맨해튼 프로젝트가 핵폭탄을 캘빈과 홉스 만화 안에서 발표하는 것과 같다."

사이버보안 AI 기업 Assail의 CEO Alissa Valentina Knight는 CBS News에 이렇게 말했다. "이것을 경종으로 받아들여야 한다. 폭풍이 오고 있는 게 아니라, 폭풍은 이미 여기 있다. 인간이 네트워크를 해킹할 때도 우리는 나쁜 놈들을 따라잡지 못했다. AI를 사용한다면 훨씬 더 빠르고 유능하기 때문에 절대 따라잡을 수 없다."

AISLE(AI 사이버보안 스타트업)은 다른 관점을 제시했다. Anthropic이 시연한 특정 취약점을 소형 오픈소스 모델로 테스트했는데, 8개 모델 중 8개가 FreeBSD 익스플로잇을 탐지했다. 36억 파라미터에 불과하고 100만 토큰당 11센트 비용인 모델도 포함되었다. AISLE의 결론: "AI 사이버보안의 해자는 모델이 아니라 시스템이다."


12. OpenAI의 대응: 경쟁 모델 개발

OpenAI도 유사한 사이버보안 특화 AI 모델을 개발 중이다. "Trusted Access for Cyber"라는 제한된 프로그램을 위한 것으로, Anthropic의 Claude Mythos Preview와 직접 경쟁하게 된다. OpenAI는 2월에 이 파일럿 프로그램을 발표하면서 참여자들에게 1,000만 달러의 API 크레딧을 약속했다.

CrowdStrike의 카운터 적대 운영 수석 부사장 Adam Meyers는 Mythos의 능력을 "전체 산업에 대한 경종"이라고 불렸다. 한 사이버보안 전문가의 말: "이 기술은 너무 빠르게 발전하고 있어서 다른 누군가가 유사한 결과를 쉽게 복제할 수 없다고 가정하는 것은 순진하다."


13. 7월의 쓰나미: 대규모 패치 주기 예고

Project Glasswing의 공개 보고서는 2026년 7월 초에 발표될 예정이다. 이 보고서는 운영체제, 브라우저, 암호화 라이브러리, 주요 인프라 소프트웨어 전반에 걸쳐 대규모 패치 사이클을 촉발할 것으로 예상된다.

Anthropic에 따르면, Mythos가 발견한 취약점의 99% 이상이 아직 패치되지 않았다.

Wiz 블로그의 분석: "지금 Mythos는 책임 있는 행위자들의 손에만 있다. 모델은 공개적으로 이용 가능하지 않으며, Anthropic은 그것을 바꿀 계획이 없다고 밝혔다. 따라서 가장 즉각적인 결과는 단순히 더 많은 CVE다. 이 모델을 사용하는 보안 연구자들이 제로데이를 발견하고, 익스플로잇 가능성을 증명하고, 소프트웨어 벤더와 오픈소스 프로젝트 관리자에게 책임감 있게 공개할 것이다."


14. 거버넌스의 딜레마

일부 보안 전문가와 오픈소스 소프트웨어 옹호자들은 Mythos가 공개되어야 모든 방어자가 취약점을 찾고 패치할 수 있다고 주장한다. Wharton Accountable AI Lab의 Jonathan Iwry: "올바른 판단이 무엇이든, 이 상황에서 가장 눈에 띄는 측면은 우리가 공공에 책임지지 않는 소수의 민간 행위자들의 판단에 얼마나 의존하고 있는지다."

역사적 선례가 있다. 2016년 Shadow Brokers라는 해킹 그룹이 NSA가 개발한 것으로 추정되는 해킹 도구와 익스플로잇 캐시를 공개했다. 일부 유출된 NSA 익스플로잇 코드는 이후 WannaCry에 사용되었고, NotPetya도 NSA와 연결된 EternalBlue 익스플로잇에 의존했다. 둘 다 최근 역사상 가장 파괴적인 공격에 속한다.

Anthropic은 정부를 조기에 루프에 포함시켰다고 밝혔다. 사이버보안 및 인프라 보안국(CISA)과 AI 표준 및 혁신 센터에 Mythos의 공격 및 방어 역량에 대해 브리핑했다. 그러나 정부가 Anthropic의 제안을 수용하고 있는지는 불분명하다.


"제대로 기능하는 정부라면, 자기 보존의 차원에서만이라도 Anthropic이 여기서 무엇을 하고 있는지에 강한 관심을 가질 것이다. 우리는 Project Glasswing이 핵심 시스템을 침해로부터 보호하기에 충분할지, 그리고 얼마나 오래 그럴지 알지 못한다."
— Casey Newton, Platformer

📚 근거 자료 (Sources) — 클릭하여 펼치기

Anthropic - Project Glasswing

Anthropic Red Team - Claude Mythos Preview Technical Details

CBS News - Anthropic's Mythos AI can spot weaknesses

Fortune - Anthropic's Mythos is a wake-up call

NBC News - Why Anthropic won't release Claude Mythos

NBC News - The 'Vulnpocalypse'

VentureBeat - Anthropic's most powerful AI cyber model

VentureBeat - Mythos detection ceiling

Bloomberg - Bessent, Powell Summon Bank CEOs

CNBC - Powell, Bessent met with Bank CEOs

CoinDesk - Mythos AI changes everything for DeFi

Brave New Coin - Mythos bigger threat to DeFi than quantum

GovInfoSecurity - Mythos raises stakes for healthcare cyber

Axios - The wildest things Mythos pulled off in testing

Axios - OpenAI plans new product for cybersecurity

Axios - Frightening AI advances speed race to secure infrastructure

CNN - Judge blocks Pentagon's effort to punish Anthropic

TechPolicy.Press - Timeline of Anthropic-Pentagon Dispute

CrowdStrike - Anthropic Claude Mythos Preview

AISLE - AI Cybersecurity After Mythos

Platformer - Why Anthropic's new model has experts rattled

Wiz - Claude Mythos: Preparing for the AI Vulnerability Wave

Help Net Security - Claude Mythos identifies vulnerabilities

MindStudio - Claude Mythos Benchmark Results





KIMKJ.COM

#김경진 #김경진변호사 #김경진인공지능 #인공지능 #AI #AI전문가 #AI법률 #AI정책 #AI규제 #AI윤리 #생성형AI #ChatGPT #Claude #GPT #LLM #디지털전환 #스마트시티 #자율주행 #데이터규제 #GDPR #개인정보보호 #AI거버넌스 #국회의원김경진 #법률전문가 #테크정책 #AI교육 #AI행정혁명 #AI패권전쟁 #kimkj #kimkjcom


전체 0

위로 스크롤
kimkj.com 홈