Anthropic이 미공개 프론티어 모델
Claude Mythos Preview로 수십 년 묵은 보안 취약점 수천 개를 찾아냈습니다. 모델이 너무 강력해 일반 출시는 미루고, 빅테크 11곳과 함께 그 능력을 방어용 점검에 먼저 투입하기로 결정했습니다. — 프로젝트명 Glasswing
미공개 모델 Mythos의 벤치마크 점수
Anthropic이 아직 일반에 풀지 않은 프론티어 모델 Claude Mythos Preview 의 능력을 공개했습니다. "AI 시대의 핵심 소프트웨어를 지킨다"를 내건 보안 협업 프로그램 Project Glasswing 발표와 함께였죠.
벤치마크 점수는 한 세대 차이로 벌어졌습니다.
특히 눈여겨볼 건 보안 벤치마크 CyberGym — 실제 취약점을 재현해 내는 평가입니다. 66.6%에서 83.1%로, 한 세대 만에 16.5%p 뛰어올랐죠. 모델이 결함을 찾는 능력에서 결정적 선을 넘었다는 신호입니다.
27년·16년 묵은 결함을 찾아내다
수치보다 인상적인 건 실제 발견 사례입니다.
- OpenBSD 에 27년 동안 잠복해 있던 취약점.
- FFmpeg 에 16년 동안 박혀 있던 결함 — 사람 검토와 자동화 테스트 500만 번을 통과시켰던 결함입니다.
- Linux 커널에서는 단일 결함을 넘어 여러 취약점을 연쇄로 엮어 익스플로잇을 구성해 냈습니다.
Anthropic 은 모든 주요 운영체제와 웹 브라우저에서 수천 개의 고위험 취약점을 찾았다고 밝혔습니다. 사람이 충분히 본 코드, 도구가 충분히 두드린 코드에서도 새 결함이 줄줄이 나왔다는 뜻입니다.
지금은 때가 아니다
이런 능력은 양면이 또렷합니다. 방어자 손에 들어가면 묵은 결함을 메우는 백신이 되고, 공격자 손에 들어가면 패치 안 된 결함을 쥔 무기가 되겠죠.
AI capabilities have crossed a threshold that fundamentally changes the urgency required to protect critical infrastructure.
Cisco 의 보안 책임자 Anthony Grieco가 발표문에서 한 말입니다. CrowdStrike CTO Elia Zaitsev 의 진단은 더 직설적이죠 — 취약점 발견에서 실제 악용까지의 간격이 무너졌다, 몇 달 걸리던 일이 이제 몇 분이면 끝난다.
그래서 Anthropic 은 Mythos Preview 를 일반 API 로 풀지 않기로 했습니다. 검증된 협력자들에게 먼저 쥐어 주고, 그 사이 위험 능력을 막을 안전장치를 차기 Claude Opus 에 녹이겠다는 그림이죠. 즉, 일반 사용자가 받게 될 건 Mythos 자체가 아니라 Mythos 의 위험을 막아낸 다음 세대 Claude Opus 라는 얘기입니다.
빅테크 11곳과 만든 방어 동맹
Project Glasswing 에는 핵심 소프트웨어 인프라를 굴리는 외부 11개 조직이 참여합니다.
- Amazon Web Services
- Apple
- Broadcom
- Cisco
- CrowdStrike
- JPMorganChase
- Linux Foundation
- Microsoft
- NVIDIA
- Palo Alto Networks
여기에 더해 핵심 인프라를 만드는 40여 개 추가 기관에도 제한적 접근권을 줍니다. 모두가 같이 코드를 뒤져 결함을 메우자는 그림이죠.
자금 지원도 함께 발표됐습니다.
- 참여 기관들에 1억 달러 분량의 모델 사용 크레딧.
- 오픈소스 보안 단체 Alpha-Omega·OpenSSF 에 250만 달러.
- Apache Software Foundation 에 150만 달러.
90일 뒤 공개 보고, 그 다음 가격
Anthropic 은 프로그램 진행 동안 발견한 내용을 90일 안에 공개 보고서로 풀겠다고 했습니다. 프로그램 자체는 수개월 지속될 예정입니다.
프리뷰 단계 이후의 모델 가격대도 같이 나왔습니다 — 입력 백만 토큰당 25달러, 출력 백만 토큰당 125달러. 현재 Claude Opus 시세보다 큰 폭으로 비쌉니다. 일반 API 로 풀리는 형태가 아니라 이 숫자 자체가 곧장 의미를 갖진 않지만, Anthropic 이 Mythos 를 어디쯤에 놓고 있는지 가늠은 됩니다.
결국 순서를 뒤집었습니다. 새 모델의 가장 위험한 능력을, 일반에 풀기 전에 방어자 손에 먼저 쥐어 준다 — 점점 강해지는 AI 와 보안의 관계를 짚는 한 가지 답이 되지 않을까 싶습니다.
참고 자료
이 글은 Anthropic 원문을 정리한 것입니다. 원저작권은 Anthropic에 있습니다.



