구글·오픈AI·앤트로픽, 나흘 사이 사이버보안 전용 AI 나란히 공개
오픈AI·앤트로픽·구글이 9월 1~2일 사흘 사이 잇달아 사이버보안 전용 AI 모델과 접근 제한 프로그램을 내놨습니다. 각사가 내건 조건과 한계, 접근 방법을 정리했습니다.
목차 · 5
오픈AI, 앤트로픽, 구글이 9월 1일부터 2일 사이 사흘도 안 되는 간격으로 사이버보안에 특화된 AI 모델과 접근 제한 프로그램을 각각 발표했습니다. 세 회사 모두 “공격 탐지·방어 능력이 이전 모델보다 크게 올라간 만큼, 아무나 쓸 수 없게 제한한다”는 공통된 태도를 보였습니다.
오픈AI — GPT-6 Astra, 자체 ‘치명적 위험’ 등급 첫 적용

오픈AI는 9월 1일 공개한 “Path to Astra” 문서에서 GPT-6 Astra가 자사 안전성 평가 체계인 Preparedness Framework의 사이버보안 부문 최고 등급(Critical)을 처음으로 넘겼다고 밝혔습니다. 이 등급은 모델이 사람 개입 없이 실제 운영 중인 중요 시스템에서 알려지지 않은 취약점(제로데이)을 찾아 작동하는 공격 코드를 만들 수 있거나, 목표만 주어져도 처음부터 끝까지 새로운 공격 전략을 짤 수 있을 때 적용됩니다.
이 때문에 고급 사이버보안 기능은 일반 공개 없이 Daybreak Blue라는 소수 테스터 그룹에만 먼저 열립니다. 오픈AI는 접근 확대는 안전장치가 충분히 검증된 뒤 방어 목적 위주로 넓히겠다고 밝혔고, 안전장치가 정상적인 보안 작업을 오탐지해 막을 수 있다는 점도 함께 알렸습니다.
앤트로픽 — Claude Mythos 5.1, 신뢰된 조직에만 공개

앤트로픽은 같은 날 Claude Fable 5.1과 Claude Mythos 5.1을 함께 내놨습니다. 두 모델은 같은 기반 모델이지만 안전장치 수준이 다릅니다. Fable 5.1은 누구나 쓸 수 있는 일반 공개 모델이고, Mythos 5.1은 사이버보안·생명과학 분야 신뢰된 접근 프로그램(Cyber Verification Program 등)에 등록된 미국 조직만 쓸 수 있습니다.
앤트로픽은 사이버보안 안전장치의 오탐지가 이전보다 60% 줄었다고 밝혔습니다. 또 같은 날 기업 고객이 자사 클라우드(AWS, Azure, Google Cloud)에 데이터를 직접 보관하면서도 오용 탐지를 받을 수 있는 Enterprise Frontier Safeguards(EFS)도 공개했습니다. 데이터를 아예 저장하지 않는 기존 방식(제로 데이터 보존)과 달리, 데이터는 고객이 통제하는 인프라에 남고 이상 신호만 고객 팀에 전달되는 방식입니다. 앤트로픽은 100곳 이상의 기업과 함께 이를 개발했다고 밝혔습니다.
구글 — Gemini 3.8 Flash Cyber, 신뢰 파트너 한정

구글 딥마인드는 9월 2일 Gemini 3.8 Flash와 사이버보안 특화 버전인 Gemini 3.8 Flash Cyber를 함께 발표했습니다. 일반 버전은 개발자용 Google AI Studio와 Gemini 앱 등을 통해 바로 공개됐지만, Cyber 버전은 정부 기관·주요 기반시설 운영자·소프트웨어 유지보수자 등 신뢰 파트너에게만 Fairwind Program을 통해 제공됩니다.
구글은 업계 표준 취약점 탐지 시험인 CyberGym에서 최고 수준 성능을 냈고, 실제 환경 취약점 탐지 성공률이 70%를 넘었다고 밝혔습니다. Fairwind Program은 이 모델을 자동 코드 수정 도구인 CodeMender와 함께 제공해, 방어자가 취약점을 찾고 검증하고 고치는 과정을 한 번에 지원한다고 설명했습니다.
왜 세 회사가 동시에 움직였나
이보다 앞선 8월 27일, 오픈AI·앤트로픽·구글을 포함한 100곳 이상의 기업이 “앞으로 몇 달 안에 AI를 이용한 사이버공격이 훨씬 광범위하고 정교해질 것”이라며 민관 공동 대응을 촉구하는 공동 서한을 낸 바 있습니다. 이번 세 회사의 발표는 이 경고 이후 나온 것으로, AI 모델의 공격·방어 능력이 동시에 올라가는 상황에서 각사가 접근을 제한하는 방식으로 대응하고 있다는 공통점이 있습니다.
다만 접근 제한 기준과 범위는 회사마다 다릅니다. 오픈AI는 등급 기준으로 아예 기능을 나눴고, 앤트로픽은 같은 모델에 안전장치만 다르게 적용했으며, 구글은 대상 조직군을 지정해 별도 프로그램으로 운영합니다. 세 방식 모두 아직 소수에게만 열려 있어, 일반 사용자나 중소 보안팀이 체감할 변화는 당장은 크지 않습니다.
출처
- OpenAI, “Path to Astra: critical capabilities and frontier safeguards” (2026-09-01)
- Anthropic, “Introducing Claude Fable 5.1 and Claude Mythos 5.1” (2026-09-01)
- Anthropic, “Developing Enterprise Frontier Safeguards with our customers” (2026-09-01)
- Google, “Introducing Gemini 3.8 Flash and 3.8 Flash Cyber” (2026-09-02)
- Google, “Google’s Fairwind Program: Cyber defense tools for trusted partners” (2026-09-02)
- TechCrunch, “OpenAI, Anthropic, Google, and 100 other companies call for action to defend against rogue AI” (2026-08-27)
팩트 체크 기준일: 2026년 9월 8일