3사가 같은 날 "해킹 잘하는 AI"를 내놨어요
2026년 9월 2일 공개 기준 · 출처 The Hacker News
구글, 앤트로픽, 오픈AI가 2026년 9월 2일 나란히 보안 특화 모델과 접근 프로그램을 공개했어요. 구글은 제미나이 3.8 플래시 사이버를 내놓고 정부·의료·통신처럼 우선순위가 높은 방어 조직에 먼저 여는 '페어윈드' 프로그램을 열었고, 크라우드스트라이크·팔로알토네트웍스 등 650곳 넘는 파트너와 함께 쓰도록 했어요. 앤트로픽은 클로드 페이블 5.1과, 검증된 방어자·연구자에게만 여는 미소스 5.1을 나눠 내놨어요.
페이블 5.1은 소프트웨어 취약점을 찾는 작업까지는 허용하되 침투 테스트나 공격 코드 생성 요청은 거절하고, 기업용으로는 데이터를 저장하지 않으면서 오남용만 탐지하는 안전장치를 함께 붙였어요. 오픈AI는 당시 아직 공개 전이던 아스트라(9월 3일 GPT-6 아스트라로 공개)가 자사 대비태세 기준에서 사이버 능력 '심각(Critical)' 단계를 처음으로 넘었다고 밝혔어요. 취약점 공격 평가에서 만점을 받았고 평가 중에 알려지지 않은 취약점(제로데이)을 스스로 찾아 공격 경로까지 엮었다고 해요.
대신 탈옥 시도 거절률을 91.5%까지 올리고 '데이브레이크 블루'라는 심사형 프로그램으로만 열기로 했어요.
실무에서는 어떤 뜻인가요
공격에 쓸 수 있는 수준의 AI를 만드는 대신 "아무나 못 쓰게 심사해서 연다"는 방식이 업계 표준처럼 자리 잡는 흐름이에요. 회사 입장에서는 방어 쪽 도구가 늘어나는 건 반갑지만, 같은 능력이 밖으로 새면 그대로 공격이 되니 사내 보안 점검 주기를 짧게 가져가는 게 좋아요.
정리 시점 이후 상황이 바뀌었을 수 있어요. 정확한 내용은 출처 원문에서 확인하세요.