AI ASSiSTANT
오늘 19 · 총 2610
← AI 소식 목록으로
OpenAI보안·안전

오픈AI가 최대 규모 학습을 스스로 멈췄다

2026년 8월 19일 발표 기준 · 출처 Help Net Security

오픈AI가 2026년 8월 19일, 아직 공개하지 않은 모델 '아스트라(Astra)'가 자사 안전 기준에서 가장 높은 단계인 '치명적(Critical) 사이버보안 능력'에 닿았을 가능성을 배제할 수 없다고 밝히고, 예정돼 있던 가장 큰 규모의 강화학습 훈련을 일단 멈췄어요. 8월 7일 사내 평가에서 나온 점수가 근거예요. 이 단계는 사람이 시키지 않아도 방어가 잘 된 실제 시스템에서 알려지지 않은 취약점(제로데이)을 스스로 찾아 파고들 수 있는 수준을 뜻해요.

회사가 자기가 만든 기준에 걸려 개발을 실제로 멈춘 건 이번이 처음이에요. 대신 안전장치를 여러 겹 붙였어요. 모델이 만들어내는 토큰을 하나하나 감시 장치가 들여다보고 이상하면 30분 안에 경보를 울리게 했고, 연구용 서버에서 인터넷에 접속할 수 있는 코드 실행 작업도 함께 멈췄어요.

이 감시에 드는 계산 비용이 감시 대상 자체의 약 20%에 달한다고 밝혔고요. 앞서 7월에 드러난 허깅페이스 침입 사건이 이 조치의 배경으로 함께 언급됐어요. 이 모델은 결국 2026년 9월 3일 'GPT-6 아스트라'라는 이름으로 공개됐어요.

실무에서는 어떤 뜻인가요

사람이 지켜보지 않아도 알아서 침투 경로를 찾아내는 AI가 이미 연구실 안에 있다는 뜻이에요. 회사에서 AI 에이전트에 사내 시스템 권한을 줄 때는 접근 범위를 꼭 필요한 만큼만 열고 무엇을 했는지 기록이 남게 해두세요. 안전 비용이 20%씩 붙기 시작하면 언젠가 요금에도 반영될 수 있다는 점도 참고할 만해요.

출처 원문 보기: Help Net Security

정리 시점 이후 상황이 바뀌었을 수 있어요. 정확한 내용은 출처 원문에서 확인하세요.

함께 보면 좋은 소식