GPT-6 아스트라 Critical 등급, 기업은 AI에게 권한을 어디까지 줘야 할까
2026년 9월 3일, OpenAI가 새로운 모델 GPT-6 Astra를 공개했습니다. 그 자리에서 그렉 브록만 사장은 기자 브리핑을 마치며 "Welcome to the AGI era"라고 말했고, "이 모델이 바로 그 지점일 수도 있다고 생각한다"고 덧붙였습니다.
—-
GPT-6 아스트라, 정확히 뭐가 달라졌나요?
아스트라의 핵심 변화는 일하는 방식에 있습니다. 마우스와 키보드를 직접 움직여 컴퓨터를 조작하는 에이전트 기능이 크게 좋아졌고, 소프트웨어 작업 벤치마크 OSWorld V2에서 점수가 65.7%에서 72.6%로 올랐습니다. 같은 작업을 처리하는 데 걸리던 시간도 평균 75분에서 40분으로 줄었습니다.
한국 매체에서도 "답하는 AI에서 일하는 AI로 넘어갔다"고 표현했고, 이는 웹 브라우징, 도구 호출, 터미널 명령 실행, 데이터 분석과 보고서 작성까지 사람이 일일이 개입하지 않아도 끝까지 처리한다는 뜻입니다. CEO 샘 올트먼은 이 모델이 "새로운 세대의 기업가 정신과 과학적 발견, 창작과 구축을 가능하게 하길 기대한다"고 밝혔습니다.
"GPT-6 Astra는 사이버보안 역량이 'Critical' 수준에 도달한 OpenAI 최초의 모델입니다."
단순히 코딩을 잘하거나 보안 문제를 찾아주는 정도와는 다릅니다. OpenAI가 정의한 Critical 수준은 적절한 도구와 접근 권한이 주어질 경우, 사람이 다음 행동을 일일이 알려주지 않아도 잘 보호된 시스템에서 아직 알려지지 않은 취약점을 찾아내고, 이를 실제 공격에 활용할 방법까지 개발할 수 있는 수준입니다.
이제 정말 AI가 해킹까지 할 수 있게 된 걸까요? AI가 이렇게 많은 일을 할 수 있다면, AI에게 어디까지 권한을 줘야 할까요?
Critical은 무슨 뜻인가요?
오픈AI는 아스트라가 자체 대비 체계(Preparedness Framework)에서 사이버보안 "크리티컬(Critical)" 등급에 도달한 첫 공개 모델이라고 밝혔습니다. 'Critical'은 OpenAI의 자체 준비성 평가 프레임워크에서 최첨단 AI가 심각한 피해를 일으킬 수 있는 능력을 분야별로 평가하는 자체 안전 평가 체계입니다.
GPT-6 Astra는 이 가운데 사이버보안 역량에서 Critical 기준에 도달했습니다. 통제된 평가 환경에서 고도화된 공격 역량이 확인됐습니다.
OpenAI는 사이버보안 Critical 수준을 크게 두 가지 경우로 설명합니다.
사람이 개입하지 않아도 여러 보안 강화 시스템에서 작동 가능한 제로데이 취약점을 찾아 실제 공격 방법을 개발할 수 있는 경우
공격 목표만 주어져도 보안이 강화된 표적을 대상으로 새로운 사이버 공격 전략을 처음부터 끝까지 설계하고 실행할 수 있는 경우
GPT-6 Astra는 어느 정도일까?
OpenAI가 공개한 평가 결과를 보면 알려진 소프트웨어 취약점을 실제 공격 코드로 전환하는 능력을 평가하는 ExploitBench에서 GPT-6 Astra는 100%를 기록했습니다.
통제된 내부 테스트에서는 최근 공개된 취약점만 골라 평가했는데도 이전에 알려지지 않은 제로데이 2건을 스스로 찾아 실제 공격으로 연결하는 일련의 방법에 활용했습니다. 보안 전문가들과의 별도 평가에서는 전문가 주도 평가에서는 보안이 강화된 브라우저의 격리 공간을 벗어나 컴퓨터에서 명령을 실행하는 체인과, 일반 사용자 권한에서 관리자(root) 권한으로 올라가는 공격 체인을 직접 만들었습니다.
다만 이건 실제 해킹이 아니라 출시 전 통제된 레드팀 테스트 결과입니다. 출시 제품은 고도화된 공격 지원을 제한하며, OpenAI는 방어 목적의 고급 기능도 별도 접근 체계를 통해 제공할 계획이라고 밝혔습니다. 능력의 존재와 실제 사용 권한은 구분해야 합니다.
기업 입장에서 더 실무적인 숙제도 있습니다. 한 IT 매체는 아스트라 이후 AI 거버넌스의 초점이 "어떤 모델이 승인됐는지가 아니라, 권한을 가진 주체가 통제 장치가 개입하기 전에 얼마나 큰 피해를 일으킬 수 있는가"로 옮겨가야 한다고 지적했습니다. 현재 ERP 같은 기업 시스템에서는 AI 에이전트가 작업해도 로그에 서비스 계정만 남고, 어느 모델이 어떤 지시로 움직였는지 추적이 안 되는 경우가 많다는 지적도 함께였습니다.
봐야 할 것은 성능보다 권한입니다
보고서를 요약하는 AI와 고객 데이터베이스를 수정하는 AI는 같은 기준으로 관리할 수 없습니다. OpenAI는 Astra가 온라인 양식 작성, CRM 고객 기록 업데이트, 일정 관리 같은 업무를 직접 수행할 수 있다고 설명합니다. AI가 답변을 넘어 실제 업무를 수행하면 오류의 영향도 시스템·데이터·고객에게 이어질 수 있습니다.
OpenAI 역시 Astra에 전체 작업 흐름 모니터링과 무단 행동을 자동 중단하는 장치를 적용했다고 설명합니다. 동시에, 의도적으로 감시를 피하도록 유도한 테스트에서는 Astra의 사고 과정을 이전 모델보다 관찰하기 어려웠다는 결과도 공개했습니다. 이는 실제 침해 사고가 발생했다는 뜻은 아니지만, 최종 결과만 확인하는 통제로는 부족할 수 있다는 경고로 읽을 수 있습니다.
AI 정책은 "써도 되는가?"에서 끝나지 않습니다. 어떤 업무를, 어떤 데이터와 권한으로, 어느 단계까지 맡길 것인지를 정해야 합니다.
같은 모델을 ARC-AGI-3에 돌렸을 때, 오픈AI 전용 하네스(추론 상태 보존·압축 기능)를 쓰면 99.9%, 특정 업체에 치우치지 않은 표준 하네스를 쓰면 62.7%가 나왔습니다. 그런데 실제로 API로 판매되는 아스트라는 표준 하네스가 아니라 이 오픈AI 전용 하네스에 가까운 조건에서 작동합니다. 즉 기업이 실제로 도입해 마주하는 성능은 62.7%보다 99.9%에 가까운 결과라는 뜻이고, 그만큼 벤치마크만으로는 실제 업무 위험을 가늠하기 어렵다는 의미이기도 합니다.
기업에 더 현실적인 질문은 "AGI인가?"가 아닙니다. AI가 실제로 실행할 수 있는 업무 범위가 얼마나 넓어졌는가, 그리고 그 범위를 누가 통제하는가입니다.
AGI 논쟁보다 먼저 확인할 변화
GPT-6 Astra의 Critical 분류가 뜻하는 것은 "이제 누구나 AI로 해킹할 수 있다"가 아닙니다. AI가 권한을 받으면 수행할 수 있는 일의 범위가 크게 넓어졌고, 그만큼 권한 설계와 인간의 감독이 중요해졌다는 뜻입니다.
기업이 지금 답해야 할 질문은 두 가지입니다.
AI는 어디까지 행동할 수 있는가?
누가 어느 순간에 승인하고, 멈추고, 책임지는가?
AI가 실행 주체가 되는 시대, 기업교육의 목표도 달라져야 합니다. 더 빠르게 쓰게 하는 데서 그치지 않고, 안전하게 위임하고 정확히 검증하며 끝까지 책임지는 역량을 만들어야 합니다.
AI에게 어디까지 맡기고, 언제 사람이 개입할지. 이제 이 질문은 보안 담당자만이 아니라 업무와 학습을 설계하는 HR·교육담당자, 리더가 함께 고민해야 할 과제입니다.
참고자료
Axios, 「OpenAI releases new model GPT-6 Astra, says it may represent AGI」, 2026.9.3
The New Stack, GPT-6 Astra 컴퓨터 사용 벤치마크 관련 기사, 2026.9
리더스팩트, 「아스트라 쇼크① '답하는 AI'서 '일하는 AI'로…GPT-6 뭐가 달라졌나」, 2026.9
인공지능신문, 2026.9
OpenAI, 「Safety overview: GPT-6 Astra」, 2026.9.3
OpenAI Deployment Safety Hub, 「GPT-6 Astra System Card」, 2026.9.3
OpenAI, 「Astra로 향하는 길: Critical 역량과 프런티어 보호 조치」, 2026.9.1
The Hacker News, 「GPT-6 Astra Scores 100% on ExploitBench」, 2026.9
OpenAI, 「GPT-6 Astra: A new generation of intelligence」, 2026.9.3
CIO Korea, 2026.9
The New Stack, 「OpenAI will sell you Astra, but not the system that scored 98.6% on ARC-AGI-3」, 2026.9