AGI 시대 성큼? 오픈AI GPT-6 아스트라, 코딩서 클로드 능가…사이버보안도 강화 > 인공지능 (Artificial Intelligence) | MZ세대의 IT과학

AGI 시대 성큼? 오픈AI GPT-6 아스트라, 코딩서 클로드 능가…사이버보안도 강화 > 인공지능 (Artificial Intelligence)

본문 바로가기
    • 'C
    • 2026.09.15 (화)
  • 로그인
사이트 내 전체검색

인공지능 (Artificial Intelligence)

AGI 시대 성큼? 오픈AI GPT-6 아스트라, 코딩서 클로드 능가…사이버보안도 강화

페이지 정보

작성자 작성일 26-09-05 13:02

본문

AGI 시대 성큼? 오픈AI GPT-6 아스트라, 코딩서 클로드 능가…사이버보안도 강화

 

ChatGPT Image 2026년 9월 5일 오후 01_02_03.png

 

오픈AI가 차세대 인공지능 모델 ‘GPT-6 아스트라(Astra)’를 공개하며 범용인공지능(AGI)을 둘러싼 논쟁에 다시 불을 붙였다. 새 모델은 소프트웨어 공학과 전문 업무 수행, 과학 분야, 사이버보안 등에서 성능을 크게 끌어올린 것으로 소개됐으며, 일부 코딩 벤치마크에서는 최근 공개된 앤트로픽 모델보다 높은 점수를 기록한 것으로 전해졌다. 다만 특정 벤치마크에서의 우위가 곧 모든 영역에서 경쟁 모델을 앞선다는 의미는 아니며, GPT-6 아스트라가 실제 AGI 단계에 도달했는지를 놓고도 평가는 엇갈리고 있다.

 

사용자가 제공한 자료에 따르면 오픈AI는 3일 현지시간 GPT-6 아스트라를 공개했다. 그레그 브로크먼 오픈AI 사장은 모델 공개 과정에서 “AGI 시대에 온 것을 환영한다”는 취지의 발언을 내놓으며 새로운 모델의 기술적 도약을 강조했다. 오픈AI 역시 아스트라에 대해 능력 측면에서 ‘세대교체 수준의 대약진’을 이뤘다고 평가하고, 소프트웨어 엔지니어링과 과학, 전문적인 사무 업무, 사이버보안 등 여러 분야에서 최첨단 수준의 성능을 갖췄다고 설명한 것으로 전해졌다.

 

AGI는 특정 분야에만 능한 기존의 좁은 범위 인공지능을 넘어 인간처럼 다양한 종류의 문제를 이해하고 학습하며 추론할 수 있는 범용적 지능을 의미한다. 그러나 AGI를 판단하는 국제적으로 통일된 기준은 아직 존재하지 않는다. 어떤 수준의 추론 능력과 자율성, 새로운 상황에 대한 적응력을 갖춰야 AGI라고 부를 수 있는지에 대해서도 기업과 연구자마다 견해가 다르다. 이런 이유로 오픈AI 관계자의 발언과 별개로 GPT-6 아스트라를 AGI 자체로 단정하기에는 이르다는 평가도 함께 나오고 있다.

 

아스트라가 강조하는 변화 가운데 하나는 복잡한 업무를 보다 짧은 시간에 수행하는 능력이다. 제공된 자료에서 오픈AI는 사람이 약 30분 동안 진행해야 하는 반려동물 위탁 돌봄 서비스 검색 업무를 아스트라가 5분 27초 만에 마쳤다고 소개했다. 사람이 약 5시간을 들여 수행하는 구직 정보 검색 작업은 2분 51초 만에 완료한 사례도 제시됐다.

 

이 같은 사례가 주목받는 이유는 생성형 AI가 질문에 문장으로 답하는 수준에서 벗어나 여러 단계를 거치는 실제 업무를 수행하는 방향으로 발전하고 있기 때문이다. 정보를 검색하고 조건을 비교한 뒤 결과를 정리하는 업무가 자동화될 경우 AI의 활용 범위가 개인용 챗봇에서 전문 업무 보조와 소프트웨어 개발, 연구 및 기업 업무 자동화 영역으로 빠르게 넓어질 가능성이 있다.

 

코딩 능력도 GPT-6 아스트라의 주요 특징으로 소개됐다. 제공된 자료에 따르면 코딩 및 소프트웨어 작업 능력을 측정하는 ‘터미널-벤치 4.0’과 ‘딥SWE v1.1’ 등 일부 성능평가에서 아스트라는 앤트로픽이 최근 선보인 ‘클로드 페이블 5.1’보다 높은 점수를 기록했다.

 

다만 이를 두고 단순히 “GPT-6가 클로드보다 모든 면에서 뛰어나다”고 해석하는 것은 정확하지 않다. AI 모델의 성능은 코딩, 수학, 추론, 멀티모달 이해, 장문 처리, 에이전트 실행 등 평가 분야에 따라 결과가 달라질 수 있다. 따라서 제목의 ‘클로드 능가’ 역시 제공된 자료에서 언급된 특정 코딩 벤치마크를 기준으로 한 표현으로 이해하는 것이 정확하다.

 

이번 모델에서 더욱 주목되는 부분은 사이버보안 능력이다. 제공 자료에서는 GPT-6 아스트라가 오픈AI 모델 가운데 처음으로 안전 기준상 ‘중대(Critical)’ 등급을 받은 것으로 설명됐다. 이는 아스트라가 인간의 지속적인 개입 없이 보안 취약점을 발견하고 공격에 사용할 수 있는 도구를 설계·실행하는 등 기존 모델보다 강한 사이버 역량을 갖췄다는 의미로 소개됐다.

 

강력한 사이버 역량은 방어 분야에서 활용할 경우 상당한 생산성을 제공할 수 있다. 보안 취약점 탐지와 코드 분석, 공격 가능성 평가를 자동화하면 기업과 기관이 보다 빠르게 보안 문제를 찾아 대응하는 데 활용될 수 있기 때문이다. 반면 동일한 능력이 악의적인 목적으로 사용될 경우 해킹 자동화나 공격 도구 제작 등에 악용될 위험도 함께 커질 수 있다.

 

이에 따라 오픈AI는 아스트라의 능력 향상과 함께 안전장치도 강화한 것으로 전해졌다. 제공된 내용에 따르면 모델의 사고 과정뿐 아니라 실제 행동이 사람의 의도와 정렬돼 있는지를 확인하는 ‘정렬(Alignment) 감시 기능’을 추가했다. 이는 AI가 복잡한 업무를 스스로 수행하는 과정에서 사용자의 지시와 다른 방향으로 행동하거나 위험한 작업으로 이어지는지를 감시하기 위한 장치로 설명된다.

 

오픈AI는 사이버보안 능력을 방어 목적으로 활용하고 악용 가능성을 낮추기 위한 대규모 지원책도 함께 내놓은 것으로 소개됐다. 제공된 자료에 따르면 약 10억달러, 한화 약 1조3500억원 규모의 사이버보안 방어 지원 프로그램인 ‘최전선 방어자를 위한 데이브레이크’를 발표했다. 아스트라의 보안 능력을 공격보다 방어에 활용할 수 있도록 지원한다는 취지다.

 

이번 발표는 AI 산업에서 ‘성능’과 ‘안전성’이 더 이상 별개의 문제가 아니라는 점도 보여준다. AI가 단순히 텍스트를 생성하는 수준을 넘어 직접 소프트웨어를 작성하고 보안 취약점을 찾아 실제 작업까지 실행할 수 있게 될수록 모델이 무엇을 할 수 있는지뿐 아니라 무엇을 하지 못하도록 통제할 것인지가 핵심 기술 과제로 부상하기 때문이다.

 

그렇다고 GPT-6 아스트라의 등장만으로 AGI가 완성됐다고 판단하기에는 여전히 논쟁의 여지가 있다. 제공된 자료에서도 외부에서는 아스트라를 AGI로 부르는 것이 시기상조라는 평가가 제기됐다. 인간이 사용하는 직관과 상식, 다양한 상황에서의 유연한 판단을 AI가 어느 정도까지 안정적으로 구현할 수 있는지 아직 충분히 입증되지 않았다는 이유에서다.

 

외부 평가에서도 이런 복합적인 모습이 나타난다. 제공된 기사에 따르면 AI 모델 분석 전문업체 아티피셜애널리시스는 GPT-6 아스트라의 지능지표인 AAII를 61점으로 평가했다. 이는 전작으로 언급된 ‘GPT-5.6 솔’과 동일한 점수로, 클로드 페이블 5.1과 클로드 오퍼스 5, 클로드 페이블 5, 뮤즈 스파크 1.3 등에 이어 공동 5위 수준으로 소개됐다.

 

이 결과가 사실이라면 특정 코딩 벤치마크에서 경쟁 모델보다 높은 점수를 기록했다는 사실과 AI의 전반적인 지능 수준을 종합한 평가 결과가 반드시 일치하지 않는다는 점을 보여준다. 특정 분야에서 큰 성능 향상이 나타나더라도 언어 이해와 추론, 수학, 장문 처리, 에이전트 수행 등 여러 분야를 종합하면 다른 결과가 나올 수 있기 때문이다.

 

GPT-6 아스트라를 둘러싼 향후 평가에서 중요한 것은 공개 직후 제시된 벤치마크 숫자만이 아니다. 실제 개발환경에서 복잡한 소프트웨어 문제를 어느 정도 안정적으로 해결하는지, 장시간 작업 중 오류가 누적되지 않는지, 사람이 개입하지 않는 상황에서도 안전한 결정을 유지하는지, 사이버보안 기능이 공격보다 방어 목적으로 통제될 수 있는지 등이 실제 활용 단계에서 확인돼야 한다.

 

특히 AI 에이전트 기술이 발전하면서 앞으로의 모델 경쟁은 단순히 “어떤 질문에 더 좋은 답을 내놓느냐”에서 “어떤 일을 얼마나 정확하고 안전하게 끝까지 수행할 수 있느냐”로 이동할 가능성이 크다. 아스트라가 제시한 업무수행 시간과 코딩·보안 능력이 실제 사용자 환경에서도 재현된다면 생성형 AI가 전문적인 업무 수행 도구로 이동하는 속도가 한층 빨라질 수 있다.

 

결국 GPT-6 아스트라 공개의 핵심은 ‘인간의 시대가 끝났다’는 식의 자극적인 해석보다는 AI가 인간의 컴퓨터 기반 업무를 어디까지 독립적으로 수행할 수 있는 단계에 도달했는지에 있다. 일부 코딩 벤치마크에서 클로드 페이블 5.1을 앞섰다는 평가와 강화된 사이버보안 능력은 분명 주목할 요소지만, 이것만으로 인간의 지능을 대체하거나 AGI가 완성됐다고 단정할 근거는 충분하지 않다.

 

향후 실제 이용 과정에서의 독립적인 성능 검증과 안전성 평가가 축적돼야 GPT-6 아스트라의 기술적 위치를 보다 정확하게 판단할 수 있다. 특히 오픈AI가 강조하는 ‘세대교체 수준의 도약’이 실사용 환경에서도 확인될지, 그리고 강력한 사이버 능력을 어떻게 안전하게 관리할지가 아스트라의 성패를 가르는 핵심 변수가 될 전망이다.

 

사실 확인 안내: 2026년 9월 5일 네이버 최신 검색에서는 ‘GPT-6 아스트라’, AGI, 사이버보안 등과 관련된 최근 게시물이 확인됐습니다. 다만 현재 공식 OpenAI 웹사이트와 원문 발표를 실시간으로 직접 조회할 수 없는 환경이므로, 위 기사는 사용자가 제공한 기사에 포함된 사실·수치·인용 내용을 토대로 재구성한 것입니다. 특히 GPT-6 아스트라의 공식 출시 여부, Critical 등급, 10억달러 프로그램, 각 벤치마크 점수와 AAII 순위는 게시 전 OpenAI 공식 발표와 해당 평가기관 원문을 최종 확인하는 것이 가장 정확합니다.





21

20

17

18

21

18

20

20

21

19

24

23
09-15 19:33 (화) 발표

ss

현대 세대의 디지털 혁신과 영향력 MZ세대의 IT/과학 Copyright © 2024 MZ세대의 IT/과학. All rights reserved.
.