오픈AI가 추론과 코딩 성능을 강화한 차세대 프론티어 모델 'GPT-6 아스트라'를 공개했다. 복잡한 업무를 직접 수행하는 에이전트 역량을 끌어올리고 과학·사이버보안 등 전문 영역의 성능도 높인 것이 특징이다. 오픈AI는 GPT-6 아스트라가 사전학습과 강화학습, 정렬 연구의 성과를 결합해 문제 해결 능력과 사용자 의도를 이해하고 따르는 능력을 강화했다고 밝혔다. 아스트라는 추상 추론 평가 'ARC-AGI-3'에서 최대 99.9%, 고난도 수학 평가 '프론티어매스 티어 4'에서 97.6%를 기록했다. 코딩 평가 '터미널 벤치 4.0'에서는 57.9%, 소프트웨어 엔지니어링 평가 '딥SWE v1.1'에서는 74.1%를 기록했다. 컴퓨터 조작 능력을 평가하는 'OS월드 2.0'에서는 72.6%로 GPT-5.6 Sol(65.7%)을 넘어섰다. 지연시간을 반영한 시뮬레이션에서는 작업 완료 시간도 약 47% 단축됐다. 과학·의료 분야에서도 '터미널 벤치 사이언스 0.1' 64.6%, '헬스벤치 프로페셔널' 63.4%를 기록했다. 사이버보안 역량이 강화되면서 안전장치도 확대했다. 아스트라는 오픈AI의 위험 관리 체계인 '프리페어드네스 프레임워크'에서 사이버보안 역량이 중대 수준에 도달했으며, 모델 자체의 사이버보안 능력을 측정하는 '익스플로잇 벤치'에서는 100%를 기록했다. 오픈AI는 위험한 사이버 활동을 탐지해 작업을 중단하는 모니터링 등 보호 조치도 강화했다. GPT-6 아스트라는 일부 조직을 대상으로 우선 제공된다. 향후 챗GPT 플러스·프로·비즈니스·엔터프라이즈 이용자와 오픈AI API, AWS로 제공 범위를 확대할 예정이다. API 표준 가격은 입력 토큰 100만개당 10달러, 출력 토큰 100만개당 50달러다(파이낸셜뉴스, 2026. 9. 4). |