오픈AI, ‘GPT-6 아스트라’ 선봬… “추론·코딩·과학 성능↑” 작성일 09-04 50 목록 <div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">안전장치도 확대…일부 조직부터 순차 제공</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="1Nyk4HEovD"> <figure class="figure_frm origin_fig" contents-hash="7155a5343a18020d4a4f555c57fdf2269d8efa7bce816786f33c9e701c9f601d" dmcf-pid="tjWE8XDglE" dmcf-ptype="figure"> <p class="link_figure"><img alt="GPT-6 아스트라 비주얼 이미지. 오픈AI 제공" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/04/dt/20260904182445747fykr.png" data-org-width="640" dmcf-mid="ZsLVGNfzTr" dmcf-mtype="image" height="auto" src="https://img3.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/04/dt/20260904182445747fykr.png" width="658"></p> <figcaption class="txt_caption default_figure"> GPT-6 아스트라 비주얼 이미지. 오픈AI 제공 </figcaption> </figure> <p contents-hash="d11313d8220d6af7cc51eb6d010d1ee06ea38ecc4707a71cf058b9bb0c0f048f" dmcf-pid="FAYD6Zwayk" dmcf-ptype="general"><br> 오픈AI는 차세대 프론티어 모델 ‘GPT-6 아스트라(Astra)’를 선보인다고 3일(현지시간) 밝혔다.</p> <p contents-hash="f59669f980b29acbc2fa3f419e61694580284d56bcd4b54651df079092c6bb3d" dmcf-pid="3cGwP5rNhc" dmcf-ptype="general">회사는 이 최신 모델이 추론, 컴퓨터 사용, 소프트웨어(SW) 개발, 사이버보안, 과학 등 다양한 영역에서 최고 수준의 성능을 보인다고 소개했다. 사전학습과 강화학습, 정렬(alignment) 연구의 성과를 결합해 복잡한 문제 해결 능력과 사용자 의도를 이해하고 따르는 능력을 함께 강화했다.</p> <p contents-hash="cd46b43705e239db58e3ad3ce7fce41f25cfc48b4f42f2b33380795297717e98" dmcf-pid="0kHrQ1mjWA" dmcf-ptype="general">오픈AI에 따르면 아스트라는 추상 추론 평가 ARC-AGI-3에서 최대 99.9%, 고난도 수학 평가 프론티어매스 티어4(v2)에서 97.6%를 기록하며 고난도 추론과 수학에서 최고 수준의 성능을 보였다. 코딩과 SW개발 영역에서도 성능이 향상됐다. 터미널벤치 4.0에서 57.9%의 성능을 기록했고, 실제 SW엔지니어링 역량을 평가하는 딥SWE v1.1에선 74.1%를 기록했다. 실제 수학 연구에서도 장기간 풀리지 않았던 문제 해결에 기여했다.</p> <p contents-hash="81ec8fb20769c07947a9cfebae24cca92bd8a30714baf0dc8d04d679e666dc29" dmcf-pid="pEXmxtsAWj" dmcf-ptype="general">컴퓨터와 브라우저를 직접 사용하는 능력에서도 큰 폭의 성능 향상을 보였다. OS월드 2.0 오프라인 평가에서 72.6%를 기록해 ‘GPT-5.6 솔(Sol)’의 65.7%를 넘어섰으며, 지연시간을 반영한 시뮬레이션에서는 작업 완료에 걸리는 시간도 약 47% 줄었다.</p> <p contents-hash="e7b626d93fa458e2afc7ad858eb7b026e9c559c57c324bb410f4dfd4cf9899cb" dmcf-pid="UDZsMFOcyN" dmcf-ptype="general">실제 도구를 활용해 복합적인 업무 흐름을 수행하는 능력을 평가하는 오토메이션벤치에선 41.4%를 기록해 GPT-5.6 솔의 18.1%보다 높은 성능을 보였다. 오픈AI는 아스트라가 컴퓨터 사용과 브라우징, SW개발뿐 아니라 전문 업무 전반에서도 최고 수준의 성능을 보인다고 강조했다.</p> <p contents-hash="4f34da25afff034a127e98a03f6359dac4212fa05d19e495f5c0a15dc88c8b59" dmcf-pid="ukHrQ1mjCa" dmcf-ptype="general">과학 연구 영역에서도 높은 성능을 보였다. 터미널벤치 사이언스 0.1에서 64.6%, 과학 추론 평가 GPQA 다이아몬드에서 96.0%, 의료 전문 평가 헬스벤치 프로페셔널에서 63.4%를 기록했다. GPQA 다이아몬드와 헬스벤치 프로페셔널에선 공개 비교표에 포함된 모델 가운데 가장 높은 점수를 달성했다.</p> <p contents-hash="406ad4828a65baf53c92296d067071afe2321734ed8274aba307f00d64e53612" dmcf-pid="7EXmxtsATg" dmcf-ptype="general">오픈AI는 아스트라가 자사 ‘프리페어드니스 프레임워크’(Preparedness Framework)에서 중대(Critical) 수준의 사이버보안 역량 기준에 도달했다고 설명했다. 운영 환경의 안전장치를 제외하고 모델 자체의 사이버보안 능력을 측정하는 익스플로잇벤치에선 100%를 기록했다. 위험한 사이버 활동을 탐지하고 일시 중지하거나 중단할 수 있는 모니터링을 비롯해해 모델 오용 가능성을 낮추기 위한 보호 조치를 강화했다.</p> <p contents-hash="c136d7cc97e68105cd56e8295787ef508f9853cafbff64648aa97ea9219174bb" dmcf-pid="zDZsMFOcvo" dmcf-ptype="general">오픈AI는 GPT-6 아스트라를 일부 조직을 대상으로 우선 제공한다. 향후 며칠에 걸쳐 챗GPT 플러스·프로·비즈니스·엔터프라이즈 사용자와 오픈AI 응용프로그램인터페이스(API) 및 아마존웹서비스(AWS)로 제공 범위를 확대할 계획이다. API 표준 가격은 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러로 책정됐다.</p> <p contents-hash="de644dd06b236474e15c1e5b3c282842560b2534fb7c8a2be1776ad6545b28cb" dmcf-pid="qw5OR3IklL" dmcf-ptype="general">팽동현 기자 dhp@dt.co.kr</p> </section> </div> <p class="" data-translation="true">Copyright © 디지털타임스. 무단전재 및 재배포 금지.</p> 관련자료 이전 [지금, 명의] “생후 2개월 아기 겨드랑이 4㎝만 절개…소아심장 수술도 진화” 09-04 다음 티빙, 개인정보 유출 사고 조사결과 발표…“3954만 전 계정 탈취” 09-04 댓글 0 등록된 댓글이 없습니다. 로그인한 회원만 댓글 등록이 가능합니다.