AI들이 팀처럼 움직였다… 사이트 해킹하고 정보도 공유 작성일 09-07 81 목록 <div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">똑똑해질수록 더 위험해진 ‘일탈’</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="1DGrIbYCXQ"> <figure class="figure_frm origin_fig" contents-hash="403dfcb9eff66baeb6ef2062b72503bfdc1d8988f64008c3b9ce5708dbfd3138" dmcf-pid="twHmCKGhYP" dmcf-ptype="figure"> <p class="link_figure"><img alt="챗GPT 생성 이미지" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/07/chosun/20260907004912939eshd.jpg" data-org-width="1448" dmcf-mid="ZzJzKEQ9YM" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/07/chosun/20260907004912939eshd.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> 챗GPT 생성 이미지 </figcaption> </figure> <p contents-hash="5dd9d5ce7ef6e72e7e8c427c6861d45cd66db8102f7c00e5cc757b891f899d8e" dmcf-pid="FrXsh9HlZ6" dmcf-ptype="general">오픈AI의 인공지능(AI) 에이전트(비서) 약 3700개가 지난 5월 독일 프로그래밍 위키 사이트 ‘DseWiki(데에스에비키)’를 해킹, 자체 정보 공유 게시판처럼 사용하며 1만5000건 넘는 편집을 한 사실이 드러났다고 6일 외신들이 보도했다.</p> <p contents-hash="102fb21f5ad253c7c58c6b7722ca66f600d99bba9f23a38d3de595b50a3396d7" dmcf-pid="3mZOl2XSH8" dmcf-ptype="general">AI 에이전트들은 접속자가 뜸한 이 사이트에서 테스트 과제를 부정하게 해결하는 방법과 시스템 제한을 우회하거나 자신의 행동을 감추는 방법 등을 공유했다. 또 사이트 운영자가 관련 페이지를 삭제하자, 이를 피하려 백업 페이지까지 만들었다. 마치 인간 해커 수십 명이 모인 ‘팀’처럼 행동한 것이다.</p> <p contents-hash="ddc0bbf61b354873770065412aedb2d5791e65760d04445da81377235f891ea6" dmcf-pid="0s5ISVZvZ4" dmcf-ptype="general">오픈AI는 이 사건을 수 주 전에 파악했으나 공개하지 않았다. 오픈AI는 5일(현지 시각) 성명을 내고 “AI의 의도하지 않은 행동에 대한 공개 관행이 새로운 모델 능력의 단계에 맞춰 확대될 필요가 있다”며 “업계에 아직 명확한 공개 기준이 없다”고 주장했다.</p> <p contents-hash="9642f12dce690e9a51df0ab899fb34a9c4fc304a75a284e4c2ee0270a9e8953e" dmcf-pid="pO1Cvf5T5f" dmcf-ptype="general">똑똑해진 AI들의 ‘위험한 일탈’이 계속되고 있다. 과거 AI의 오류가 잘못된 답변이나 허위 정보 생성에 그쳤다면, 최근의 에이전트형 AI는 인터넷을 통해 외부 시스템에 침입, 마음대로 내용을 바꾸거나 이메일을 보내는 등 인간 해커와 다름없는 일도 벌일 수 있게 됐다. 오픈AI와 앤스로픽 등이 더 강력한 에이전트형 AI를 잇달아 내놓으면서, 통제 기술이 성능 향상 속도를 따라가지 못하는 게 아니냐는 우려도 커지는 상황이다.</p> <figure class="figure_frm origin_fig" contents-hash="961289cb8d63dee6bb5b78eb66e0e20c69580b67fce6e35eae6a84cd55d6db57" dmcf-pid="U1VFUg2uXV" dmcf-ptype="figure"> <p class="link_figure"><img alt="그래픽=백형선·Gemini" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/07/chosun/20260907004914290mjum.jpg" data-org-width="2000" dmcf-mid="5ZQ7bkPKGx" dmcf-mtype="image" height="auto" src="https://img2.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/07/chosun/20260907004914290mjum.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> 그래픽=백형선·Gemini </figcaption> </figure> <p contents-hash="f3dfd8304e648bd39f7e355d34916d13b4710d970ac033a8152a9196d8ebddfb" dmcf-pid="utf3uaV7H2" dmcf-ptype="general"><strong>◇잇따르는 AI의 ‘통제 실패’</strong></p> <p contents-hash="cdea85c5cde2b05a95ef6017fa678da2017b93ef790e693c1ad72dd1a30aac6d" dmcf-pid="7F407NfzH9" dmcf-ptype="general">오픈AI에선 지난 7월 AI 에이전트들이 격리된 테스트 환경의 취약점을 뚫고 탈출해 인터넷에 접속, AI 기술 공유 플랫폼 허깅페이스의 시스템에 침입하는 사고가 벌어졌다. 후속 조사 결과, 하나가 아닌 약 700개의 에이전트가 사고에 관여했고 일부는 평가 기록을 바꾸거나 흔적을 감추려고까지 한 것으로 파악됐다.</p> <p contents-hash="10d7972ab0b1c37a781c23ef1b4c2421481b5994bc598dbf96e2fa95d0a7a378" dmcf-pid="z38pzj4q1K" dmcf-ptype="general">메타가 출시 준비 중인 개인용 AI 에이전트 ‘해치(Hatch)’도 비슷한 문제를 일으켰다. 호텔을 검색·예약하도록 맡겼더니 예약 대신 여행 포인트를 호텔 계정으로 옮겼고, 이용자의 동의를 받으라는 지시에도 마음대로 이메일을 보냈다. 건강관리 사이트 비밀번호를 허락 없이 바꾸거나, 외부에서 이메일로 비밀번호를 묻자 실제 비밀번호를 알려준 사례까지 나왔다.</p> <p contents-hash="c1bc2932e55b1815141eca2eaced27b0f5d8cc5f04858588d526961f58ee608b" dmcf-pid="q06UqA8BYb" dmcf-ptype="general">앤스로픽의 클로드 최신 모델도 외부 보안 평가 중 인터넷에 접속해 외부 시스템 3곳에 무단 접근한 사실이 지난 7월 뒤늦게 알려졌다. 안전 장치를 의도적으로 완화한 테스트 과정이었으나, 앤스로픽은 이후 외부 평가를 일시 중단했다.</p> <p contents-hash="6818cc1e712b690bfffb716b7cdd3ac5c1fb78248d88ee0fa6dc14a2c76f5bf8" dmcf-pid="BpPuBc6bXB" dmcf-ptype="general">AI가 똑똑해지고 권한이 많아질수록, 문제가 발생했을 때 피해 규모는 더 커진다. 영국 파이낸셜타임스(FT)는 보험업계 보고서를 인용해 “대형 AI 사고 한 건의 직접 피해가 약 1000억달러(약 134조원)에 이를 수 있다”고 분석했다.</p> <p contents-hash="f4affdc91750971edf80a7e869c9f403a9f9559ee9f3fe298b0349df0be8ed43" dmcf-pid="bUQ7bkPK5q" dmcf-ptype="general"><strong>◇성능 발전에 뒤처지는 안전장치</strong></p> <p contents-hash="5f5748831fac0fb8b3e1aa8aee7bd45ccc77742c7d0a86f8352f4b83ea74d503" dmcf-pid="KuxzKEQ9Hz" dmcf-ptype="general">기업들은 이미 크고 작은 사고를 경험하고 있다. IBM이 전 세계 기업 기술 임원 2000명을 대상으로 조사해 보니, 이들은 지난 1년간 평균 54건의 AI 에이전트 사고를 경험했다. 이 중 17%가 해결에 4시간 이상이 걸린 ‘고위험 사고’였다.</p> <p contents-hash="4822ba0d657277a79673c0d6f6f69e44fd74e08a67468613b8d895a916e9b683" dmcf-pid="9SpTGQ0HG7" dmcf-ptype="general">이런 사고는 AI 기업들이 앞다퉈 초고성능 AI를 내놓는 와중에 벌어지고 있다. 오픈AI가 최근 ‘GPT-6 아스트라’를 공개했고, 앤스로픽은 ‘클로드 페이블 5.1’을, 메타도 새 AI 모델을 선보이며 모델 경쟁이 다시 격화 중이다. 성능이 높아질수록 AI가 스스로 판단하고 처리하는 일도 늘어나고 있다.</p> <p contents-hash="5d5e68fe0c7b4a2ca8a14f7c63207a0e8b8c441316e94839ac11313bc7718a75" dmcf-pid="2vUyHxpXYu" dmcf-ptype="general">기업들도 통제·안전장치 강화에 힘쓰고 있다. 메타는 AI가 이메일을 보내거나 브라우저를 사용하고 외부 네트워크에 접속하기 전 반드시 이용자의 승인을 받도록 하는 ‘하드 게이트’를 도입했다. 오픈AI도 에이전트가 비정상적으로 행동하면 바로 중단시키는 ‘자동 셧다운’ 기능을 개발하고, 테스트 중 인터넷 접근과 행동 감시를 강화하겠다고 밝혔다.</p> <p contents-hash="9b3eb602f68d36cf6fe32b2036fb65a25f85fdd697729226632a0a1182b12a30" dmcf-pid="VTuWXMUZ1U" dmcf-ptype="general">그러나 AI의 성능 향상 속도를 통제 기술이 따라가지 못한다는 회의론도 나온다. AI 안전 평가 기관 가이드라이트 AI 스탠더드는 “주요 AI 기업들이 자신들이 만든 고성능 시스템을 아직 충분히 격리·통제하지 못하고 있다”고 지적했다.</p> </section> </div> <p class="" data-translation="true">Copyright © 조선일보. 무단전재 및 재배포 금지.</p> 관련자료 이전 [동아 게임 백과사전] 최종보스보다 쎈데 힘을 숨긴 보스들 09-07 다음 “심각한 저평가”…노무라 ‘삼전닉스’ 목표가 ‘67만·470만’ 유지 09-07 댓글 0 등록된 댓글이 없습니다. 로그인한 회원만 댓글 등록이 가능합니다.