[배종찬의 보안 빅데이터] ‘AI 스스로 해킹’하는 시대, 통제 가능한가 작성일 08-04 19 목록 <div id="layerTranslateNotice" style="display:none;"></div> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="3vztYZ5TIg"> <p contents-hash="72dd5f5964193aa45e7abaff6c5f201088205e95bd4c0e7bd1c5bc494b400360" dmcf-pid="0TqFG51yOo" dmcf-ptype="general"><strong>오픈AI 최신 모델, 테스트 환경 스스로 벗어나 외부 플랫폼 침해 사례 발생<br>목표 달성 위해 스스로 경로 탐색하는 ‘자율 에이전트’ 진화의 양면성 노출</strong></p> <p contents-hash="b4c1749200ac88ab9e6fa08cf839730ebd975c780418e3b8d5ace63c7733bffa" dmcf-pid="pyB3H1tWsL" dmcf-ptype="general">[보안뉴스= 배종찬 인사이트케이 연구소장] 지난 한 달간 국내 뉴스와 소셜 빅데이터를 분석한 썸트렌드(SomeTrend)의 ‘빅데이터 감성 연관어 분석’(2026년 6월 29일~7월 28일) 결과, ‘AI해킹’이라는 키워드 주변에는 유독 무거운 단어들이 몰려 있다. ‘위협’, ‘우려’, ‘피해’, ‘경고하다’, ‘악용하다’ 같은 부정적 감성어가 절반 이상을 차지하는 가운데, ‘성장하다’, ‘진화하다’, ‘경쟁력’, ‘강화하다’, ‘최첨단’ 같은 긍정·중립 어휘도 함께 크게 자리 잡고 있다. </p> <figure class="figure_frm origin_fig" contents-hash="6c3f5a251b8dd6082ac37f1e4cd73c95f340d3718073758706151cd3af0b362c" dmcf-pid="UWb0XtFYOn" dmcf-ptype="figure"> <p class="link_figure"><img class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/04/552815-KkymUii/20260804175212423qqmw.jpg" data-org-width="750" dmcf-mid="8AiP948Bwh" dmcf-mtype="image" height="auto" src="https://img4.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/04/552815-KkymUii/20260804175212423qqmw.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> [출처: gettyimagesbank] </figcaption> </figure> <div contents-hash="08c6bf4f8457909603053193036e6f152366593ee262aa75aee650bd7806091d" dmcf-pid="uYKpZF3Gwi" dmcf-ptype="general"> <br>이는 지금의 AI 해킹 현상이 단순한 위협 하나로 정리되지 않는, 양면적이고 복합적인 사안임을 그대로 보여준다. AI는 한편으로 해킹 탐지와 방어 역량을 ‘진화’시키고 ‘경쟁력’을 ‘갖추게’ 하는 도구이면서, 동시에 스스로 통제를 벗어나 ‘무너지다’, ‘혼란’, ‘전산장애’를 일으킬 수 있는 ‘위험’ 요인으로 인식되고 있는 셈이다. </div> <p contents-hash="de790a23c9d26e9fe27f29a4d6644926b983152fb62e097451ee6bf3baf6c82a" dmcf-pid="7G9U530HEJ" dmcf-ptype="general">‘AI 스스로 해킹’ 혹은 ‘AI 멋대로 해킹’이라는 표현은 더 이상 비유가 아니다. 실제로 지난 7월 21일 오픈AI는 자사의 최신 모델 GPT-5.6 솔과 미공개 모델이 내부 사이버보안 평가를 받던 중 격리된 테스트 환경, 이른바 샌드박스를 스스로 벗어나 외부 인터넷에 접속하고 개방형 AI 공유 플랫폼 허깅페이스의 시스템을 침해했다고 공식 발표했다.</p> <p contents-hash="474d9986fe921d64b7c1ede24f9c341b08a8341baeb2621e8a3d420d6f1d3e8c" dmcf-pid="zH2u10pXmd" dmcf-ptype="general">인간 연구자가 명령을 내린 것이 아니라, 벤치마크 문제의 정답을 더 효율적으로 찾아내려는 과정에서 AI가 스스로 취약점을 찾아 침투 경로를 설계하고 실행에 옮긴 사건이다. 허깅페이스 측은 자체 탐지 시스템으로 침입을 포착했으며, 조사 결과 수만 건에 달하는 자동화된 행위가 이른바 ┖자율 에이전트 무리┖에 의해 수행된 것으로 파악됐다.</p> <figure class="figure_frm origin_fig" contents-hash="25079f71a85b43a63beaef555f65bf7eef668846bd3ec43f6c45425186cf3f39" dmcf-pid="qXV7tpUZwe" dmcf-ptype="figure"> <p class="link_figure"><img class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/04/552815-KkymUii/20260804175213707jxtx.jpg" data-org-width="750" dmcf-mid="Fa6bpzqFEa" dmcf-mtype="image" height="auto" src="https://img3.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/04/552815-KkymUii/20260804175213707jxtx.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> ▲‘해커톤’ 연관어 빅데이터 분석 [출처: 인사이트케이] </figcaption> </figure> <div contents-hash="2b01acc42d665f5ed07f917d8da4a82767d4cbf55bd40d627e8fd16c0fe82354" dmcf-pid="BNyOkrmjrR" dmcf-ptype="general"> <br>이는 빅데이터 분석에서 유독 크게 표시된 ‘진화하다’, ‘갖추다’, ‘경쟁력’이라는 단어와 정확히 맞닿아 있다. AI는 사람이 일일이 지시하지 않아도 목표를 달성하기 위한 경로를 스스로 탐색하고 실행하는 ‘에이전트’로 진화하고 있으며, 이 능력이 방어에 쓰이면 강력한 보안 도구가 되지만 통제를 벗어나면 곧바로 공격자가 된다. </div> <p contents-hash="31a3115dc690d571b204ce0ef2535f7469851a7d3921e5802c339aa2cf2b60f1" dmcf-pid="bjWIEmsAsM" dmcf-ptype="general">실제로 앤트로픽 역시 지난해 자사 AI 모델이 중국 정부 배후로 추정되는 해킹조직에 의해 악용되어, 세계 곳곳의 기술·금융·정부기관을 겨냥한 대규모 자동화 공격에 동원되었다고 밝힌 바 있다. 이처럼 ‘AI 스스로 해킹’은 크게 두 갈래로 나뉜다. 하나는 AI가 인간의 통제나 원래 목적을 벗어나 예상치 못한 방식으로 스스로 판단해 침투 행위를 벌이는 경우이고, 다른 하나는 악의적 행위자가 AI를 도구로 삼아 해킹의 속도와 규모를 극단적으로 끌어올리는 경우다. </p> </section> </div> <p class="" data-translation="true">Copyright © 보안뉴스. 무단전재 및 재배포 금지.</p> 관련자료 이전 AI로 얼굴·목소리 베끼는 ‘디지털 레플리카’ 규제 추진 08-04 다음 실내외 로봇에 제어 플랫폼까지…‘이해진의 로봇 빅픽처’ 연내 완성한다 08-04 댓글 0 등록된 댓글이 없습니다. 로그인한 회원만 댓글 등록이 가능합니다.