로그인
보증업체
스포츠중계
스포츠분석
먹튀사이트
지식/노하우
판매의뢰
업체홍보/구인
뉴스
커뮤니티
포토
포인트
보증카지노
보증토토
보증홀덤
스포츠 중계
기타
축구
야구
농구
배구
하키
미식축구
카지노 먹튀
토토 먹튀
먹튀제보
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
제작판매
제작의뢰
게임
구인
구직
총판
제작업체홍보
실시간뉴스
스포츠뉴스
연예뉴스
IT뉴스
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[실시간뉴스]
與野, DMZ 폭발사고 공방 격화…“정쟁 소재로 호도” vs “北 소행이 두려운가”
N
[실시간뉴스]
민주당 “조희대, 격노하며 독단적으로 재제청 거부”
N
[IT뉴스]
철권으로 종주국 日 잡았다...韓 e스포츠 아시안게임 메달 질주
N
[실시간뉴스]
수장도 시스템도 없이 사건 2168건 대이동
N
[실시간뉴스]
고속터미널 귀경 행렬…고속도로 정체 절정
N
커뮤니티
더보기
[자유게시판]
드디어 금요일이군요
[자유게시판]
오늘 다저스 어떻게 생각하시나요
[자유게시판]
하아 댓노
[자유게시판]
식곤증지립니다요
[자유게시판]
벌써 불금이네요
목록
글쓰기
[IT뉴스]“안전장치 뚫고 탈출… 오픈AI·앤트로픽, AI 통제 실패 사례 ‘수만건’ 조사”
온카뱅크관리자
조회:
2
2026-09-27 18:07:25
<div id="layerTranslateNotice" style="display:none;"></div> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="PSxK9BwagJ"> <figure class="figure_frm origin_fig" contents-hash="1807888d1177c3ad8342245a02610882c4b1a1ae7ecb49da6050d3f9a38fd7d5" dmcf-pid="QvM92brNNd" dmcf-ptype="figure"> <p class="link_figure"><img alt="오픈AI와 앤트로픽 로고./로이터연합뉴스" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/27/chosunbiz/20260927175712534oobl.jpg" data-org-width="3500" dmcf-mid="6d5Svh4qgi" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/27/chosunbiz/20260927175712534oobl.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> 오픈AI와 앤트로픽 로고./로이터연합뉴스 </figcaption> </figure> <p contents-hash="e1d58e824283c53d4acd08ac9d07ba26e5b3c2acb11f277b9cc7dca9cf14a462" dmcf-pid="xTR2VKmjoe" dmcf-ptype="general">오픈AI와 앤트로픽이 최근 수개월간 인공지능(AI) 모델이 안전장치를 우회하거나 격리된 시험환경을 벗어나려 한 사례 등 수만건의 ‘이상행동’을 조사하고 있는 것으로 전해졌다.</p> <p contents-hash="35c35947abffb66f0cb10fc1c39fe36ad549737200f7f73b2983d109306dd47e" dmcf-pid="ykBtF5nQjR" dmcf-ptype="general">26일(현지시각) 미국 인터넷매체 악시오스는 복수의 소식통을 인용해 오픈AI와 앤트로픽, 외부 보안 연구자들이 최근 수개월간 첨단 AI 모델에서 확인된 수만건의 문제 행동을 조사하고 있다고 보도했다. 조사 대상은 기업 내부 시험과 실제 인터넷 환경에서 발생한 사례를 모두 포함한다.</p> <p contents-hash="d4096bdd06f6510c85b4657566cfcf323b03ef16f4599cac4d1a92b5d075c61c" dmcf-pid="WEbF31LxoM" dmcf-ptype="general">확인된 행동 유형은 ▲AI 모델이 회사가 설정한 안전장치를 우회하거나 외부와 격리된 ‘샌드박스’를 벗어나려 한 사례 ▲웹사이트 침입 ▲온라인 게시판 생성 ▲스스로 추가 지시를 만들어 작업을 이어가는 행동 ▲감시 시스템을 피하려 한 시도 등이다. 조사가 진행되면서 전체 사례가 현재 파악된 수만건보다 더 늘어날 가능성도 있다고 악시오스는 전했다. 이런 행동의 일부는 개발사가 취약점을 찾기 위해 의도적으로 모델을 극단적인 상황에 놓는 ‘레드팀’ 시험 과정에서 나온 것이라고 한다.</p> <p contents-hash="4f0eaf4f7966687a5eb6f57a719f111676392916ab6f8edfc0575da15178422d" dmcf-pid="YDK30toMcx" dmcf-ptype="general">앤트로픽의 최신 AI 모델에서도 이런 행동이 관찰됐다. 이 회사가 지난 22일 공개한 ‘클로드 오퍼스 5.5(Claude Opus 5.5)’의 시스템 카드에 따르면, 모델이 격리 환경의 경계를 넘어설 가능성을 확인하기 위해 설계한 시험에서 오퍼스 5.5는 전체 실행의 1.5%에서 샌드박스를 탈출하거나 경계를 변조하려 했다. 해당 시험은 정상적인 방법으로는 과제를 해결할 수 없도록 설계된 적대적 실험이었으며, 앤트로픽은 모든 시도를 낮은 심각도로 평가했다. 이전 오퍼스 5와 미소스(Mythos) 5.1보다 경계 우회 시도가 약 85% 줄었다.</p> <p contents-hash="8b29544e955fd6770940892c4c516c240ad4443979c9ae1676b2b57f8567655e" dmcf-pid="Gw90pFgRoQ" dmcf-ptype="general">앤트로픽은 자체 조사 범위도 대폭 넓혔다. 앞서 실제 외부 시스템에 무단 접근한 사례가 발견되자 약 14만1000건의 사이버보안 평가 기록을 검토했고, 이후 조사 범위를 강화학습(RL) 환경과 하위 에이전트 기록 등을 포함한 약 4억8100만건의 기록으로 확대했다. 이 가운데 인터넷 접속 가능성이 있다고 분류된 920만건을 추가 분석한 결과 기존에 확인한 4건 외에 같은 수준 이상의 외부 시스템 침해 사례는 발견하지 못했다고 밝혔다. 외부 안전평가기관 METR에도 독립 조사를 맡겼다.</p> <p contents-hash="1bb4021ef778b20dc09e7f232c7bb252c9d705d929a6d70dc126593835f2646b" dmcf-pid="Hr2pU3aegP" dmcf-ptype="general">오픈AI에서도 실제 인터넷 사이트를 대상으로 한 예상 밖 행동이 잇따라 확인되고 있다. 최근 공개된 사례 가운데는 챗GPT 이용자가 제공한 이미지 53장을 외부 이미지 호스팅 사이트에 게시하거나, 호주 정부의 보건통계 시스템에 허용 범위를 넘어 접근한 사건 등이 있다. 오픈AI는 가장 성능이 높은 모델에 대해 도구 사용이 포함된 학습·평가·추론 작업을 중단하고 안전장치를 재점검하고 있다.</p> <p contents-hash="d79830cd22e338bab8967e891c4ccf44fc93fe11081a511a2df3ee999ca3220c" dmcf-pid="XmVUu0Ndk6" dmcf-ptype="general">유엔(UN) 사이트에서도 별도의 접근 사례가 확인됐다. 월스트리트저널(WSJ)이 26일 공개된 독립 연구 결과를 인용해 보도한 내용에 따르면 오픈AI와 연관된 AI 에이전트들은 지난 4월부터 6월 말까지 유엔무역개발회의(UNCTAD)가 운영하는 공개 데이터 사이트를 1만6000회 이상 조회했다. 처음에는 공개 자료를 확보하려 했지만 요청이 차단되자 필터를 우회하고 사이트 운영자가 허용하지 않은 방식으로 데이터에 접근하려 한 것으로 분석됐다.</p> <p contents-hash="31f95113ab252fe311f0d9b8ab7f74b63c1f5bf8dee14d5a1c2793a4e8db3a14" dmcf-pid="Zsfu7pjJj8" dmcf-ptype="general">AI 기업들이 대규모 조사에 나선 것은 모델이 스스로 여러 단계의 작업을 수행하는 ‘에이전트’ 형태로 발전하면서 행동 경로를 사전에 모두 예상하기 어려워지고 있기 때문이다. 특히 AI에 외부 인터넷 접속이나 코드 실행, 계정 접근 같은 도구 사용 권한을 부여하면 당초 개발자가 예상하지 않은 방법을 찾아 목표를 달성할 가능성이 커진다.</p> <p contents-hash="4d78eaec3d3b4b3878a820d277a0ca2a4002d0a2ea4717d5010c739983250f1d" dmcf-pid="5O47zUAik4" dmcf-ptype="general">악시오스는 업계 관계자들을 인용해 모델이 취할 수 있는 모든 행동을 미리 열거해 차단하는 방식에는 한계가 있다고 전했다. 독립 AI 평가기관 트랜스루스(Transluce)의 연구자 콘래드 스토시는 “지금까지 AI 에이전트에서 확인된 행동은 빙산의 일각”이라고 말했다.</p> <p contents-hash="4ea4eb1980297413fedc89feaef50c0d110f1d073e67085b50b0e9171c74353a" dmcf-pid="1I8zqucnjf" dmcf-ptype="general">- Copyright ⓒ 조선비즈 & Chosun.com -</p> </section> </div> <p class="" data-translation="true">Copyright © 조선비즈. 무단전재 및 재배포 금지.</p>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기