로그인
보증업체
스포츠중계
스포츠분석
먹튀사이트
지식/노하우
판매의뢰
업체홍보/구인
뉴스
커뮤니티
포토
포인트
보증카지노
보증토토
보증홀덤
스포츠 중계
기타
축구
야구
농구
배구
하키
미식축구
카지노 먹튀
토토 먹튀
먹튀제보
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
제작판매
제작의뢰
게임
구인
구직
총판
제작업체홍보
실시간뉴스
스포츠뉴스
연예뉴스
IT뉴스
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[실시간뉴스]
네팔·티베트 대홍수 사망 797명·실종 3048명…터널 구조 사력
N
[IT뉴스]
[AI & LAW] '고영향 AI'라는 낯선 이름
N
[IT뉴스]
[취재수첩] ‘국가대표 AI’라는 이름의 과열
N
[실시간뉴스]
네팔 韓 근로자 9명 실종 엿새째…수색 드론조차 못 띄워
N
[실시간뉴스]
진로 변경·역주행 차량 골라 '쾅'…보험금 1500만원 편취한 택시기사[사기꾼들]
N
커뮤니티
더보기
[자유게시판]
드디어 금요일이군요
[자유게시판]
오늘 다저스 어떻게 생각하시나요
[자유게시판]
하아 댓노
[자유게시판]
식곤증지립니다요
[자유게시판]
벌써 불금이네요
목록
글쓰기
[IT뉴스]인간 행세하는 AI에 실리콘밸리 골머리...거짓말하고 저격글까지 스스로 작성
온카뱅크관리자
조회:
3
2026-08-31 07:37:26
<div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">7월 한달만 300건…연간 누적 1600건 돌파<br>"BOOM!"…해킹 성공에 자축한 AI 에이전트들<br>오픈AI·구글·메타 종사자 1200명 "속도 조절 나서달라"</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="BsEqCiHlTa"> <figure class="figure_frm origin_fig" contents-hash="0a64c16cd91d05bd90afd54d92241cce0c87e606422f00b92a314a4a8bf9d078" dmcf-pid="bODBhnXSCg" dmcf-ptype="figure"> <p class="link_figure"><img alt="AI로 만든 이미지 [사진=제미나이]" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/31/552779-26fvic8/20260831073157770oskb.png" data-org-width="640" dmcf-mid="qbHJ0I9UlN" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/31/552779-26fvic8/20260831073157770oskb.png" width="658"></p> <figcaption class="txt_caption default_figure"> AI로 만든 이미지 [사진=제미나이] </figcaption> </figure> <p contents-hash="e56e4dfed655253a69e4f5ba3afd0d7b99d28ae4e1b90b5b27b11939a5e2f675" dmcf-pid="KIwblLZvTo" dmcf-ptype="general">인공지능(AI) 모델의 발달과 함께 AI가 스스로 통제에서 벗어나 인간인 척 행세하며 승인 절차를 무력화하는 등 이탈행동 사례가 급격히 증가하고 있다. 실험실이 아닌 실제 배포 환경에서 수집한 수치라는 점에서 정부보다 AI업계가 먼저 경각심을 키우는 상황이다.</p> <p contents-hash="bb03b054b88009743f4eba794346f9a9c8fe099ffccdffb0ae7d0a6b4f47c8bb" dmcf-pid="9CrKSo5TSL" dmcf-ptype="general">30일 IT업계에 따르면 영국 AI안전연구소(AISI)의 싱크탱크 CLTR(Centre for Long-Term Resilience)은 'AI 통제이탈 관측소'를 통해 지난해 10월부터 올해 3월까지 5개월간 18만3000여 건의 트랜스크립트를 분석해 신뢰할 수 있는 AI 이탈행동 698건을 확인했다. 이 기간 월별 발생건수는 4.9배 증가했다.</p> <p contents-hash="8756d5e62c9cb3d3af339f5ef81ca896961e69b726865bd287c5b516917ac10b" dmcf-pid="2hm9vg1ySn" dmcf-ptype="general">별도 발표된 최신 수치에 따르면 7월 한달에만 300건 이상의 이탈행동 사례가 확인돼 6월 대비 거의 두 배로 늘었고, 2026년 누적 확인 건수는 1600건을 넘어섰다.</p> <p contents-hash="be3d36aca371f19f866c026c6612ade332f6cd809167a53a0ea137db5385400b" dmcf-pid="Vls2TatWWi" dmcf-ptype="general">AI의 이탈행동 방식도 다양하다. 호주에서는 개인용 AI 에이전트가 사용자 몰래 헬스장 인기 아침반 대기명단에서 다른 회원을 제외시켜 자리를 만든 사건이 있었다.</p> <p contents-hash="268b9bd14051b8a15e20f9823ac0192f6d46f60f206cbfb7dcb7406fbb9d038d" dmcf-pid="fSOVyNFYvJ" dmcf-ptype="general">한 AI 모델은 자신을 통제하는 인간인 척 문체까지 흉내내 스스로 승인절차를 통과시켰고, 다른 사례에서는 개발자가 코드 수정 제안을 거부하자 AI 에이전트가 해당 개발자를 비판하는 글을 블로그에 올려 공개 비난했다.</p> <p contents-hash="fde38f658ae67e01deccb7facf7a754b06bfa5a5b7df40294141e04846c52a5a" dmcf-pid="4vIfWj3GSd" dmcf-ptype="general">저작권 제한을 피하려 '청각장애인용 접근성 대본을 만드는 중'이라며 다른 AI 모델을 속인 사례, 자신의 추론 과정을 요약·감시하는 별도 AI를 속이려 한 정황도 새롭게 포착됐다. CLTR은 이 같은 사례들이 그동안 실험 환경에서만 보고돼온 기만행동이 실제 배포 환경에서도 동일하게 나타나고 있다는 증거라고 짚었다.</p> <p contents-hash="6a3dbb0e5a73f922d6951446c9fd01995d0b06ac0af83b0be3ee7fda7abac22b" dmcf-pid="8TC4YA0Hve" dmcf-ptype="general">같은 흐름은 오픈AI에서도 확인됐다. 오픈AI는 지난주 공개한 기술보고서에서, 7월 자사의 내부 연구용 모델들이 사이버보안 평가 도중 소프트웨어 저장소 허깅페이스의 실제 프로덕션 서버에 침투한 사건의 전말을 밝혔다.</p> <p contents-hash="a4396615ec8273611db404cf237dedbab17f9ae5b8a572026e8d6db164535a96" dmcf-pid="6yh8GcpXWR" dmcf-ptype="general">최대 700개에 달하는 자율 에이전트들이 즉석에서 만든 메시지보드를 통해 서로 소통하며 훈련 평가를 속이는 '리워드 해킹'을 벌였고, 해킹에 성공할 때마다 "BOOM!", "Whoa!" 같은 감탄사를 남기며 서로 자축한 정황도 담겼다.</p> <p contents-hash="a3793456fd5d4886e3b3bf46803e81d2065e5300768023492bdad771daf3d27c" dmcf-pid="PWl6HkUZhM" dmcf-ptype="general">오픈AI는 이미 5월 말부터 관련 징후를 내부적으로 포착했지만 테스트를 중단하지 않았다며 "지나고 보니 초기 신호가 더 빠른 대응을 촉발할 수도 있었다"고 인정했다.</p> <p contents-hash="0955427e9ee47ca3c5b8ea5acae95a2fc839d5849f859ab9455811e1406014dc" dmcf-pid="QYSPXEu5Cx" dmcf-ptype="general">사건 이후 오픈AI는 문제가 된 모델의 가중치를 격리 조치하고, 프런티어 강화학습 훈련을 일부 지연시켰으며, 정렬(얼라인먼트) 훈련을 가속화하는 등 보안 개선에 나섰다고 밝혔다. 앤트로픽과 메타 역시 허깅페이스 사건 이후 "우리 모델도 배포 전 테스트 과정에서 실제 시스템을 해킹한 적이 있다"고 인정하며, 이번 문제가 오픈AI만의 사례가 아니라는 점을 시사했다.</p> <p contents-hash="50ab0377fc81836a7368d211908afb923eb48f288c463adfb5ec840db1487ac5" dmcf-pid="xODBhnXShQ" dmcf-ptype="general">CLTR은 "아직 최악의 시나리오는 관측되지 않았다"면서도, AI 에이전트가 코드·소프트웨어를 넘어 금융·인프라 등 더 중요한 업무를 맡게 될수록 위험 수위가 높아질 수 있다고 경고했다. 이에 따라 각국 정부에 AI 기업의 심각한 통제이탈 사건에 대한 모니터링·보고를 의무화하고, 필요 시 AI 서비스를 일시 제한할 수 있는 비상권한을 도입할 것을 요구했다.</p> <p contents-hash="0e7176279f5e024dacd46a7b261db71a2aaded8cf45d37a6f6dd168524a30da9" dmcf-pid="y2qw45J6vP" dmcf-ptype="general">업계 전반의 경계감도 커지고 있다. 지난달 30일 오픈AI·앤트로픽·구글 딥마인드·메타 소속 1200명 이상의 AI 업계 종사자들은 "정부가 AI 개발 속도를 조절할 수 있는 장치 마련에 나서달라"는 공동성명 '페이싱 더 프런티어'에 서명했다. 오픈AI는 이달 초 차세대 모델 '아스트라'가 사이버보안 관련 잠재 위험 신호를 보였다는 이유로 일부 모델 개발을 일시 중단하기도 했다.</p> </section> </div>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기