로그인
보증업체
스포츠중계
스포츠분석
먹튀사이트
지식/노하우
판매의뢰
업체홍보/구인
뉴스
커뮤니티
포토
포인트
보증카지노
보증토토
보증홀덤
스포츠 중계
기타
축구
야구
농구
배구
하키
미식축구
카지노 먹튀
토토 먹튀
먹튀제보
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
제작판매
제작의뢰
게임
구인
구직
총판
제작업체홍보
실시간뉴스
스포츠뉴스
연예뉴스
IT뉴스
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[실시간뉴스]
인사수석 신설 무색…용혜인 사퇴에 靑 ‘정무 판단’ 도마
N
[IT뉴스]
위메이드 경영권 매각...네오펄스-킹넷 컨소시엄 "10월 30일 거래 종결 목표"
N
[IT뉴스]
시진핑 "AI 개방·협력·공유해야"…브릭스서 中 주도권 메시지
N
[IT뉴스]
달 사진 들이대면 AI가 알아서 분석…‘생명수’ 얻을 얼음 분포지 찍어준다
N
[IT뉴스]
[AI 고속도로] 공무원 AI도 국산 NPU로…범정부 인프라 다변화 속도
N
커뮤니티
더보기
[자유게시판]
드디어 금요일이군요
[자유게시판]
오늘 다저스 어떻게 생각하시나요
[자유게시판]
하아 댓노
[자유게시판]
식곤증지립니다요
[자유게시판]
벌써 불금이네요
목록
글쓰기
[IT뉴스]"챗GPT-5.2 이미지 가역성, 사람 절반 수준"
온카뱅크관리자
조회:
5
2026-09-14 11:57:25
<div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">GIST, C3-벤치 개발 AI 정확성 등 평가해보니…"문장 자연스러움은 더 우수"</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="pcgEHCEoaq"> <p contents-hash="5a2d4e05aadf4efb158ff3d6ada44af51b9965b1a599a35cc0e7ae20a3f5bea5" dmcf-pid="UkaDXhDgAz" dmcf-ptype="general">(지디넷코리아=박희범 기자)<span>인공지능(AI)이 제대로 답을 찾았는지를 평가하는 벤치마크가 개발됐다. 챗 GPT를 사람과 비교했을 때 가역성(역으로 뒤집어 보는) 평가에서는 절반 수준에 불과한 것으로 나타났다.</span></p> <p contents-hash="9273f6869fbe73c76843a0e23a867e16aa61d7b272e3385b3af303d814f7b39e" dmcf-pid="uDjr5SrNA7" dmcf-ptype="general">광주과학기술원(GIST)은 김의환 AI학과 교수 연구팀이 두 장의 이미지를 비교해 인공지능(AI)이 주어진 상황에 맞는 중요한 변화를 찾아 정확하게 설명하는지 확인할 수 있는 새로운 평가 기준 ‘C3-벤치(문맥 인식 변화 설명 평가체계)’를 개발, 시험한 결과를 14일 공개했다.</p> <figure class="figure_frm origin_fig" contents-hash="21119f377fc2abb0798e500dced05998c645ff25eebb868d1e34a3520b5f6739" dmcf-pid="7wAm1vmjgu" dmcf-ptype="figure"> <p class="link_figure"><img alt="C3-벤치 개요(위)와 GPT-5.2 대표 오류사례.(그림=GIST)" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/14/ZDNetKorea/20260914115150804pfmg.jpg" data-org-width="639" dmcf-mid="4yZhpGhDci" dmcf-mtype="image" height="auto" src="https://img3.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/14/ZDNetKorea/20260914115150804pfmg.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> C3-벤치 개요(위)와 GPT-5.2 대표 오류사례.(그림=GIST) </figcaption> </figure> <p contents-hash="c38679b3742649042675e3f7f75ccf75ab79405d168e4203ad7c8dc2b5cab4bc" dmcf-pid="zrcstTsAgU" dmcf-ptype="general">'C3-벤치'는 두 장의 이미지 비교에서 ‘무엇을 살펴볼 것인지’를 제시하고, AI가 그 목적에 맞는 변화를 골라 설명하는지 확인하는 일종의 ‘AI 변화 이해력 시험’이다.</p> <p contents-hash="76f589933974721ddfb3c92a9cf8ba1e19c88c808fa14666525be6bdd7d8d728" dmcf-pid="qmkOFyOcgp" dmcf-ptype="general">예를들어 같은 철도 사진 두 장이라도 날씨 변화를 살피는 상황에서는 눈이 쌓이거나 구름이 줄어든 것이 중요한 변화가 될 수 있다. 반면 철도 안전을 확인하는 상황에서는 선로에 새로 나타난 열차가 핵심적인 변화이고, 날씨 차이는 중요하지 않을 수 있다.</p> <p contents-hash="be82d6c1ad512a15dbbce2ecda52ce70b9e8b527b611effef34d04015f93eb82" dmcf-pid="BsEI3WIkN0" dmcf-ptype="general">그러나 기존 평가용 데이터는 특정 장면이나 변화에 집중돼 있거나, 각 상황에서 어떤 변화를 중요하게 봐야 하는지가 명확하게 정해져 있지 않은 경우가 많다.</p> <p contents-hash="95fa838148204a5683c32626387fc111cfc9f5f2a76176db504ca30770da9d00" dmcf-pid="bODC0YCEc3" dmcf-ptype="general">연구팀은 이러한 한계를 보완하기 위해 ▲자연 장면 ▲위성·항공 등 원격탐사 영상 ▲이미지 편집 ▲이상 탐지 등 4개 분야에서 51개의 현실적인 변화 상황을 선정하고, 사람이 변화 내용을 직접 설명한 4,996개의 이미지 쌍으로 'C3-벤치'를 구성했다.</p> <p contents-hash="f87ecd005071ab008506f6ae9970eb5155fbb67dd97e22476569ad0920e67201" dmcf-pid="KIwhpGhDoF" dmcf-ptype="general">논문 제1저자인 김재우 AI학과 석·박사통합과정생은 "각 상황마다 AI가 ‘찾아야 할 변화’와 ‘무시해야 할 차이’, ‘변화를 설명할 때 지켜야 할 기준’을 구체적으로 정했다"고 설명했다.</p> <p contents-hash="5e00077d1f89459babe138038a6445186648b471cc9eb8b10088697952cd3aaf" dmcf-pid="9CrlUHlwot" dmcf-ptype="general">연구팀은 AI가 내놓은 답을 평가하는 방식도 기존과 달리했다. 정답 문장과 같은 단어가 얼마나 포함됐는지만 비교하는 대신, ▲내용이 정확한지 ▲변화를 구체적으로 설명했는지 ▲문장이 자연스러운지 ▲주어진 상황에 맞는 내용인지를 함께 살펴 답변의 의미를 종합적으로 평가했다.</p> <p contents-hash="b718e734a90212f0f40a8fa8bbda652c621775140b50deba373087863c746d5b" dmcf-pid="2hmSuXSrA1" dmcf-ptype="general">400개의 이미지 쌍을 대상으로 사람과 GPT-5.2가 각각 이미지 속 변화를 설명하도록 하고, 답변의 정확성·구체성·자연스러움·상황 관련성을 비교한 결과 4개 항목을 종합한 10점 만점 점수는 사람이 7.45점, GPT-5.2가 5.72점으로 1.73점의 차이를 보였다.</p> <figure class="figure_frm origin_fig" contents-hash="bb48f0e1d08c9065631e3bb9a99b1f5ac553cb058e19e33b43aab7393b38a96d" dmcf-pid="Vlsv7ZvmA5" dmcf-ptype="figure"> <p class="link_figure"><img alt="GIST 연구팀. 왼쪽부터 김의환 AI학과 교수, 김재우 석·박사통합과정생.(사딘=GIST)" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/14/ZDNetKorea/20260914115152038dosw.jpg" data-org-width="400" dmcf-mid="6n9PkiPKAd" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/14/ZDNetKorea/20260914115152038dosw.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> GIST 연구팀. 왼쪽부터 김의환 AI학과 교수, 김재우 석·박사통합과정생.(사딘=GIST) </figcaption> </figure> <p contents-hash="5fee16054025af15b42099bbe5b40e985ae1f609c12861b5eb6979e36783f44e" dmcf-pid="fSOTz5TsNZ" dmcf-ptype="general">반면 문장의 자연스러움만 놓고 보면 GPT-5.2가 8.53점으로 사람(8.32점)보다 오히려 높았다.</p> <p contents-hash="c14716cddc389f753f712343684215c2eedcb34dd5c9dd0e01c6083e3acca893" dmcf-pid="4vIyq1yONX" dmcf-ptype="general">김재우 석·박사통합과정생은 "AI가 사람이 쓴 글에 가까운 자연스러운 문장을 만드는 능력과 실제 이미지에서 중요한 변화를 정확하게 찾아내는 능력이 반드시 같은 것은 아님을 보여준다"고 부연 설명했다.</p> <p contents-hash="883d0811c93cf6998abe8da71618e1c545d1202b8ec232214eb409c687518890" dmcf-pid="8TCWBtWIjH" dmcf-ptype="general">연구팀은 또 이미지의 순서를 바꿨을 때도 같은 변화를 앞뒤에 맞게 설명하는지를 확인했다. 예를 들어 첫 번째 사진에서 “물체가 새로 생겼다”고 설명했다면, 사진의 순서를 뒤집었을 때는 같은 물체가 “사라졌다”고 설명해야 한다.</p> <p contents-hash="3df253b5faa689204e2ce61f04b975c6ea9c4737c86f734adb2d89484331f6e3" dmcf-pid="6yhYbFYCkG" dmcf-ptype="general">연구팀은 이러한 능력을 ‘가역성’으로 평가했다. 그 결과 사람은 93%의 가역성 점수를 보인 반면 GPT-5.2는 61%에 그쳤다. 이는 최신 AI가 자연스러운 문장을 만드는 데는 뛰어나지만, 사진 속 변화의 방향까지 일관되게 이해하는 데는 여전히 한계가 있음을 보여준다.</p> <p contents-hash="67324c2338caf82753a75099ab5eb2eec234d994f57c4641c42210e4748e5008" dmcf-pid="PmkOFyOcAY" dmcf-ptype="general">한편 연구결과는 지난 12일까지 스웨덴 말뫼에서 열린 국제학술대회 ‘ECCV 2026’에 채택됐다. 'ECCV'는 유럽컴퓨터비전협회(ECVA)가 주관하는 컴퓨터비전·머신러닝 분야의 주요 국제학술대회다.</p> <p contents-hash="93dbab5bb9ddc6a21f9cf2718f5a101f58f24905fea162678f2c4c6de0887824" dmcf-pid="QsEI3WIkjW" dmcf-ptype="general">박희범 기자(hbpark@zdnet.co.kr)</p> </section> </div> <p class="" data-translation="true">Copyright © 지디넷코리아. 무단전재 및 재배포 금지.</p>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기