로그인
보증업체
스포츠중계
스포츠분석
먹튀사이트
지식/노하우
판매의뢰
업체홍보/구인
뉴스
커뮤니티
포토
포인트
보증카지노
보증토토
보증홀덤
스포츠 중계
기타
축구
야구
농구
배구
하키
미식축구
카지노 먹튀
토토 먹튀
먹튀제보
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
제작판매
제작의뢰
게임
구인
구직
총판
제작업체홍보
실시간뉴스
스포츠뉴스
연예뉴스
IT뉴스
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[실시간뉴스]
'결혼 축의금' 국가가 현금 100만원 준다...출산도 세액공제 대신 재정지원
N
[IT뉴스]
1030 사로잡은 '여권폰'…갤 Z 폴드8 디자인 비밀은?[모닝폰]
N
[실시간뉴스]
[날씨] 서쪽 극한 폭염, 수도권 첫 '중대경보'...서울 38℃
N
[IT뉴스]
KT, 피지컬AI 시동…"인프라로 승부"
N
[IT뉴스]
[새 폼팩터 표준화 전쟁]①4:3 비율이 대세…삼성·애플·화웨이 주도권 싸움
N
커뮤니티
더보기
[자유게시판]
드디어 금요일이군요
[자유게시판]
오늘 다저스 어떻게 생각하시나요
[자유게시판]
하아 댓노
[자유게시판]
식곤증지립니다요
[자유게시판]
벌써 불금이네요
목록
글쓰기
[IT뉴스]비용 낮추고 특화 성능 높인 '작은 AI' 등판…SLM 경쟁 본셕화
온카뱅크관리자
조회:
9
2026-08-04 06:37:29
<div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">GPU 공급난 장기화·토큰 비용 부담↑…에이전틱 AI에도 적합<br>애플, 온디바이스 AI 전략 집중…네카오, 자체 경량 모델 개발</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="V0FXRHXSZu"> <figure class="figure_frm origin_fig" contents-hash="68239f997e15db8b9aa23aa659edcdb9e347dc55d529c4239f7bd873ee39f6bc" dmcf-pid="fp3ZeXZvZU" dmcf-ptype="figure"> <p class="link_figure"><img alt="ⓒ 뉴스1 양혜림 디자이너" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/04/NEWS1/20260804063527849wpnr.jpg" data-org-width="560" dmcf-mid="2XYSflSr17" dmcf-mtype="image" height="auto" src="https://img2.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/04/NEWS1/20260804063527849wpnr.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> ⓒ 뉴스1 양혜림 디자이너 </figcaption> </figure> <p contents-hash="1947d1a8a48619cf252dd95141580728d8ddc302ae40fce7ea2d602bac67fafc" dmcf-pid="4onRTMRftp" dmcf-ptype="general">(서울=뉴스1) 유수연 기자 = 거대언어모델(LLM) 성능 경쟁이 이어지는 가운데 비용과 연산 부담을 줄인 경량언어모델(SLM) 경쟁도 본격화하고 있다.</p> <p contents-hash="385bec3b99752a365126c6e7e81f6497523f2a6811d918dd3b957e2d044bc8b2" dmcf-pid="8gLeyRe410" dmcf-ptype="general">특정 작업에 필요한 성능을 확보하면서 비용과 연산량을 낮출 수 있다는 장점에 글로벌 빅테크는 물론 국내 AI 기업들도 잇따라 경량 모델 개발과 공개에 나서고 있다.</p> <h3 contents-hash="20e0bce7e79ee7973215f60bb1600e3010fcd0a96171f91d20d069bf12961340" dmcf-pid="6aodWed8t3" dmcf-ptype="h3">연산 속도 빠르고 비용 부담 적어…에이전틱 AI에 '착붙'</h3> <p contents-hash="96b4b0953a9e655c94ecc8f5eb285731aae69bb951c12755188b7ad90996cb84" dmcf-pid="PNgJYdJ6GF" dmcf-ptype="general">4일 정보기술(IT) 업계에 따르면 경량언어모델은 거대언어모델보다 적은 수의 매개변수(파라미터)를 가진 AI 모델로, 반복적이고 목적이 명확한 작업을 효율적으로 처리하는 데 강점이 있다.</p> <p contents-hash="3b76e4ca1aaa7e049387fdf207c9c1cc88279d4583f0b7ad881754fbc30b6f4b" dmcf-pid="QjaiGJiPtt" dmcf-ptype="general">거대 모델보다 범용성은 다소 떨어질 수 있지만 연산 속도가 빠르고 추론 비용이 낮다. 온디바이스 AI 구현에 폭넓게 활용되는 동시에 AI 에이전트나 특정 목적의 AI 서비스에도 적용되고 있다.</p> <p contents-hash="6cc0039b09d55554844e8d4b0eb24efa64d3e2ba318004920fbd49bbba779b9f" dmcf-pid="xANnHinQX1" dmcf-ptype="general">AI 서비스 이용이 늘면서 추론 비용과 GPU 운영 부담이 커지자 모든 작업을 거대 모델이 처리하기보다 단말기나 소형 모델이 처리할 수 있는 작업은 경량 모델에 맡기는 방식이 확산할 것으로 전망된다. 스스로 판단하고 계획을 세워 필요한 작업을 수행하는 에이전틱 AI 확산도 경량 모델 수요를 키우고 있다.</p> <p contents-hash="8a86aaed83b1fe42d3b034d74d837e4a08b73453f9aba830a1a78fb5a76976c8" dmcf-pid="yU05dZ5Tt5" dmcf-ptype="general">엔비디아 리서치는 지난해 발표한 논문에서 "에이전틱 AI 시스템의 부상은 언어모델이 소수의 특화된 작업을 반복적으로 수행하는 사례를 만들어내고 있다"며 "경량언어모델은 에이전틱 AI 시스템의 많은 호출에서 충분한 성능을 제공하면서 비용 측면에서도 더 경제적"이라고 분석했다.</p> <h3 contents-hash="8b1e0f4322be405d68542a4db64fce00c7e19355212d682378e22f599e48bb32" dmcf-pid="Wup1J51ytZ" dmcf-ptype="h3">애플·구글·메타 이어 네카오도 속도…AI 경쟁 효율로</h3> <p contents-hash="942eb71a17a9d85710b5a28a323d7f66af0f906d0789716a29f43eed7b94eaac" dmcf-pid="Y7Uti1tWZX" dmcf-ptype="general">AI 경쟁이 '누가 더 큰 모델을 만드느냐'에서 '어떤 환경에서 가장 효율적으로 AI를 구현하느냐'로 확장되면서 빅테크들도 경량 모델 생태계 구축에 속도를 내고 있다.</p> <p contents-hash="bb322f81ddb6508c590b3508f16a8ba4c53a467734efade6a6fd45b7da8c5623" dmcf-pid="GzuFntFY5H" dmcf-ptype="general">구글은 개방형 모델 '젬마(Gemma)' 시리즈를 공개해 개발자 생태계를 확대하고 있다. 일부 모델은 온디바이스 환경에서도 활용할 수 있도록 설계됐다.</p> <p contents-hash="ea86db4b4406a9544daf69c36c7e31bc92a6ee8f153e45a00b387bc63720b854" dmcf-pid="H5Xy6TyOXG" dmcf-ptype="general">메타 역시 '라마(Llama)'의 경량 모델을 선보이며 온디바이스와 플랫폼 서비스에서 활용 범위를 넓히고 있다.</p> <p contents-hash="6d2ce0b1e08eedf3134e466036a1449892cd42fd946ed60cf5e48af2b9c075a9" dmcf-pid="X1ZWPyWIGY" dmcf-ptype="general">온디바이스 AI 전략에 무게를 둔 애플은 기기에서 직접 구동되는 경량 모델 개발을 강화했다. 복잡한 작업은 자체 프라이빗 클라우드 컴퓨트에서 처리하고, 가능한 작업은 기기 내부에서 수행하는 구조를 통해 개인정보 보호와 응답 속도를 함께 높이고 있다.</p> <p contents-hash="1dfe15b4c38b09ad4a6f6a79c0f4033363fa03f1cea47ba7987f1b027f1b9e2a" dmcf-pid="Zt5YQWYCYW" dmcf-ptype="general">국내 기업들도 경량 모델 경쟁력 확보에 속도를 내고 있다.</p> <p contents-hash="25bca16c2f037bfc18a318a54539b770946ad49f894018a54bdddf2fb6aac762" dmcf-pid="5F1GxYGh1y" dmcf-ptype="general">카카오(035720)는 최근 허깅페이스에 자체 개발 AI 모델 '카나나' SLM 시리즈 △Kanana-2-1.3B-base △Kanana-2-1.3B-instruct △Kanana-2-3B-base △Kanana-2-3B-instruct 등 4종을 공개했다.</p> <p contents-hash="f78bc9fac512e3bdf450ec9baa24d9a8a7720a2e9edf7da290b92f7c8a23e0b8" dmcf-pid="13tHMGHlGT" dmcf-ptype="general">카카오는 해당 모델이 비슷한 규모의 최신 공개 모델과 비교해 한국어와 영어, 지식, 수학, 코드 등 주요 벤치마크에서 경쟁력 있는 성능을 기록했다고 설명했다.</p> <p contents-hash="fcc1ec34d83eaa33a47acc47eaceacb0b9b9e1501f1f80dff8d1fbec29dbb1d5" dmcf-pid="t0FXRHXSYv" dmcf-ptype="general">네이버(035420)는 AI탭 서비스에 분업형 SLM 구조를 적용해 검색과 쇼핑, 플레이스 등 기능별로 모델이 역할을 나누도록 했다. 이를 통해 운영 비용은 기존 대비 3분의 1 수준으로 줄이고 응답 속도는 2배 이상 높였다고 밝혔다.</p> <p contents-hash="7ec2d29cc32a6b6320b45514406e756be1d4b60fabdf058a051ac5bc7859f3ee" dmcf-pid="Fp3ZeXZvXS" dmcf-ptype="general">또 하이퍼클로바X 시드 계열을 비롯한 경량 모델을 공개했으며, 최근에는 국방 특화 경량 옴니모달 모델 '하이퍼클로바X 시드 4B'도 선보였다.</p> <p contents-hash="60b3cda2bccafd91ae6186049ba30bdffab80a62dfa81491ef7a46f3ff01300b" dmcf-pid="3U05dZ5Ttl" dmcf-ptype="general">업계는 앞으로 거대 모델과 경량 모델이 경쟁하기보다 서로 역할을 나눠 활용하는 방향으로 발전할 것으로 보고 있다.</p> <p contents-hash="894916a2123a8ffe175aadcc3e27f8e0463509047aba157e047b3246c0957ddf" dmcf-pid="0up1J51yZh" dmcf-ptype="general">복잡한 추론과 범용 작업은 거대 모델이 담당하고, 빠른 응답과 비용 효율성이 중요한 작업은 경량 모델이 처리하는 방식이다. 이에 따라 AI 경쟁도 단순히 더 큰 모델을 만드는 데서 나아가 거대 모델과 경량 모델을 목적에 맞게 조합하고 운영하는 방향으로 확대될 것이라는 전망이 나온다.</p> <p contents-hash="11fcdf80fe3063365e0afeaeb283d580b1077b906367d554173c89018306509a" dmcf-pid="p7Uti1tW1C" dmcf-ptype="general">업계 관계자는 "거대 모델과 별도로 온디바이스에서 구동되는 경량 모델을 확보하는 것도 중요한 경쟁력이 되고 있다"며 "앞으로는 어떤 모델을 보유했느냐보다 어떤 작업에 어떤 모델을 배치해 효율적으로 운영하느냐가 서비스 경쟁력을 좌우하게 될 것"이라고 말했다.</p> <p contents-hash="3dd5a15b4580901556f116594acdf34213006103566f544e7cc7bdb4851f79f6" dmcf-pid="U7Uti1tWHI" dmcf-ptype="general">shushu@news1.kr<br><br><strong><용어설명></strong><br><br>■ 경량언어모델(SLM)<br>거대언어모델(LLM)에 비해 적은 수의 매개변수(parameter)를 가진 AI 모델로 반복적이고 특화된 작업을 효율적으로 처리하는 데 장점이 있다. 거대언어모델보다 범용성은 다소 떨어질 수 있지만 연산 속도가 빠르고 비용 부담이 적다는 것이 강점이다.<br><br>■ 온디바이스<br>기기 자체에서 수행되는 연산이나 처리. 데이터가 클라우드 서버 등으로 전송되지 않고 기기 내부에서 직접 처리된다.<br><br> </p> </section> </div> <p class="" data-translation="true">Copyright © 뉴스1. All rights reserved. 무단 전재 및 재배포, AI학습 이용 금지.</p>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기