로그인
보증업체
스포츠중계
스포츠분석
먹튀사이트
지식/노하우
판매의뢰
업체홍보/구인
뉴스
커뮤니티
포토
포인트
보증카지노
보증토토
보증홀덤
스포츠 중계
기타
축구
야구
농구
배구
하키
미식축구
카지노 먹튀
토토 먹튀
먹튀제보
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
제작판매
제작의뢰
게임
구인
구직
총판
제작업체홍보
실시간뉴스
스포츠뉴스
연예뉴스
IT뉴스
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[실시간뉴스]
국방부 "올 SCM때 전작권 전환연도 결정 가능…UFS서 일부 평가"(종합)
N
[IT뉴스]
나루씨큐리티, KISA와 중소기업 침해평가·취약점 진단 지원
N
[IT뉴스]
'이 껌' 씹었더니 구강암 세균 93%↓…어떤 성분 넣었길래
N
[IT뉴스]
40도 극한 폭염, 피서지 어디로?…'티맵'이 알려준다
N
[실시간뉴스]
정청래, 친명 추가투표 요구에 “투표 쿠데타, 폭동 난다”
N
커뮤니티
더보기
[자유게시판]
드디어 금요일이군요
[자유게시판]
오늘 다저스 어떻게 생각하시나요
[자유게시판]
하아 댓노
[자유게시판]
식곤증지립니다요
[자유게시판]
벌써 불금이네요
목록
글쓰기
[IT뉴스]AMD 라이젠 AI 헤일로, 엔비디아 제치고 온디바이스 에이전트 성능 34% ↑
온카뱅크관리자
조회:
12
2026-08-05 10:27:31
<div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">[인더스트리 AI] 단순 토큰 속도 끝났다… AI 에이전트 시대, 왜 '전체 워크플로우 시간'</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="fGPlryWIyB"> <figure class="figure_frm origin_fig" contents-hash="842cb2cf3fe5050054079bb4eb796c5a17d0c95d1e99339bd276dc2834a900e8" dmcf-pid="4HQSmWYCCq" dmcf-ptype="figure"> <p class="link_figure"><img class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/05/552796-pzfp7fF/20260805101709145epxo.jpg" data-org-width="640" dmcf-mid="2jg1W0pXWK" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/05/552796-pzfp7fF/20260805101709145epxo.jpg" width="658"></p> </figure> <p contents-hash="b43b77c96f01b530afbbf86da6be58621c96bc4ff48dc3100e4e85a8fd78018e" dmcf-pid="8XxvsYGhSz" dmcf-ptype="general">[디지털데일리 김문기 기자] AI 에이전트 시대가 본격화되면서 기존 GPU 중심의 단순 '토큰 생성 속도'가 아닌, CPU와 GPU의 균형 잡힌 시스템 전반의 '워크플로우 완료 시간'이 온디바이스 AI의 새로운 핵심 성능 지표로 떠오르고 있다.</p> <div contents-hash="44531b8d8d48d929dabe089fe3d2ee8a2d3047bc1bde03ad6d3a971693513bd0" dmcf-pid="6ZMTOGHlS7" dmcf-ptype="general"> 4일(현지시간) 마이클 아벨(Michael Abel) AMD 관계자는 블로그를 통해 에이전틱 AI(Agentic AI) 시대를 위해 설계된 'AMD 라이젠 AI 헤일로(Halo)'가 로컬 추론 환경에서 경쟁사 대비 최대 34% 향상된 에이전트 오케스트레이션 성능을 발휘한다고 밝혔다. </div> <figure class="figure_frm origin_fig" contents-hash="c8afd816cc10e185a10da8c23f970b2adc397d80cdac96c588a9d258f266690a" dmcf-pid="Py4IESvmWu" dmcf-ptype="figure"> <p class="link_figure"><img class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/05/552796-pzfp7fF/20260805101711020fukz.jpg" data-org-width="640" dmcf-mid="VrHR4inQlb" dmcf-mtype="image" height="auto" src="https://img3.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/05/552796-pzfp7fF/20260805101711020fukz.jpg" width="658"></p> </figure> <p contents-hash="b476dbacd124b6b3395e1dc60fd8672ab4c89b75d5469d723903fde4196815af" dmcf-pid="QW8CDvTshU" dmcf-ptype="general">단순 질문에 답을 제시하는 챗봇과 달리, AI 에이전트 워크플로우는 계획 수립, 파싱(Parse), OCR, 청크 분할, 임베딩, 검색, 생성, 검증에 이르는 복합 파이프라인으로 구성된다. 이 중 상당수 단계는 GPU가 아닌 CPU 기반의 오케스트레이션 과정을 거치게 된다.</p> <p contents-hash="c4a05a60208d9a9882e7fbae437aeec60e899a8d175cc798c1e6c584fed7a40d" dmcf-pid="xY6hwTyOCp" dmcf-ptype="general">AMD는 실제 기업 지식 근로자의 업무 환경을 반영해 개발한 로컬 벤치마크 'HEPA(Hermes Executive Presentation Agent)'를 통해 로컬 AI 에이전트의 성능을 전 과정에 걸쳐 측정했다. HEPA는 로컬 데이터셋을 기반으로 프레젠테이션, 메모, 차트, 출처 부록까지 완성하고 품질 검증을 통과하는지 평가한다.</p> <p contents-hash="063452136d2ee69bc8e4281351dfe07d7f6d251077b802935f1572edac3b9ab5" dmcf-pid="yRS4BQx2S0" dmcf-ptype="general">해당 측정 환경은 8개 파이프라인 단계 중 7개 단계가 CPU에서 실행되고, GPU는 모델 생성만 담당하는 구조다.</p> <p contents-hash="8c080afc4487d759df6e6559791f671dbc4521aa6cbc5908976db25a5e576633" dmcf-pid="Wev8bxMVy3" dmcf-ptype="general">측정 결과, 'AMD 라이젠 AI 맥스+ 395' 프로세서를 탑재한 AMD 라이젠 AI 헤일로는 리눅스 환경에서 엔비디아 'DGX 스파크 그레이스 블랙웰(GB10)' 대비 탁월한 효율을 입증했다.</p> <p contents-hash="66392e0f8b278a335cf60d286fa692aa749b24a77b1da71efbe88b8e1f456fd4" dmcf-pid="YdT6KMRfCF" dmcf-ptype="general">AMD 라이젠 AI 헤일로는 CPU 오케스트레이션 성능에서 엔비디아 DGX 스파크보다 34% 빠른 속도를 기록했다. AMD는 CPU 측 준비 작업을 152.1초 만에 마쳤으나, DGX 스파크는 229.9초가 소요됐다. 특히 임베딩 및 라우팅 작업에서 AMD는 71.5초를 기록해 DGX 스파크(139.6초) 대비 약 2배 빠른 처리 속도를 보였다.</p> <p contents-hash="02a5b8f50858f2258629432fbd14fa16a1c5868ec7d53d74ad1f646e05f681ea" dmcf-pid="GJyP9Re4lt" dmcf-ptype="general">전 과정에 걸친 워크플로우 완료 시간 측면에서도 AMD는 품질 검증을 통과한 최종 결과물을 311.6초 만에 완료, DGX 스파크(367.1초)보다 15%(55.5초) 빠르게 작업을 끝냈다. 3년 하드웨어 감가상각 기준 완료된 워크플로우당 비용 역시 AMD가 약 27% 더 낮았다.</p> <p contents-hash="3aaba7807349f991a02cde5e6e9766bc8b9e84e40a1fab11f4330d6036496860" dmcf-pid="HiWQ2ed8v1" dmcf-ptype="general">이 같은 성능 차이는 CPU의 멀티스레딩 및 벡터 연산 능력에서 비롯된다. 라이젠 AI 맥스+ 395 프로세서는 SMT를 통해 16개의 '젠 5(Zen 5)' 코어와 32개 스레드, AVX-512/VNNI 벡터 가속을 지원해 데이터 병렬 처리에서 우위를 점했다. 반면 20개의 Arm 코어를 탑재한 그레이스 블랙웰은 SMT를 지원하지 않는다.</p> <p contents-hash="0d33c57bfa564c9fc136b7c858b81210926c3db4c52a0265b41a9ffd4f64e0b3" dmcf-pid="XnYxVdJ6l5" dmcf-ptype="general">마이클 아벨은 "채팅은 하나의 응답을 제공하지만, AI 에이전트는 검증까지 마친 결과물을 제공한다. 즉, 단일 GPU 추론이 아닌 시스템 전체의 결과물이다"라며 "AI 에이전트 워크플로우에서는 전 과정에 걸친 완료 시간이 가장 의미 있는 성능 지표가 된다"고 설명했다.</p> <p contents-hash="04b5e5046d59076730d49239932081ce9a369f036cda02ca96beca5420bfa8ce" dmcf-pid="ZLGMfJiPSZ" dmcf-ptype="general">이어 "챗봇 시대는 GPU의 시대였다면, AI 에이전트 시대는 시스템 전체의 성능이 경쟁력을 좌우하는 시대"라며, "온디바이스 환경에서는 CPU, GPU, 통합 메모리가 균형 있게 구성돼 워크플로우 완료 시간과 비용을 최적화한 시스템이 해답"이라고 강조했다.</p> </section> </div> <p class="" data-translation="true">Copyright © 디지털데일리. All rights reserved. 무단 전재 및 재배포 금지.</p>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기