댄 맥나마라 수석부사장 "MI350P, 경쟁사 대비 달러당 토큰 수율 4배 이상" [AAI 2026] 작성일 07-24 58 목록 <div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">공랭식 기업용 가속기 '인스팅트 MI350P' 출시</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="4Kg1jvlwSV"> <figure class="figure_frm origin_fig" contents-hash="3a79a2e852798bec3ae6850cd1303664d5fe26428273d7a89057f81e1376823f" dmcf-pid="89atATSrh2" dmcf-ptype="figure"> <p class="link_figure"><img class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202607/24/552796-pzfp7fF/20260724062801093wrhf.jpg" data-org-width="640" dmcf-mid="fnYxXKB3Tf" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202607/24/552796-pzfp7fF/20260724062801093wrhf.jpg" width="658"></p> </figure> <p contents-hash="b743e28c6812d88e31a2354da9a20ffa213f0479d5581337dd29989839d1c240" dmcf-pid="62NFcyvmW9" dmcf-ptype="general">[샌프란시스코(미국)=디지털데일리 김문기기자] <strong>"많은 기업들이 자체 데이터센터에 AI 인프라를 도입하고 싶어 하지만, 수랭식 액체 냉각 설비 구축과 전력망 개조 비용이 가장 큰 장벽이다. AMD가 공개한 '인스팅트 MI350P'는 추가 설비 투자 없이 기존 공랭식 엔터프라이즈 서버에 바로 탑재되어 기업의 전통 데이터센터를 즉시 첨단 AI 데이터센터로 전환시켜 준다."</strong></p> <p contents-hash="3ab6b75ff5b35dde64724eea0e4d36146080ba975b8496ffd0a7b2fd531101cb" dmcf-pid="PVj3kWTsTK" dmcf-ptype="general">댄 맥나마라(Dan McNamara) AMD 컴퓨팅 및 엔터프라이즈 AI 담당 수석부사장(SVP)은 23일(현지 시각) 미국 샌프란시스코 모스콘 웨스트에서 열린 '어드벤싱 AI(Advancing AI) 2026' 키노트 무대에 올라 공랭식 기업용 AI 가속기 '인스팅트 MI350P(Instinct MI350P)'를 출시를 알렸다.</p> <p contents-hash="daed471bb3b59bd1a574391c7d36fb7eb33968a23c1e01fc3e95f6bb57737f83" dmcf-pid="QfA0EYyOyb" dmcf-ptype="general"><strong>◆ 단일 GPU서 2600억 파라미터 처리… 달러당 토큰 수율 경쟁사 대비 4배 이상 우위</strong></p> <p contents-hash="cd8ff12f3eb51dc4537a9f3f5bacf21646df43bd82c01b6a7e9ca0d9119ea440" dmcf-pid="x4cpDGWIlB" dmcf-ptype="general">'인스팅트 MI350P'는 별도의 냉각 시설이나 전력 설비 확충 없이 기존 데이터센터 서버 랙에 그대로 체결할 수 있도록 공랭식(Air-cooled) 환경에 맞춰 특화 설계된 가속기다.</p> <p contents-hash="b5ac98861c25d999665d2d538fde6db527f35be2be3fc295c2f041b5afb95e64" dmcf-pid="yhujqeMVTq" dmcf-ptype="general">댄 맥나마라 수석부사장은 "MI350P는 단 한 대의 GPU만으로 최대 2600억개 파라미터 규모의 대형언어모델(LLM)을 완벽히 지원한다"며 "기업들이 가동하는 AI 워크로드의 대부분을 단일 GPU 상에서 수용할 수 있다"고 설명했다.</p> <p contents-hash="f8ed9e009809d1af1c7cff7d0aa01377a5e47645d52a428eb2c230b3e900ad33" dmcf-pid="Wl7ABdRfvz" dmcf-ptype="general">압도적인 경제성도 입증됐다. 댄 맥나마라 수석부사장은 "MI350P는 경쟁사 최신 제품 대비 달러당 초당 토큰 수율이 4배 이상 뛰어날 뿐만 아니라, 실제 기업용 생산 모델을 적용한 실측 테스트에서도 경쟁사 대비 2배에서 최대 5배 빠른 토큰 처리 속도를 제공한다"고 강조했다.</p> <p contents-hash="f3c01f5f3a2b49fad4a8ce3af42a2f632808d185b69cdd85c7586e2b32d01659" dmcf-pid="YSzcbJe4v7" dmcf-ptype="general"><strong>◆ AMD IT 팀 실전 배치 사례 공개… "토큰 비용 43% 절감·응답 속도 3배 가속"</strong></p> <p contents-hash="f9d6db2c334831d56700fbff7e8b10edc7ee9720156cb153dc0dc9c34c7c779d" dmcf-pid="GvqkKid8Tu" dmcf-ptype="general">AMD는 자체 IT 부서 데이터센터에 에픽(EPYC) CPU와 MI350P 가속기를 실전배치해 거둔 비용 절감 및 성능 개선 성과도 함께 공개했다.</p> <p contents-hash="8f1d93edf347358de76b2fc6a4dd740647970b54805fd4a46ccdc8b4190af993" dmcf-pid="HCUNzRx2yU" dmcf-ptype="general">AMD IT 팀은 자율 위협 탐지 에이전트와 사내 맞춤형 AI 비서 오픈봇(OpenBot) 시스템에 게이트웨이 지능형 라우팅 기술을 적용했다. 대량의 일반적인 요청은 사내에 구축된 에픽 CPU 및 MI350P 공랭식 가속기 인프라로 처리하고, 고난도 정밀 요청만 클라우드 프론티어 모델로 분산 배치했다.</p> <p contents-hash="9434271c2858b0c0df09d5505ea2e096139c75c1adacd79acb9367c45bd2c61c" dmcf-pid="XhujqeMVhp" dmcf-ptype="general">댄 맥나마라 수석부사장은 "사내 지능형 라우팅을 통해 전체 토큰 비용을 43% 절감하는 동시에 온프레미스 인프라에서 가동되는 워크로드의 응답 속도를 최대 3배 가속했다"며 "이것이 바로 최고 수준의 보안과 예측 가능한 TCO(총소유비용)를 달성하는 기업용 AI 구축의 표준이 될 것"이라고 설명했다.</p> </section> </div> <p class="" data-translation="true">Copyright © 디지털데일리. All rights reserved. 무단 전재 및 재배포 금지.</p> 관련자료 이전 한국스포츠레저, 청소년·성인 대상 도박 예방 콘텐츠 공모전 개최 07-24 다음 여의도 15배 빙산이 막았다… 황제펭귄 새끼 69% 사라진 이유 07-24 댓글 0 등록된 댓글이 없습니다. 로그인한 회원만 댓글 등록이 가능합니다.