오픈AI, GPT-5.6 가격 최대 80% 인하… 소넷 5·키미 K3에 가격 공세 작성일 07-31 32 목록 <div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">테라, K3보다 입력 33%·출력 20% 저렴 <br>소넷 5, 업무 단계별 모델 조합 강조</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="yzJStOmjLT"> <p contents-hash="19e7219a4ee47a21c52023b32da426da85466226c9f896f3670906feb772e0b9" dmcf-pid="WqivFIsAJv" dmcf-ptype="general">오픈AI가 'GPT-5.6' 출시 3주 만에 대량 반복 작업용 모델 '루나(Luna)'와 일상 업무용 모델 '테라(Terra)'의 API(애플리케이션 프로그래밍 인터페이스) 가격을 최대 80% 내렸다. 앤트로픽의 '클로드 소넷 5(Claude Sonnet 5)'와 문샷AI의 '키미 K3(Kimi K3)'가 가격 대비 성능을 앞세운 가운데 GPT-5.6 제품군의 가격 경쟁력을 높인 것이다.</p> <p contents-hash="62b77cbd91852525beeb2e46f7d6e37c1ae588a7345a2285a1d1dff28e11b9e6" dmcf-pid="YBnT3COcnS" dmcf-ptype="general">오픈AI는 30일(현지시각) 공식 블로그를 통해 GPT-5.6 루나 가격을 80%, 테라는 20% 인하한다고 밝혔다. 지난 9일 솔·테라·루나로 구성된 GPT-5.6 제품군을 정식 출시한 지 3주 만이다.</p> <div contents-hash="522f98de565a92993957200b13aab7c01faeb7ba1311c8c426fbe11a82c4b547" dmcf-pid="GbLy0hIknl" dmcf-ptype="general"> 루나의 API 가격은 100만토큰당 입력 1달러에서 0.2달러, 출력 6달러에서 1.2달러로 낮아졌다. 테라는 입력 2.5달러에서 2달러, 출력 15달러에서 12달러로 내려갔다. 토큰은 AI가 글과 코드를 처리하는 기본 단위다. </div> <figure class="figure_frm origin_fig" contents-hash="a6994ed90903d2c16902a65f9899a11e5c2648fc92daaee17ae028a376ce9fb3" data-idxno="449048" data-type="photo" dmcf-pid="HKoWplCEeh" dmcf-ptype="figure"> <p class="link_figure"><img alt="GPT-5.6과 소넷 5, 키미 K3 API 요금 비교 / 각사 자료 챗GPT 제작" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202607/31/552810-SDi8XcZ/20260731113027391ppnt.png" data-org-width="1200" dmcf-mid="Q2unwRx2LW" dmcf-mtype="image" height="auto" src="https://img3.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202607/31/552810-SDi8XcZ/20260731113027391ppnt.png" width="658"></p> <figcaption class="txt_caption default_figure"> GPT-5.6과 소넷 5, 키미 K3 API 요금 비교 / 각사 자료 챗GPT 제작 </figcaption> </figure> <p contents-hash="456a1e1095e2a0e22d742095d8a791f45d5341a3f85c077b1f6978b27a782ca7" dmcf-pid="X9gYUShDMC" dmcf-ptype="general">앤트로픽은 지난 6월 30일 코딩과 도구 사용, 전문 업무 성능을 높인 클로드 소넷 5를 출시했다. 8월 31일까지 입력 2달러·출력 10달러의 한시 가격을 적용한 뒤 9월부터 입력 3달러·출력 15달러로 올린다. 현재 테라는 소넷 5와 입력 가격이 같고 출력은 20% 비싸지만, 한시 가격이 끝나면 입력은 33%, 출력은 20% 저렴해진다.</p> <p contents-hash="ca1570881ce4b927abc28df7525df735d10953c04c1d0265a43eabdd899fcaa2" dmcf-pid="Z9gYUShDnI" dmcf-ptype="general">문샷AI가 지난 16일 선보인 키미 K3와 비교해도 테라가 싸다. 키미 K3의 API 가격은 일반 입력 3달러, 출력 15달러다. 테라가 입력은 33%, 출력은 20% 낮다. 문샷AI가 프런티어급 성능과 오픈웨이트를 내세운 K3를 출시한 데 이어 오픈AI가 일상 업무용 모델의 가격을 K3 아래로 낮춘 셈이다.</p> <div contents-hash="63d838657bff30861d2fef7e6f4d67d727c043e26671a91130d1b30a4bfc6658" dmcf-pid="52aGuvlwiO" dmcf-ptype="general"> 오픈AI는 저가형 루나의 성능 대비 비용도 강조했다. 전문 업무 평가인 '에이전츠 라스트 이그잼(Agents' Last Exam)'에서 루나가 앤트로픽의 상위 모델 '클로드 페이블 5'보다 높은 점수를 기록하면서 작업당 추정 비용은 99% 가까이 낮았다고 설명했다. 다만 특정 평가에서 사용한 토큰량을 반영한 오픈AI 측 추정치다. </div> <figure class="figure_frm origin_fig" contents-hash="7bbb5b7bac3a7922118c8fbedee1cf1a0786f8264b67b79ef33f6140e6273792" data-idxno="449049" data-type="photo" dmcf-pid="1VNH7TSrMs" dmcf-ptype="figure"> <p class="link_figure"><img alt="아티피셜 애널리시스의 '인텔리전스 인덱스 v4.1'에서 GPT-5.6 루나는 51점을 기록했다. 비슷한 점수대의 경쟁 모델보다 작업당 비용이 낮은 것으로 나타났다. 가로축은 작업당 비용, 세로축은 종합 성능 점수다. / 오픈AI" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202607/31/552810-SDi8XcZ/20260731113028645yemm.png" data-org-width="600" dmcf-mid="xyEtKHYCMy" dmcf-mtype="image" height="auto" src="https://img3.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202607/31/552810-SDi8XcZ/20260731113028645yemm.png" width="658"></p> <figcaption class="txt_caption default_figure"> 아티피셜 애널리시스의 '인텔리전스 인덱스 v4.1'에서 GPT-5.6 루나는 51점을 기록했다. 비슷한 점수대의 경쟁 모델보다 작업당 비용이 낮은 것으로 나타났다. 가로축은 작업당 비용, 세로축은 종합 성능 점수다. / 오픈AI </figcaption> </figure> <p contents-hash="28eee119d8d4793f84bc65cc16f9cab4b7eeed3fe8f1ddbda06e4fcb7392f63e" dmcf-pid="tfjXzyvmMm" dmcf-ptype="general">최상위 모델인 GPT-5.6 솔(Sol)의 가격은 입력 5달러·출력 30달러로 유지했다. 대신 두 배의 요금으로 처리 속도를 최대 2.5배 높이는 '패스트 모드(Fast mode)'를 추가했다. 챗GPT 워크와 코덱스의 구독 가격과 이용 한도는 유지되지만, 테라와 루나를 사용할 때 차감되는 크레디트는 줄었다.</p> <p contents-hash="be2cde7d02e25d6d1270de35aa6739a6fafef060bb3369208ca5e6181318fe2f" dmcf-pid="F4AZqWTser" dmcf-ptype="general">오픈AI는 하드웨어에 요청을 배분하는 경로와 토큰 생성 소프트웨어, 에이전트의 문맥 관리 방식을 개선해 가격을 낮출 여력을 확보했다고 밝혔다. 솔을 활용해 그래픽처리장치(GPU)용 핵심 코드를 최적화하면서 모델 제공 비용을 20% 줄였고, 토큰 생성 효율도 15% 이상 높였다는 설명이다.</p> <p contents-hash="33d05a90388f24457f959cbd3835c6535a16cc8e089be819c5dc494f7efe8807" dmcf-pid="38c5BYyORw" dmcf-ptype="general">오픈AI는 "기업이 각 단계에서 필요한 수준의 지능을 활용하고, 창출하는 가치에 맞는 비용을 지불할 수 있도록 선택 폭을 넓혔다"며 "모델 성능과 효율을 함께 높여 더 낮은 비용으로 더 많은 업무를 처리하도록 하는 것이 전략"이라고 밝혔다.</p> <p contents-hash="374d2c22614bf4daacdafa6921aba45bcf54b22f8efdd42b66f97205eb33f077" dmcf-pid="06k1bGWIMD" dmcf-ptype="general">정종길 기자<br>jk2@chosunbiz.com</p> </section> </div> <p class="" data-translation="true">Copyright © IT조선. 무단전재 및 재배포 금지.</p> 관련자료 이전 KAIST, 'AI 감각 혼선' '환곽' 줄이는 기술 구현...AI 신뢰성 높인다 07-31 다음 데이터 폭탄 걱정 끝…알뜰폰도 ‘안심옵션’ 달고 유튜브 본다 07-31 댓글 0 등록된 댓글이 없습니다. 로그인한 회원만 댓글 등록이 가능합니다.