가격 반값에 ‘토큰 다이어트’까지…AI 모델 가성비 경쟁

기사 듣기
00:00 / 00:00

사용료 40∼50% 낮추는 가격 할인 정책 도입

▲앤트로픽 로고. (로이터/연합뉴스)

AI 기업들이 서비스 모델 가격을 절반 가까이 낮추는 데 이어 업무를 처리하는 데 드는 토큰까지 줄이고 있다. 성능 개선에서 나아가 반복 업무 비용 낮추기가 새로운 경쟁 요소로 떠오르는 데다 중국 업체들이 저가형 모델을 앞세워 시장 점유율을 넓히면서 가격 압박도 거세지는 분위기다.

27일 정보기술(IT) 업계에 따르면 오픈AI는 새로 출시한 GPT-6 솔과 루나의 응용프로그램인터페이스(API) 가격을 이전 세대 GPT-5.6 솔·루나의 프로모션 가격보다 50% 낮췄다. 캐싱과 추론 효율을 개선해 절감한 비용을 가격에 반영했다.

GPT-6 솔은 100만 토큰당 입력 2달러, 출력 10달러다. 루나는 같은 기준 입력 0.10달러, 출력 0.50달러다. 토큰은 AI가 글과 정보를 처리하는 단위다. 기업이 대규모 이용자를 대상으로 AI 서비스를 운영할수록 사용량이 비용에 직접 영향을 미친다.

반복적으로 쓰는 자료의 처리 비용도 낮췄다. 솔은 이미 처리한 입력을 다시 활용하는 캐시 입력이 100만 토큰당 0.20달러, 루나는 0.01달러다. 일반 입력 가격의 10% 수준이다. 같은 업무 지시나 문서, 코드를 반복해 불러오는 서비스에서 비용을 줄일 수 있는 구조다.

앤트로픽도 22일(현지시간) 공개한 ‘클로드 오퍼스 5.5’에서 가격과 토큰 사용량을 함께 낮췄다. API 가격은 100만 토큰당 입력 4달러, 출력 20달러로 전작 오퍼스 5보다 각각 20% 저렴하다. 저장된 입력을 다시 불러오는 캐시 읽기 가격은 0.50달러에서 0.20달러로 60% 내렸다.

여기에 같은 작업을 수행하는 데 필요한 토큰도 줄였다. 앤트로픽은 오퍼스 5.5가 전작보다 적은 컴퓨팅 자원과 토큰으로 업무를 처리해 기본 설정의 일반적인 작업 비용이 약 40% 감소한다고 밝혔다. 출력 생성 속도도 전작보다 30% 이상 빨라졌다.

이른바 ‘토큰 다이어트’가 중요해지는 것은 API 단가만 낮춰서는 실제 기업의 비용 부담을 충분히 줄이기 어렵기 때문이다. 모델이 한 번의 작업에 많은 토큰을 사용하면 단가가 낮아져도 전체 비용이 늘어날 수 있다. 반대로 같은 결과를 더 적은 토큰으로 내면 사용량이 많은 코딩이나 고객 지원, 자료 분석 등에서 비용 절감 효과가 커진다.

고성능 모델과 실무형 모델의 가격 차이도 크다. 오픈AI의 최상위 GPT-6 아스트라는 100만 토큰당 입력 10달러, 출력 50달러로 솔보다 각각 5배 비싸다. 오픈AI는 “캐싱과 추론 효율을 높여 절감한 비용을 이용자에게 돌려주고 있다”며 “낮은 비용과 높은 사용 한도로 더 많은 업무를 시도하고 반복할 수 있도록 했다”고 설명했다.

앤트로픽의 상위 모델 페이블 5.1도 입력 10달러, 출력 50달러다. AI 업체들이 최고 성능 모델과 별개로 대량 업무에 투입할 수 있는 상대적으로 저렴한 제품군을 확대하는 모습이다. 회사 측은 “오퍼스 5.5는 전작보다 적은 컴퓨팅 자원과 토큰으로 업무를 처리한다”며 “효율 개선을 가격에 반영해 일반적인 업무의 실행 비용을 약 40% 낮췄다”고 말했다.

  • 좋아요0
  • 화나요0
  • 슬퍼요0
  • 추가취재 원해요0
주요뉴스
많이 본 뉴스
댓글
0 / 300