LLM Token Index가 고점 대비 52% 하락했지만 GPU 임대료는 오르면서 토큰 가격만으로 인공지능 수요 둔화를 단정하기 어렵다는 분석이 나왔다.
Silicon Data는 24일 LLM Token Index가 5월 28일 2.07달러에서 9월 21일 1달러로 하락했다고 밝혔다. 이 지수는 API 사용자가 100만 토큰을 처리할 때 실제로 지불한 가격을 사용량에 따라 가중한 수치다.
LLM Token Index는 토큰 사용량이나 인공지능 서비스의 전체 지출을 직접 측정하는 지표가 아니다. 가격 변화만으로 모델 사용량이나 인공지능 산업의 수익성을 판단하기 어려운 이유다.
Silicon Data는 해당 지수가 올해 1월부터 5월 고점까지 67% 상승했다는 점도 제시했다. 최근 하락만 떼어 보면 약세처럼 보이지만, 연초 이후 가격 흐름은 상승과 하락이 함께 나타났다.
최근 지수 하락은 더 많은 작업이 저렴하고 빠른 모델로 이동한 결과로 분석됐다. 인공지능 연구소들이 중간급 모델을 잇달아 내놓으면서 사용자가 선택할 수 있는 모델이 늘어난 점도 영향을 줬다.
토큰 가격은 모델의 성능과 사용 목적을 모두 반영하지 못한다. Silicon Data는 지수만으로 모델 교체와 더 효율적인 인공지능 에이전트의 작업 배분을 구분하기 어렵다고 설명했다.
같은 가격 하락이라도 사용량이 줄어든 결과인지, 저렴한 모델로 수요가 이동한 결과인지에 따라 의미가 달라진다. 토큰 단가와 전체 토큰 사용량을 별도로 봐야 한다는 설명이다.
반면 GPU 임대시장에서는 가격이 올랐다. 비초대형 클라우드 사업자의 H200 임대료는 6월 평균 시간당 2.87달러(약 3918원)에서 24일 기준 3.29달러(약 4491원)로 상승했다.
H200 임대료는 9월 19일 시간당 3.32달러(약 4532원)까지 올랐다. 특정 시점의 가격이지만 6월 평균과 비교하면 임대료 상승 흐름이 확인된다.
B200 임대료는 24일 기준 시간당 5.76달러(약 7862원)로 같은 기간보다 7% 상승했다. 연초와 비교하면 상승폭은 31%였다.
4월 말 출시된 B300 임대료도 이후 44% 올랐다. H200·B200·B300 등 GPU 세대별 임대료가 모두 상승하면서 토큰 단가와 연산 자원 가격이 같은 방향으로 움직이지 않을 수 있다는 점이 드러났다.
Silicon Data의 지표는 인공지능 모델을 실제로 실행하는 데 필요한 연산 자원의 가격 흐름을 보여준다. 토큰 가격과 GPU 임대료는 별도 지수로 집계돼 서비스 이용 단가와 연산 자원 비용을 구분해 살펴볼 수 있다.
본지는 앞서 AI 모델 호출 수요가 늘어도 토큰 지출 증가율은 사용량 증가율을 밑돌 수 있다고 보도했다. 평균 단가가 낮아지면 호출량이 늘어도 전체 지출이 같은 비율로 증가하지 않을 수 있다는 내용이다.
Silicon Data는 24일 게시한 분석에서 인공지능 에이전트가 대규모로 활용되면 전체 토큰 가운데 저렴하고 빠른 모델이 처리하는 비중이 커질 수 있다고 전망했다. 이 경우 토큰 가격은 낮아져도 전체 토큰 사용량은 크게 늘어날 수 있다.
Silicon Data는 24일 게시한 분석에서 고부가가치 작업은 여전히 최첨단 모델에 집중될 수 있다고 분석했다.
Silicon Data는 24일 게시한 분석에서 인공지능이 널리 확산될수록 연산 수요가 줄기보다 늘어날 가능성이 있다고 설명했다.
다만 GPU 임대료 상승만으로 인공지능 수요의 전체 규모를 확정할 수는 없다. 이번 지표는 특정 GPU와 토큰 가격의 변화를 보여주며 실제 사용량과 기업별 지출을 직접 집계한 결과는 아니기 때문이다.

이준한 기자
댓글0
첫 댓글을 남겨 보세요.