중국 최상위 인공지능(AI) 모델과 미국 모델의 벤치마크 점수 격차가 3%로 줄었다. 5월 약 9%, 올해 초 15%에서 좁혀졌다.
블룸버그 인텔리전스(BI) 수석 애널리스트 로버트 리(Robert Lea)는 딥시크(DeepSeek)가 9월 V4.1 Flash를 공개한 뒤 중국 상위 모델과 미국 경쟁 모델의 벤치마크 점수 차이가 3%로 축소됐다고 밝혔다. 점수 격차만으로 시장 경쟁력이나 수익성을 판단하기는 어렵다.
딥시크 V4.1 Flash는 지난달 AI 모델 평가 지표인 LiveBench에서 81.1점으로 세계 6위에 올랐다. 앤트로픽(Anthropic) 최고 모델의 83.4점에 근접한 점수다. 리는 해당 모델이 앤트로픽과 오픈AI(OpenAI)의 선도 시스템에 견줄 성능을 갖췄다고 평가했다. 다만 LiveBench 상위 15개 모델 가운데 중국 모델은 3개였다.
중국 AI 모델의 발전 배경으로는 AI 전문성 축적과 자국산 하드웨어에 맞춰 모델을 최적화하는 역량이 꼽혔다. 이 같은 진전은 미국의 반도체 수출 제한이 중국 AI 발전을 억제하는 데 얼마나 효과적인지를 둘러싼 의문도 낳았다. BI 분석은 성능 개선을 수출 제한의 효과가 사라졌다는 결론으로 연결하지는 않았다.
성능 향상이 사업 수익으로 이어질지는 별개의 과제다. 중국 AI 업계에는 대규모언어모델(LLM)이 1100개 이상 있으며, 낮은 토큰 공급 마진과 가격 경쟁, 모델 간 경쟁이 수익성을 압박하는 요인으로 제시됐다. 바이트댄스(ByteDance)의 더우바오(Doubao)는 AI 앱 수익화에서 앞서 있지만, 딥시크와 텐센트(Tencent)의 챗봇은 무료로 제공되고 있다.

김미래 기자
댓글0
첫 댓글을 남겨 보세요.